IT之家 4 月 28 日消息,中國(guó)移動(dòng)自主研發(fā)的九天 35B 通用大模型將在第九屆數(shù)字中國(guó)建設(shè)峰會(huì)上正式發(fā)布。摩爾線程官方昨晚宣布,其基于旗艦級(jí) AI 訓(xùn)推一體全功能 GPU MTT S5000,依托成熟的 MUSA 軟件棧與高性能算子優(yōu)化,已率先完成九天 35B 模型的全流程適配與推理驗(yàn)證。

據(jù)介紹,本次適配中,摩爾線程基于自研 MUSA 軟件棧與 SGLang-MUSA 高性能推理引擎,深度打通九天 35B 模型推理全鏈路。
MTT S5000 基于第四代 MUSA“平湖”架構(gòu)打造,單卡 AI 稠密算力可達(dá) 1000 TFLOPS,支持從 FP8 到 FP64 全精度計(jì)算,匹配九天 35B 大模型在長(zhǎng)文本處理與高并發(fā)響應(yīng)方面的核心需求。
摩爾線程通過 MUSA C 開發(fā)框架、muDNN 計(jì)算庫與 MATE 開源算子庫的全棧優(yōu)化,針對(duì)九天 35B 模型特有的注意力機(jī)制與長(zhǎng)序列推理進(jìn)行深度適配,確保模型在 MTT S5000 上高效執(zhí)行。在標(biāo)準(zhǔn)推理場(chǎng)景下,MTT S5000 可穩(wěn)定支撐九天 35B 模型的高并發(fā)請(qǐng)求。
IT之家注:MTT S5000 是專為大模型訓(xùn)練、推理及高性能計(jì)算而設(shè)計(jì)的全功能 GPU 智算卡,基于第四代 MUSA 架構(gòu)“平湖”打造。其單卡 AI 算力最高可達(dá) 1000 TFLOPS,配備 80GB 顯存,顯存帶寬達(dá)到 1.6TB/s,卡間互聯(lián)帶寬為 784GB/s,完整支持從 FP8 到 FP64 的全精度計(jì)算。
廣告聲明:文內(nèi)含有的對(duì)外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時(shí)間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。