IT之家 7 月 6 日消息,今天,美團(tuán)將萬億參數(shù)大模型 LongCat-2.0 正式開源。
據(jù)介紹,LongCat-2.0 總參數(shù) 1.6T,平均激活約 48B,為真實(shí)的 Agentic Coding 任務(wù)而生,架構(gòu)上創(chuàng)新性引入 LongCat 稀疏注意力和 N-gram Embedding,提升長上下文處理效率與 token 級表示能力的同時,結(jié)合動態(tài)激活進(jìn)一步強(qiáng)化了代碼理解、生成以及執(zhí)行的表現(xiàn)。
官方稱,作為業(yè)界首個在五萬卡國產(chǎn)算力集群上完成推理的萬億參數(shù)模型,LongCat-2.0 已全面開源。針對顯存與帶寬受限的國產(chǎn)算力芯片,在模型架構(gòu)、芯片適配到部署策略上進(jìn)行了深度協(xié)同優(yōu)化,讓萬億參數(shù)模型在存量卡上同樣跑得穩(wěn)、跑得快。
IT之家注意到,本次開源同步提供 BF16、FP8 以及 INT8 等多精度版本,全面覆蓋不同算力平臺的部署需求。同時,將針對國產(chǎn)算力極致優(yōu)化的推理成果同步開源。這意味著,即使手上沒有最新算力,也能基于現(xiàn)有硬件將 LongCat-2.0 穩(wěn)定跑起來。
廣告聲明:文內(nèi)含有的對外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。