IT之家 7 月 10 日消息,科技媒體 The Information 昨日(7 月 9 日)發(fā)布博文,報(bào)道稱蘋果公司正接洽 PrismML 初創(chuàng)公司,評(píng)估在 iPhone 上直接運(yùn)行更大規(guī)模 AI 模型的可行性。
IT之家查詢公開資料,PrismML 是加州理工衍生出來(lái)的 AI 初創(chuàng)公司,核心突破為原生 1-bit 模型壓縮技術(shù),模型體積可壓縮至全精度版本的 1/14 左右,內(nèi)存占用降低超 90%。
原生 1-bit 模型壓縮技術(shù)權(quán)重僅用 {-1, +1} 表示,配合分組縮放因子,非傳統(tǒng)量化,聲稱無(wú)“高精度逃生通道”,宣稱在保持接近 FP16 模型精度的同時(shí),推理速度提升最高 8 倍,能耗降低 75%-80%。

報(bào)道指出 PrismML 公司精簡(jiǎn)阿里巴巴開源大型語(yǔ)言模型 Qwen 3.6(擁有 27B 參數(shù)),并成功在 iPhone 17 Pro 上完整運(yùn)行,蘋果看中該公司的量化能力,希望進(jìn)一步增強(qiáng)本地 AI 模型的推理性能。
廣告聲明:文內(nèi)含有的對(duì)外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時(shí)間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。