IT之家 9 月 27 日消息,據(jù)界面新聞報(bào)道,9 月 27 日,零一萬(wàn)物 CEO 李開(kāi)復(fù)在長(zhǎng)江 CEO 組織 20 周年返校日慶典上表示,DeepSeek 對(duì)中國(guó) AI 發(fā)展的核心貢獻(xiàn)在于推動(dòng)了開(kāi)源生態(tài)的形成?!叭绻旰螅覀兓仡?DeepSeek 怎么讓中國(guó)沒(méi)有落后于美國(guó),答案并非其技術(shù)能力本身,而是它帶來(lái)了中國(guó)(大模型)開(kāi)源時(shí)代。”
李開(kāi)復(fù)提到,自 DeepSeek 開(kāi)源以來(lái),國(guó)內(nèi)多家企業(yè)相繼開(kāi)源大模型,形成了“既開(kāi)源、又比拼速度”的良性競(jìng)爭(zhēng)局面。他認(rèn)為,開(kāi)源模式高度契合中國(guó)企業(yè)的學(xué)習(xí)特性,有望助力中國(guó)在 AI 領(lǐng)域縮小與美國(guó)的差距。
IT之家注意到,李開(kāi)復(fù)此前曾多次力挺大模型開(kāi)源。今年 3 月,他在中關(guān)村論壇人工智能日上表示,DeepSeek 的成功證明閉源是一條死路,開(kāi)源才會(huì)有更大的發(fā)展。
他認(rèn)為,隨著 AI 的 Scaling Law 法則從預(yù)訓(xùn)練端轉(zhuǎn)移到推理端上,AI 模型、AI 應(yīng)用會(huì)在今年迎來(lái)新的加速爆發(fā),今年的一個(gè)行業(yè)口號(hào)應(yīng)該是“Make AI Work”(讓 AI 變得有用)。他表示,隨著 Scaling Law 的放緩,超大預(yù)訓(xùn)練模型的直接商業(yè)價(jià)值在逐步降低。
IT之家獲悉,李開(kāi)復(fù)給出的四個(gè)理由是:數(shù)據(jù)不足導(dǎo)致傳統(tǒng)預(yù)訓(xùn)練將終結(jié);超大 GPU 群效率降低,容錯(cuò)問(wèn)題等導(dǎo)致邊際效應(yīng)降低;超大預(yù)訓(xùn)練模型價(jià)格昂貴,速度緩慢;新推理 Scaling Law 將帶來(lái)更高回報(bào)。超大預(yù)訓(xùn)練模型的價(jià)值正在轉(zhuǎn)移,將進(jìn)一步體現(xiàn)在“教師模型”的角色中,其本質(zhì)也將更趨進(jìn)于大模型時(shí)代的基礎(chǔ)設(shè)施。舊學(xué)習(xí)范式是人教 AI,新學(xué)習(xí)范式是 AI 教 AI。
廣告聲明:文內(nèi)含有的對(duì)外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時(shí)間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。