IT之家 10 月 5 日消息,科技媒體 NeoWin 昨日(10 月 4 日)發(fā)布博文,報(bào)道稱谷歌公司即將商用 Gemini 1.5 Flash 8B 模型,成為谷歌公司最便宜的 AI 模型。
IT之家曾于今年 8 月報(bào)道,谷歌公司推出 3 款 Gemini 實(shí)驗(yàn)性模型,其中 Gemini 1.5 Flash 8B 是 Gemini 1.5 Flash 的更小尺寸模型,擁有 80 億參數(shù),專為多模態(tài)任務(wù)而設(shè)計(jì),包括大容量任務(wù)和長文本摘要任務(wù)。
相比較原版 Gemini 1.5 Flash,Gemini 1.5 Flash 8B 延遲更低,特別適合聊天、轉(zhuǎn)錄和長文本翻譯任務(wù)。

Gemini 1.5 Flash 8B 的另一個(gè)亮點(diǎn)是親民的價(jià)格,相關(guān)計(jì)費(fèi)將于 10 月 14 日星期一生效,IT之家附上相關(guān)信息如下:
在低于 128K 上下文窗口下,每百萬 tokens 輸入提示詞費(fèi)用為 0.0375 美元(當(dāng)前約 0.26 元人民幣)
在低于 128K 上下文窗口下,每百萬 tokens 輸出提示詞費(fèi)用為 0.15 美元(當(dāng)前約 1.1 元人民幣)
在低于 128K 上下文窗口下,每百萬 tokens 緩存提示詞費(fèi)用為 0.01 美元(當(dāng)前約 0.071 元人民幣)

作為對比,Gemini 1.5 Flash 模型的每百萬輸出 tokens 成本為 0.3 美元,這一價(jià)格是在 2024 年 8 月 12 日開始實(shí)施的,意味著新版 Gemini 1.5 Flash 8B 的價(jià)格相比較原版直接腰斬。
廣告聲明:文內(nèi)含有的對外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時(shí)間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。