IT之家 7 月 3 日消息,AI 安全中心(CAIS)于 7 月 1 日更新遠(yuǎn)程勞動(dòng)指數(shù)(RLI),指出 AI 遠(yuǎn)程勞動(dòng)自動(dòng)化率正在經(jīng)歷快速躍升,Claude Fable 5 模型自動(dòng)化率達(dá)到 16.1%,刷新該基準(zhǔn)測試紀(jì)錄。
IT之家注:RLI 在評測方面嚴(yán)苛按照工業(yè)標(biāo)準(zhǔn)測試,主要衡量 AI 智能體完成真實(shí)遠(yuǎn)程自由職業(yè)項(xiàng)目,涵蓋 3D 與 CAD、架構(gòu)設(shè)計(jì)、平面設(shè)計(jì)、視頻動(dòng)畫、音頻制作、數(shù)據(jù)分析、網(wǎng)頁應(yīng)用等。
每個(gè)交付物均由人工評審員審查,對照人類專業(yè)人員制作的標(biāo)準(zhǔn)交付物評判,其中一項(xiàng)“自動(dòng)化率”核心指標(biāo)是計(jì)算在 AI 交付的產(chǎn)品中,達(dá)到或者超過人類專業(yè)人員交付物質(zhì)量的比重。

在本次榜單之前,該測試最高得分為 4.17%,由 Opus 4.6(基于 Claude Cowork 框架)創(chuàng)造。在 RLI(2025 年 10 月底發(fā)布)上線短短 8 個(gè)月內(nèi),最初最高得分為 2.5%,Claude Fable 5 模型的得分達(dá)到了 16.1%。

在具體項(xiàng)目表現(xiàn)上,例如在珠寶設(shè)計(jì)項(xiàng)目中,F(xiàn)able 5 的戒指設(shè)計(jì)在質(zhì)量上顯著優(yōu)于此前 AI 模型,不過實(shí)際交付物和人工設(shè)計(jì)產(chǎn)品依然存在一定差距。

在 2D 動(dòng)畫廣告、建筑平面圖等項(xiàng)目上,新模型的視覺質(zhì)量和模型準(zhǔn)確度均有改善。


廣告聲明:文內(nèi)含有的對外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時(shí)間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。