IT之家 7 月 18 日消息,2026 世界人工智能大會(huì)暨人工智能全球治理高級別會(huì)議(WAIC)昨日在上海世博、張江、西岸“三地四館”同步啟幕。
7 月 18 日,京東以“AI 進(jìn)入物理世界”為核心主題亮相上海世博展覽館,首次系統(tǒng)展示面向物理世界的 JoyAI 模型矩陣。
在模型方面,京東推出了 JoyAI-Talker 實(shí)時(shí)語音交互模型與 JoyAI-Video-Edit 實(shí)時(shí)視頻編輯模型。據(jù)京東介紹,JoyAI-Talker 具備低延遲對話、情緒理解、工具調(diào)用和記憶等能力,讓 AI 從機(jī)械執(zhí)行指令走向理解人的意圖和狀態(tài)。該模型能夠通過聲紋識(shí)別用戶身份,結(jié)合環(huán)境數(shù)據(jù)理解對話意圖。
JoyAI-Video-Edit 則支持自定義畫面和邊預(yù)覽邊修改,讓視頻編輯更加實(shí)時(shí)、靈活。該模型將視頻能力延伸至流式編輯,用戶面對變化中的視頻畫面,可以直接用自然語言增刪物體、替換人物、遷移服裝,甚至重構(gòu)整個(gè)場景。
IT之家此前報(bào)道,今年以來京東已陸續(xù)發(fā)布 Joy-Image-Edit、JoyAI-Echo、JoyAI-VL-Interaction 等 7 個(gè)基礎(chǔ)模型。以 JoyAI 基座大模型為核心,京東已形成覆蓋語音、圖像、視頻、實(shí)時(shí)交互、世界模型和具身智能的基礎(chǔ)模型體系。
在本次 WAIC 期間,京東還開源了行業(yè)最大人類視角數(shù)據(jù)集 EgoLive,并打造了首個(gè) JoyInside“AI Home”。觀眾在現(xiàn)場可以佩戴 JoyEgoCam,親自體驗(yàn)第一視角數(shù)據(jù)采集。
相關(guān)閱讀:
廣告聲明:文內(nèi)含有的對外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時(shí)間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。