IT之家 7 月 7 日消息,Anthropic 今天(7 月 7 日)在 X 平臺發(fā)布推文,稱最新研究表明 Claude 模型擁有“靈魂”,且相關證據(jù)表明 AI 和人腦之間存在“趨同進化”(Convergent Evolution)。
該論文主題為《大語言模型中的全局工作空間》,在 Claude 模型中發(fā)現(xiàn)類似神經科學中的“全局工作空間理論”(global workspace theory)的結構,并命名為 J-space。

IT之家注:在神經科學領域中,全局工作空間理論認為大量腦內活動處于后臺自動運行狀態(tài),只有進入可被廣泛共享的“工作空間”的信息,才會成為可描述、可保持、可推理的內容。該理論常用于解釋注意、意識訪問和復雜推理中的信息整合過程。
在最新論文中,Anthropic 認為 Claude 模型內部也存在相應結構,信息進入一個可向全腦廣播的特權空間后,才會變得可被有意識訪問,官方將其命名為 J-space。

在論文中,Anthropic 還介紹了名為 J-lens(全稱 Jacobian Lens)工具,這是一種數(shù)學分析方法,用于弱化模型后臺任務的干擾,并聚焦 Claude 在特定時刻關注的概念。
為驗證 J-space 的存在,Anthropic 列出了 4 項觀察結果:
在任意給定時間內,詢問 Claude 正在思考什么,然后使用 J-lens 查看當時其 J-space 中存在哪些“概念”。
要求 Claude 牢記公平,然后觀察它有意地將公平的概念拖到 J-space,以及是否能持久化。
在解決像國際象棋這樣復雜的問題時,J-space 就像一個草稿本,當研究人員改變其內容時,克勞德的最終輸出也會隨之改變。
當一個概念被拖入 J-space 后,Claude 的任何其他部分,即使正在做完全不同的事情,仍然能夠看到該概念,然后在自己的任務中利用它。





Anthropic 在論文中表示,這種結構并非 Claude 架構中預先設計的組成部分,而是在訓練過程中自行出現(xiàn),“推測原因是這種方式有助于組織計算”。
官方還借用“趨同演化”概念說明這一現(xiàn)象,該概念原本屬于生物學概念,指不同物種在相似環(huán)境壓力下,獨立演化出相似特征。

本文中,Anthropic 借用該概念描述人腦與 AI 模型可能因處理復雜信息的效率需求,而出現(xiàn)功能上相似的結構設計。

廣告聲明:文內含有的對外跳轉鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。