IT之家 9 月 29 日消息,當用戶提交情感化或個性化提示詞時,OpenAI 旗下的 ChatGPT 會自動切換到限制性更強的語言模型,但這一過程不會通知用戶。

目前,OpenAI 正在 ChatGPT 中測試一款全新的“安全路由系統(tǒng)”,該系統(tǒng)可根據(jù)對話主題自動將交流內(nèi)容導(dǎo)向不同模型。ChatGPT 負責(zé)人尼克?特利(Nick Turley)表示,只要對話涉及“敏感或情感類主題”,該系統(tǒng)就會啟動干預(yù)。
在實際應(yīng)用中,ChatGPT 會將用戶提示詞臨時轉(zhuǎn)交至更嚴格的模型進行處理,例如 GPT-5,或是專用模型“gpt-5-chat-safety”。特利指出,這種模型切換僅針對單條消息觸發(fā),且只有當用戶專門就此向模型提問時,切換行為才會顯露出痕跡。
IT之家注意到,OpenAI 早在 9 月的一篇博客文章中就首次披露了這類基于情感的路由機制,并將其描述為針對“嚴重心理困擾”場景的防護措施。而特利此次的最新表態(tài)則將該機制的適用范圍擴大到所有涉及敏感或情感領(lǐng)域的對話。
萊克斯(Lex)對這套新路由系統(tǒng)開展的技術(shù)評估顯示,即便是無害的情感化或個性化提示詞,也常常會被重定向至更嚴格的“gpt-5-chat-safety”模型。此外,涉及模型自身角色設(shè)定或其“自我認知”的提示詞,同樣會觸發(fā)自動切換。
已有一名用戶記錄下了模型切換的實際過程,其他用戶也證實了類似情況的存在。目前似乎還存在第二款路由模型“gpt-5-a-t-mini”,當用戶提示詞可能涉及請求實施潛在非法行為時,該模型便會被啟用。
部分人士已對 OpenAI 提出批評,認為其在模型重定向的觸發(fā)時機與原因方面缺乏足夠透明度。他們表示,這種做法給人一種“居高臨下”的感覺,且模糊了“兒童安全保護”與“更廣泛的一般性限制”之間的界限。
目前,OpenAI 僅計劃在特定地區(qū)推行基于官方文件的嚴格年齡驗證機制。就當前而言,該語言模型判斷用戶身份及解讀消息含義的方式準確性尚不高,這一問題未來可能持續(xù)引發(fā)爭議。
廣告聲明:文內(nèi)含有的對外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。