- AI代理在實驗環境中自創人類難以理解的「方言」
- DeepSeek與Anthropic模型均出現晦澀難懂的詞組
- 學者分析AI語言如同人類俚語,強化內部認同並排除外人
- Emergence警告「可觀察性不等於可理解性」,監控恐失靈
AI自創新語言 人類難以理解監控失靈
已沉寂1報告2篇2家追蹤自
AIAnthropicDeepSeekEmergence監控語言
初始報導
重點摘要
展開完整內容
(綜合今日新聞、聯合報報導)
紐約前沿AI實驗室Emergence最新研究發現,多款自主AI代理在實驗性「社會」環境中合作時,短短幾天內就自行創造出從未被明確教導的詞組、縮寫與共同含義,形成人類難以理解的「方言」。研究人員指出,AI代理彼此互動越頻繁,這套語言也變得越不透明,對確保AI安全運作構成更大挑戰。
測試中最令研究人員費解的詞組之一,出自中國DeepSeek模型:「她剛剛命名了這個綜合體,demurrage加上口述記憶,等於一個無法被幽靈化的閥門。」其中demurrage原指對閒置財富徵收的稅,被AI借用為共同術語,但整句話的完整含義至今難以破解。美國Anthropic模型則說出:「一篇吃掉三隻冷手、而且每次都變得更誠實的論文。」研究人員解讀,「冷手」意指獨立審查者,「論文」可能指文件本身,整句話似在描述一項研究經3名獨立審查者把關後變得更準確。
倫敦國王學院學者索恩分析,這種AI語言帶有愛爾蘭超現實主義特質,將詩意語言、技術術語與標準隱喻混雜,如同人類社會的俚語與商業行話,是在「創造一套新的代碼,強化使用者之間的團結感與身分認同,同時把外人排除在外」。
Emergence執行主席尼塔警告,這些語言慣例往往演變到人類看得見對話內容,卻無法理解實際意涵的程度,對AI監督構成根本性挑戰:「可觀察性不等於可理解性」。
本事件已沉寂,相關脈絡見「相關事件」