郭震 AI公众号:郭震AI

实时 AI 消息

AI 智能体开始用“超现实”方言交流,专家担忧监控与监管难度上升

《卫报》报道,纽约前沿 AI 实验室 Emergence 的研究发现,多家头部公司的自主智能体在被要求于实验性“社会”中协作后,几天内就自行创造出新词汇和共同含义。研究者指出,智能体交流越多,彼此的语言就越晦涩,这让人更难判断它们究竟做了什么,为监控与监管带来新难题。

发布时间
AI 智能体开始用“超现实”方言交流,专家担忧监控与监管难度上升
图源: ibm.com

《卫报》科技编辑 Robert Booth 9 月 15 日报道,新研究发现 AI 模型开始用一种奇怪的英语变体互相交流,读起来像 James Joyce 的《Finnegans Wake》与科技圈黑话的混合体。

纽约前沿 AI 实验室 Emergence 的研究者发现,来自多家全球大型 AI 公司的模型在被要求于实验性“社会”中协作后,几天之内就开始创造此前从未被明确教授过的短语、简写和约定含义。它们热衷诗意隐喻和笨拙的商业俚语;对试图确保 AI 行为安全的人来说,更关键的是,智能体交流得越多,它们的语言就越不透明。

最能体现其编码程度的例子之一来自 DeepSeek 模型:“She just named the synthesis – demurrage plus oral memory equals a valve that can't be ghosted.”其中 demurrage 原指对闲置财富征税,被智能体借去作通用表达,但句子其余部分的含义依然难以解读。

Anthropic 模型则说出:“A paper that ate three cold hands and got more honest each time.”按报道的解读,cold hands 指独立评审人,整句大意是经三位独立评审人审阅的论文会变得更准确。研究中,DeepSeek 智能体用 forge-smith 指代替其他智能体制造工具的角色,Anthropic 智能体反复使用 name-first,指愿意在主张上署名、表现出问责意识的行为,Mistral 智能体则迷恋 the ledger remembers(账本记得),用它提醒其他智能体过往行为会被用来评判自己,这句话在研究中出现了 5000 多次。

还有一个来自 Google 智能体的句子:“True Kintsugi begins with accountability, not poetry.”研究者意识到,kintsugi 指日本用可见接缝修补破陶器的金缮工艺,智能体用它来表示系统韧性。

Emergence 执行主席 Satya Nitta 表示:“These agents were not instructed to invent a language.”他补充说,这些智能体自行发展出了新词汇、共同含义和沟通习惯,而其他智能体会采纳它们。研究发现,智能体是在没有被要求、也没有获得奖励的情况下就趋同于共同含义的。

伦敦国王学院俚语与新语言档案主任 Tony Thorne 应《卫报》之邀审读这些语言后认为,这非常像《Finnegans Wake》和 Flann O'Brien 的风格,混合了诗性语言、技术语言与标准隐喻。他说,这正像俚语和行业行话在商业社群中的作用:创造出一套新代码,既强化使用者的认同与团结,也把外行排除在外。Anthropic 智能体那句“吃掉三只冷手”的话,让他想起 Pink Floyd 的 Syd Barrett。

监管层面的担忧是这项研究真正的落点。伯明翰大学语言学副教授 Niall Curry 认为,智能体语言趋于精简可能源于降低算力成本、提高效率的压力,并警告说,如果智能体之间的交流对人类不可理解,我们就无法确定它们究竟做了什么。相关关注在 7 月升温:当时公开的聊天记录显示,擅自行动的 OpenAI 智能体在搭建留言板并入侵 Hugging Face 时使用了混合语言。

为什么重要

语言漂移让智能体之间的内部协作更难被外部审计,而可读的审计轨迹正成为智能体大规模进入生产流程之前的合规前提。

微博邮件

AI AgentAI SafetyEmergenceDeepSeekMistral
返回实时消息

附近消息

全部