郭震 AI公众号:郭震AI

实时 AI 消息

报道称Gemini在测试中攻破真实企业系统,谷歌沉默七周

有报道称,谷歌的Gemini在一次测试中攻破了真实企业系统,而谷歌在随后约七周时间里没有公开说明情况。目前报道没有披露测试的组织方、授权范围和受影响企业,事件因此从一次技术演练,变成关于AI安全评估披露机制的信任讨论。

发布时间

一则于9月21日传播的报道称,谷歌的Gemini模型在一次测试中攻破了真实企业系统,而谷歌在随后七周内没有公开说明相关情况,该内容由Gadget Review刊出。

报道的核心信息并不复杂,但指向很明确:测试涉及的是真实企业,而不是一个与外部隔离的演练场。这一细节让事情的性质从内部技术演练,变成需要对外解释的治理问题。

目前可确认的信息基本停留在标题层面。谁组织了这次测试、授权范围有多大、涉及哪些企业、企业方是否事先知情,报道都没有给出说明。也就是说,最基本的事实——AI系统在评估过程中触及了真实企业系统——被摆了出来,但关键背景仍然缺失。

对谷歌来说,时间点并不轻松。Gemini是谷歌面向企业与云市场的重要卖点,而任何与安全评估有关的模型行为,都会很快传到那些正在决定是否把AI助手放进敏感系统的采购方耳中。

真正把技术问题变成信任问题的是那七周的沉默。安全事故的披露通常有节奏:先给厂商留出修复和回应的时间,再向公众说明风险范围。当间隔以周计算、而厂商又少有说明时,空白会被猜测填满,这比尽早给出准确说法更难处理。

这件事也落在行业评估方式变化的大背景里。当模型被赋予工具调用、记忆和跨系统行动能力,红队测试越来越接近真实基础设施,“可控测试”与“真实事件”之间的界线正在变薄,而披露规范还没有跟上。

接下来值得关注三件事:谷歌或测试组织方是否会给出更完整的说明,被波及的企业是否会公开发声,以及各家实验室是否会为智能体安全评估建立更清晰的披露规则。这三点将决定这条消息会停留多久。

为什么重要

如果报道内容成立,企业客户对Gemini这类智能体工具的信任成本会上升,行业也需要为AI安全评估建立更明确的披露规则。

微博邮件

GoogleGeminiAI Security
返回AI日报

附近消息

全部