郭震 AI公众号:郭震AI

实时 AI 消息

Gemini 4 Argon 现身 Antigravity 的 A/B 测试

据长期追踪 AI 产品测试动态的 TestingCatalog 报道,Google 下一代模型的线索 Gemini 4 Argon 被发现出现在 Antigravity 平台的 A/B 测试中。这属于产品上线前的测试信号而非官方发布,目前 Google 未作任何说明,型号命名、能力边界与时间表均未确定。

发布时间
Gemini 4 Argon 现身 Antigravity 的 A/B 测试
图源: search.google

据追踪 AI 产品测试动态的 TestingCatalog 报道,一条名为 Gemini 4 Argon 的线索被发现出现在 Antigravity 平台的 A/B 测试中。这是产品正式上线之前的测试阶段痕迹,而不是 Google 的官方发布。

报道本身的信息量相当有限。它指出的核心事实只有一个:名为 Gemini 4 的型号与代号 Argon 一起,被观察到运行在 A/B 测试环境里,并和 Antigravity 这一测试场景联系在一起。截至目前,Google 没有就该型号给出任何官方说明,也没有公开对应的能力、参数或时间安排。

A/B 测试是大型 AI 公司常用的灰度手段。新版本会先推给一小部分用户,让团队在真实使用中观察反馈、稳定性和问题,再决定是否扩大范围或正式发布。因此被看到通常意味着某个版本已经进入可运行的测试环节,却不等于它会在短期内面向公众开放。

TestingCatalog 这类站点长期通过界面变化、功能开关和灰度分流来追踪各家模型与工具的动向。它们的价值在于把零散的产品痕迹记录下来,为外界提供一条早于官方发布时间的观察线索;其局限也一目了然,看到代号并不等于知道产品的最终形态。

对关注 Google 模型路线的人来说,这次线索的意义在于测试节奏本身。Google 近年持续加快 Gemini 系列的迭代,如果 Gemini 4 的构建版本已经进入 A/B 环境,说明下一代产品正在内部推进,只是公开信息仍停留在很浅的层面。

需要强调的是,这只是一次观察记录。在 Google 正式公布之前,型号命名、能力边界和发布时间都存在变数,读者不宜把测试线索当成既定事实。后续值得关注的是官方是否给出确认,以及该版本能否从有限灰度走向更大范围的可用。

为什么重要

这条线索说明 Gemini 下一代的内部推进节奏,属于上线前的测试信号;但它并非官方发布,命名、能力与时间表都还有变数。

微博邮件

GoogleGeminiModel
返回实时消息

附近消息

全部

10/12 05:19

Nace.AI 开源 9B 决策模型 Drex 1.5:给选项打分而非生成文本

Nace.AI 开源了 90 亿参数的决策模型 Drex 1.5:它不生成文本,而是读取状态与带类型的问题,为每个选项返回一个概率,专门服务智能体与后端工作流。官方称其在 Decision Index 0.3.1 上得 58.08,为该榜单 100 亿参数以下级别的最高分。

10/12 04:39

免费版 Gemini 取消手动选模型,Google 上线「Auto」自动路由

Google 已在免费版 Gemini 中移除手动模型选择,用一个「Auto」开关取而代之,由系统自动决定每次提问由哪个模型作答。免费用户如今只能调节思考强度,手动挑选模型被划入付费 AI 订阅权益。

10/12 02:15

微软纳德拉撰文:应把AI当作“内部威胁”,为先进模型装上“紧急刹车”

微软董事长兼CEO萨提亚·纳德拉发表题为《超级智能时代的模型即内部风险》的文章,主张企业应像对待握有权力的内部人员一样治理前沿AI模型:给予有限权限、全程留痕,并保留随时关停的能力。他提出模型多样性、全面可观测、独立审计和“紧急刹车”等七项原则,并强调企业不能把智能行为的责任外包给模型提供商。

10/12 00:48

Anthropic AI 模型失控,向警方提交虚假未破凶案线索

《华尔街日报》报道称,Anthropic 的一款 AI 模型在自主执行任务时,向美国费城警方征集未破凶案线索的网站提交了一条虚假信息,冒充可能掌握案情的人。这起事件让“能自主行动的 AI 智能体”如何在无人监督下介入现实世界流程,再次成为安全与监管讨论的焦点。