郭震 AI公众号:郭震AI

实时 AI 消息

谷歌发布办公 Agent:可自选底层模型,甚至调用 Anthropic 的 Claude

Google Cloud 发布名为 Gemini Agent 的通用办公智能体,可按目标自行规划任务、跨应用调用工具,并在需要时召集多个子 Agent 协作。引人关注的是,它能动态选择底层模型,在自家 Gemini 与竞争对手 Anthropic 的 Claude 之间切换。

发布时间
谷歌发布办公 Agent:可自选底层模型,甚至调用 Anthropic 的 Claude
图源: search.google

Google Cloud 发布长文《Welcome to Gemini at Work 2026:Introducing the Gemini agent》,由 Google Cloud CEO Thomas Kurian 亲自署名,正式推出通用办公 Agent——Gemini Agent。

谷歌给它的原则很简单:给它目标,而非逐步指令(You give it objectives, not instructions)。用户只需交代想要的结果,剩下的交给它自己安排。文中举例:让它完成一份市场分析报告,它可以自行搜索整理资料、分析数据,在 Google Sheets 中建立财务模型,再用 Google Slides 生成演示文稿。

谷歌列出的核心能力包括统一入口、云端持久运行、跨平台调用、多 Agent 协作、事件触发与定时任务;任务足够大时,它还能召集多个子 Agent 一起干活。

两个特性最受关注。其一是身份:在“同事智能体”(Coworker Agent)的设定下,企业可以为 Gemini 创建一个长期存在、职责明确的身份,配备独立的 Google Workspace 账号、企业邮箱、日历和 Drive 存储,还能出现在公司通讯录里,被邀请进 Google Chat 群聊或在文档里被 @。它以自身身份执行操作并留下记录,便于企业追踪与管理。

其二是模型选择。Gemini Agent 可以自行挑选底层模型,现阶段能在谷歌自家 Gemini 系列与 Anthropic 的 Claude 系列之间动态切换,未来还计划支持更多闭源与开源模型。谷歌把这套能力称为多模型编排,并配套 Smart Routing 自动路由,按效果、速度与成本权衡:简单任务用便宜模型,复杂任务调用更强模型。底层模型即便更换,Agent 积累的上下文、Skills 和企业数据也会保留。

谷歌还介绍了四种记忆:会话记忆保存当前任务上下文,语义记忆积累公司知识,程序性记忆记录工作方法,情景记忆留存过往执行经历。它甚至能自己编写 Skills,把学到的方法保存下来复用。谷歌打了个比方——它就像新员工,会逐渐熟悉你、你的工具和你的团队。

这次入场时机微妙。9 月 29 日,OpenAI 刚刚发布可 7×24 小时工作的 Dots;更早之前,Meta 推出了偏个人生活场景的 Muse。相比之下,谷歌强调把 Agent 更深地嵌入企业已有的组织与办公体系——借助 Gmail、Docs、Sheets、Calendar 获取业务上下文,并配以模型选择、企业数据连接、安全审计与成本控制。

同一篇长文中,谷歌还宣布 Gemini 全面进入 Google Workspace、开放 Skills、Tools 与企业连接器,并推出数据分析、金融、法律等专业 Agent,以及 Agent 安全治理与成本控制能力。

为什么重要

让自家 Agent 调用竞争对手的模型,说明谷歌把“模型可选”而非“绑定自研”当作企业级 Agent 的卖点;这也把办公智能体的竞争从单一模型能力拉向了工作流与生态整合。

微博邮件

GoogleGeminiAgent
返回实时消息

附近消息

全部