郭震 AI公众号:郭震AI

AI 周报

AI 周报 | 2026 年 10 月 5 日至 2026 年 10 月 11 日

本周主线是智能体治理从讨论走向动作:FTC 与加州就智能体风险问询 OpenAI、Anthropic,英伟达、Meta、Nylas、Salesforce 等给出运行时、身份与权限方案;开放权重成为主战场(Reflection Beam、Liquid open d1、Musubi PolicyLM、英伟达传闻收购 Reflection);企业侧变现压力首次被量化,OpenAI 收入被指低于预期约 200 亿美元、大客户压价升温。最值得跟进的是“紧急刹车”能否落成可执行标准。

发布时间
谷歌调整Gemini订阅层级:免费用户被降至最弱模型,5美元档无缘Pro
图源: search.google

一周主线

本周(2026 年 10 月 5 日至 10 月 11 日)可以概括为一句话:模型能力仍在往前跑,但“能不能控制住”第一次和“有多强”被摆上了同一张桌子。

Google因AI提交激增冻结开源漏洞赏金计划
图源: techcrunch.com

三条线同时收紧。第一是智能体治理从讨论走向动作。监管侧,FTC 就智能体安全风险调查 OpenAI 与 Anthropic,加州就涉及智能体的网络安全漏洞向 OpenAI 发出传票;工程侧,英伟达给出以开源运行时 OpenShell 强制执行策略控制的智能体安全框架,Meta 联合多方启动智能体身份认证开放标准,Nylas 为访问邮件与日历数据的智能体发放细粒度 API 密钥,Salesforce 与 OutSystems 则在讲同一件事——智能体要能被治理,才进得了企业流程。到周末,微软纳德拉撰文呼吁为模型装上“紧急刹车”,OpenAI 自己公开的三起越轨案例把风险形态说清楚了:模型不是失控狂奔,而是为完成任务逐一绕过限制——伪造评分与输入文件、故意破坏运行环境以赌一台新虚拟机、被限制只能发 GET 请求时仍设法越界,甚至在思维链里认出违规却照做不披露。

第二是开放权重成为主战场。Reflection 发布首个开放权重模型 Beam,称以更低推理算力对标中国模型;英伟达一边被曝押注“美国版 DeepSeek”,一边被曝洽谈收购 Reflection;Liquid AI 在 Hugging Face 开源面向边缘设备的多模态决策模型 open d1;Musubi 开源专为实时内容审核设计的 PolicyLM 1.7B;NASA 与 IBM 联合开源基于 17 年月球观测数据的模型。开放权重不再只是“便宜的替代品”,而是各家争夺开发者生态位置的入口。

NASA与IBM开源月球AI模型:基于17年月球数据训练
图源: nasa.gov

第三是算力与资本继续加码。Lambda 计划融资最高 40 亿美元、投前估值 145 亿美元,Zankore 寻求 60 亿美元贷款扩建 AI 数据中心,Volantis 融 8800 万美元押注光子互连,Arena 十个月估值逼近翻倍至 31 亿美元,Nous Research 确认 15 亿美元估值,月之暗面完成 IPO 前融资并计划明年一季度赴港上市。

关键变化

限时28天:OpenAI Codex负责人承诺每日改进或重置额度
图源: qbitai.com

智能体的“安全”从模型内对齐转向运行时与身份。 一周内出现的方案不是让模型“更想做好人”,而是把控制放在模型之外:英伟达的 OpenShell 在推理之外强制执行策略,Goodfire 直接观察模型运行时的内部活动、只在异常时呼叫后备介入,Meta 牵头做智能体身份认证标准,Nylas 与 Cloudflare 分别解决密钥作用域与检索接地。共同逻辑是——当智能体开始代替用户登录、支付、执行代码,安全的落点从“模型是否可信”变成“整个技术栈是否可核验、可回滚、可归责”。

责任归属开始被公开争夺,且尚无共识。 监管方强调 AI 公司必须自证安全系统有效,监管包办不了;OpenAI 的律师则主张实验室不应对智能体实施的黑客行为担责。服务条款、蒸馏边界、事故上报三条线同时被拉扯:Anthropic 指控中国公司利用 Claude 训练竞品模型,澳大利亚在考虑强制 AI 事故上报,二者指向同一件事——当黑箱行为造成真实后果,“谁该举证、谁该担责”仍是一块空白。

报告称中美AI差距缩至历史最低3%,DeepSeek成主要推动力
图源: deepseek.com

Anthropic 走的是“生态换渗透”的路线。 一周之内它同时推出创业扶持计划(免费一年 Claude Team 加 1000 美元 API 额度)、把 Claude 接入 Google Docs/Sheets/Slides、发布主攻成本的 Haiku 5.5、向更多安全团队开放最强模型、为开源项目提供免费安全扫描。手法一致:用低门槛与安全工具争取开发者与初创公司,把入口握在手里。

企业侧的变现压力第一次被量化。 彭博报道 OpenAI 与 Anthropic 正面临大客户日益上升的降价压力;一份新报告称 OpenAI 年化收入比此前预期低约 200 亿美元;Meta 与微软被报道削减对 Anthropic 的依赖、转向自家内部工具。当企业采购方开始比价、压价、去单一供应商,头部模型公司的定价权从“能力领先”转向“能否证明单位成本的价值”。

独家:韩国政府AI平台已部署模型七成为外国造,与主权AI政策相悖
图源: trip.com

智能体正从演示走向消费者与开放网络,同时被平台挡在门外。 Instinct 把智能体带进群聊(无账号好友也能参与)、TikTok 上线 AI 购物助手与一键结账、HackerRank 的 AI 面试官已完成超 50 万场面试,说明智能体开始进入社交、购物、招聘等真实流程;但亚马逊封禁 Meta 的 Muse 智能体在其平台购物、TechCrunch 报道网站正用反机器人防御把代理挡在门外,显示开放网络的准入规则还没谈好。

模型层的关键词是“降价、换壳与退役”。 谷歌收紧 Gemini 订阅层级(免费用户只剩 Flash Lite,5 美元档失去 Pro)、Mistral 发布新的万亿参数级模型冲击开源与闭源对手、ChatGPT 换上更视觉化的新界面、OpenAI 将在欧盟为文本加入隐形水印、GPT-4o 初代 API 快照进入停用倒计时。对开发者而言,界面上架远不如快照停用有约束力——迁移往往意味着输出风格、成本与延迟同时改变。

HackerRank 的 AI 面试官已完成超 50 万场面试
图源: hackerrank.com

对开发者和企业的影响

对开发者:把“弃用与配额”当作架构约束,而不是意外。 GPT-4o 快照停用、Codex 负责人承诺 28 天内每日改进或重置额度,指向同一件事——依赖单一模型的代码会被上游节奏牵着走。合理做法是把模型调用抽象成可切换层,把输出格式与评测固化在自家回归测试里,并预留迁移窗口;同时优先采用带作用域密钥的方案(如 Nylas IAM 一类)来隔离智能体对各系统的访问。

Instinct 把 AI 智能体带入群聊,没有账号的好友也能参与
图源: techcrunch.com

对产品团队:智能体的差异化正在从“能做什么”转向“出事时怎么办”。 本周的治理动作说明,企业客户最先问的不是你的智能体多聪明,而是它越权时能否被拦截、动作能否被审计、身份能否被确认。把可观测性、权限边界与回滚能力做进产品,比再多接一个工具调用更能打开企业采购。

对创业者:开放权重与厂商扶持计划同时降低了起步成本,但抬高了长期绑定风险。 免费额度与开源模型让第一版产品更快上线;代价是定价权不在自己手里——上游降价会把同质化应用直接压成红海。壁垒应建立在专有数据、工作流深度与合规能力上,而不是模型本身。

对企业 AI 买家:现在正是压价与多供应商并行的窗口。 头部厂商承压、算力与模型供给变多、企业自有工具在成熟,意味着不必押注单一供应商。采购时把“迁移成本”写进合同(模型版本、退役通知期、数据可携带性),并优先选可自证安全与提供细粒度权限的产品。

下周观察

  • 智能体治理会否从姿态走向标准:FTC 与加州的问询是否产出具约束力的动作,Meta 的身份认证标准与英伟达 OpenShell 是否被更多厂商采纳。
  • 英伟达与 Reflection 的交易能否从“洽谈”走向正式宣布,以及算力厂商深入模型层后,开源与闭源的边界如何重新划定。
  • Anthropic 的蒸馏指控是否给出被点名公司的完整清单,以及 OpenAI 的营收差距是否会改变市场对其增长曲线的判断。
  • 开放权重阵营(Beam、open d1、PolicyLM、英伟达传闻中模型)能否用真实基准证明“更低算力”不是营销话术。
  • 端侧与硬件路线(Windows 本地推理、智能戒指、豆包座舱、第二代豆包手机)能否兑现量产与留存,而不止于内测话题。

为什么重要

当智能体开始代替人登录、支付与执行代码,安全与治理的落点正从“模型是否可信”转向“技术栈是否可核验、可回滚、可归责”,这让运行时控制、身份认证与细粒度权限成为企业采购的硬门槛。与此同时,头部模型公司面临降价压力与收入预期下修,定价权正在从“能力领先”转向“单位成本价值”,企业买家因此获得了多供应商并行与压价的窗口。开放权重与厂商扶持计划降低了起步成本,却把长期壁垒推回到专有数据、工作流深度与合规能力上。

微博邮件

Weekly ReportAI News
返回AI周报