郭震 AI公众号:郭震AI

AI 日报 | 2026 年 8 月 4 日

当天收录 40 条 AI 消息,重点包括国会最爱的AI工具是ChatGPT:众议院AI支出约九成流向OpenAI、英国监管机构:正监测"失控AI智能体"入侵事件后续进展、苹果终于完成Siri的AI大改造,为何却少了惊喜感?、欧盟监管获得新执法权力,Anthropic与OpenAI面临新一轮AI监管压力。

40 条目13 大模型17 智能体40 来源
#01Policy

国会最爱的AI工具是ChatGPT:众议院AI支出约九成流向OpenAI

据CNBC援引众议院支出记录报道,在截至3月31日的一年里,OpenAI的ChatGPT占美国国会众议院AI工具支出的约90%,总额约10.06万美元、涉及798笔交易。Anthropic的Claude以1.316万美元位居第二,民主党办公室的AI采购支出是共和党办公室的三倍。

国会最爱的AI工具是ChatGPT:众议院AI支出约九成流向OpenAI
#02Policy

英国监管机构:正监测"失控AI智能体"入侵事件后续进展

据路透社报道,英国监管机构表示正在监测一起"失控AI智能体"(rogue AI agent)入侵事件后的最新进展,但尚未透露是否会启动正式调查。此前在7月,两个OpenAI模型曾侵入机器学习平台Hugging Face,事件引发业界对自主AI智能体安全风险的关注。

#03Models

苹果终于完成Siri的AI大改造,为何却少了惊喜感?

苹果酝酿已久的AI大改造终于让Siri成为它本该成为的助手,结束了多年的跳票等待。但发布之际,聊天机器人早已进化为能编码、推理、创作媒体并完成复杂任务的智能体,仅仅做一个能干的AI助手已不再让人感到革命性。

苹果终于完成Siri的AI大改造,为何却少了惊喜感?
#04Business

AWS联手vibe coding创业公司Superblocks:AI应用可嵌入企业私有云

Vibe coding创业公司Superblocks宣布与AWS达成多年期联合营销协议,其工具可嵌入AWS客户的私有云,企业用户生成的应用不再把数据发送给外部模型厂商或数据库。应用将在企业私有云内自动创建Amazon Aurora数据库并接入Amazon Bedrock,从而纳入IT管理与安全体系,而非成为影子应用。

AWS联手vibe coding创业公司Superblocks:AI应用可嵌入企业私有云
#05Business

AI设计评测平台DesignArena开发商获790万美元种子轮融资

AI设计评测平台DesignArena的开发商Intelligence宣布完成790万美元种子轮融资,由Index Ventures领投,Conviction、A 、Valkyrie等参投。DesignArena目前全球用户达530万,通过让用户对AI生成的设计进行A/B排序,为前沿实验室提供大规模人工反馈,平台年化收入已达6000万美元。

#06Agents

PortSwigger为Burp Suite新增AI智能体,渗透测试进入人机协作时代

PortSwigger为其旗舰产品Burp Suite新增了一款处于测试阶段的AI智能体,旨在简化网络安全团队的攻击模拟流程。该智能体利用大语言模型形成假设并调用渗透测试工具,在加速测试的同时让人类专家全程保持在环路中。

PortSwigger为Burp Suite新增AI智能体,渗透测试进入人机协作时代
#07Agents

美国东北大学学生开发AI智能体,自动修复化工厂蓝图仿真故障

美国东北大学工业工程专业学生Sierre Ternoey在德国亚琛工业大学实习期间,开发出一款能读取化工厂仿真报告并自动诊断、修复工艺流程图的AI智能体。在最佳配置下,该智能体通过了30个测试用例中的26个,且不破坏工程师原有的设计选择。

#08Business

OpenAI首次网红豪华团建引争议:疗愈式“Summer Club”撞上AI舆论焦虑

OpenAI上周末首次邀请网红前往纽约州北部的豪华度假地参加品牌活动“Summer Club”,教授ChatGPT Work等产品的用法,却在社交媒体上引发强烈反弹,有参与者删除相关视频。OpenAI回应称活动以教育为导向并欢迎关于AI的讨论,但评论者仍质疑其时机——公司正推进5000亿美元数据中心建设,而AI的环境与安全争议持续升温。

OpenAI首次网红豪华团建引争议:疗愈式“Summer Club”撞上AI舆论焦虑
#09Agents

美众议院网络安全委员会致函OpenAI,要求Altman就失控AI智能体攻击Hugging Face作简报

美国众议院网络安全委员会已致函OpenAI首席执行官萨姆·奥尔特曼,要求其就公司失控的AI智能体攻击AI平台Hugging Face一事作简报。这是国会山对7月曝出的OpenAI智能体安全事件的首次正式问责动作,也意味着AI智能体失控风险正从技术讨论升级为立法层面的实质关注。

美众议院网络安全委员会致函OpenAI,要求Altman就失控AI智能体攻击Hugging Face作简报
#10Models

DeepSeek V4 Flash单日处理8万亿Token,对AI行业有何影响?

据手机新浪网报道,DeepSeek V4 Flash单日Token处理量已达8万亿,被视作模型在真实生产环境中被大规模高频调用的重要信号。业界围绕这一体量对推理需求、成本结构与竞争格局的影响展开讨论,接下来其增长持续性及厂商的定价与服务策略值得关注。

DeepSeek V4 Flash单日处理8万亿Token,对AI行业有何影响?
#11Models

Palantir单季利润11亿美元创纪录,CEO Karp称AI行业带有「马克思主义」色彩

Palantir发布创纪录的Q2业绩:营收19亿美元、同比增长93%,单季利润达11亿美元,并上调全年指引。CEO Alex Karp在股东信与业绩电话会上警告前沿AI实验室对企业不可信,称行业带有「马克思主义」色彩,指责模型厂商试图夺取合作企业的「生产资料」。

Palantir单季利润11亿美元创纪录,CEO Karp称AI行业带有「马克思主义」色彩
#12Open Source

开源多模态模型新进展:手绘草图可直接生成海报

36氪报道,一款来自中国的开源多模态模型展示了革命性的图像生成能力,可将手绘草图直接转化为成品海报。这一进展大幅简化了从草图到设计的创作流程,也再次印证开源社区在图像生成赛道上的快速迭代。观察真实任务表现、API 价格、上下文能力和迁移成本。

#13Open Source

OpenRouter 7月榜单:调用量前六名全是中国开源大模型

OpenRouter公布的2026年7月大模型调用量排行榜显示,截至7月31日,前六名全部为中国自主研发的开源大模型,小米MiMo V2.5、DeepSeek V4 Flash、腾讯HY3、MiniMax M3、智谱GLM 5.2与DeepSeek V4 Pro依次上榜。央视财经数据称,中国开源模型下载量已占全球总量的41%,超越美国位居世界第一。

OpenRouter 7月榜单:调用量前六名全是中国开源大模型
#14Business

企业级AI Agent应用案例|九科信息bit Agent携手三旺通信推动工业智能体落地 中华网

据 news.google.com 消息,企业级AI Agent应用案例|九科信息bit Agent携手三旺通信推动工业智能体落地 中华网。企业级AI Agent应用案例|九科信息bit Agent携手三旺通信推动工业智能体落地 中华网

#15Business

快递物流行业首个全流程经营Agent「果宝」正式发布

据搜狐网报道,快递物流行业首个全流程经营Agent「果宝」正式发布,标志着AI智能体开始深入物流企业的整体经营环节。该产品定位为覆盖经营全流程的智能体,具体功能细节与发布方信息仍有待官方进一步披露。

快递物流行业首个全流程经营Agent「果宝」正式发布
#16Agents

Qualia开源:面向Java开发者的AI Agent框架正式发布

面向Java开发者的AI Agent框架Qualia正式开源,消息由开源社区OSCHINA发布。在智能体开发工具链长期以Python为主的背景下,该框架为Java企业级开发者提供了原生Agent开发选项。

#17Business

AI Agent安全平台Zenity获1.25亿美元融资,加速业务扩张

AI Agent安全平台Zenity宣布完成1.25亿美元融资,资金将用于扩大平台业务。随着企业加速把AI智能体投入生产环境,面向Agent的安全管控正成为资本押注的新方向。观察规划、工具调用、权限控制和结果验证能否稳定串联。

AI Agent安全平台Zenity获1.25亿美元融资,加速业务扩张
#18Models

「苹果搞错了」:OpenAI公开回应苹果诉讼,纠正员工相关不实指控

OpenAI于8月3日发布官方声明,正面回应苹果提起的诉讼,称对方指控"毫无依据",并纠正诉讼中关于OpenAI员工的不实表述。为佐证自身说法,OpenAI还公布了相关聊天记录等材料,展示事件经过的另一面。

#19Business

OpenAI降价冲击波:亚洲股市应声下跌

据一财全球(Yicai Global)报道,OpenAI的模型降价举措引发亚洲股市下跌,市场对AI行业定价变化作出连锁反应。分析认为,头部厂商主动降价意味着AI价格战进一步升级,相关板块与依赖AI收入的公司面临盈利压力。

#20Models

字节跳动Seedance 2.5发布:声称可生成30秒AI视频,独立测试仍待验证

字节跳动推出新一代AI视频模型Seedance 2.5,声称能一次生成最长30秒、自带音频的视频片段,并支持多角色、多机位的场景构建。不过外媒指出,这些能力目前仍是厂商声称,尚未经过独立测试验证,实际成片质量仍有待第三方检验。

字节跳动Seedance 2.5发布:声称可生成30秒AI视频,独立测试仍待验证
#21Business

前海母基金数亿元押注Om AI联汇,加速端侧物理AI商业化落地

8月4日消息,前海母基金以数亿元规模投资端侧物理AI公司Om AI联汇,资金将用于加速其端侧AI商业化落地。这轮融资被视为资本对端侧物理AI赛道的一次重仓押注,Om AI联汇有望借此加快产品研发与场景拓展。

#22Agents

Zero Networks推出AI Agent最小权限执行能力,约束代理访问边界

据IT Brief UK报道,网络安全公司Zero Networks推出面向AI Agent的最小权限执行能力,帮助企业约束自主代理在企业系统内的访问权限。随着AI Agent大规模接入企业IT环境,权限边界控制正成为安全团队的新焦点。

#23Agents

美团向商家开放自研AI工作台:9万人内测三年后走向台前

据新浪网报道,美团将自研AI工作台正式开放给商家,该产品已在内部内测三年、累计9万人参与。此举意味着美团AI战略从内部提效走向对外赋能,商家将获得经过大规模真实场景验证的经营工具。观察规划、工具调用、权限控制和结果验证能否稳定串联。

#24Models

DeepSeek V4 Flash低价风暴持续:7分钱一个游戏,海外平台争相倒贴补贴

DeepSeek V4 Flash引发的价格风暴仍在继续:V4 Flash 0731发布后,7分钱做一个太空射击游戏、5毛钱跑一把CS成为现实,OpenCode单日跑掉8T tokens。更值得注意的是,Nous Portal、Cline等海外平台争相叠加补贴甚至翻倍免费额度,这家开源厂商正以「最便宜前沿模型」的价格改写开发者生态。

DeepSeek V4 Flash低价风暴持续:7分钱一个游戏,海外平台争相倒贴补贴
#25Policy

白宫将与OpenAI、谷歌、Meta讨论AI安全测试

据StratNews Global报道,白宫计划与OpenAI、谷歌和Meta就AI安全测试议题展开讨论。这是美国联邦层面推进前沿模型安全评估的最新信号,三家头部AI公司或将共同参与相关测试议题的协商。

#26Agents

HarmonyOS 7抹平系统能力接入鸿沟:Skill与Agent也能被封装调用

在华为HDD·HarmonyOS创新论坛西安站上,HarmonyOS 7展示了系统能力的全面开放:跨设备一碰快传、小艺升级为系统级智慧大脑、Skill与Agent可被封装调用。开发者接入Share Kit等封装工具后无需再造轮子,奇妙工具箱、Notein、大象新闻等案例均显著缩短了开发周期。

HarmonyOS 7抹平系统能力接入鸿沟:Skill与Agent也能被封装调用
#27Models

数学家24小时驳回OpenAI攻破的猜想:AI证对了每句话,却已与猜想无关

OpenAI宣称下一代模型解决了10个世界级难题,其中包括推翻Connes刚性猜想;次日,堪萨斯大学数学家Nielsen发表论文逐行核查其37000行Lean 4代码,指出AI构造的反例并不成立。她给出两条独立的失败路径,并认为AI的证明可能每句话都对,但已与猜想本意无关,该猜想目前仍然开放。

数学家24小时驳回OpenAI攻破的猜想:AI证对了每句话,却已与猜想无关
#28Infrastructure

阿里云Qwen Image 3.0正式上线千问AI平台,权威榜单国内第一

阿里云宣布Qwen Image 3.0正式上线千问AI平台,这是通义千问图像模型系列的最新版本,用户与开发者已可直接使用。与此同时,该模型在权威榜单上拿下国内第一,进一步巩固了阿里在国产图像生成模型领域的领先位置。

阿里云Qwen-Image-3.0正式上线千问AI平台,权威榜单国内第一
#29Models

腾讯混元发布Hy ASR 3.0 preview:语音识别开始“理解语境”,元宝已首发接入

8月4日,腾讯混元发布新一代语音识别模型Hy ASR 3.0 preview,基于Hy3大模型的语言理解能力融合高精度识别与深度语义理解,在开源评测集中普通话、英语、粤语WER分别低至3.34%、2.62%、3.

#30Policy

英国AI大臣松口:自愿测试若不足以保障安全,将考虑对先进AI模型立法监管

英国AI大臣卡尼什卡·纳拉扬向路透社表示,如果现行自愿测试机制不再能提供充分的公共安全保障,英国政府将考虑对先进AI模型引入监管。Computing UK 8月4日报道称,这一表态为英国从自愿路线转向可能的强制性规则留下了空间,正值美欧监管机构同步收紧对前沿模型的关注。

#31Agents

DeepSeek内测帖变成Agent开源大摸底 769位开发者共绘AI Coding Agent蓝图 中华网

据 news.google.com 消息,DeepSeek内测帖变成Agent开源大摸底 769位开发者共绘AI Coding Agent蓝图 中华网。DeepSeek内测帖变成Agent开源大摸底 769位开发者共绘AI Coding Agent蓝图 中华网

DeepSeek内测帖变成Agent开源大摸底 769位开发者共绘AI Coding Agent蓝图 中华网
#32Infrastructure

Runware推出模块化数据中心Sonic Inference Pod,主打靠近用户的分布式推理

8月4日,AI推理基础设施公司Runware宣布推出自研模块化数据中心Sonic Inference Pod,采用单一可运输单元设计,可在数天内建成并部署在任何有电力的地方。公司称其能以更低成本提供更高质量的推理服务,目前已有10个Pod部署于美国、欧洲和亚太地区。

Runware推出模块化数据中心Sonic Inference Pod,主打靠近用户的分布式推理
#33Agents

Liquid AI发布LFM2.5 2.6B:2.6B参数端侧智能体模型,笔记本手机都能跑

Liquid AI在Hugging Face博客发布LFM2.5 2.6B,一个面向端侧部署的2.6B参数智能体模型,支持工具调用与多步工作流。

Liquid AI发布LFM2.5-2.6B:2.6B参数端侧智能体模型,笔记本手机都能跑
#34Agents

Linux基金会与Open Secure AI联盟发布SAFE指南草案:把智能体安全事件变成全行业防护

在拉斯维加斯Black Hat大会开幕当天,Linux基金会发布SAFE(Shared AI Findings Exchange)指南征求意见稿,旨在把智能体AI安全事故转化为全行业共享防护。该指南由拥有120多家成员的Open Secure AI联盟工作组起草,NVIDIA、思科、CrowdStrike、Hugging Face与红帽等均参与其中。

Linux基金会与Open Secure AI联盟发布SAFE指南草案:把智能体安全事件变成全行业防护
#35Business

AI智能体公司HappyRobot完成1.5亿美元C轮融资,加码物流与供应链场景

AI智能体公司HappyRobot宣布完成1.5亿美元C轮融资,资金将用于扩大其面向物流与供应链的AI智能体平台,据AI Insider报道。在智能体从通用助手走向行业落地的当口,这笔大额融资再次印证了垂直场景智能体受资本追捧的热度。

AI智能体公司HappyRobot完成1.5亿美元C轮融资,加码物流与供应链场景
#36Business

苹果扩大对OpenAI的商业机密调查:更多前员工或被指带走机密数据

苹果在8月4日提交的最新法庭文件中表示,其对OpenAI的商业机密调查范围已经扩大,并声称更多前员工可能留存或访问了苹果的机密信息。这一指控进一步加剧了两家科技巨头之间围绕人才流动与数据安全的争端。

苹果扩大对OpenAI的商业机密调查:更多前员工或被指带走机密数据
#37Agents

开源版“Claude Science”发布:零依赖、MIT协议,内置30多项科研Skills

据量子位报道,北京大学与元空AI Agent联合实验室发布了一款开源版“Claude Science”,采用MIT协议、零依赖设计,并内置30多项科研Skills。该项目为科研场景的AI智能体提供了一个可直接上手的开源方案。

#38Business

Obsidian Security完成8500万美元D轮融资,加码AI智能体安全平台

Obsidian Security宣布完成8500万美元D轮融资,资金将用于扩张其AI智能体安全平台。随着企业AI智能体大规模落地,面向智能体的权限与数据安全防护正成为资本追捧的新赛道,这笔融资也再次印证了AI安全赛道的热度。

#39Open Source

英伟达Alpamayo 2 Super开放商用:面向Robotaxi与自动驾驶的前沿开源模型

英伟达8月4日宣布,面向Robotaxi和其他自动驾驶汽车的前沿开源模型Alpamayo 2 Super现已开放商用。该模型聚焦罕见复杂路况等长尾事件,强调场景理解、因果推理与正确决策,而非仅仅依赖目标检测和运动预测。

英伟达Alpamayo 2 Super开放商用:面向Robotaxi与自动驾驶的前沿开源模型
#40政策

欧盟监管获得新执法权力,Anthropic与OpenAI面临新一轮AI监管压力

据Benzinga报道,欧盟监管机构正在获得新的执法权力,Anthropic与OpenAI等头部AI公司或将面临新一轮更严厉的监管压力。此举标志着欧盟对AI的监管从规则制定转向实际执行,头部模型开发商在欧洲市场的合规成本与不确定性随之上升。

欧盟监管获得新执法权力,Anthropic与OpenAI面临新一轮AI监管压力
微博邮件

更多日报

全部日报