郭震 AI公众号:郭震AI

实时 AI 消息

腾讯发布并开源混元新模型 Hy4 preview:7700 亿参数 MoE,上下文超百万 token

腾讯发布并开源了混元大模型家族最新成员 Hy4 preview,该模型采用混合专家架构,总参数 7700 亿、激活参数 490 亿,支持超过 100 万 token 的上下文窗口。模型将陆续接入 WorkBuddy、CodeBuddy、元宝与 ima 等产品,并可通过腾讯云 TokenHub 与 OpenRouter 的 API 调用,输入定价为每百万 token 0.834 美元。

发布时间
腾讯发布并开源混元新模型 Hy4 preview:7700 亿参数 MoE,上下文超百万 token
图源: tencent.com

据 IT Brief UK 报道,腾讯已发布并开源混元(Hunyuan)AI 家族最新成员 Hy4 preview,此举使腾讯直接进入开源大模型的最新一轮竞争,各家厂商都在寻求提升推理能力的同时控制推理成本,这个问题在企业评估大规模部署时变得愈发突出。

从规格看,Hy4 preview 采用混合专家(MoE)设计,总参数 7700 亿、激活参数 490 亿,支持超过 100 万 token 的上下文窗口,可在单次提示中处理长文档、软件代码库与大型数据集。

在分发上,腾讯将该模型接入 WorkBuddy、CodeBuddy、元宝(Yuanbao)与 ima 等多款自有产品,开发者也可通过腾讯云 TokenHub 与 OpenRouter 上的应用程序接口调用。

Hy4 preview 面向软件工程、办公任务、金融分析、科学研究与游戏开发等场景开发。软件工程方面,模型针对长上下文理解、规划、调试与验证进行了训练,并支持前端开发;办公与分析场景下,腾讯称其在复杂工作环境与金融分析中表现更好,并针对数据分析与跨文档协作进行了调优;游戏开发中,它可以从一句自然语言请求生成可玩原型,并通过多轮交互与游戏引擎协作;科学研究方面则强化了 AI 研发、分子动力学模拟、凝聚态物理与基础数学的表现。

值得注意的是,该模型还参与了自身的开发。据腾讯介绍,Hy4 preview 通过提出方案、运行实验并迭代结果,参与了训练方法、数据策略、评估框架与底层算子的自动化优化,这一过程被描述为早期的递归自我改进循环;模型还分析了自身推理系统的瓶颈,经过算子融合与通信等多轮优化,端到端吞吐量较基线提升 31.8%。

在评测上,腾讯将发布重点放在实际使用而非单纯跑分上,但也公布了内部对比数据:在涉及 163 名专家与 203 项工程任务的盲评中,Hy4 preview 平均得分 2.99 分(满分 4.00),高于 GLM-5.3 的 2.92 分与 Kimi K3 的 2.94 分。

定价与获取同样被重点提及。Hy4 preview 的 API 定价为每百万输入 token 0.834 美元、每百万输出 token 2.501 美元、缓存命中每百万 token 0.042 美元;WorkBuddy 与 CodeBuddy 将提供两周免费使用,Hy3 在两平台上的免费期也得到延长。腾讯表示预览版旨在广泛开放前收集开发者的反馈,混元将延续先预览后发布的路线,通过真实使用来打磨模型。

在推理成本成为企业规模化部署关键约束的当下,腾讯选择以开源加低价 API 的方式推出超大参数 MoE 模型,给开发者提供了一个观察中文与全球开源模型竞争的早期信号。后续值得关注的是开发者与企业用户的反馈、Hy4 正式版的发布节奏,以及超大上下文与递归自我优化能力能否在工程和办公场景中得到验证。

为什么重要

腾讯以开源与低价 API 切入推理成本竞争,超大上下文与递归自我优化若得到开发者验证,将给中美开源大模型的性价比竞争带来新的变量。

微博邮件

TencentHunyuanOpen Source
返回实时消息

附近消息

全部

09/04 00:36

英伟达同意以129.3亿美元收购Hugging Face

据Tech Edition报道,英伟达已同意以129.3亿美元收购开源AI平台Hugging Face,交易消息于9月3日传出。若交易完成,英伟达将把全球最大的开源模型托管社区收入囊中,其在AI基础设施生态中的地位也将进一步巩固。

09/04 00:09

家庭AI助手Ollie押注隐私保护,争夺个人AI助手市场

TechCrunch报道,面向家庭与日常生活的AI助手Ollie把隐私保护作为核心卖点,承诺不会用用户数据训练AI模型,也不会与第三方共享。在个人AI助手竞争日益激烈的当下,这家初创公司希望以“可信赖”的定位赢得用户。

09/04 00:00

英伟达在 IFA 2026 加速本地 AI:RTX Spark Windows PC 十月上市,PAIR 工具可串联多台 PC 算力

在 IFA 2026 上,英伟达联合微软等伙伴集中发布了本地 AI 升级:Hermes Agent、OpenClaw、Perplexity Portable Computer 将获得简化的本地模型配置,llama.cpp 推理吞吐最高提升 1.9 倍,还推出了可在局域网内调度多台 PC 算力的免费工具 NVIDIA PAIR。联想与宏碁的紧凑型 NVIDIA RTX Spark Windows PC 将于 10 月上市。

09/03 23:00

谷歌DeepMind发布AI天气预报模型WeatherNext 3:5公里级分辨率、支持逐小时预报,将接入搜索、地图与Gemini

谷歌DeepMind与谷歌研究院9月3日发布新一代AI天气预报模型WeatherNext 3,关键变量预测分辨率可达5公里,降雨评估较前代提升60%,并可提供逐小时预报。谷歌表示,该模型将接入搜索、谷歌地图与Gemini中的天气信息,同时向谷歌云平台上的用户和研究人员开放。