郭震 AI公众号:郭震AI

实时 AI 消息

Moonshot AI 2.8 万亿参数模型登顶主流编程基准,系中国模型首次

据报道,Moonshot AI 的 2.8 万亿参数模型成为首个登顶主流编程基准的中国模型。这一里程碑意味着国产大模型在代码能力上首次站上国际权威评测的榜首位置,代码竞争的格局正在被改写。

发布时间

据 AOL 转载的报道,Moonshot AI 的 2.8 万亿参数模型刚刚成为首个登顶主流编程基准的中国模型。

报道并未披露具体基准名称与分数,但“中国模型首次登顶”这一里程碑本身就足以说明问题。

编程能力是当前大模型竞争最激烈的方向之一,代码基准上的排名直接关系到编程工具、开发者体验与企业级代码场景的选型。

Moonshot AI 是 Kimi 系列模型的开发商,其模型在开发者社区拥有广泛的知名度,此次登顶主流编程基准,进一步巩固了其在代码领域的竞争力。

对整个中国大模型行业而言,这一成绩意味着国产模型在编程这一硬核维度上,已经具备与国际顶尖模型正面竞争的实力。

编程基准的榜首之争不仅是技术实力的比拼,也直接影响企业采购与开发者选型,登顶意味着更多代码密集型工作负载会把目光投向该模型。

后续看点:这一成绩能否转化为真实产品竞争力,模型在编程 Agent 等落地场景中的表现如何,以及竞争对手将如何回应,是接下来的关注焦点。

为什么重要

国产模型首次登顶主流编程基准,标志着中国大模型在代码能力上进入国际第一梯队,有望带动编程 Agent 与开发者工具侧的国产模型采用。

微博邮件

Moonshot AICoding BenchmarkKimi
返回实时消息

附近消息

全部

08/09 15:13

南澳大利亚州长在OpenAI总部签署草案协议

澳大利亚南澳大利亚州州长Peter Malinauskas在访美期间于OpenAI总部签署了一份草案协议,澳媒将其称为OpenAI与南澳政府之间的里程碑式合作。目前协议具体内容尚未公开,市场关注其后续落地进展。

08/09 11:40

无尽前沿团队发布BigBang-V1:首个原生递归自我改进训练的开源基座模型,35B跑赢1T大模型

由上海交大、深势科技等组成的无尽前沿团队发布开源基座模型BigBang-V1,称其为首个以递归自我改进方式原生训练的模型,后训练数据100%由AI自主合成。该35B参数模型在多项科研评测中拿下35B档全部第一,甚至在FrontierScience Research等任务上超过1T级的DeepSeek V4 Pro Preview。

08/09 11:25

Opus 5烧掉6.9亿token单提示词做出可玩竞速游戏,GPT-5.6在Codex里5美元复刻

网友用Claude Opus 5以一条约2000字提示词、消耗6.9亿token和423美元,一次生成了一款可在线游玩的复古街机快艇竞速游戏;随后另一名网友在Codex中用GPT-5.6组建Agent小队,以约5美元成本复刻出相似作品。对比显示,AI已能产出工程上站得住脚的游戏,但完成度上限仍取决于人的判断与账单。

08/09 15:43

上线不到一天,苹果官网删除千问使用手册,客服回应:相关功能正在申请中

苹果中国官网此前上线的Apple智能接入阿里千问(通义千问)使用手册,在上线不到一天后被撤下,引发市场广泛关注。苹果客服回应称,目前暂无相关智能功能,相关合作正在申请中,为国行Apple智能的推进节奏增添了变数。