郭震 AI公众号:郭震AI

实时 AI 消息

陈大年复出押注本地大模型:StartLux首款27B模型逼近DeepSeek万亿旗舰

退隐近十年的盛大网络联合创始人陈大年以新公司StartLux(原点星辉)复出大模型赛道,首款本地模型StartLux-V1.0-27B-Preview正式亮相。这款27B参数模型在中国信通院MCP专项测试中综合得分39.25%、排名第二,仅落后1.6万亿参数的DeepSeek-V4-Pro约1.3个百分点。

发布时间
陈大年复出押注本地大模型:StartLux首款27B模型逼近DeepSeek万亿旗舰
图源: startlux.com

国产大模型第一梯队最近爆了个冷门:一家新公司的首款模型只有27B参数,却在中国信通院MCP专项测试中拿下综合第二。排在它前面的,是参数量高达1.6万亿的DeepSeek-V4-Pro,两者差距只有1.3个百分点。这匹黑马就是StartLux(原点星辉)推出的StartLux-V1.0-27B-Preview,而它的创始人兼CEO,是退隐近十年的陈大年。

据量子位报道,陈大年是盛大网络联合创始人、连尚网络掌门人,也是国民级产品“WiFi万能钥匙”的孵化者,被视作中国互联网第一代程序员中的代表人物。这次复出,他把赌注押在了本地模型上:StartLux没有随行业大流堆参数,而是专注小而美的本地模型商业化,号称全球第一家真正意义上的本地模型公司,StartLux-V1.0-27B-Preview不依赖云端,可直接运行在消费级PC上。

这次对标的成绩出自中国信通院可信AI大模型基准测试的MCP专项,围绕位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理和3D设计六类真实任务场景展开。结果显示,StartLux-V1.0-27B-Preview综合得分39.25%,排名第二,超过284B参数的DeepSeek-V4-Flash-0731和198B的Step-3.7-Flash;同为27B规模,它也比Qwen 3.6高出5.34个百分点,并在位置导航、金融分析和浏览器自动化三个单项上位列第一。

据官方介绍,StartLux-V1.0-27B-Preview并非从零训练,而是以Qwen3.6-27B为基座,靠任务数据和自动化后训练方法拉开差距:训练数据重点强化任务理解、工具选择、参数构造、多步执行、状态检查和结果验证,让模型学会什么时候调用哪个工具、工具异常后如何调整、什么情况下才能宣布任务完成。其后训练采用自研的多维度、可验证、可规模化的模型迭代优化技术,以“AI训练AI”的Auto Research方式让模型在真实工具环境中自主执行任务、根据环境反馈持续调整策略,也被称为国内首个以Auto Research方式完成后训练的本地Agent模型。

文章还披露了两场与Claude Sonnet 4.6的同题实战:一道跨越两年的微软股票投资计算题中,Claude把2025年1月8日误判为非交易日,给出47254美元、89.02%的结果,而StartLux回查数据、验证目标日期附近行情后给出47499.09美元、90.00%的可复核答案;在浏览器查询新加坡飞北京最便宜直飞航班的任务中,StartLux约95秒、12步找到299美元的国航机票,Claude用时200多秒、21步,给出的最低报价是556美元。这足以说明,在Agent任务上,参数规模已然不是唯一的决定性变量。

团队配置上,StartLux由“企业家+科学家”组合掌舵:联合创始人兼CTO郭权玮拥有国立阳明交通大学计算机科学与工程博士学位,曾任AI科学公司幻量科技首席算法科学家,是2024年TAAI最佳论文奖获得者;另一位联合创始人罗永祥是前摩根士丹利亚洲董事总经理,负责市场和投融资,与懂产品和用户的陈大年形成分工。

按照StartLux的构想,本地智能解决方案应该像安装Office一样一键完成部署,用户无需理解量化、显存配置和推理框架。目前团队计划面向企业和个人用户,在年内推出第一代本地智能解决方案,并稳步推进自有基模训练,探索扩散式语言模型等新架构。

在DeepSeek、Kimi等云端模型公司相继涌现之后,StartLux代表国产本地模型开始补位,也给“参数做减法”的路线提供了新样本。值得注意的是,Meta、Google、NVIDIA近期也在加码本地小模型方向,但大多停留在实验阶段,以本地模型产品化为主的玩家目前屈指可数。后续看点在于:年内落地的第一代本地智能解决方案能否兑现一键部署的承诺,以及27B小模型在真实商用场景中能否延续榜单上的表现。

为什么重要

陈大年携StartLux押注本地模型,用27B参数在Agent基准上逼近万亿级云端旗舰,为“少即是多”的技术路线再添注脚,也意味着国产大模型竞争正从云端参数竞赛延伸到本地化部署与PC端智能。年内本地智能解决方案能否落地,将检验这条非共识路线能否在真实商用场景中兑现。

微博邮件

StartLuxChen DanianLocal AI
返回实时消息

附近消息

全部

09/03 19:00

Amber International转型专业AI智能体:Q2营收环比增38.8% 扭亏为盈

Amber International Holding Limited(纳斯达克:AMBR)发布2026年第二季度财报,总营收达1390万美元,环比增长38.8%,毛利率79.5%,经营利润与调整后EBITDA双双转正。公司宣告已正式转向专业AI智能体业务,个人理财智能体Ambre与营销智能体MIA现已上市,其中约740万美元收入被归类为智能体相关。

09/03 19:01

美国立法者推出AI智能体安全新法案 回应OpenAI Hugging Face泄露事件

据Axios报道,美国立法者推出一项新法案,旨在保障AI智能体的安全,以回应OpenAI在Hugging Face平台遭遇的泄露事件。随着智能体开始自主调用工具并接触账户与资金,监管的关注点正从内容安全转向智能体行动安全。

09/03 19:49

针对 AI 智能体开发工具 Langflow 的攻击激增

据 BankInfoSecurity 报道,针对开源 AI 智能体开发框架 Langflow 的攻击正在显著增加,相关消息经 Google News 转载。这一趋势表明,随着企业加速采用智能体开发工具,AI Agent 基础设施正成为攻击者重点瞄准的新目标。

09/03 16:03

字节跳动将获得296亿美元银团贷款,为年内亚洲第二大

据界面新闻报道,字节跳动将获得一笔296亿美元的银团贷款,为年内亚洲规模第二大的同类交易。在字节跳动围绕豆包、Seed模型与火山引擎持续加码AI投入的背景下,这笔巨额融资有望为后续扩张提供充足弹药。