实时 AI 消息
PrismML 发布 Bonsai 2 27B:27B 开源模型被压到 5.9GB,可跑在 PC 上
加州理工背景的 AI 实验室 PrismML 在周四发布 Bonsai 2 27B,把阿里开源模型 Qwen3.8 27B 压缩到 5.9GB,内存占用比原模型减少约 9 到 10 倍,小到可以装进 PC 甚至跑在高端手机上。公司称新版在聚合基准分数上达到原模型 98%,高于初代 Bonsai 的 95%,而它目前只拿过 2225 万美元种子轮。

加州理工背景的 AI 实验室 PrismML 在周四发布 Bonsai 2 27B,把阿里的开源模型 Qwen3.8 27B 压缩到 5.9GB。
这是一次幅度不小的瘦身:相比原始模型,内存占用减少约 9 到 10 倍,小到可以装进 PC,甚至有可能跑在高端智能手机上。PrismML 押注的核心判断是,具备推理能力的大模型并不一定非要“大”。
性能是这家公司最想强调的一点。据其说法,Bonsai 2 在聚合基准分数上达到原模型 98% 的水平,而今年 3 月发布的初代 Bonsai 只有 95%。这家公司还表示,初代模型已经被下载超过 1100 万次,更小的模型又累计下载了 260 万次——从一代到二代,压缩后的性能损失在收窄,这是它希望外界注意到的趋势。
实现方式上,模型的能力以“权重”形式存储,通常每个权重需要 16 位表示;PrismML 采用的是“三元”权重,把每个权重简化成 +1、-1 或 0 三种取值。权重表示越简单,模型占用的内存就越小。
公司本身还很早期:由一群加州理工的研究人员创立,CEO Babak Hassibi 是加州理工教授、压缩技术方向的专家;顾问名单里有 Databricks 联合创始人、伯克利 Sky Computing Lab 主任 Ion Stoica;投资方包括 Khosla Ventures、Cerberus Capital 和加州理工。目前融资金额只有 2225 万美元种子轮。
这条赛道并不只有它在跑。总部背景为西班牙的 Multiverse Computing 同样在做大模型压缩,而且拿到的钱更多。Hassibi 认为 PrismML 的差异在于压缩后几乎不掉性能,但他本人也承认,压缩总会带来一些影响,能否做到基准分数 100% 持平仍有待观察。
真正的看点在于,如果端侧小模型能保留原模型接近 98% 的推理能力,AI 的落地形态就可能从调用云端 API 转向本地常驻。后续可以观察 Bonsai 系列下一代的基准差距是否继续收窄,以及在实际任务与真实硬件上,端侧版本是否真的接近原模型的体验——毕竟基准分数和真实使用之间,还隔着运行框架与硬件的差异。
来源
为什么重要
这意味着推理的成本与隐私边界都可能被重写:企业可以在本地跑起接近原模型能力的 27B 级模型,AI 应用的默认部署位置或许会从云端挪到设备端。
附近消息
全部09/18 06:14
美国 FAA 将上线 8.75 亿美元 AI 空管系统 SMART,先在华盛顿特区落地
美国联邦航空管理局将推出一套名为 SMART 的 AI 软件系统,用 AI 评估航班时刻、天气、机场容量与空域状况,预测交通流量并提前识别潜在冲突,据《华尔街日报》报道,合同总额 8.75 亿美元、周期 12 年。这套由 Air Space Intelligence 开发的云端平台将先在华盛顿特区都会区上线,再扩展到其他地区。
09/18 07:25
Crusoe融资39亿美元,估值309亿美元,押注大型园区与模块化“AI工厂”
数据中心开发商Crusoe于9月17日宣布完成39亿美元F轮融资,公司估值升至309亿美元,由Atreides Management、Mubadala Capital和Valor Equity Partners联合领投。新资金将投入包括得州阿比林(供OpenAI使用)在内的在建数据中心,以及可用卡车运输、快速接入电源的模块化“AI工厂”。
09/18 04:55
GitLab 发布 19.4 版本,扩展平台内 AI 智能体工具
据 Investing.com 报道,GitLab 发布了 19.4 版本,此次更新的重点是扩展平台内的 AI 智能体工具。这说明代码托管与研发平台正在把智能体能力直接做进产品主线,而不只是以外部插件的形式提供。
09/18 04:05
美媒报道:美国政府网站使用了被 FBI 指为抄袭 Anthropic 的中国 AI 搜索工具
据 whbl.com 报道,一个美国政府网站使用了一款来自中国的 AI 搜索工具,而 FBI 曾指称该工具抄袭了 Anthropic 的技术。报道把两条通常分开讨论的线索接了起来:对中国 AI 产品复制美国模型能力的指控,以及这类工具是否已经进入政府运营的公开服务。