实时 AI 消息
Sand.ai开源全球首个千亿参数MoE视频生成模型:114B参数、6B激活,10秒1080P成本仅5毛
Sand.ai刚刚开源了其千亿参数MoE视频生成模型,总参数达114B、激活参数仅6B,并宣称这是全球首个千亿级MoE视频生成模型。该模型支持10秒1080P视频生成,单次生成成本约0.5元,大幅拉低了高质量AI视频的生产门槛。
Sand.ai 今日宣布开源旗下千亿参数 MoE 视频生成模型。据量子位报道,这是全球首个千亿级 MoE 架构的视频生成模型,标志着视频生成领域正式进入开源稀疏化时代。
从参数规模看,该模型总参数量达 114B,但凭借 MoE(混合专家)架构,单次推理仅激活 6B 参数,在保证生成质量的同时显著压缩了算力开销。
在生成能力上,模型支持 10 秒 1080P 视频生成,官方给出的单次生成成本约为 5 毛钱(0.5 元),将高质量视频生成的价格门槛压到了极低水平。
开源意味着开发者可以自行部署、微调并在自有场景中复现此前主要依赖闭源 API 的视频生成能力,个人开发者与小团队第一次有机会触及千亿级视频模型。
从行业信号看,视频生成正在沿着大语言模型的路径演进——从闭源 API 走向开源权重、从稠密模型走向 MoE 稀疏化,用更低的推理成本换取可规模化。
6B 的激活参数也让社区适配成为现实议题:量化、微调与推理优化能否让模型跑在消费级硬件上,将是开源社区接下来最关心的方向之一。
后续值得观察的是该模型在时序一致性、动作流畅度与文本跟随等维度的社区实测表现,以及 Sand.ai 是否会基于这套架构继续推出更大规模或面向特定场景的版本。
为什么重要
千亿级 MoE 视频生成模型的开源,把视频生成的算力与成本门槛大幅下探,可能加速开源社区在视频生成领域的追赶与二次创新。
附近消息
全部08/05 14:33
微软叫停Tokenmaxxing:预算卡死、超限自负,内部默认用GPT-5.6
据量子位报道,微软已叫停内部“Tokenmaxxing”做法,将AI使用预算卡死,超出限额的用量由使用者自行承担。报道称,微软内部目前默认使用GPT-5.6,成本管控成为大模型应用的新重点。
08/05 16:04
NVIDIA Nemotron 3 Ultra:AI智能体能力迎来新进展
据Techgenyz报道,NVIDIA Nemotron 3 Ultra在AI智能体能力上带来一系列新进展,成为业界关注的焦点。这一动向延续了NVIDIA以模型与算力生态切入智能体赛道的策略,具体能力细节与基准表现仍有待官方披露。
08/05 13:59
字节 Seed 发布 SeedRealtime:音视频全双工大模型上车豆包
字节跳动 Seed 团队发布音视频全双工大模型 SeedRealtime,并将其集成到豆包 App。该模型支持"边看、边听、边说"的实时多模态对话,消除了传统语音助手一问一答间的"卡拍"停顿,让交互更接近自然交流。
08/05 13:53
AI用10小时凿开黄仁勋20年筑起的CUDA护城河,量子位:CUDA又危了?
量子位报道,AI刚刚用约10小时凿开了NVIDIA创始人黄仁勋经营20年之久的CUDA护城河。报道借此抛出“CUDA又危了?”的疑问,认为AI正在大幅降低绕开或替换CUDA生态的门槛。