实时 AI 消息
Qwen开源多模态模型Qwen3.8-27B上架Hugging Face,同步推出FP8量化版
Qwen团队在Hugging Face官方模型库上架了全新的多模态模型Qwen3.8-27B,该模型采用image-text-to-text架构,支持图像与文本的跨模态对话,并以Apache 2.0许可证开源。同一天,团队还发布了基于该模型的FP8量化版本Qwen3.8-27B-FP8,进一步降低部署门槛。

Qwen团队在Hugging Face官方模型库更新了模型注册信息,正式上架了新的多模态模型Qwen3.8-27B。该模型采用image-text-to-text流水线,能够同时处理图像与文本输入,并支持对话式交互。
根据官方模型卡信息,Qwen3.8-27B基于transformers库构建,权重以safetensors格式提供,采用Apache 2.0开源许可证,并标注为endpoints_compatible,意味着可以较为方便地接入推理服务。
同一天,Qwen团队还发布了该模型的FP8量化版本Qwen3.8-27B-FP8,其基础模型为Qwen3.8-27B,同样采用Apache 2.0许可证。FP8量化通常意味着更低的显存占用与推理成本,适合生产环境部署。
从模型库数据看,主模型页面已获得7818次点赞,社区关注度不低;而FP8版本刚刚上架,下载量仍处于起步阶段。
27B规模的参数体量使该模型落在开源多模态模型的中坚区间,既有能力储备,又不像超大规模模型那样对部署资源要求苛刻。加上Apache 2.0许可证的宽松商用条款,开发者可以自由地在自有产品中集成或二次开发。
这一更新的信号意义在于:开源多模态模型的竞争仍在加速,头部团队选择在发布主模型的同时同步提供量化版本,说明推理效率与易部署性已成为模型发布的标配考量。
接下来值得关注的是模型卡后续补充的技术细节与基准表现、社区评测,以及Hugging Face生态中各推理框架对Qwen3.8-27B的适配进度。若其实际能力符合社区预期,这款模型有望成为多模态应用开发的新热门底座。
为什么重要
Qwen3.8-27B以Apache 2.0协议开源并同步推出FP8量化版,有望进一步降低多模态模型的应用门槛,推动开源多模态生态的竞争与普及。
附近消息
全部08/14 22:50
法国初创公司Kog:GPU并非不适合智能体推理工作负载
法国初创公司Kog认为,GPU不适合智能体工作负载的说法可能是一种误解,公司正致力于从GPU中榨取更多推理性能。TechCrunch的报道显示,这家初创公司选择在接近硬件的层面深耕优化,为智能体时代的推理基础设施提供了一条务实路线。
08/14 23:43
Meta 发布开放权重模型 Glimmer,扎克伯格宣称 AI 应“为每个人服务”
本周 Meta 发布了开放权重模型 Glimmer,任何人都可以下载并在自己的硬件上运行,而更强大的 Muse Spark 仍被锁定在 Meta 自家 API 之后。随发布一同出现的还有扎克伯格主张 AI“为每个人服务”的公开信,TechCrunch 的 Equity 节目对这一表态的诚意提出了质疑。
08/14 22:05
新预测称美国部分地区天然气价格或涨至三倍,超大规模数据中心成本承压
TechCrunch援引的一项新预测指出,美国部分地区天然气价格可能涨至目前的三倍,这将让押注天然气为AI数据中心供电的超大规模云厂商背上巨额电费账单。如果预测成真,能源成本将成为AI算力扩张中最棘手的变量之一。
08/14 18:25
太初元碁助力国家级“AI+教育”大赛 “AI+加速卡模型适配赛道”开启招募
由中国教育技术协会主办的“AI+教育”创新应用技能大赛正在进行中,战略合作伙伴太初元碁承办的大学生AI创新创业“AI+加速卡模型适配赛道”正式开启招募。该赛道以国产算力为底座,参赛队伍可免费使用太初AI加速卡云服务器资源完成模型适配优化,报名及代码提交截止至2026年10月15日。