郭震 AI公众号:郭震AI

实时 AI 消息

MiniMax更新Music3音乐生成模型:文本一键生成音频

MiniMax官方在Hugging Face更新了Music3模型,该模型面向文本到音频(text-to-audio)生成场景,支持音乐生成与文本转音乐任务。模型库采用sglang-omni,并兼容diffusers与safetensors格式。

发布时间
MiniMax更新Music3音乐生成模型:文本一键生成音频
图源: huggingface.co

8月13日,MiniMax在Hugging Face官方仓库更新了Music3模型,登记信息显示其任务管线为text-to-audio(文本到音频),即通过文本直接生成音频内容。

官方标签显示,Music3面向音乐生成(music-generation)与文本转音乐(text-to-music)两类任务,推理库采用sglang-omni,并带有diffusers、safetensors与pytorch标签,说明模型以开源生态的标准格式发布。

目前模型页面显示下载量25次、获赞1次,属于刚刚完成登记的新版本,社区热度仍处于起步阶段。

从命名看,Music3是该音乐模型系列的第三代产品,此次以官方开源形态上线Hugging Face,延续了MiniMax在音乐生成方向的产品化思路。

文本转音乐是2026年生成式AI应用的热门方向之一,与图像、视频生成相比,音乐生成对创作者工具链的补充价值明显,也被视为内容平台降低素材生产成本的关键能力。

接下来值得关注的是Music3是否会同步上线MiniMax开放平台并开放API调用,以及生成音质、时长限制与商业授权条款的具体安排。

对音乐创作者以及视频、播客等内容生产者来说,文本直接生成音乐的模型更新意味着创作门槛与素材成本的进一步下降。

为什么重要

MiniMax以官方开源形式更新Music3,巩固其在音乐生成赛道的布局,文本转音乐能力有望降低内容创作者的素材生产成本。

微博邮件

MiniMaxMusicText-to-Audio
返回实时消息

附近消息

全部

08/13 23:30

微软砍掉多个表现不佳的AI功能,合并消费者与企业版Copilot应用

据TechCrunch报道,微软正在简化Copilot产品线,将消费者版与企业版Copilot应用合并,同时停用AI生成播客、群聊(Group Chats)、深度研究(Deep Research)以及Mico虚拟角色等功能。这是微软对表现不佳AI功能的一次集中清理。

08/14 00:28

DeepSeek 官方更新 DeepSeek-V4-Pro-0813 模型,新版本上线 Hugging Face

DeepSeek 官方在 Hugging Face 更新了 DeepSeek-V4-Pro-0813 文本生成模型,新条目采用 transformers 与 safetensors 格式,支持对话任务并标记为端点兼容。该模型以 MIT 许可证发布,截至上线时已获得 174 个收藏。

08/13 23:08

英伟达推进约5000亿美元新计划:为老化GPU保值并撬动新一轮AI融资

TechCrunch 于 8 月 13 日报道,英伟达正推进一项约 5000 亿美元的新计划,旨在让日渐老化的 GPU 保持价值,并吸引新一批金融机构继续为 AI 算力建设提供贷款。分析认为这一做法风险与巧思并存,可能为 AI 基础设施注入大规模资金,同时加深英伟达与金融市场信贷周期的绑定。

08/14 00:51

加州多项 AI 法案今日迎来最终表决:覆盖聊天机器人安全、版权与美国优先委员会

据 Tech Times 报道,加州多项 AI 法案将在今日迎来最终表决,涉及聊天机器人安全、生成式 AI 版权责任以及设立美国优先的 AI 委员会等内容。表决结果将直接影响美国 AI 监管格局。