郭震 AI公众号:郭震AI

实时 AI 消息

MiniMax更新Music3音乐生成模型:文本一键生成音频

MiniMax官方在Hugging Face更新了Music3模型,该模型面向文本到音频(text-to-audio)生成场景,支持音乐生成与文本转音乐任务。模型库采用sglang-omni,并兼容diffusers与safetensors格式。

发布时间
MiniMax更新Music3音乐生成模型:文本一键生成音频
图源: huggingface.co

8月13日,MiniMax在Hugging Face官方仓库更新了Music3模型,登记信息显示其任务管线为text-to-audio(文本到音频),即通过文本直接生成音频内容。

官方标签显示,Music3面向音乐生成(music-generation)与文本转音乐(text-to-music)两类任务,推理库采用sglang-omni,并带有diffusers、safetensors与pytorch标签,说明模型以开源生态的标准格式发布。

目前模型页面显示下载量25次、获赞1次,属于刚刚完成登记的新版本,社区热度仍处于起步阶段。

从命名看,Music3是该音乐模型系列的第三代产品,此次以官方开源形态上线Hugging Face,延续了MiniMax在音乐生成方向的产品化思路。

文本转音乐是2026年生成式AI应用的热门方向之一,与图像、视频生成相比,音乐生成对创作者工具链的补充价值明显,也被视为内容平台降低素材生产成本的关键能力。

接下来值得关注的是Music3是否会同步上线MiniMax开放平台并开放API调用,以及生成音质、时长限制与商业授权条款的具体安排。

对音乐创作者以及视频、播客等内容生产者来说,文本直接生成音乐的模型更新意味着创作门槛与素材成本的进一步下降。

为什么重要

MiniMax以官方开源形式更新Music3,巩固其在音乐生成赛道的布局,文本转音乐能力有望降低内容创作者的素材生产成本。

微博邮件

MiniMaxMusicText-to-Audio
返回实时消息

附近消息

全部