实时 AI 消息
Google 将 Lyria 3.5 带入 Gemini 应用与 API,AI 音乐向所有人开放
Google 已将最新一代音乐生成模型 Lyria 3.5 带入 Gemini 应用与 API,AI 音乐创作能力正式向所有用户开放。普通用户可以直接在 Gemini 中生成音乐,开发者也能通过 API 把同样的能力接入自有产品。
Google 已将最新一代音乐生成模型 Lyria 3.5 带入 Gemini 应用与 API,相关报道将其概括为“AI 音乐向所有人开放”。这是 Lyria 系列在生成式音乐能力上的一次关键落地:从面向特定创作场景的模型,走向 Gemini 这一大众入口。
此次更新覆盖两个层面:一是 Gemini 应用内的直接使用,二是面向开发者的 API 接入。换句话说,普通用户可以在对话界面中完成音乐创作,开发者也能把同样的生成能力嵌入自己的产品,而不必从零搭建音乐生成系统。
Lyria 是 Google 面向音乐生成打造的模型系列,核心是把用户的文本描述转化为音乐内容。3.5 版本进入 Gemini 应用与 API,延续了 Google 将生成式模型系统性地接入主力产品的做法,让音乐生成不再局限于独立的创作工具。
对普通用户而言,AI 音乐创作的门槛进一步降低,对话式的描述就能成为一首作品的起点。对开发者与企业来说,API 形式意味着内容生产、多媒体应用等场景都有机会直接调用这一能力,生成式音乐从“尝鲜功能”走向“可调用能力”的步伐明显加快。
在 AI 音乐赛道,Suno、Udio 等产品已经让“文本生成音乐”被广泛认知,但 Google 没有选择再做一款独立应用,而是把能力放进现成的入口:把 Lyria 3.5 放进 Gemini,意味着 Google 将生成式音乐直接推向了体量庞大的助手用户群,AI 音乐赛道的竞争将随之升温。
后续看点在于开放的实际节奏与边界:Gemini 应用中的音乐生成入口会向哪些用户开放、API 的可用性与使用条件如何,以及生成质量在不同语言和风格上的表现,都还有待 Google 进一步公布。对音乐行业而言,生成式音乐从专业工具走向默认能力,这一步的影响值得持续观察。
为什么重要
生成式音乐由此获得 Gemini 这一大众入口,将从尝鲜工具加速走向默认能力;Suno、Udio 等独立服务将面临来自平台级产品的直接竞争。
附近消息
全部09/05 19:13
开源 CoDock 亮相:一个桌面工作台聚合管理 9+ AI 编程 Agent 80aj.com
据 news.google.com 消息,开源 CoDock 亮相:一个桌面工作台聚合管理 9+ AI 编程 Agent 80aj.com。开源 CoDock 亮相:一个桌面工作台聚合管理 9+ AI 编程 Agent 80aj.com
09/05 12:24
陶哲轩吐槽GPT-6孪生素数新突破:令人无语的一幕
菲尔兹奖得主陶哲轩就GPT-6在孪生素数猜想上的新进展公开发文吐槽:GPT-6 Astra发布后即以Lean形式化证明把连续素数间距上界从246推到186,Anthropic与Axiom的模型也同期给出188和212的成绩。陶哲轩同时发出AI告警,认为AI解题太快、过程太黑盒,可能掩盖数学研究中宝贵的失败,甚至让AI对数学的影响转为净负面。
09/05 12:18
训练完就“退场”:光象科技联合清华发布物理原生世界模型Phi-WM 1.0
具身智能公司光象科技联合清华大学李升波教授课题组,发布第一代物理原生世界模型Phi-WM 1.0(代号ActEffect):受控世界模型只在训练阶段检查动作后果并优化策略,训练完成即退出部署链路,机器人执行任务时无需在线展开未来预测。该模型在LIBERO、LIBERO-PLUS和RoboCasa-GR1三项基准上分别取得98.8%、80.3%与67.5%的平均成功率,公司正将其推向汽车工厂焊接上下料、移动质检等真实工位。
09/05 10:55
GPT-6 Astra 登陆 Pro、Enterprise 和 API,Anthropic 同时重置 Claude 使用上限
OpenAI 将 GPT-6 Astra 的访问范围扩大至 Pro、Enterprise 与 API 渠道,Anthropic 同期重置了 Claude 的使用上限,两家头部实验室几乎同时放宽旗舰模型的获取门槛。对企业与开发者而言,旗舰模型的可获得性正在成为比跑分更现实的竞争维度。