郭震 AI公众号:郭震AI

实时 AI 消息

通义千问发布 Qwen-Audio-3.1 音频模型

据新浪财经 9 月 23 日的 AI 行业动态汇总,通义千问发布 Qwen-Audio-3.1,这是千问音频模型系列的一次版本迭代。目前公开信息只确认了发布动作,参数规模、支持语言与开放方式等细节尚未披露。

发布时间
通义千问发布 Qwen-Audio-3.1 音频模型
图源: chat.qwen.ai

新浪财经 9 月 23 日的 AI 行业动态汇总中出现一条信息:千问发布 Qwen-Audio-3.1。版本号显示,这是千问音频模型系列的一次迭代更新。

候选信息本身只保留了发布的动作,没有给出参数规模、训练数据、支持语言、开放许可或接口细节,因此目前能确认的是发布了新的音频模型这件事。

音频模型处在人机交互的关键位置:语音是使用门槛最低的输入方式之一,理解声音与生成声音的能力,直接影响语音助手、客服系统和无障碍工具的实际体验。

对开发者和企业来说,值得关注的不是版本号,而是这类模型能否以可接受的价格与延迟接入现有语音链路,并在噪声环境、口音和长音频等真实条件下保持稳定。

后续观察点包括官方模型卡与许可条款、第三方基准与真实场景评测、推理成本与延迟,以及是否提供不同规模的版本供本地或云端部署。

在官方细节补齐之前,Qwen-Audio-3.1 更像一个方向性信号:音频与语音正在成为多模态模型竞争中被持续加码的一环。

为什么重要

音频模型持续迭代,意味着语音交互链路的选型窗口还在打开,企业的比较重点会落在真实场景下的稳定性与单位调用成本上。

微博邮件

QwenAlibabaAudio Model
返回实时消息

附近消息

全部

09/23 20:39

深蓝汽车与火山引擎官宣合作,豆包大模型首搭深蓝S07 AI激光版,9月28日上市

深蓝汽车与火山引擎正式官宣合作,豆包大模型将首次搭载于深蓝 S07 AI 激光版,该车型定于 9 月 28 日上市。这次合作把字节跳动体系的大模型能力装进量产车型,也让大模型上车从发布会的演示环节,变成按车型、按上市日期推进的交付项目。

09/23 20:09

OpenAI 将 Daybreak 网络防御计划扩展至乌克兰政府

OpenAI 宣布将其 Daybreak 计划的使用权限扩展给乌克兰政府,用于支持民用基础设施的网络防御。公告未说明具体技术能力、覆盖系统与合作期限,BBC 等媒体的报道也集中在同一核心信息上。

09/23 20:00

Ema完成7700万美元融资,累计1.4亿美元,企业客户超50家

企业 AI 公司 Ema 完成 7700 万美元新一轮融资,累计融资额达到 1.4 亿美元,目前拥有 50 多家企业客户,名单中包括 Google 和 Microsoft。TechCrunch 把这一轮融资放在 AI 开始吃进企业软件与服务预算的背景下解读,认为采购重心正在从工具转向能够直接完成工作的智能体。

09/23 19:54

OpenAI 寻求对AI安全防护与重大事件进行独立审查

据 citybiz 报道,OpenAI 正在寻求对其AI安全防护机制以及重大事件进行独立审查,回应的正是前沿模型风险治理中「谁来验证」的问题。这一动作把安全评估从内部流程推向更具外部监督色彩的框架。