实时 AI 消息
阿里巴巴发布Wan3.0:支持30秒视频生成与多模态输入
据Pokde.Net报道,阿里巴巴发布通义万相Wan3.0,支持最长30秒的视频生成并引入多模态输入。长时长生成与多模态控制让该模型在视频生成赛道中更具竞争力,也进一步加剧了行业竞争。

据Pokde.Net报道,阿里巴巴发布了通义万相Wan3.0,支持生成最长30秒的视频,并加入多模态输入能力。
与以往的视频生成模型相比,30秒的生成时长明显延长,意味着模型可以覆盖更完整的叙事片段,而不仅仅是短视频镜头。
多模态输入则让用户可以通过图像、文字等多种方式共同控制视频生成,提升创作的自由度和一致性。
这是阿里巴巴在视频生成赛道的又一次重要升级,此前通义万相系列已在开源社区积累了不少用户,新版本延续了阿里在多模态大模型上的布局。
在视频生成竞争日益激烈的当下,长时长生成与多模态控制正是各家模型比拼的关键方向,Wan3.0的发布将加剧这一领域的竞争。
后续看点:Wan3.0是否会开源、具体的评测表现,以及它在电商、营销等场景中的落地应用。
为什么重要
Wan3.0将视频生成时长提升至30秒并支持多模态输入,有望推动视频生成在电商、营销等场景的规模化应用。
附近消息
全部08/12 00:47
Databricks收购Electric:为每个AI智能体配备专属Postgres数据库
The New Stack报道,Databricks已收购数据库初创公司Electric,计划为每个AI智能体提供独立的Postgres数据库。此举将数据库能力嵌入AI代理基础设施,降低企业构建与运行AI代理的门槛。
08/12 00:48
报道:Nvidia正打造1万亿参数Nemotron 4,对标开源AI模型
据The Information报道,Nvidia正在开发拥有1万亿参数的Nemotron 4模型,目标是与现有的开源AI模型竞争。这将是Nvidia开源模型路线的重要升级,也意味着芯片巨头正在模型层加大投入,以进一步巩固其AI生态。
08/12 01:00
谷歌医疗AI系统AMIE首次演示实时临床视频问诊能力
谷歌在最新研究中展示其医疗AI系统AMIE的实时临床视频问诊能力,这是同类研究中的首次。该系统在模拟问诊场景中与患者进行实时视频交流,标志着医疗AI从文本对话向多模态临床交互迈出重要一步。
08/12 00:25
TechCrunch:Anthropic未发布模型在黎曼猜想上取得超预期进展
TechCrunch报道称,Anthropic一个尚未发布的模型在黎曼猜想这一数学难题上取得了超出预期的进展,但距离真正解决仍有很大距离。这一信号显示前沿模型的数学推理能力仍在快速提升,引发外界对模型何时正式发布的关注。