郭震 AI公众号:郭震AI

实时 AI 消息

字节跳动发布Seedance 2.5:行业独家30秒视频原生直出,即梦AI已接入

字节跳动正式发布自研视频模型Seedance 2.5,「即梦AI」作为官方体验入口第一时间接入。新模型支持行业独有的30秒视频原生直出,并新增最长3分钟的超长视频生成模式、视频编辑、1秒级时间戳指令控制,以及绿幕/白模参考生成和Maya/Blender插件接入。

发布时间
字节跳动发布Seedance 2.5:行业独家30秒视频原生直出,即梦AI已接入
图源: seeddance.ai

字节跳动正式发布了自研视频模型Seedance 2.5,熟悉的「即梦AI」作为官方体验入口第一时间完成接入,用户在即梦AI官网(jimeng.jianying.com)即可直接上手体验。这次发布最核心的卖点,是行业独家的30秒视频原生直出。

在此之前,行业里常见的视频生成时长大多停留在5-15秒左右,创作者想要更长的内容,往往只能反复剪裁、拼接,被戏称为「赛博剪辑裁缝」。Seedance 2.5把单次生成时长直接拉到30秒,还新增了最长支持3分钟的超长视频生成模式,一致性和长镜头能力依旧在线。

视频编辑能力是这次的另一大升级。局部替换、细节修改、元素增加和删减都可以通过指令完成,哪里不满意改哪里;配合误差控制在1秒以内的精准时间戳指令,剧情控制更细、动作质量更稳、AI感更少。

面向专业生产场景,Seedance 2.5在参考生成上做了大幅加强:可同时参考最多50个素材,能直接参考绿幕素材和白模素材生成,还支持通过Maya/Blender插件直接调起生成。这意味着广告、游戏、影视行业的创作者不再需要先抠图或走完材质、灯光、渲染、后期全套流程。

量子位的实测覆盖了多种风格:赛博末日追逐短片、韦斯·安德森式喜剧片段、中式美学短片和太空科幻大片,30秒内完整呈现一段剧情,角色一致性、镜头衔接和画面质感都保持稳定,且均为原生直出。

编辑能力实测同样按指令执行:删掉指定画面和人物说话镜头、在广告最后1秒精确加入品牌字样,都顺利完成,连音效都踩在点上。作者直言,这一刻开始怀疑年费购买的剪辑软件还要不要续。

从Seedance 2.0到2.5,定位正在发生明显变化。如果说2.0带来的更多是视觉惊艳,那么这次模型正在从创意工具走向真正可进入生产链路的工具:更完整的叙事空间、更可控的编辑能力,以及视频延长、Maya/Blender插件、绿幕/白模参考,把影视级表达放进更轻、更快、更可控的生产链路。

作为全球头部的AI视频生成模型,Seedance 2.5正在从创意工具往真正可进入生产链路的生产力工具靠近。对创作者来说,最直接的变化是不再把大量时间耗在抽卡和补救上,而是把更多精力放回叙事、审美和创意判断。

为什么重要

Seedance 2.5把视频生成从「生成素材」推进到「直出成品」,配合3分钟长视频、编辑与绿幕/白模参考能力,正在把AI视频拉进影视、广告、游戏的真实生产流程,字节跳动在视频生成赛道的产品化优势进一步扩大。

微博邮件

ByteDanceSeedance 2.5Video Generation
返回实时消息

附近消息

全部

07/31 15:22

米哈游蔡浩宇AI创业生变:多项目停摆,近九成资源押向Agent

量子位报道,米哈游创始人蔡浩宇的AI公司Anuttacon近期频繁按下休止键:AI游戏《Whispers from the Star》终止后续开发,AI聊天应用AnuNeko宣布永久停运,视频模型LPM 1.0亦无下文。蔡浩宇已更新领英身份为“独立大模型与智能体开发者”,Anuttacon近九成资源转向LLM与Agent方向。

07/31 14:54

姚顺雨为腾讯混元AI4S招人:自研智能体Hyra攻克50年数学难题

量子位报道,姚顺雨亲自下场为腾讯混元AI for Science方向招人,并晒出一张科研成绩单:基于本月开源的Hy3模型(总参数295B、激活21B),自研智能体Hyra为加法组合学中困扰数学家约50年的开放问题给出完整答案,证明结果可无限逼近理论上限。混元强调这并非单纯暴力搜索——Hyra先用自然语言提出数学构造与论证,约24小时后找到论文核心思路,团队随后整理出完整证明并给出Lean 4形式化验证。

07/31 14:47

学习强国推出AI星伙社区:上线两周铺进68座城市

学习强国AI频道发起「AI星伙社区」并推出「AI超级卡」,上线仅两周成员已遍布68座城市,多地正自发组织线下活动。社区以一份8万余份问卷揭示的普通用户AI使用痛点为切入口,试图把AI普及从开发者圈层下沉到职场人和基层用户。

07/31 13:40

MiniMax发布全模态生成模型H3:支持15秒2K音视频,价格不到主流三分之一

MiniMax今日正式发布通用全模态生成模型MiniMax H3,首次实现文本、图像、视频、音频的统一理解与生成,最高支持15秒2K分辨率、带原生双声道的音视频输出。官方称其在2K分辨率下的每秒生成成本不到主流模型的1/3,并计划未来几天内在符合法律法规的前提下开放模型权重。