30 秒视频直出不是参数升级,是创作方式的切换。
作者|张勇毅
编辑|靖宇
5 个月前,我们在体验 Seedance 2.0 那篇「AI 上新」的时候,提到了一个关键判断——「AI 视频第一阶段的比赛,结束了」。
看完之后,我一直在想一个问题:第二阶段是什么?第一阶段比的是谁能生成更好看的画面、更连贯的动作、更稳定的输出。Seedance 2.0 把这条线拉得很高。但「好看」解决了之后呢?
7 月 31 日,字节正式发布了 Seedance 2.5,同步上线即梦、豆包专业版、扣子和小云雀。
我立即重新打开我已经吃灰许久的即梦账号,花重金充值了会员,花了一个下午把它从头到尾跑了一遍,现在可以回答那个问题了:
第二阶段比的不是画面,是叙事。
01
从 15 秒到 30 秒
先说最直观的变化。Seedance 2.0 单次生成上限是 15 秒,2.5 直接翻倍到了 30 秒。
这个数字看起来只是参数升级,但用过就知道不是。15 秒能做什么?一个镜头,一个动作,一个表情。你可以做出一个很好看的片段,但它只是片段。30 秒能做什么?一个完整的情绪弧线——有起承转合,有铺垫,有高潮,有收束。
实测为例。
提示词:
30 秒电影级短片,黄昏光线。一个科技记者坐在咖啡馆窗边,盯着笔记本电脑屏幕上的空白文档,表情焦虑。他喝了一口咖啡,放下杯子,开始敲键盘,起初很慢,然后越来越快。窗外的光线从暖黄变成深蓝。最后他停下来,盯着屏幕露出一个微笑,合上笔记本。镜头从他的侧脸慢慢拉远,穿过玻璃窗,看到整条街的灯亮起来了。风格克制、安静、有呼吸感,像是枝裕和的日常叙事。钢琴为主的轻配乐。
在这 30 秒里情绪层层递进,BGM 卡着节奏推上去。这在 2.0 时代是不可想象的,那时候想要一个满意的结果,抽卡十几次是常态。
更关键的是延长能力。
30 秒只是单次原生生成的上限,通过即梦的延长功能,可以把一段视频续到 3 分钟。内测期间有人做过测试:一个女孩走进便利店、拧开汽水瓶盖、便利店开始融化变成荧光海——整个 3 分钟的叙事里,女孩的驼色大衣和马尾辫没有任何跳变。
再看下面这个例子。
提示词:
20 秒温情短片,室内暖光。一个年轻人推开家门,玄关灯亮,他看到餐桌上摆好了饭菜,厨房里妈妈正在炒最后一道菜。妈妈听到声音回头看了一眼,没说话,笑了一下,继续炒菜。年轻人放下背包,走到厨房门口靠着门框站了一会儿,表情从疲惫变成柔软。固定机位,不运镜,用画面纵深表现两人的距离感。没有对白,只有炒菜的声音和油烟机的嗡嗡声。2000 年代家庭剧质感,暖黄色调,轻微胶片颗粒。
这意味着什么?AI 视频不再是做「素材」的工具了。它开始能讲故事。
此外,Seedance 2.0 支持最多 9 张图片、3 段视频、3 段音频作为参考素材。2.5 把这个上限拉到了 50 个全模态参考——图片、视频、音频、文字,混着来。
50 这个数字有多夸张?知乎上有人评论说,「生图天花板的模型也就十来个参考还会崩脸,50 个参考都不崩的话那是天顶星科技」。
提示词:
一镜到底,机场航站楼内部。镜头从候机大厅的落地玻璃窗开始,窗外一架宽体客机正在缓慢滑行。镜头向右平移,经过几排座椅上的等待旅客,穿过免税店的玻璃门,沿着通道持续推进,最后到达登机口,一个穿制服的地勤人员正在扫描登机牌。全程手持跟拍质感,画面微晃,自然光为主,有广播背景音和行李轮拖行的环境声。纪录片风格,像 NHK 的日常观察镜头。
这个能力主要面向两类需求。一类是品牌内容——你需要在一条视频里保持多个演员形象一致、视觉系统统一、场景美术风格稳定。以前这需要逐帧检查、反复重生成,现在一次性把参考素材喂进去就行。
另一类是影视前期制作的概念验证——导演可以把分镜、角色设定、参考镜头、背景音乐一股脑丢进去,直接看效果。
提示词:
让这张照片动起来,保持原图的光线和氛围,15 秒。
同步新增的还有白模和绿幕参考能力。即梦现在支持 Maya 和 Blender 插件唤起,可以用 3D 白模做预演,然后让 Seedance 2.5 把它「填充」成实拍质感的画面。这等于把 AI 视频生成直接接进了专业影视的工业管线。
此外,2.0 时代的一个众所周知的痛点是:生成了一段 90 分的视频,但有一个细节不对——比如背景里有个不该出现的元素,或者商品颜色偏了。你的选项只有两个:要么接受瑕疵,要么整段重新生成,赌下一次能不能更好。
2.5 加了局部编辑。你可以框选画面的某个区域,只改那一块,其他部分保持不动。背景不对?换背景。商品颜色偏了?改颜色。人物表情不到位?重新生成那张脸。
这个功能的意义不在于技术本身,在于它改变了创作者和 AI 之间的协作方式。以前是「生成—判断—重来」的循环,现在变成了「生成—微调—完成」的流程。后者的效率高一个量级。
还有一个容易被忽略的升级:文字渲染。2.0 生成的视频里如果出现文字,大概率会变成乱码。2.5 在这方面好了很多。
用一张化学方程式的截图让它生成教学视频,方程式被原封不动地搬到了对应的实验现象处,没有崩。这对教育类内容和商业广告来说是刚需——你终于可以在 AI 视频里放品牌名和 slogan 了。
提示词:
10 秒商业短片。一家精品咖啡店的门面特写,玻璃门上贴着白色字体的店名「Mountain Fog Coffee 山雾咖啡」。镜头从门外慢慢推进,透过玻璃可以看到里面的菜单板上写着「今日特调 ¥38」。自然光,清晨氛围,略带雾气。
提示词:
15 秒科技发布会片段。一块巨大的 LED 屏幕上依次显示三行文字:第一行「Seedance 2.5」,停留 3 秒后切换为第二行「30 秒 · 原生直出」,再停留 3 秒切换为第三行「即梦 AI」。台下观众席有人举着手机拍摄,现场灯光偏暗,LED 屏幕是主光源。发布会氛围,有轻微的现场环境音。
02
不只是模型升级
如果你只看参数——30 秒、50 个参考、4K、局部编辑——你会觉得这是一次常规的版本迭代。但把它放在更大的图景里看,这次更新的意义其实在参数之外。
第一个信号是产品落地的速度。Seedance 2.5 发布当天,徐工集团、小鹏汽车、灵初智能等企业就宣布了合作。
徐工用它做工业操作培训和工序 SOP 视频,小鹏把它接进了内部的 AI 设计平台。这些不是「未来可能的应用场景」,是正在发生的事。
第二个信号是豆包专业版的联动。2.5 不只是即梦里的一个模型选项——它被接进了豆包专业版的「创意视频」技能。你可以先让豆包的 Seedream 5.0 Pro 生成一张海报,然后直接在同一个对话里让 Seedance 2.5 把它变成 30 秒的宣传片。从图到视频,一个对话框搞定。
这是 Agent 调用能力,不是简单的模型接入。
第三个信号是市场格局。有行业数据显示,按日消耗占比计算,Seedance 系列已经占据了国内 AI 视频市场超过八成的份额,可灵约占 14%,万相约占 4%。在这种市场集中度下推出大版本更新,字节的意图很明确——不给对手留追赶窗口。
能力升级说完了,说说钱的事。
无论是抽卡还是规模化制作,这都可能是很多人最关心的部分:即梦的标准会员每月 239 元,到账 2210 积分。生成一条 30 秒 720P 视频,单次消耗 780 积分。算一下:一条 30 秒的视频,成本大约 84 元。一个月的积分满打满算只够生成不到 3 条。
这还是每次一抽就满意的理想情况。实际使用中你大概率需要跑 2-3 次才能出一个真正能用的结果。也就是说,如果你想做一条满意的 30 秒成片,实际成本可能奔着两三百去了。
一个月的积分额度,认真做的话,可能就只够够产出一条。
虽然即梦目前有限时折扣,积分消耗最高打到 5.4 折,算下来一条大约 45 元,月配额能撑到 5 条左右。但折扣窗口不会一直在,按原价算的话,Seedance 2.5 对个人创作者来说还不算便宜。
当然,换一个角度想,以前想做一条 30 秒、有完整叙事弧线、有运镜有 BGM 的视频短片,找人拍摄加后期的报价至少四位数起步。
84 元做出来的东西如果真能直接用,性价比其实并不差。问题只在于:你得是一个真的「有活要干」的人,而不是随便玩玩——随便玩玩的话,这个价格会让你在每次按下生成按钮之前都犹豫一下。
但 Seedance 2.5 一个下午带给我的惊喜,仍然会有有种让我物超所值的感觉;因为这让我想起了 5 个月前我体验 Seedance 2.0 的时候,看到有人用一段话评价它:「当工具强大到一定程度,它就从你思考的对象变成了你思考的背景。你不会去想笔好不好用,你只会想我要写什么。」
用完 2.5,我觉得这句话需要更新一下。
Seedance 2.0 让你不再想「AI 能不能做到」;Seedance 2.5 开始让你想「我要讲一个什么样的故事」——而且是一个完整的故事,不是一个片段。30 秒的原生时长,3 分钟的延长能力,50 个参考素材的可控性,加上局部编辑的精修能力,这些加在一起,让 AI 视频第一次有了「叙事工具」的样子。
Seed 团队在发布文章里写了一句值得注意的话:「用户对视频创作模型的期待正在从『生成一个片段』走向『完成一段创作』。」
这句话精准地描述了 AI 视频正在经历的转折——从玩具变成工具,从素材变成作品。
Seedance 2.5 目前已经在即梦和豆包专业版上线,即梦会员可以直接使用,限时积分消耗最高 5.4 折。API 将在近期通过火山引擎面向企业开放。
如果你之前用过 Seedance 2.0 觉得「也就那样」,这次建议重新试一下。30 秒和 15 秒之间的差距,远比数字看起来的大。
*头图来源:即梦 AI