技术与生产

Seedance 2.5 把单次生成拉到 30 秒:真正的门槛从‘能不能生成’转向‘能不能管理连续镜头’

字节跳动 Seed 官方披露 30 秒单次音视频生成、扩展、多模态参考和按时间点编辑,Runway API 又给出竖屏 1080p、输入数量和按秒计费规则。更长输出会减少一部分拼接,却同时放大表演连续、参考权利、失败成本和版本管理;短漫剧团队需要把模型测试从漂亮片段升级成可复现的场景验收。

已证实
酷秀漫界编辑部2026年8月28日29 分钟2 个已登记来源修订 #1
字节跳动 Seedance 2.5 官方发布素材中的蓝色动态人物画面
字节跳动 Seedance 2.5 官方发布素材画面;正文同时提醒厂商精选示例不等于独立测试,项目使用前仍需以锁定资产、版本、次数和验收人完成重复验证,并保存未采用输出与修订记录 · 来源:ByteDance Seed - Introducing Seedance 2.5 · 用于新闻报道与评论,版权归原权利人

Seed 团队 7 月 31 日发布 Seedance 2.5,称模型可单次生成最长 30 秒音视频,并支持多轮扩展;官方示例强调一段内部可以出现建立、发展、转折和收束,而不只是把一个动作延长。8 月中旬,Runway API 更新又列出 Seedance 2.5 的 4 至 30 秒时长、1080p 竖屏规格和多种参考输入。这些都是官方能力与接口说明,不是独立制作成功率。

对短漫剧而言,30 秒接近一场完整的移动端戏:人物进入、建立目标、发生阻力、作出反应并留下下一步。十秒片段失败,可能只损失一个动作;三十秒在第十八秒出现脸部漂移、道具跳变或口型错位,前面已经可用的表演也可能一起报废。输出更长,叙事单位更完整,单次失败价值也更高。

因此评测不能只比较时长和清晰度。团队应给模型一组真实场景:两人对话、进出场、递交道具、多人遮挡、情绪变化、音乐与台词、跨镜延续,并记录在第几秒首次失真、哪些部分可局部修复、是否必须整段重生。只有把失败位置和修复成本写出来,30 秒才是生产能力,而不是发布会数字。

参考越多,控制越强,也越需要权利清单

官方文章称单次可输入最多 30 张图片、10 段视频和 10 段音频,用于人物、环境、动作、镜头和声音参考。Runway API 的具体计费与最低输入又提醒团队,参考不是一个抽象按钮,而是一组需要上传、编号、版本化和支付的资产。模型能够读取更多材料,不代表团队拥有把所有材料交给服务的权利。

生产前应为每个参考分配稳定 ID,记录来源、作者、授权、演员与声音同意、允许模型处理的范围、到期时间和对应角色或场景。剧照可能允许宣传却不允许训练或生成;临时音乐可能只能用于剪辑预览;演员试镜视频不应自动成为长期角色资产。参考进入请求前做权利门禁,比成片后追查某张脸来自哪里可靠得多。

更多参考还会产生冲突。人物照片要求一种发型,动作视频出现另一套服装,声音样本的情绪与剧情相反,场景图的光向与角色图不一致。团队要先写参考优先级和用途,而不是把所有素材堆进请求期待模型判断。真正的多模态控制,是人先建立资产关系,模型再执行;否则输入越多,结果越难解释。

按时间点编辑有价值,但不能把模型当成非线性剪辑软件

Seedance 2.5 官方说明可通过时间点控制叙事、视角、运动和节奏,也能对片段中的人物、动作或情节做定向修改。对短剧,这是比整段重生更接近真实后期的能力:第五秒换背景、十二秒修动作、二十秒调整镜头,理论上可以保留其余表演。但官方也承认复杂运动与多主体交互仍有改进空间。

团队要区分三类修改:不改变人物与时空的修补、改变镜头但保留表演的重构、改变剧情因果的再创作。第一类最适合局部编辑,第二类必须检查前后光线和运动,第三类往往应回到剧本和剪辑。把所有问题都交给提示词修改,会让版本越来越难追踪,甚至在解决一个瑕疵时破坏另一处连续性。

每次编辑应产生新任务和差异记录:基于哪个输出、修改哪个时间区间、保留哪些对象、提示词和参考是什么、谁验收、影响哪些下游母版。原始输出不得覆盖。若局部编辑连续失败两次,应触发人工判断:换输入、缩短区间、进入传统后期或重新拍摄。可回滚比无限尝试更接近专业工具。

竖屏 1080p 解决画布,不解决竖屏导演

Runway 文档列出的 1080×1920 输出使竖屏交付不必依赖横版裁切,这是明确的生产便利。但画布正确并不保证人物眼神、手部、字幕、平台按钮和双人关系正确。竖屏场景需要从输入阶段就决定主体距离、动作路径、上下空间和安全区,否则更高分辨率只会更清楚地呈现错误。

测试提示应使用真实发布框架而非只有‘9:16 cinematic’。团队把标题、字幕、互动按钮和平台遮挡叠加到预览上,检查脸和关键道具是否被覆盖;在 390 像素宽手机上看动作是否可读;再在平板和桌面竖向播放器里检查背景是否过空。模型输出是素材,最终构图必须在实际界面验收。

双人和多人镜头尤其需要位置规则。谁在上半部、谁可被切到边缘、视线是否成立、人物交叉时身份是否漂移、对话反应是否有足够停留,都要成为镜头门槛。若模型无法稳定完成,就拆成更短镜头或采用实拍/合成。选择镜头语言不能由‘模型最长能做多少秒’倒推。

按秒计费必须乘上失败率,而不是只乘成片时长

Runway API 更新列出 Seedance 2.5 的输出每秒 68 credits、输入或参考处理每秒 34 credits,并设定最低消耗。接口价格让团队能够估算请求,却不能直接得到合格镜头成本。一个 30 秒请求若在后半段失败,重新生成三次、做两次局部编辑并由剪辑师处理,最终成本与标价相差很大。

成本表应记录每次请求的模型版本、长度、参考数量、排队、成功与否、采用区间、人工操作、后期修复和废弃原因。项目比较的是每个合格镜头或合格分钟的总成本,而不是模型单价。人物一致性镜头、环境建立、特效转场和广告素材的失败代价不同,不能用一个平均成功率覆盖。

更长生成可能减少剪辑拼接,却会增加一次失败丢失的素材量。团队可以按场景复杂度决定长度:稳定环境或连续动作尝试长段,多人对白与关键表演先用短段验证。价格策略最终应服务叙事风险,而不是为了‘用满 30 秒’让每次请求变成更昂贵的赌注。

扩展功能最难的不是接上画面,而是保持人物经历

官方展示多轮扩展可继续既有主体、环境和节奏。短剧团队真正需要验证的是人物经历是否延续:上一段受伤的手是否仍受伤,刚刚得到的信息是否改变表演,道具在哪只手,灯光和环境声是否衔接,音乐是否在正确拍点继续。只保持脸和服装,不足以形成连续叙事。

每次扩展应带入结构化 shot state:角色外观、身体状态、情绪、知识、位置、道具、光线、环境、声音、镜头和上一段末帧。提示词负责当前动作,状态表负责不可丢失的事实。生成后按相同字段验收,把变化区分为剧情要求、可接受波动和必须修复的错误。

长到数分钟的内容还需要剪辑呼吸。模型能连续延长,不等于观众应该一直看一个连续运镜。对话反应、空间重建、节奏停顿和集尾钩子仍要由导演与剪辑决定。扩展最好被理解为保留上下文的素材生成方式,而不是自动完成一整集的按钮。

厂商示例证明能力存在,不证明你的角色可交付

Seed 官方页面展示演唱会、京剧、绿幕、动画和工业场景,帮助用户理解能力范围;它们由厂商选择,并不提供全部失败尝试、提示迭代、人工处理或统一评测。行业媒体可以引用这些示例说明公开能力,却不能把精选结果写成普遍成功率,更不能推断某个短剧角色会达到相同质量。

项目测试应使用自己的权利清楚资产和盲验。为同一场景准备锁定输入、提示、版本和验收表,至少重复多次;由导演、摄影、声音、后期和制片分别记录问题,而不是只让模型操作员选最好的一条。保留失败样本,才能知道人物、动作、物理、音画和文字错误怎样出现。

跨模型比较还要求相同资产、时长、分辨率、版本、预算和评审。若一个模型用十次挑选、另一个只跑一次,结果没有可比性。酷秀漫界不会据厂商演示制作综合排行榜;更有用的是发布可复现测试方法、适合镜头、失败边界和版本日期,让团队按自己的故事权重选择。

模型进入工作流的标志,是失败也能被管理

团队可以把 Seedance 2.5 放入三层门禁。第一层验证访问、版本、输入权利、时长和费用;第二层验证镜头技术,包括画幅、人物、动作、音画、文字和连续;第三层验证故事,包括目标、关系、表演、节奏和集尾。只有三层都通过,镜头才进入可用库。失败结果按原因隔离,不与已批准素材混放。

每个项目还要设置版本冻结。厂商更新可能改善能力,也可能改变构图、颜色和提示响应;已经生产的季不能在没有回归测试时自动切换。团队保留模型版本、API 参数、参考哈希、输出和验收,在升级前用代表性镜头重跑。若差异影响角色或母版,就为新版本建立分支,而不是覆盖旧季。

30 秒、多参考和局部编辑确实让模型更接近制作工具,但专业价值来自系统而不是按钮。谁准备资产、谁决定镜头、谁批准表演、谁承担失败、谁保存权利和版本,这些问题比宣传片更决定项目成败。生成能力越强,管理责任越不能被提示词掩盖。

一场 30 秒试拍,应该留下怎样的生产证据

团队可以选择一场真正会出现在项目里的 30 秒戏,而不是为模型量身定做的展示:两名固定角色在厨房争执,其中一人递出一张照片,另一人先否认再改变决定,背景有水汽和实景声,结尾必须落到手机画幅可读的反应。剧本锁定每五秒的目标、动作、台词和道具状态,同时准备角色正侧面、服装、场景、声音与动作参考。所有资产先通过权利和技术检查。

第一轮只测试基础生成,固定模型、版本、分辨率、长度、随机性和参考,不进行无限挑选。至少运行多次,记录每次首个失败时间、人物、手、照片、口型、声音、光线和空间。评审者独立打标而不是先讨论,避免最会操作模型的人影响所有判断。结果不是一个平均美感分,而是一张失败分布和可采用区间图。

第二轮选择一条接近可用的结果做局部编辑。只改一个时间区间和一个问题,例如照片在第十二秒变形,其他人物、声音与镜头必须保持;再检查编辑是否产生新漂移。若模型修复成功,保存父子任务、提示与差异;若失败,改用合成或传统后期估算修复时长。局部编辑的价值由保留多少已批准表演决定,而不是按钮是否返回结果。

第三轮把输出放进真实后期和发行。剪辑加入前后镜头、字幕、音乐与响度,导出竖屏母版,再经过目标平台压缩并在低端手机、主流手机和平板查看。很多生成瑕疵在单独播放器里不明显,接入连续戏后会破坏眼神、节奏或色彩;反过来,一些局部问题可能在真实尺寸下无需修复。验收对象必须是观众将看到的版本。

最终报告列出总请求、生成秒数、采用秒数、人工时长、后期修复、队列、费用和权利资产数量,并说明哪些结论仅适用于当前版本与场景。团队据此决定模型用于完整场景、局部镜头、预演还是不进入本项目。一次试拍的价值不是证明厂商宣传对错,而是让下一次预算、镜头设计和风险选择有证据可用。

制作、发行和研究人员看到的是同一模型的三种风险

制作团队最关心镜头是否能进入时间线:人物、动作、声音、画幅和节奏可否通过,失败能否局部修复,等待与返工是否落在计划内。它需要镜头级测试、版本冻结和成本回写。若官方再增加功能,制作不能因为新版本更强就自动切换,必须用本项目角色和场景回归。

发行团队关心的是母版和权利:参考是否允许用于目标地区,声音与人物是否得到多语言和生成授权,AI 标识怎样保留,平台压缩后效果是否成立,修改由谁承担。一个在创作工具里漂亮的 30 秒片段,若没有来源、版本和批准记录,可能无法进入采购、广告或监管要求更高的渠道。

研究与投资人员则应区分公开能力、厂商示例和生产证据。30 秒、输入数量、分辨率和 API 价格可以由官方来源确认;稳定率、成本下降和商业回报必须由对齐测试或项目数据支持。没有共同资产和方法,就不能把厂商 A 与厂商 B 排出一个综合名次,也不能把产品上线写成行业平均效率。

三种视角应共享同一个事实底座:模型与接口版本、访问地区、输入输出、价格日期、官方限制、测试资产、采用结果、权利和修订。页面可以按角色突出不同章节,却不能复制出互相矛盾的记录。模型资源真正有用,不是字段越多,而是每个角色能找到与自己决定有关、且知道证据来自哪里的内容。

当访问状态、价格或限制发生变化时,资源页必须保留观察日期和旧版本,而不是让昨天的项目判断在今天失去依据,也不能用新页面静默改写已经发生的采购与制作决定。

Seedance 2.5 的意义不应被缩成‘单次 30 秒’。更长音视频、更多参考、局部编辑和竖屏 1080p 让团队有机会减少切片与拼接,但也让一次失败损失更多素材,并扩大参考权利、角色状态、音画连续、成本和版本治理。短漫剧团队应以真实场景建立重复测试,把请求单价换算为合格镜头成本,并为每次扩展和编辑保存父版本、时间区间与验收。模型进入专业生产的标准,不是它偶尔生成一条漂亮长镜头,而是成功可以复现、失败可以定位、版本可以回滚、权利可以解释。团队还要把官方能力、精选演示和自己的生产结果分开记录:官方参数回答‘产品公开支持什么’,对齐测试回答‘这个项目能稳定完成什么’,上线回执才回答‘观众与平台最终接受什么’。任何一层都不能替代下一层。模型更新时,代表性角色、对白、动作和母版必须重新回归,确保提高某项能力没有破坏已经批准的镜头语言与交付。每次升级还应保留可比较的新旧回执,避免把‘更新成功’误解成‘项目自动变好’。