先锁定官方能力边界,不先写结论
Google 的公开说明提供了测试起点:最长 10 秒历史上下文、每次续写 10 秒、累计最多 40 秒、首尾帧、360p 预览和 4K 放大。文档还明确产品通过不同开发与订阅入口提供。测试表的第一行必须保存访问日期、入口、模型标识和实际可用参数;同一个产品名在不同账户或时间上可能对应不同功能。
官方示例可以帮助团队理解交互方式,却不能成为项目样本。测试应选择一场真正困难但规模可控的戏:两个角色在固定空间完成一段有台词、有道具交接、有视线变化和结尾动作的 20 至 30 秒场景。它同时暴露身份、空间、声音、动作和连续问题,比风景空镜更能回答短漫剧生产价值。
第一门是便宜地否定,不是便宜地承诺
360p 预览只负责三个决定:构图方向是否正确、动作路径是否成立、台词和音乐节奏是否值得继续。它不负责皮肤纹理、发丝、细字、压缩边缘或最终字幕安全。审片人必须把‘方向通过’与‘镜头通过’分开,防止团队为了节省时间把预览直接当成画质承诺。
每个方向最多保留三次预览,并写明拒绝原因。超过次数仍不能建立正确运动,就回到首尾帧、参考素材或分镜,而不是无限抽卡。预览的价值来自尽早停止错误路线;如果团队只保存最好的一次,就无法判断模型是否减少了试错。
续写要按接缝验收,首尾帧要按中段验收
续写测试在原片最后两秒、生成后的前两秒和后续十秒分别检查。接缝处要看身体速度、眼神、声音环境、光向和道具位置;后段再看人物身份、空间方向与剧情指令是否继续成立。累计 40 秒并不要求每个项目都做满,关键台词或多人动作在 20 秒已经不稳定时,应拆镜而不是追求产品上限。
首尾帧测试则反过来:两端本来就是输入,最容易显得正确;真正需要审的是中间如何到达。团队逐帧标记异常身体、遮挡、道具变形、镜头加速度和突然的光线跳变。如果中段无法通过,漂亮的开始和结尾不能挽救镜头。
放大通过之后,才轮到母版问题
4K 验收比较的不是‘更清楚’,而是放大是否制造新的边缘、皮肤、纹理、文字和抖动问题。通过后仍需进入竖屏版位、安全区、字幕、对白、响度、AI 标识、内容凭证、地区权利和压缩复测。模型输出与发行母版之间必须有独立版本号,任何平台返修都不能覆盖原始结果。
最后用合格镜头成本决定是否采用:把预览、正式生成、失败候选、等待、人工审片、后期修复和母版处理全部计入,再除以实际采用秒数。只有这一数字能与实拍、合成或其他模型路线比较。