Seedance 2 Mini 参考转视频检查清单
一份面向低成本首轮测试的实操清单:在真实运行时限制内使用 Seedance 2 Mini 的图片、视频和音频参考,并判断何时该升级到更高规格模型。

如果你只想要一句直接结论:当目标是低成本验证,而不是一次做出最终成片时,就先用 Seedance 2 Mini。还在整理素材时,先回到 China Video AI 首页。准备测试时,再打开预选了 Seedance 2 Mini 的工作区,只带最小可用参考包跑一段短片。
这篇文章讨论的是 Mini 的判断与复盘循环。如果你的目标已经是完整产品广告序列,下一步可以看相关的一张图片制作 AI 产品广告指南。想同时比较站内其他路线,可以再对照中文 AI 视频模型总览和China Seedance 页面。

简短结论:Mini 适合受控首轮测试
当你的主体明确、镜头目标单一,而且确实需要把第一次尝试成本压低时,Seedance 2 Mini 才最有价值。真正该问的问题不是“Mini 强不强”,而是“这一组参考图、参考动作和提示词,能不能先用一次便宜测试回答最关键的问题”。如果答案是能,Mini 就合适;如果一开始就需要复杂编排、更高输出预期或长时间反复返工,Mini 往往不是最好的第一步。
很多被归咎于模型的失败,其实是素材打包失败。参考图不清楚,动作参考过长,音频参考同时想解决节奏和情绪,提示词又在一次重试里同时改三件事。这些时候,直接切到更贵模型通常只是把问题藏起来,而不是解决问题。
最好的 Mini 使用方式,是让每次运行只回答一个窄问题:
- 主体能否保持一致?
- 动作参考是否足够清楚?
- 这一组参考包能否安全撑过一段短片?
只要 Mini 能便宜地回答这些问题,它就已经完成任务了。
1. 在本站里,“参考转视频”到底是什么意思
在 China Video AI 里,Seedance 不是一个模糊的“支持参考素材”开关。当前运行时里有明确模式和硬限制。模型族支持 text-to-video、image-to-video、first-last-frame 和 advanced-reference。在现在这套逻辑中,advanced-reference 不是营销词;当你添加参考图片、参考视频或参考音频时,请求逻辑会把这次运行按多模态参考场景处理。
这很重要,因为很多人会默认所有图片转视频请求都一样。实际上,纯图片转视频和同时携带动作或音频参考的多模态请求并不等价。真正的工作流问题不是“是不是要把所有素材都传进去”,而是“什么样的最小参考集,已经足够回答这个镜头”。
如果你只需要锁定主体身份,就尽量保持接近单图主导的请求。如果你需要借一个样片动作节奏,就只带一段短参考视频。只有在视觉包已经稳定、但时序仍不够明确时,再加入一段短音频参考。这样一旦失败,你知道该怪哪一层。
参考包顺序:
1. 一张强主图,先锁定主体
2. 只有动作不清楚时,再加一段短动作参考
3. 只有节奏仍未解决时,再加一段短音频参考
2. 真正应该围绕哪些 Mini 限制来设计
实操检查清单必须先从运行时限制出发,因为它们决定了什么样的提示词和素材包是合理的。当前 China Video AI 代码里,非 2.5 的 Seedance 2 系列参考流程支持最多 9 张参考图、3 段参考视频、3 段参考音频,总数不超过 12 个参考素材。定长参考素材通常要落在 2 到 15 秒之间。对 Mini 而言,当前输出路径主要是 480p 和 720p,而不是拿它当 4K 工作流。
这也是为什么清单比空泛对比更有用。错误的读法是看到“支持参考素材”就以为参考越多控制越强。实际情况通常相反:参考过多会让镜头更难解释。有效参考包不是“合法上限最大的包”,而是“最小但足够表达主体、动作和节奏的包”。
把限制当成设计工具:
- 第一段定长参考尽量远低于 15 秒上限;
- 能用 1 段动作参考,就不要先上 2 到 3 段;
- 尽量把主体身份和动作风格拆开描述;
- 对 Mini 的分辨率预期保持现实;
- 只有在核心镜头已被证明值得继续时,才考虑堆更大的多模态包。
Mini 首轮打包清单:
- 1 张主参考图
- 0 或 1 段动作参考
- 0 或 1 段音频参考
- 短时长
- 单一场景目标
- 清楚写出什么绝对不能变
3. 什么情况下 Mini 是正确的第一模型
当目标是评估,而不是一步拿到完整成片时,先用 Seedance 2 Mini 最合理。典型场景包括:主体一致性测试、便宜的镜头运动试跑、节奏实验,以及“这个概念到底能不能成立”的验证。只要问题足够窄,而且你希望错误成本低,Mini 就是对的。
一个常见例子是:你拿到一张产品主图,但还不知道它是否能撑住推近、转身、视线偏移或产品揭示。此时并不需要最终渲染,只需要知道主体会不会崩。另一个合适场景,是比较提示词方向:一个版本强调主体一致性,一个版本强调动作能量,另一个版本把花哨措辞全部删掉。Mini 很适合先判断哪个方向值得投入更大预算。
它也适合拿来建立团队复盘清单。一次小测试可以把“工作流错误”和“审美分歧”分开:如果在非常干净的参考图和非常克制的提示词下,主体依旧漂移,那说明素材包还没准备好;如果主体稳住了、镜头逻辑也成立,那剩下的问题才是画质,而不是控制。
4. 什么情况下 Mini 是错误的第一模型
当未解决的问题已经是规模,而不是清晰度时,Mini 就不适合作为第一选择。如果团队已经知道主体包没问题,真正要解决的是更复杂的动作、更高输出预期、更多参考素材组合或更长成片,那先上 Mini 可能只是多加一道评估工序。
还有一种情况是:提示词本身想同时解决太多事。如果一次请求既要保持角色设定、模仿参考动作、贴合音频节奏、给出可发布的细节,还要撑住多段场景变化,那这已经不是“便宜的首轮问题”了,而是要求生产级确定性。哪怕 Mini 技术上能接收,也会让诊断更慢,因为你不知道到底是哪一层先崩。
经验法则很简单:如果一次便宜测试的失败诊断依旧有价值,就先上 Mini;如果便宜测试只会告诉你早就知道的事,就直接去更强的层级。
5. 先搭出最小可用参考包
最容易浪费额度的方式,就是按磁盘里看到的顺序把素材都丢进去。更好的方式是按“角色”组包。先确定主体来源,再判断动作是否仍不明确,再判断节奏是否仍不明确。每加一个素材,都要说明它到底在回答什么问题。
每次 Mini 运行前,先写这份参考 brief:
主体来源:
- 哪一张静态图或帧负责定义主体身份?
动作来源:
- 哪一个单独动作必须被继承?
节奏来源:
- 节奏问题是否严重到值得加一段音频参考?
硬边界:
- 什么绝对不能变?
- 什么可以浮动?
这会强迫你按约束思考,而不是按素材数量思考。一张清晰主图通常比五张普通图更有效;一段短动作参考通常比三段互相打架的视频更有效;音频参考只有在它真正回答节奏问题时才值得加入。
最小升级规则:
- 先确认主体稳定
- 再确认动作可读
- 最后才判断是否需要更高画质
6. 给 Mini 写的是检查清单,不是散文
Mini 更适合把提示词写成指令,而不是写成情绪板。模型不需要一大堆形容词才能理解什么应该保留。先写镜头逻辑,再写氛围,最后写排除项。你真正关心的问题是:回看这段片子时,什么必须被稳定保留下来?
一个可靠的首轮提示词骨架可以这么写:
主体:保持参考素材中的同一主体身份。
动作:只写一个主要动作。
相机:只指定一个运动和一个构图决定。
时序:保持短片长度,并说明起止重点。
排除:不要额外物体,不要身份漂移,不要可读的虚构文字。
真正容易把运行带偏的,不是“缺少风格词”,而是“没有指令层级”。如果提示词在说明主体动作前,先堆上“电影感、情绪化、动态、高级、未来感、戏剧化”,那你之后很难判断失败的是主体、动作还是氛围要求。
7. 先跑一段短测试,并记录到底改了什么
第一轮 Mini 运行就应该故意便宜且短,因为你买的是信息。只要这次测试能明确告诉你下一步做什么,它就是成功的。可能的结论是“Mini 已经够用”,也可能是“主体很稳,但动作参考太弱”。两种结论都值钱。
维护一份一次只改一个变量的实验记录:
Run ID: mini-pass-01
References: 1 still, 1 video
Goal: 测试慢推镜头下的主体一致性
What changed: 删除多余风格形容词
Result: 主体稳定,结尾发软,但动作仍可用
Next step: 保持参考包不变,只加强动作描述
如果你一次同时改模型、相机和背景,就不会知道到底是哪一个改动起作用。
8. 只有真正重要的失败类型才值得触发升级
以 Mini 为首轮的工作流,失败通常很规律:主体漂移,动作参考压过主体身份,音频参考把节奏拉离视觉动作,或者结果虽然勉强能看,但软到不值得继续花钱。关键是先把失败类型叫对,再决定要不要换模型。
可以用这个诊断循环:
如果主体变了:
- 去掉多余参考素材
- 强化 identity line
如果动作不对:
- 缩短动作参考
- 相机只留一条指令
如果节奏崩了:
- 先移除音频参考,只重测视觉
如果唯一缺口是质量:
- 保持参考包不变,升级模型层级
最后这一条才是真正的升级信号。不是“我烦了”,也不是“结果不一样”。只有当主体、动作和节奏逻辑已经清楚,剩下的问题确实只是质量时,升级才有意义。
9. 把站内页面当作下一步,而不是噪音
这篇文章应该把读者送到下一个合理动作,而不是把一堆链接堆在页脚。如果你还在判断 Mini 是否适合当前工作流,就先看 China Seedance 页面;如果你要把 Mini 和非 Seedance 选项一起比较,再看 中文 AI 视频模型总览;如果你想比较“先靠图片”还是“先靠提示词”哪条路更好,再把 text-to-video 和 Mini 工作区并排打开。
关键是顺序:素材还没理顺时,从首页开始;素材包已经清楚时,进 Mini 工作区跑一段短片;只有当素材包不再是问题时,才去模型对比页。这样用户就不会把平台导航误当成工作流进展。
如果你的真实目标已经是商业成片,而不是参考测试,下一步继续看相关的一张图片制作 AI 产品广告指南。那篇文章处理的是这份清单的后半段:当你已经知道参考包至少能撑住一段稳定短片之后,怎么把它扩展成完整广告。
上面这段视频并不是在证明所有 Mini 运行都会长这样。它的作用,是把复盘标准具体化:看主体是否稳定、镜头是否易读,以及这段片子是否真的告诉了你下一步该怎么做。
10. 在继续花更多额度前,做最后一遍发布前检查
最后的规则很简单:在这份低成本检查清单还没回答正确问题前,不要急着上更贵额度。首轮测试不需要漂亮,但必须有诊断价值。
- 静态主参考图足够干净
- 每个定长参考素材都符合真实运行时限制
- 提示词只问一个主问题
- 失败类型已经明确命名
- Mini 已经回答了这次首轮测试的问题
- 剩下的缺口是质量,而不是混乱
如果你还在整理素材包,就回到 China Video AI 首页;如果素材已经足够小、足够清楚,而且就是为了先跑一次短测试,那就直接进入 Seedance 2 Mini 工作区。这份清单的目的就是:先小额验证、得到清晰结论,然后再决定是否值得进入更贵流程。
常见问题
Seedance 2 Mini 最适合什么场景?
当你只想先验证一组参考素材、一条提示词方向和一段短片是否成立时,Seedance 2 Mini 最适合作为低成本首轮测试。
Seedance 2 Mini 支持参考视频和参考音频吗?
在当前 China Video AI 运行时中,加入参考图片、参考视频或参考音频后,Seedance 2 Mini 可以进入 advanced-reference 相关行为。
参考视频最长能多长?
当前项目里,非 2.5 Seedance 系列的定长参考素材通常要控制在 2 到 15 秒之间,因此 Mini 的参考视频和参考音频也应尽量落在这个窗口内。
一开始应该放多少参考素材?
先用最小可用组合。相比混合堆很多素材,一张强主参考图加一段短动作参考更容易排查问题。
什么时候该从 Mini 切到 Fast 或标准版?
当参考包已经稳定,剩下的问题主要是分辨率、复杂动作或重复重试成本,而不是输入本身不清楚时,再考虑升级。
去哪里测试这个清单?
打开已经预选 Seedance 2 Mini 的 China Video AI 图片转视频工作区,上传最小可用参考包,先跑一段短片。
