SunoMV SunoMV
Seedance 2.5 提示词完全指南:官方公式、秒级时间戳与 30 秒一镜到底(2026 年 8 月实测)
教程指南

Seedance 2.5 提示词完全指南:官方公式、秒级时间戳与 30 秒一镜到底(2026 年 8 月实测)

发布于 · 作者: SunoMV 团队
把 SunoMV 设为 Google 优先来源 在热门报道和 AI 概览里看到更多 SunoMV。

Seedance 2.5 提示词完全指南:官方公式、秒级时间戳与 30 秒一镜到底(2026 年 8 月实测)

2026 年 8 月 7 日,字节把 Seedance 2.5 的 API 正式搬上了火山方舟——30 秒视频直出、最多 50 个多模态参考素材、原生十余种语言。但比模型本身更值得你花十分钟读完的,是官方同步放出的《Seedance 2.5 提示词指南》:它第一次把「怎么写 prompt 才不抽卡」讲成了一套可以照抄的工程方法。

我们把官方指南、发布日的官方示例 prompt 和自己的真实出片实测放在一起对照,发现了一件挺反直觉的事:很多人写 Seedance prompt 的习惯,恰恰是官方在 2.0 上明确不推荐的写法——而这些写法到了 2.5 上,反而变成了强项。

这篇讲清楚三件事:官方公式怎么用、时间戳这个最大的分歧点怎么处理、以及光影和动作这两个被严重低估的杠杆。

Seedance 2.5 提示词指南封面:官方公式与秒级时间戳

一、先搞懂 2.5 的能力边界:你的 prompt 在指挥什么

写 prompt 之前先知道模型能接住什么。Seedance 2.5 对比 2.0 的关键升级:

能力Seedance 2.0Seedance 2.5
单段直出时长最长 15 秒最长 30 秒
参考素材上限约 12 个50 个(图 ≤30 张、视频 ≤10 段、音频 ≤10 段)
秒级时间戳官方称支持不稳定高效响应,一等公民
多视图主体参考不建议支持
输出宽高比固定 6 档0.4–2.5 之间任意比例
新参考能力白模渲染、宫格分镜、视频无缝转场、指令编辑

30 秒直出解决的是「一段副歌被迫拆三段生成再硬拼」的老问题;50 个参考素材意味着整套角色设定图、场景参考甚至参考音频可以一次性喂进去。这两件事叠起来,复杂叙事第一次变得「可控」而不是「靠抽」。

实用规则: 时长和素材上限只是入场券——能不能用满,取决于你的 prompt 有没有按官方公式组织。一段 30 秒的流水账描述,出来的还是 30 秒的流水账。

二、官方结构化公式:四段式照抄就行

官方指南给的推荐结构非常明确,四段,顺序固定:

  1. 素材指代:给每个上传素材编号并绑定用途——谁是形象、谁是音色、谁是场景。推荐句式:「将图片 1 中穿红色连衣裙、戴草帽的女人定义为主体 1」,之后全程用同一标签指代。官方特别提醒:不要只在图片里写映射文字(比如在参考图上标「张三」然后 prompt 里直接喊张三),多人场景容易混淆或重复角色。
  2. 一句话概述:主体 + 地点 + 事件 + 题材/风格 + 特殊运镜,一句话把片子说清。
  3. 具体情节:用时间戳或「镜头 N」切分,逐段写画面、运镜、动作、台词、音效,尽量正向描述。反向描述只用于字幕和音频控制(「不要字幕」「不要 bgm」)。
  4. 结尾收束:补充贯穿全片的细节——机位习惯、环境氛围、声音设计、光影基调。

发布日官方放出的几条完整示例 prompt(30 秒恐怖短片、仓库群戏、水下追逐)全部严格遵循这个骨架,而且都在结尾加了一段「几点要守住」:角色一致性、无字幕水印、张力弧线。这个「收尾守则段」非常值得抄——它相当于给模型划了不许越过的红线。

实用规则: 参考素材本身足够精准时,只做指代、别复述画面。官方原话是「严格参考视频 1 的动作与运镜」就够了,不需要再把动作逐帧写一遍——写多了反而引入冲突。

三、时间戳还是镜头序号?两代模型的答案完全相反

这是本次调研里最大的发现,也是最多人踩的坑。

Seedance 2.0 的官方指南写得很直白:「模型对精确时间(如 0–3 秒)的支持不稳定,强行限制时长可能导致生成结果异常」,推荐用「镜头 1 / 镜头 2 / 镜头 3」的序号式分镜,让模型自己决定节奏。

Seedance 2.5 则把秒级时间戳做成了主打能力。官方公众号的原话是「对 Prompt 中秒级时间戳的高效响应」,2.5 指南里「时间戳或镜头 N 均可」,而发布日的官方示例几乎全是 0s-3s: / (0:00–0:05) 的写法——精确到秒地指挥每一个镜头切换。

也就是说,如果你一直习惯给 Seedance 写 [0-4 seconds] 这种硬时间戳,在 2.0 上其实是逆着官方建议在写,部分「抽卡不稳」可能就来自这里;而同一套写法到了 2.5 上突然变顺了——不是你写功进步了,是模型终于接得住了。

给两代模型的分镜写法各举一段:

2.0 推荐写法(序号式):

镜头 1:街巷侧拍,男人缓慢起跑,带有急促的呼吸感。
镜头 2:男人撞翻水果摊,镜头快速摇动并给到男人惊恐的特写。
镜头 3:男人翻过矮墙消失,镜头缓慢拉远定格在空荡的街道。

2.5 推荐写法(秒级时间戳):

0s-3s:低机位中远景,熊猫幼崽趴在绿色草坡上,顺着斜坡慢慢侧滚,阳光从左上方穿过树林。
3s-8s:熊猫滚到画面右下方停下,从侧躺变成趴卧,圆脸朝向镜头,头部小幅抬起又放低。

实用规则: 卡节拍的内容(音乐视频、卡点混剪)选 2.5 用时间戳;节奏可以交给模型的内容(叙事短片、氛围片)用 2.0 序号式也够。别在 2.0 上强卡秒级时间戳。

对做音乐视频的人来说这条尤其关键——MV 的镜头切换必须踩在拍点上,秒级时间戳就是踩点指令。这也是为什么我们把 2.5 视为音乐视频转场与分镜场景的首选新引擎。

四、光影与色调:官方示例里被抄得最少、却最值钱的一段

翻完发布日全部官方示例 prompt 你会发现一个共性:每一条都有独立的光影专段,而且写得极其具体——「低调的恐怖光,以冷蓝绿的黑暗为主,头顶一根荧光灯管忽明忽暗地闪」「太阳从少女侧后方斜射入镜,在她面部形成明亮的伦勃朗光斑」。

这不是文采,是杠杆。早在 2.0 时代的官方资料里就有结论:在风格描述、画质词、分辨率要求这些修饰语里,光影描述对画质的影响最大。大多数人的 prompt 只写「电影感、8K」,而官方示例在写光源方向、光的质感、明暗对比。

色调的写法同样有套路——官方示例全部采用三层结构

  • 主色调:大面积基底(「去饱和的冷蓝绿阴影和灰混凝土」)
  • 次色调:主体相关的中间层(「水獭湿暗的毛发、藏青校园夹克」)
  • 点缀色:一两个反复出现的小面积高光(「病态的荧光灯辉、远处微弱的绿色安全出口标志」)

这就是电影调色的思路:基底定情绪、中间层立主体、点缀色引导视线。照这个三层结构写色调,出片的「电影感」不是玄学,是配方。

光影段写对了是什么效果?下面这张成片画面里的暗部层次和高光轮廓,就是按「光源方向 + 质感 + 对比」写出来的:

Seedance 电影级光影与三层色调的音乐视频画面细节

配图:SunoMV 团队 · Seedance 成片光影示例

实用规则: 每条 prompt 留一段专门写光——光源方向 + 质感(硬光/柔光)+ 对比度(低调暗部/明亮通透)。写了这一段,「电影感」三个字就可以从你的 prompt 里删掉了。

五、动作四则与情绪外化:让角色像演员而不是提线木偶

官方指南对动作描述给了四条具体规则,每条都能直接抄进你的写作习惯:

  1. 肢体细化 + 程度量化:具体到手、腿、头部,补幅度和速度——「缓慢抬手」「快速转头」「用力蹬地」,而不是「他动了一下」。
  2. 优先低缓连续的小动作:官方明确建议规避狂奔、大跳、剧烈翻滚这类高爆发动作——那是崩坏重灾区。想要高能量?把能量交给剪辑节奏和运镜,而不是让角色在一个镜头里翻跟头。
  3. 写出动作衔接:「借着转身惯性顺势抬手」——前后动作的惯性承接写清楚,画面才连贯。
  4. 情绪具象外化:不写「很悲伤」,写「低头、肩膀微微颤抖、手指无意识地攥紧衣角、泪水在眼眶里打转但没有落下」。官方直接给了一张抽象情绪 → 身体细节的对照表,值得存下来。

发布日那条西部牛仔示例把这套用到了极致:10 秒的面部特写,情绪从「平静专注」到「眼神一震、眉梢轻挑」再到「嘴角极轻微地上扬」,全程只靠眉眼和嘴角的微变化承载——2.5 的表演理解已经能接住这种级别的指令了。

分镜与角色一致性配合起来,跨场景叙事是这样的效果:

Seedance 多镜头连贯叙事:同一角色跨场景的音乐视频分镜

配图:SunoMV 团队 · 跨镜头角色一致性示例

六、把这套公式用在音乐视频上:SunoMV 的做法

读到这你可能会想:一首歌几十个镜头,每个镜头都按官方公式写一遍,工作量也太大了。

这正是 SunoMV 在做的事:把一首歌自动拆成分镜脚本——角色设定、视觉母题、段落情绪弧线先由 AI 导演统一规划,再按每句歌词生成具体镜头描述,光影、色调、动作幅度这些官方最佳实践直接内置在生成逻辑里。Seedance 全系模型(含 2.5 抢先版)就在视频模型列表里,选好模型,一首歌进去、一支带转场和字幕的 MV 出来。

用 AI 把音乐转成音乐视频画面的创作概念

想深入完整工作流的,这两篇拆得更细:Seedance + Suno 的音频到成片五步工作流Seedance 2.5 与 4K 对音乐视频意味着什么。想看真人操作,可以参考这支把 Suno 歌曲做成完整 AI MV 的教程(Roboverse,12 分钟)。

常见问题

Q:Seedance 2.5 的 prompt 可以写多长?

官方示例普遍在 500–1500 字之间,30 秒复杂叙事的示例甚至更长。2.5 的指令遵循强化后,长 prompt 的信息基本不会被丢弃——前提是按四段式组织,而不是一大段流水账。

Q:官方有没有工具帮我优化 prompt?

有。官方在 2.5 指南里推荐了 sd25-pe 提示词调优 skill(通过 npx 安装),输入你的草稿 prompt 就能按官方规范帮你重写。

Q:2.5 比 2.0 贵多少?还能用 2.0 吗?

官方定价 2.5 是每百万 token 70 元(不含视频输入),2.0 是 46 元,贵约 52%。2.0 并没有下线,日常内容用 2.0 系仍然是性价比之选——两代怎么选,我们写了一篇完整对比

Q:时间戳写法在 SunoMV 里需要自己写吗?

不需要。SunoMV 会按所选模型自动组织分镜格式——2.5 走秒级时间戳、2.0 系走序号式,这套分流逻辑已经按官方指南的建议内置了。

现在就试试

把官方公式背下来是一回事,出片是另一回事。去 SunoMV 音频转视频生成器,丢一首你最近单曲循环的歌进去,在模型列表里选 Seedance,亲眼看看按官方方法组织的 prompt 能把一首歌拍成什么样。

SunoMV 团队

查看「AI 音乐与视频工具对比」全部 32 篇 →

试试这些 AI 工具