SunoMV SunoMV
Seedance 2.5 プロンプト完全ガイド:公式フォーミュラ・秒単位タイムスタンプ・30秒ワンショット(2026年8月実測)
ガイド

Seedance 2.5 プロンプト完全ガイド:公式フォーミュラ・秒単位タイムスタンプ・30秒ワンショット(2026年8月実測)

公開日 · 著者: SunoMV チーム
SunoMV を Google の優先ソースに追加 トップニュースと AI による回答に SunoMV がもっと表示されます。

Seedance 2.5 プロンプト完全ガイド:公式フォーミュラ・秒単位タイムスタンプ・30秒ワンショット(2026年8月実測)

2026年8月7日、ByteDanceはSeedance 2.5のAPIを正式にVolcano Engine ARKに公開した——30秒動画の直接生成、最大50件のマルチモーダル参照素材、十数言語のネイティブ対応。だが、モデル自体よりも10分かけて読む価値があるのは、公式が同時に公開した『Seedance 2.5 プロンプトガイド』だ。「どう書けばガチャを外さないプロンプトになるか」を、初めてそのまま真似できるエンジニアリング手法として体系化している。

公式ガイド、リリース当日に公開された公式サンプルプロンプト、そして私たち自身の実際の生成テストを突き合わせてみると、かなり直感に反する事実が見えてきた。多くの人がSeedanceのプロンプトを書く際の習慣は、まさに公式が2.0で明確に非推奨としていた書き方だった——そして、その書き方こそが2.5では逆に強みに変わっている。

この記事では3つのことを明確にする。公式フォーミュラの使い方、最大の分岐点であるタイムスタンプの扱い方、そして著しく過小評価されている「光と影」「アクション」という2つのレバレッジだ。

Seedance 2.5 プロンプトガイドの表紙:公式フォーミュラと秒単位タイムスタンプ

一、まず2.5の能力の境界を理解する:あなたのプロンプトは何を指揮しているのか

プロンプトを書く前に、モデルが何を受け止められるのかを知っておこう。Seedance 2.5 が 2.0 と比べて進化した主なポイントは次の通りだ。

能力Seedance 2.0Seedance 2.5
1カットの直接生成尺最長15秒最長30秒
参照素材の上限約12個50個(画像≤30枚、動画≤10本、音声≤10本)
秒単位タイムスタンプ公式曰く対応は不安定高効率で応答、ファーストクラス対応
マルチビュー主体参照非推奨対応
出力アスペクト比固定6段階0.4〜2.5の間で任意の比率
新規参照機能ホワイトモデルレンダリング、グリッド絵コンテ、動画のシームレストランジション、指示編集

30秒の直接生成が解決するのは、「サビ1つを無理やり3つに分けて生成し、力づくでつなぎ合わせる」という長年の悩みだ。50個の参照素材は、キャラクター設定画一式、シーン参照、さらには参照音声までも一度に読み込ませられることを意味する。この2つが重なることで、複雑なストーリーテリングが初めて「ガチャ任せ」ではなく「コントロール可能」なものになった。

実用ルール: 尺と素材上限はあくまで入場券にすぎない——それを使い切れるかどうかは、プロンプトが公式フォーミュラに沿って組み立てられているかにかかっている。30秒分のだらだらとした説明を書けば、出てくるのも30秒分のだらだらとした映像でしかない。

二、公式の構造化フォーミュラ:4段構成をそのまま真似ればいい

公式ガイドが示す推奨構成は非常に明確で、4段構成、順序は固定だ。

  1. 素材の指定:アップロードした各素材に番号を振り、用途を紐づける——誰が容姿担当か、誰が声担当か、どれがシーン担当か。推奨される言い回しは「画像1の赤いワンピースを着て麦わら帽子をかぶった女性を主体1と定義する」というもので、以降は同じラベルで一貫して指し示す。公式が特に注意を促しているのは、画像の中にマッピング文字だけを書き込まないこと(例えば参照画像に「張三」とラベルを付けて、プロンプト中でそのまま「張三」と呼ぶような書き方)——複数人物が登場するシーンでは、キャラクターの混同や重複が起きやすい。
  2. 一文サマリー:主体+場所+出来事+テーマ/スタイル+特殊なカメラワークを、一文で作品全体を説明する。
  3. 具体的なストーリー展開:タイムスタンプまたは「カットN」で区切り、各セグメントごとに画面・カメラワーク・アクション・セリフ・効果音を書く。できる限り肯定的な表現を使うこと。否定表現は字幕と音声のコントロールにのみ使う(「字幕なし」「BGMなし」など)。
  4. 締めくくり:作品全体を貫くディテールを補足する——カメラワークの癖、環境の雰囲気、サウンドデザイン、光と影のトーン。

リリース当日に公式が公開したいくつかの完全なサンプルプロンプト(30秒のホラー短編、倉庫での群像劇、水中追跡劇)はすべて、この骨格を厳密に守っており、しかも末尾には「守るべきポイント」——キャラクターの一貫性、字幕・透かしなし、緊張感のアーク——が必ず添えられている。この「締めくくりのルール段落」は非常に真似る価値がある。モデルに越えてはいけないレッドラインを引いてやるようなものだからだ。

実用ルール: 参照素材自体が十分に精密であれば、指定だけにとどめ、画面をわざわざ書き直さないこと。公式の原文でも「動画1の動作とカメラワークを厳密に参照する」だけで十分だとされており、動作をコマ送りで書き直す必要はない——書きすぎるとかえって矛盾を生む。

三、タイムスタンプか、それともカット番号か?2世代のモデルで答えは正反対

今回の調査で最大の発見であり、最も多くの人がはまっている落とし穴でもある。

Seedance 2.0 の公式ガイドは非常に率直に書いている——「モデルは正確な時間指定(0〜3秒など)への対応が不安定で、尺を強引に制限すると生成結果が異常になる可能性がある」として、「カット1/カット2/カット3」という番号式の絵コンテを推奨し、テンポはモデル自身に任せるとしている。

一方、Seedance 2.5 は秒単位タイムスタンプを主力機能に据えた。公式の公衆号(WeChat公式アカウント)の原文では「プロンプト中の秒単位タイムスタンプへの高効率な応答」とされ、2.5のガイドでは「タイムスタンプでもカットNでもどちらでもよい」としている。しかしリリース当日の公式サンプルは、ほぼすべてが 0s-3s:(0:00–0:05) という書き方——秒単位で正確にカットの切り替えを指揮している。

つまり、もしあなたがこれまでSeedanceに対して[0-4 seconds]のような固定タイムスタンプを書く習慣があったなら、それは2.0では実は公式の推奨に逆らって書いていたことになる——「ガチャが安定しない」という現象の一部は、ここに原因があったのかもしれない。そして、まったく同じ書き方が2.5になった途端に急にうまくいくようになる——それはあなたのプロンプトスキルが上達したからではなく、モデルがようやく受け止められるようになっただけだ。

2世代のモデルそれぞれの絵コンテの書き方を、一段落ずつ例に挙げる。

2.0 推奨の書き方(番号式):

镜头 1:街巷侧拍,男人缓慢起跑,带有急促的呼吸感。
镜头 2:男人撞翻水果摊,镜头快速摇动并给到男人惊恐的特写。
镜头 3:男人翻过矮墙消失,镜头缓慢拉远定格在空荡的街道。

2.5 推奨の書き方(秒単位タイムスタンプ):

0s-3s:低机位中远景,熊猫幼崽趴在绿色草坡上,顺着斜坡慢慢侧滚,阳光从左上方穿过树林。
3s-8s:熊猫滚到画面右下方停下,从侧躺变成趴卧,圆脸朝向镜头,头部小幅抬起又放低。

実用ルール: ビートに合わせる必要があるコンテンツ(ミュージックビデオ、ビート編集動画)は2.5でタイムスタンプを使う。テンポをモデルに任せられるコンテンツ(ナラティブ短編、ムード重視の作品)は2.0の番号式でも十分だ。2.0で無理に秒単位タイムスタンプを詰め込まないこと。

ミュージックビデオを作る人にとって、これは特に重要なポイントだ——MVのカット切り替えは必ずビートに乗せなければならず、秒単位タイムスタンプはまさにビートを踏むための指令になる。だからこそ私たちは2.5を、ミュージックビデオのトランジションと絵コンテというシーンにおける第一候補の新エンジンと見ている。

四、光と色調:公式サンプルの中で最も真似されていないのに、最も価値のある部分

リリース当日の公式サンプルプロンプトを全部読み込むと、ある共通点に気づく。どのプロンプトにも独立した光と影の専用セクションがあり、しかも極めて具体的に書かれている——「トーンを抑えたホラー照明、冷たい青緑の暗闇を基調とし、頭上の蛍光灯が明滅する」「太陽が少女の斜め後方から差し込み、顔に明るいレンブラント光を作る」といった具合だ。

これは文章力の問題ではなく、レバレッジの問題だ。すでに2.0時代の公式資料の中で、「スタイル描写・画質ワード・解像度要求といった修飾語の中で、光と影の描写が画質に与える影響が最も大きい」という結論が示されている。ほとんどの人のプロンプトは「シネマティック、8K」としか書かないが、公式サンプルは光源の方向、光の質感、明暗のコントラストまで書き込んでいる。

色調の書き方にも同じく型がある——公式サンプルはすべて3層構造を採用している。

  • メインカラー:大面積のベース(「彩度を落とした冷たい青緑の影とグレーのコンクリート」)
  • サブカラー:主体に関連する中間層(「カワウソの濡れた暗い毛並み、紺色のスクールジャケット」)
  • アクセントカラー:繰り返し登場する1〜2個の小面積のハイライト(「病的な蛍光灯の輝き、遠くに見えるかすかな緑の非常口標識」)

これはまさに映画のカラーグレーディングの発想だ——ベースが感情を決め、中間層が主体を立たせ、アクセントカラーが視線を誘導する。この3層構造に沿って色調を書けば、仕上がりの「シネマティック感」はオカルトではなく、レシピになる。

光と影のセクションを正しく書くとどんな効果になるのか?下の完成映像に見られる暗部の階調とハイライトの輪郭は、「光源の方向+質感+コントラスト」という書き方に沿って生み出されたものだ。

Seedanceのシネマティックな光と影、3層色調によるミュージックビデオ画面のディテール

図:SunoMVチーム · Seedance 完成映像の光と影の例

実用ルール: どのプロンプトにも、光だけを書く専用のセクションを残しておくこと——光源の方向+質感(ハードライト/ソフトライト)+コントラスト(暗部を抑えたトーン/明るく抜けたトーン)。このセクションさえ書けば、「シネマティック」という言葉自体はプロンプトから削除してかまわない。

五、アクションの4原則と感情の外在化:キャラクターを操り人形ではなく俳優にする

公式ガイドはアクション描写について4つの具体的なルールを示している。どれもそのまま自分の書き方に取り入れられる。

  1. 身体部位の細分化+度合いの数値化:手・脚・頭部まで具体的にし、幅と速度を補う——「彼が少し動いた」ではなく、「ゆっくりと手を上げる」「素早く首を回す」「力強く地面を蹴る」のように。
  2. 低速で連続的な小さな動作を優先する:公式は、全力疾走、大ジャンプ、激しい転倒といった高爆発力の動作を避けるよう明確に推奨している——そこは破綻の多発地帯だ。高いエネルギー感が欲しいなら、そのエネルギーは編集のテンポとカメラワークに任せるべきで、キャラクターに1カットの中でとんぼ返りをさせることではない。
  3. 動作のつながりを書く:「体を回した勢いに乗せて手を上げる」——前後の動作の慣性のつながりを明確に書いてこそ、映像が滑らかになる。
  4. 感情を具体的に外在化する:「とても悲しい」と書くのではなく、「うつむき、肩がかすかに震え、指が無意識に服の裾を握りしめ、涙が目に浮かぶが落ちない」のように書く。公式は抽象的な感情から身体的なディテールへの対応表をそのまま提供しており、保存しておく価値がある。

リリース当日の西部劇カウボーイのサンプルは、この手法を極限まで使い切っている。10秒間の顔のクローズアップで、感情は「静かに集中」から「目つきがハッと動き、眉尻がわずかに上がる」、そして「口角がごくわずかに上がる」へと移り変わる——その全過程を眉・目・口角のわずかな変化だけで表現しているのだ。2.5の演技理解力は、すでにこのレベルの指示を受け止められるところまで来ている。

絵コンテとキャラクターの一貫性を組み合わせると、シーンをまたいだストーリーテリングはこのような効果になる。

Seedanceのマルチカット連続ストーリーテリング:同一キャラクターがシーンをまたぐミュージックビデオの絵コンテ

図:SunoMVチーム · カットをまたぐキャラクター一貫性の例

六、このフォーミュラをミュージックビデオに応用する:SunoMVのやり方

ここまで読んで、こう思うかもしれない——1曲に数十カットもあって、それぞれを公式フォーミュラ通りに書くなんて、作業量が多すぎるのでは、と。

まさにそれこそがSunoMVがやっていることだ。1曲を自動的に絵コンテに分解する——キャラクター設定、ビジュアルモチーフ、セクションごとの感情のアークをまずAIディレクターが一括で企画し、その後歌詞の1行ごとに具体的なカット描写を生成する。光と影、色調、動作の振れ幅といった公式のベストプラクティスは、生成ロジックの中にそのまま組み込まれている。Seedanceの全モデル(2.5の先行版を含む)が動画モデルのリストに並んでおり、モデルを選びさえすれば、1曲を入力するだけでトランジションと字幕付きのMVが出来上がる。

AIで音楽をミュージックビデオの映像に変換する制作コンセプト

完全なワークフローをさらに深掘りしたい人には、この2本の記事がより細かく解説している。Seedance + Sunoによるオーディオから完成映像までの5ステップワークフローSeedance 2.5と4Kがミュージックビデオにもたらすもの。実際の操作を見たい人は、このSunoの楽曲を完全なAI MVに仕上げるチュートリアル(Roboverse、12分)を参考にするといい。

よくある質問

Q:Seedance 2.5 のプロンプトはどのくらいの長さまで書けますか?

A:公式サンプルはおおむね500〜1500文字程度で、30秒の複雑なストーリーの場合はさらに長くなることもある。2.5では指示追従性が強化されたため、長いプロンプトの情報も基本的に取りこぼされない——ただし4段構成に沿って組み立てられていることが前提で、だらだらと書き連ねただけの長文ではだめだ。

Q:公式が提供している、プロンプトを最適化してくれるツールはありますか?

A:ある。公式は2.5ガイドの中でsd25-peというプロンプト調整スキル(npx経由でインストール)を推奨している。下書きのプロンプトを入力するだけで、公式の規範に沿って書き直してくれる。

Q:2.5 は 2.0 に比べてどのくらい高いのですか?2.0 はまだ使えますか?

A:公式の価格では、2.5は100万トークンあたり70元(動画入力を含まず)、2.0は46元で、約52%高い計算になる。2.0が廃止されたわけではなく、日常的なコンテンツには2.0系が今もコストパフォーマンスに優れた選択肢だ。2世代のどちらを選ぶべきかについては、完全な比較記事を書いている。

Q:タイムスタンプの書き方は、SunoMVの中で自分で書く必要がありますか?

A:必要ない。SunoMVは選択したモデルに応じて絵コンテのフォーマットを自動で組み立てる——2.5なら秒単位タイムスタンプ、2.0系なら番号式というように。この振り分けロジックは、公式ガイドの推奨に沿ってすでに内蔵されている。

今すぐ試してみる

公式フォーミュラを暗記するのと、実際に映像を作り出すのとは別の話だ。SunoMV オーディオ→ビデオジェネレーターにアクセスして、最近リピートしているお気に入りの曲を放り込み、モデルリストからSeedanceを選んでみてほしい。公式のメソッドに沿って組み立てられたプロンプトが、1曲をどんな映像に仕立て上げるのか、自分の目で確かめられる。

SunoMV チーム

「AI 音楽・動画ツール比較」の記事 32 本をすべて見る →

これらの AI ツールを試す