SunoMV SunoMV
Seedance 2.5 프롬프트 완전 가이드: 공식 공식, 초 단위 타임스탬프, 30초 원컷 (2026년 8월 실측)
가이드

Seedance 2.5 프롬프트 완전 가이드: 공식 공식, 초 단위 타임스탬프, 30초 원컷 (2026년 8월 실측)

게시일 · 작성자: SunoMV 팀
SunoMV을 Google 선호 소스로 추가 주요 뉴스와 AI 답변에서 SunoMV를 더 자주 만나보세요.

Seedance 2.5 프롬프트 완전 가이드: 공식 공식, 초 단위 타임스탬프, 30초 원컷 (2026년 8월 실측)

2026년 8월 7일, ByteDance가 Seedance 2.5 API를 볼케이노 엔진(火山方舟)에 정식 출시했습니다 — 30초 영상 직접 생성, 최대 50개 멀티모달 레퍼런스 소재, 10여 개 언어 네이티브 지원. 하지만 모델 자체보다 10분을 투자할 가치가 있는 건, 공식이 동시에 공개한 「Seedance 2.5 프롬프트 가이드」입니다. 이 가이드는 “뽑기 실패 없이 prompt를 쓰는 법”을 처음으로 그대로 따라 할 수 있는 엔지니어링 방법론으로 정리했습니다.

공식 가이드와 출시 당일 공개된 공식 예시 prompt, 그리고 저희가 직접 실측한 결과를 함께 비교해 보니 꽤 반직관적인 사실을 발견했습니다. 많은 사람이 Seedance prompt를 쓸 때 습관적으로 사용하는 방식은, 사실 공식이 2.0에서 명확히 비추천했던 방식이라는 것 — 그런데 이 방식이 2.5에서는 오히려 강점이 됩니다.

이 글은 세 가지를 명확히 정리합니다. 공식 공식은 어떻게 쓰는지, 타임스탬프라는 가장 큰 쟁점을 어떻게 처리해야 하는지, 그리고 지나치게 저평가된 두 가지 레버 — 빛과 동작 — 에 대해서입니다.

Seedance 2.5 프롬프트 가이드 커버: 공식 공식과 초 단위 타임스탬프

1. 먼저 2.5의 능력 한계를 파악하자: 당신의 prompt가 무엇을 지휘하는가

prompt를 쓰기 전에 모델이 무엇을 받아낼 수 있는지부터 알아야 합니다. Seedance 2.5가 2.0 대비 업그레이드된 핵심 사항은 다음과 같습니다.

능력Seedance 2.0Seedance 2.5
단일 클립 최대 길이최대 15초최대 30초
레퍼런스 소재 상한약 12개50개(이미지 ≤30장, 영상 ≤10개, 오디오 ≤10개)
초 단위 타임스탬프공식상 지원하나 불안정효율적으로 응답, 1급 시민
멀티뷰 피사체 레퍼런스비추천지원
출력 화면비고정 6단계0.4–2.5 사이 임의 비율
신규 레퍼런스 기능와이어프레임 렌더링, 그리드 분할 컷, 영상 매끄러운 전환, 지시어 편집

30초 직접 생성은 “한 소절의 후렴을 억지로 세 조각으로 나눠 생성한 뒤 다시 이어붙이던” 고질적인 문제를 해결합니다. 50개 레퍼런스 소재는 캐릭터 설정 이미지 전체, 장면 레퍼런스, 심지어 레퍼런스 오디오까지 한 번에 넣을 수 있다는 뜻입니다. 이 두 가지가 합쳐지면서, 복잡한 서사가 처음으로 “뽑기”가 아니라 “제어 가능”한 영역이 되었습니다.

실용 규칙: 길이와 소재 상한은 입장권일 뿐입니다 — 이를 최대로 활용할 수 있는지는 당신의 prompt가 공식 공식대로 구성되어 있는지에 달려 있습니다. 30초짜리 묘사라도 두서없이 나열하면 결과물도 두서없는 30초가 됩니다.

2. 공식 구조화 공식: 4단 구성을 그대로 따라 하면 됩니다

공식 가이드가 제시하는 추천 구조는 매우 명확합니다. 4단 구성이며 순서는 고정입니다.

  1. 소재 지칭: 업로드한 각 소재에 번호를 매기고 용도를 지정합니다 — 누가 외형이고, 누가 음색이고, 누가 배경인지. 추천 문형은 “이미지 1의 빨간 원피스를 입고 밀짚모자를 쓴 여성을 피사체 1로 정의한다” — 이후 계속 같은 라벨로 지칭합니다. 공식이 특히 강조하는 점: 이미지 안에만 매핑 텍스트를 쓰지 말 것(예: 레퍼런스 이미지에 “장싼”이라고 적어두고 prompt에서 바로 그 이름을 부르는 방식). 인물이 많은 장면에서는 캐릭터가 혼동되거나 중복되기 쉽습니다.
  2. 한 줄 개요: 피사체 + 장소 + 사건 + 장르/스타일 + 특수 카메라워크를 한 문장으로 정리합니다.
  3. 구체적 전개: 타임스탬프나 “샷 N”으로 구간을 나누고, 각 구간마다 화면, 카메라워크, 동작, 대사, 음향 효과를 순서대로 씁니다. 가능한 한 긍정문으로 서술하세요. 부정문 서술은 자막과 오디오 제어에만 씁니다(“자막 없음”, “배경음악 없음”).
  4. 마무리 정리: 전체 영상을 관통하는 디테일을 보충합니다 — 카메라 습관, 환경 분위기, 사운드 디자인, 빛의 톤.

출시 당일 공식이 공개한 완성형 예시 prompt 몇 개(30초 공포 단편, 창고 군상극, 수중 추격)는 모두 이 골격을 엄격히 따르고 있으며, 마지막에 “지켜야 할 몇 가지” 단락을 덧붙였습니다 — 캐릭터 일관성, 자막·워터마크 없음, 긴장감의 곡선. 이 “마무리 원칙 단락”은 그대로 베낄 가치가 있습니다 — 모델에게 넘어서면 안 되는 레드라인을 그어주는 것과 같습니다.

실용 규칙: 레퍼런스 소재 자체가 충분히 정확하다면 지칭만 하고 화면을 다시 서술하지 마세요. 공식 원문은 “레퍼런스 영상 1의 동작과 카메라워크를 엄격히 참조”라고만 써도 충분하다고 밝혔습니다 — 동작을 프레임 단위로 다시 쓸 필요가 없고, 오히려 지나치게 쓰면 충돌을 일으킵니다.

3. 타임스탬프냐 샷 번호냐? 두 세대 모델의 답이 완전히 다릅니다

이번 조사에서 가장 큰 발견이자, 가장 많은 사람이 걸려 넘어지는 함정입니다.

Seedance 2.0의 공식 가이드는 매우 직설적으로 밝혔습니다. “정확한 시간(예: 0–3초)에 대한 모델의 지원은 불안정하며, 억지로 길이를 제한하면 생성 결과가 이상해질 수 있다”고 하며, “샷 1 / 샷 2 / 샷 3” 같은 순번식 분할 컷을 추천해 모델이 스스로 리듬을 결정하도록 했습니다.

Seedance 2.5는 반대로 초 단위 타임스탬프를 주력 기능으로 만들었습니다. 공식 공식 계정의 표현은 “Prompt 내 초 단위 타임스탬프에 효율적으로 응답”이며, 2.5 가이드에서는 “타임스탬프든 샷 N이든 모두 가능”이라고 설명합니다. 출시 당일 공식 예시는 거의 전부 0s-3s: / (0:00–0:05) 형태로, 초 단위까지 정확하게 각 샷 전환을 지휘합니다.

즉, 지금까지 Seedance에 [0-4 seconds] 같은 고정 타임스탬프를 습관적으로 써왔다면, 2.0에서는 사실 공식 권장과 반대로 쓰고 있었던 셈입니다 — “뽑기가 불안정하다”는 문제의 일부는 여기서 비롯됐을 수 있습니다. 그런데 같은 방식이 2.5에서는 갑자기 자연스러워집니다 — 당신의 작성 실력이 늘어서가 아니라, 모델이 드디어 이를 받아낼 수 있게 된 것입니다.

두 세대 모델에 각각 어울리는 분할 컷 작성법을 예시로 들어보겠습니다.

2.0 추천 작성법(순번식):

샷 1: 골목 측면 촬영, 남자가 천천히 달리기 시작하며 가쁜 숨소리가 느껴진다.
샷 2: 남자가 과일 가판대를 넘어뜨리고, 카메라가 빠르게 흔들리며 남자의 겁먹은 표정을 클로즈업한다.
샷 3: 남자가 낮은 담을 넘어 사라지고, 카메라가 천천히 뒤로 빠지며 텅 빈 거리에서 정지한다.

2.5 추천 작성법(초 단위 타임스탬프):

0s-3s: 낮은 앵글의 중원경, 판다 새끼가 초록빛 풀 비탈에 엎드려 있다가 경사면을 따라 천천히 옆으로 구른다. 햇빛이 왼쪽 위에서 숲 사이로 비친다.
3s-8s: 판다가 화면 오른쪽 아래로 굴러가 멈추고, 옆으로 누운 자세에서 엎드린 자세로 바뀐다. 동그란 얼굴이 카메라를 향하고 머리를 살짝 들었다가 다시 내린다.

실용 규칙: 박자를 맞춰야 하는 콘텐츠(뮤직비디오, 비트 맞춤 편집)는 2.5의 타임스탬프를 선택하세요. 리듬을 모델에게 맡겨도 되는 콘텐츠(서사 단편, 분위기 영상)는 2.0의 순번식으로도 충분합니다. 2.0에서 억지로 초 단위 타임스탬프를 강행하지 마세요.

뮤직비디오를 만드는 사람에게 이 부분은 특히 중요합니다 — MV의 샷 전환은 반드시 박자에 맞아야 하고, 초 단위 타임스탬프가 바로 그 박자 지시어이기 때문입니다. 저희가 2.5를 뮤직비디오 전환과 분할 컷 시나리오의 우선 엔진으로 꼽는 이유이기도 합니다.

4. 빛과 색조: 공식 예시에서 가장 덜 베껴지지만 가장 값진 부분

출시 당일 공개된 공식 예시 prompt를 전부 살펴보면 한 가지 공통점이 보입니다. 모든 예시가 독립된 조명 단락을 가지고 있으며, 그 표현이 매우 구체적입니다 — “차가운 청록색 어둠을 위주로 한 낮은 톤의 공포 조명, 머리 위 형광등이 깜빡거린다”, “태양이 소녀의 대각선 뒤쪽에서 비스듬히 들어와 얼굴에 밝은 렘브란트 광점을 만든다.”

이건 문학적 표현이 아니라 레버입니다. 이미 2.0 시대의 공식 자료에서도 결론이 나와 있었습니다 — 스타일 서술, 화질 키워드, 해상도 요구 같은 수식어 중에서 조명 묘사가 화질에 가장 큰 영향을 미친다는 것입니다. 대부분의 사람은 prompt에 “영화 같은 느낌, 8K”만 쓰지만, 공식 예시는 광원 방향, 빛의 질감, 명암 대비를 씁니다.

색조 작성법에도 마찬가지로 공식이 있습니다 — 공식 예시는 전부 3단 구조를 채택합니다.

  • 주색조: 넓은 면적의 바탕(예: “채도를 낮춘 차가운 청록빛 그림자와 회색 콘크리트”)
  • 보조색조: 피사체와 관련된 중간층(예: “수달의 젖어 어두운 털, 짙은 남색 교복 재킷”)
  • 포인트 색: 반복적으로 등장하는 한두 곳의 작은 하이라이트(예: “병적인 형광등 불빛, 멀리 희미한 초록빛 비상구 표시등”)

이건 영화 색보정의 사고방식과 같습니다 — 바탕이 감정을 정하고, 중간층이 피사체를 세우고, 포인트 색이 시선을 유도합니다. 이 3단 구조대로 색조를 쓰면 결과물의 “영화적 느낌”은 신비한 감이 아니라 공식이 됩니다.

조명 단락을 제대로 쓰면 어떤 효과가 나올까요? 아래 완성된 화면의 암부 레이어와 하이라이트 윤곽은 “광원 방향 + 질감 + 대비”로 써낸 결과입니다.

Seedance의 영화적 조명과 3단 색조로 완성된 뮤직비디오 화면 디테일

이미지: SunoMV 팀 · Seedance 완성 화면 조명 예시

실용 규칙: 모든 prompt에 조명만 전담으로 쓰는 단락을 하나 남기세요 — 광원 방향 + 질감(하드라이트/소프트라이트) + 대비(낮은 톤의 어두운 부분/밝고 투명한 부분). 이 단락을 쓰고 나면 “영화적 느낌”이라는 세 글자는 prompt에서 지워도 됩니다.

5. 동작 4원칙과 감정 외현화: 캐릭터를 꼭두각시가 아니라 배우처럼 만들기

공식 가이드는 동작 묘사에 대해 네 가지 구체적인 규칙을 제시하며, 각각 그대로 작성 습관에 적용할 수 있습니다.

  1. 신체 부위 세분화 + 정도 수치화: 손, 다리, 머리처럼 구체적으로 짚고, 폭과 속도를 보충합니다 — “천천히 손을 든다”, “빠르게 고개를 돌린다”, “힘껏 땅을 박찬다” 같은 식으로, “그가 움직였다” 수준에 머물지 않습니다.
  2. 저강도의 연속적인 작은 동작을 우선: 공식은 전력 질주, 큰 점프, 격렬한 구르기 같은 고폭발 동작을 피하라고 명확히 권합니다 — 그것들이야말로 붕괴가 자주 일어나는 구간입니다. 높은 에너지를 원한다면 그 에너지를 편집 리듬과 카메라워크에 맡기고, 캐릭터가 한 샷 안에서 공중제비를 돌게 하지 마세요.
  3. 동작의 연결을 서술: “몸을 돌리는 관성을 타고 자연스럽게 손을 든다” — 앞뒤 동작의 관성이 이어지는 과정을 명확히 써야 화면이 매끄럽습니다.
  4. 감정의 구체적 외현화: “매우 슬프다”라고 쓰지 말고, “고개를 숙이고, 어깨가 미세하게 떨리고, 손가락이 무의식적으로 옷자락을 움켜쥐고, 눈물이 눈가에 맺혔지만 흘러내리지 않는다”라고 씁니다. 공식은 추상적 감정 → 신체 디테일로 이어지는 대조표를 직접 제공하니 저장해둘 가치가 있습니다.

출시 당일 공개된 서부 카우보이 예시는 이 원칙을 극한까지 활용했습니다. 10초짜리 얼굴 클로즈업에서 감정이 “차분하고 집중한 상태”에서 “눈빛이 흔들리고 눈썹이 살짝 치켜올라가는” 단계를 거쳐 “입꼬리가 아주 미세하게 올라가는” 단계로 이어지며, 전 과정을 눈매와 입가의 미세한 변화만으로 담아냈습니다 — 2.5의 연기 이해력은 이미 이 수준의 지시를 소화할 수 있습니다.

분할 컷과 캐릭터 일관성이 결합되면, 장면을 넘나드는 서사는 이런 효과를 냅니다.

Seedance의 다중 샷 일관된 서사: 동일 캐릭터가 장면을 넘나드는 뮤직비디오 분할 컷

이미지: SunoMV 팀 · 샷을 넘나드는 캐릭터 일관성 예시

6. 이 공식을 뮤직비디오에 적용하기: SunoMV의 방식

여기까지 읽었다면 이런 생각이 들 수 있습니다. 노래 한 곡에 수십 개의 샷이 있는데, 샷마다 공식 공식대로 쓰려면 작업량이 너무 많지 않을까요?

이것이 바로 SunoMV가 하고 있는 일입니다. 노래 한 곡을 자동으로 분할 컷 스크립트로 나누는 것 — 캐릭터 설정, 시각적 모티프, 구간별 감정 곡선을 AI 디렉터가 먼저 통합 기획하고, 가사 한 줄마다 구체적인 샷 묘사를 생성합니다. 조명, 색조, 동작 폭 같은 공식 베스트 프랙티스는 생성 로직 안에 이미 내장되어 있습니다. Seedance 전체 모델군(2.5 얼리 액세스 포함)이 영상 모델 목록에 있으니, 모델을 선택하기만 하면 노래 한 곡이 들어가서 전환과 자막이 있는 MV 한 편이 나옵니다.

AI로 음악을 뮤직비디오 화면으로 바꾸는 창작 컨셉

전체 워크플로를 더 깊이 알고 싶다면 이 두 편이 더 자세히 다룹니다: Seedance + Suno의 오디오-완성 영상 5단계 워크플로, Seedance 2.5와 4K가 뮤직비디오에 의미하는 것. 실제 조작 영상을 보고 싶다면 Suno 곡을 완성된 AI MV로 만드는 튜토리얼(Roboverse, 12분)을 참고하세요.

자주 묻는 질문

Q: Seedance 2.5의 prompt는 얼마나 길게 쓸 수 있나요?

공식 예시는 대체로 500–1500자 사이이며, 30초 복잡 서사 예시는 그보다 더 긴 경우도 있습니다. 2.5는 지시 이행 능력이 강화되어 긴 prompt의 정보가 기본적으로 누락되지 않습니다 — 단, 4단 구조로 조직되어 있어야 하고, 두서없이 나열해서는 안 됩니다.

Q: 공식에서 prompt 최적화를 도와주는 도구가 있나요?

있습니다. 공식은 2.5 가이드에서 sd25-pe 프롬프트 튜닝 스킬(npx로 설치)을 추천합니다. 초안 prompt를 입력하면 공식 규범에 맞게 다시 써줍니다.

Q: 2.5는 2.0보다 얼마나 비싼가요? 2.0을 계속 써도 되나요?

공식 가격은 2.5가 백만 토큰당 70위안(영상 입력 미포함), 2.0은 46위안으로, 약 52% 더 비쌉니다. 2.0은 서비스가 종료되지 않았으며, 일상적인 콘텐츠에는 2.0 계열이 여전히 가성비 좋은 선택입니다 — 두 세대를 어떻게 선택해야 할지는 상세 비교 글에서 다뤘습니다.

Q: SunoMV에서 타임스탬프 작성법을 직접 신경 써야 하나요?

아닙니다. SunoMV는 선택한 모델에 맞춰 분할 컷 포맷을 자동으로 구성합니다 — 2.5는 초 단위 타임스탬프, 2.0 계열은 순번식으로 처리하며, 이 분기 로직은 공식 가이드의 권장 사항에 맞춰 이미 내장되어 있습니다.

지금 바로 시도해 보세요

공식 공식을 외우는 것과 실제로 결과물을 뽑는 것은 별개입니다. SunoMV 오디오-투-비디오 생성기로 가서 최근 반복 재생 중인 노래 한 곡을 넣어보고, 모델 목록에서 Seedance를 선택해, 공식 방법론대로 구성한 prompt가 한 곡을 어떤 영상으로 만들어내는지 직접 확인해 보세요.

SunoMV 팀

'AI 음악·영상 도구 비교' 글 32편 모두 보기 →

이 AI 도구를 사용해 보세요