Seedance 2.5 프롬프트 완전 가이드: 공식 공식, 초 단위 타임스탬프, 30초 원컷 (2026년 8월 실측)
Seedance 2.5 프롬프트 완전 가이드: 공식 공식, 초 단위 타임스탬프, 30초 원컷 (2026년 8월 실측)
2026년 8월 7일, ByteDance가 Seedance 2.5 API를 볼케이노 엔진(火山方舟)에 정식 출시했습니다 — 30초 영상 직접 생성, 최대 50개 멀티모달 레퍼런스 소재, 10여 개 언어 네이티브 지원. 하지만 모델 자체보다 10분을 투자할 가치가 있는 건, 공식이 동시에 공개한 「Seedance 2.5 프롬프트 가이드」입니다. 이 가이드는 “뽑기 실패 없이 prompt를 쓰는 법”을 처음으로 그대로 따라 할 수 있는 엔지니어링 방법론으로 정리했습니다.
공식 가이드와 출시 당일 공개된 공식 예시 prompt, 그리고 저희가 직접 실측한 결과를 함께 비교해 보니 꽤 반직관적인 사실을 발견했습니다. 많은 사람이 Seedance prompt를 쓸 때 습관적으로 사용하는 방식은, 사실 공식이 2.0에서 명확히 비추천했던 방식이라는 것 — 그런데 이 방식이 2.5에서는 오히려 강점이 됩니다.
이 글은 세 가지를 명확히 정리합니다. 공식 공식은 어떻게 쓰는지, 타임스탬프라는 가장 큰 쟁점을 어떻게 처리해야 하는지, 그리고 지나치게 저평가된 두 가지 레버 — 빛과 동작 — 에 대해서입니다.

1. 먼저 2.5의 능력 한계를 파악하자: 당신의 prompt가 무엇을 지휘하는가
prompt를 쓰기 전에 모델이 무엇을 받아낼 수 있는지부터 알아야 합니다. Seedance 2.5가 2.0 대비 업그레이드된 핵심 사항은 다음과 같습니다.
| 능력 | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| 단일 클립 최대 길이 | 최대 15초 | 최대 30초 |
| 레퍼런스 소재 상한 | 약 12개 | 50개(이미지 ≤30장, 영상 ≤10개, 오디오 ≤10개) |
| 초 단위 타임스탬프 | 공식상 지원하나 불안정 | 효율적으로 응답, 1급 시민 |
| 멀티뷰 피사체 레퍼런스 | 비추천 | 지원 |
| 출력 화면비 | 고정 6단계 | 0.4–2.5 사이 임의 비율 |
| 신규 레퍼런스 기능 | — | 와이어프레임 렌더링, 그리드 분할 컷, 영상 매끄러운 전환, 지시어 편집 |
30초 직접 생성은 “한 소절의 후렴을 억지로 세 조각으로 나눠 생성한 뒤 다시 이어붙이던” 고질적인 문제를 해결합니다. 50개 레퍼런스 소재는 캐릭터 설정 이미지 전체, 장면 레퍼런스, 심지어 레퍼런스 오디오까지 한 번에 넣을 수 있다는 뜻입니다. 이 두 가지가 합쳐지면서, 복잡한 서사가 처음으로 “뽑기”가 아니라 “제어 가능”한 영역이 되었습니다.
실용 규칙: 길이와 소재 상한은 입장권일 뿐입니다 — 이를 최대로 활용할 수 있는지는 당신의 prompt가 공식 공식대로 구성되어 있는지에 달려 있습니다. 30초짜리 묘사라도 두서없이 나열하면 결과물도 두서없는 30초가 됩니다.
2. 공식 구조화 공식: 4단 구성을 그대로 따라 하면 됩니다
공식 가이드가 제시하는 추천 구조는 매우 명확합니다. 4단 구성이며 순서는 고정입니다.
- 소재 지칭: 업로드한 각 소재에 번호를 매기고 용도를 지정합니다 — 누가 외형이고, 누가 음색이고, 누가 배경인지. 추천 문형은 “이미지 1의 빨간 원피스를 입고 밀짚모자를 쓴 여성을 피사체 1로 정의한다” — 이후 계속 같은 라벨로 지칭합니다. 공식이 특히 강조하는 점: 이미지 안에만 매핑 텍스트를 쓰지 말 것(예: 레퍼런스 이미지에 “장싼”이라고 적어두고 prompt에서 바로 그 이름을 부르는 방식). 인물이 많은 장면에서는 캐릭터가 혼동되거나 중복되기 쉽습니다.
- 한 줄 개요: 피사체 + 장소 + 사건 + 장르/스타일 + 특수 카메라워크를 한 문장으로 정리합니다.
- 구체적 전개: 타임스탬프나 “샷 N”으로 구간을 나누고, 각 구간마다 화면, 카메라워크, 동작, 대사, 음향 효과를 순서대로 씁니다. 가능한 한 긍정문으로 서술하세요. 부정문 서술은 자막과 오디오 제어에만 씁니다(“자막 없음”, “배경음악 없음”).
- 마무리 정리: 전체 영상을 관통하는 디테일을 보충합니다 — 카메라 습관, 환경 분위기, 사운드 디자인, 빛의 톤.
출시 당일 공식이 공개한 완성형 예시 prompt 몇 개(30초 공포 단편, 창고 군상극, 수중 추격)는 모두 이 골격을 엄격히 따르고 있으며, 마지막에 “지켜야 할 몇 가지” 단락을 덧붙였습니다 — 캐릭터 일관성, 자막·워터마크 없음, 긴장감의 곡선. 이 “마무리 원칙 단락”은 그대로 베낄 가치가 있습니다 — 모델에게 넘어서면 안 되는 레드라인을 그어주는 것과 같습니다.
실용 규칙: 레퍼런스 소재 자체가 충분히 정확하다면 지칭만 하고 화면을 다시 서술하지 마세요. 공식 원문은 “레퍼런스 영상 1의 동작과 카메라워크를 엄격히 참조”라고만 써도 충분하다고 밝혔습니다 — 동작을 프레임 단위로 다시 쓸 필요가 없고, 오히려 지나치게 쓰면 충돌을 일으킵니다.
3. 타임스탬프냐 샷 번호냐? 두 세대 모델의 답이 완전히 다릅니다
이번 조사에서 가장 큰 발견이자, 가장 많은 사람이 걸려 넘어지는 함정입니다.
Seedance 2.0의 공식 가이드는 매우 직설적으로 밝혔습니다. “정확한 시간(예: 0–3초)에 대한 모델의 지원은 불안정하며, 억지로 길이를 제한하면 생성 결과가 이상해질 수 있다”고 하며, “샷 1 / 샷 2 / 샷 3” 같은 순번식 분할 컷을 추천해 모델이 스스로 리듬을 결정하도록 했습니다.
Seedance 2.5는 반대로 초 단위 타임스탬프를 주력 기능으로 만들었습니다. 공식 공식 계정의 표현은 “Prompt 내 초 단위 타임스탬프에 효율적으로 응답”이며, 2.5 가이드에서는 “타임스탬프든 샷 N이든 모두 가능”이라고 설명합니다. 출시 당일 공식 예시는 거의 전부 0s-3s: / (0:00–0:05) 형태로, 초 단위까지 정확하게 각 샷 전환을 지휘합니다.
즉, 지금까지 Seedance에 [0-4 seconds] 같은 고정 타임스탬프를 습관적으로 써왔다면, 2.0에서는 사실 공식 권장과 반대로 쓰고 있었던 셈입니다 — “뽑기가 불안정하다”는 문제의 일부는 여기서 비롯됐을 수 있습니다. 그런데 같은 방식이 2.5에서는 갑자기 자연스러워집니다 — 당신의 작성 실력이 늘어서가 아니라, 모델이 드디어 이를 받아낼 수 있게 된 것입니다.
두 세대 모델에 각각 어울리는 분할 컷 작성법을 예시로 들어보겠습니다.
2.0 추천 작성법(순번식):
샷 1: 골목 측면 촬영, 남자가 천천히 달리기 시작하며 가쁜 숨소리가 느껴진다.
샷 2: 남자가 과일 가판대를 넘어뜨리고, 카메라가 빠르게 흔들리며 남자의 겁먹은 표정을 클로즈업한다.
샷 3: 남자가 낮은 담을 넘어 사라지고, 카메라가 천천히 뒤로 빠지며 텅 빈 거리에서 정지한다.
2.5 추천 작성법(초 단위 타임스탬프):
0s-3s: 낮은 앵글의 중원경, 판다 새끼가 초록빛 풀 비탈에 엎드려 있다가 경사면을 따라 천천히 옆으로 구른다. 햇빛이 왼쪽 위에서 숲 사이로 비친다.
3s-8s: 판다가 화면 오른쪽 아래로 굴러가 멈추고, 옆으로 누운 자세에서 엎드린 자세로 바뀐다. 동그란 얼굴이 카메라를 향하고 머리를 살짝 들었다가 다시 내린다.
실용 규칙: 박자를 맞춰야 하는 콘텐츠(뮤직비디오, 비트 맞춤 편집)는 2.5의 타임스탬프를 선택하세요. 리듬을 모델에게 맡겨도 되는 콘텐츠(서사 단편, 분위기 영상)는 2.0의 순번식으로도 충분합니다. 2.0에서 억지로 초 단위 타임스탬프를 강행하지 마세요.
뮤직비디오를 만드는 사람에게 이 부분은 특히 중요합니다 — MV의 샷 전환은 반드시 박자에 맞아야 하고, 초 단위 타임스탬프가 바로 그 박자 지시어이기 때문입니다. 저희가 2.5를 뮤직비디오 전환과 분할 컷 시나리오의 우선 엔진으로 꼽는 이유이기도 합니다.
4. 빛과 색조: 공식 예시에서 가장 덜 베껴지지만 가장 값진 부분
출시 당일 공개된 공식 예시 prompt를 전부 살펴보면 한 가지 공통점이 보입니다. 모든 예시가 독립된 조명 단락을 가지고 있으며, 그 표현이 매우 구체적입니다 — “차가운 청록색 어둠을 위주로 한 낮은 톤의 공포 조명, 머리 위 형광등이 깜빡거린다”, “태양이 소녀의 대각선 뒤쪽에서 비스듬히 들어와 얼굴에 밝은 렘브란트 광점을 만든다.”
이건 문학적 표현이 아니라 레버입니다. 이미 2.0 시대의 공식 자료에서도 결론이 나와 있었습니다 — 스타일 서술, 화질 키워드, 해상도 요구 같은 수식어 중에서 조명 묘사가 화질에 가장 큰 영향을 미친다는 것입니다. 대부분의 사람은 prompt에 “영화 같은 느낌, 8K”만 쓰지만, 공식 예시는 광원 방향, 빛의 질감, 명암 대비를 씁니다.
색조 작성법에도 마찬가지로 공식이 있습니다 — 공식 예시는 전부 3단 구조를 채택합니다.
- 주색조: 넓은 면적의 바탕(예: “채도를 낮춘 차가운 청록빛 그림자와 회색 콘크리트”)
- 보조색조: 피사체와 관련된 중간층(예: “수달의 젖어 어두운 털, 짙은 남색 교복 재킷”)
- 포인트 색: 반복적으로 등장하는 한두 곳의 작은 하이라이트(예: “병적인 형광등 불빛, 멀리 희미한 초록빛 비상구 표시등”)
이건 영화 색보정의 사고방식과 같습니다 — 바탕이 감정을 정하고, 중간층이 피사체를 세우고, 포인트 색이 시선을 유도합니다. 이 3단 구조대로 색조를 쓰면 결과물의 “영화적 느낌”은 신비한 감이 아니라 공식이 됩니다.
조명 단락을 제대로 쓰면 어떤 효과가 나올까요? 아래 완성된 화면의 암부 레이어와 하이라이트 윤곽은 “광원 방향 + 질감 + 대비”로 써낸 결과입니다.

이미지: SunoMV 팀 · Seedance 완성 화면 조명 예시
실용 규칙: 모든 prompt에 조명만 전담으로 쓰는 단락을 하나 남기세요 — 광원 방향 + 질감(하드라이트/소프트라이트) + 대비(낮은 톤의 어두운 부분/밝고 투명한 부분). 이 단락을 쓰고 나면 “영화적 느낌”이라는 세 글자는 prompt에서 지워도 됩니다.
5. 동작 4원칙과 감정 외현화: 캐릭터를 꼭두각시가 아니라 배우처럼 만들기
공식 가이드는 동작 묘사에 대해 네 가지 구체적인 규칙을 제시하며, 각각 그대로 작성 습관에 적용할 수 있습니다.
- 신체 부위 세분화 + 정도 수치화: 손, 다리, 머리처럼 구체적으로 짚고, 폭과 속도를 보충합니다 — “천천히 손을 든다”, “빠르게 고개를 돌린다”, “힘껏 땅을 박찬다” 같은 식으로, “그가 움직였다” 수준에 머물지 않습니다.
- 저강도의 연속적인 작은 동작을 우선: 공식은 전력 질주, 큰 점프, 격렬한 구르기 같은 고폭발 동작을 피하라고 명확히 권합니다 — 그것들이야말로 붕괴가 자주 일어나는 구간입니다. 높은 에너지를 원한다면 그 에너지를 편집 리듬과 카메라워크에 맡기고, 캐릭터가 한 샷 안에서 공중제비를 돌게 하지 마세요.
- 동작의 연결을 서술: “몸을 돌리는 관성을 타고 자연스럽게 손을 든다” — 앞뒤 동작의 관성이 이어지는 과정을 명확히 써야 화면이 매끄럽습니다.
- 감정의 구체적 외현화: “매우 슬프다”라고 쓰지 말고, “고개를 숙이고, 어깨가 미세하게 떨리고, 손가락이 무의식적으로 옷자락을 움켜쥐고, 눈물이 눈가에 맺혔지만 흘러내리지 않는다”라고 씁니다. 공식은 추상적 감정 → 신체 디테일로 이어지는 대조표를 직접 제공하니 저장해둘 가치가 있습니다.
출시 당일 공개된 서부 카우보이 예시는 이 원칙을 극한까지 활용했습니다. 10초짜리 얼굴 클로즈업에서 감정이 “차분하고 집중한 상태”에서 “눈빛이 흔들리고 눈썹이 살짝 치켜올라가는” 단계를 거쳐 “입꼬리가 아주 미세하게 올라가는” 단계로 이어지며, 전 과정을 눈매와 입가의 미세한 변화만으로 담아냈습니다 — 2.5의 연기 이해력은 이미 이 수준의 지시를 소화할 수 있습니다.
분할 컷과 캐릭터 일관성이 결합되면, 장면을 넘나드는 서사는 이런 효과를 냅니다.

이미지: SunoMV 팀 · 샷을 넘나드는 캐릭터 일관성 예시
6. 이 공식을 뮤직비디오에 적용하기: SunoMV의 방식
여기까지 읽었다면 이런 생각이 들 수 있습니다. 노래 한 곡에 수십 개의 샷이 있는데, 샷마다 공식 공식대로 쓰려면 작업량이 너무 많지 않을까요?
이것이 바로 SunoMV가 하고 있는 일입니다. 노래 한 곡을 자동으로 분할 컷 스크립트로 나누는 것 — 캐릭터 설정, 시각적 모티프, 구간별 감정 곡선을 AI 디렉터가 먼저 통합 기획하고, 가사 한 줄마다 구체적인 샷 묘사를 생성합니다. 조명, 색조, 동작 폭 같은 공식 베스트 프랙티스는 생성 로직 안에 이미 내장되어 있습니다. Seedance 전체 모델군(2.5 얼리 액세스 포함)이 영상 모델 목록에 있으니, 모델을 선택하기만 하면 노래 한 곡이 들어가서 전환과 자막이 있는 MV 한 편이 나옵니다.

전체 워크플로를 더 깊이 알고 싶다면 이 두 편이 더 자세히 다룹니다: Seedance + Suno의 오디오-완성 영상 5단계 워크플로, Seedance 2.5와 4K가 뮤직비디오에 의미하는 것. 실제 조작 영상을 보고 싶다면 Suno 곡을 완성된 AI MV로 만드는 튜토리얼(Roboverse, 12분)을 참고하세요.
자주 묻는 질문
Q: Seedance 2.5의 prompt는 얼마나 길게 쓸 수 있나요?
공식 예시는 대체로 500–1500자 사이이며, 30초 복잡 서사 예시는 그보다 더 긴 경우도 있습니다. 2.5는 지시 이행 능력이 강화되어 긴 prompt의 정보가 기본적으로 누락되지 않습니다 — 단, 4단 구조로 조직되어 있어야 하고, 두서없이 나열해서는 안 됩니다.
Q: 공식에서 prompt 최적화를 도와주는 도구가 있나요?
있습니다. 공식은 2.5 가이드에서 sd25-pe 프롬프트 튜닝 스킬(npx로 설치)을 추천합니다. 초안 prompt를 입력하면 공식 규범에 맞게 다시 써줍니다.
Q: 2.5는 2.0보다 얼마나 비싼가요? 2.0을 계속 써도 되나요?
공식 가격은 2.5가 백만 토큰당 70위안(영상 입력 미포함), 2.0은 46위안으로, 약 52% 더 비쌉니다. 2.0은 서비스가 종료되지 않았으며, 일상적인 콘텐츠에는 2.0 계열이 여전히 가성비 좋은 선택입니다 — 두 세대를 어떻게 선택해야 할지는 상세 비교 글에서 다뤘습니다.
Q: SunoMV에서 타임스탬프 작성법을 직접 신경 써야 하나요?
아닙니다. SunoMV는 선택한 모델에 맞춰 분할 컷 포맷을 자동으로 구성합니다 — 2.5는 초 단위 타임스탬프, 2.0 계열은 순번식으로 처리하며, 이 분기 로직은 공식 가이드의 권장 사항에 맞춰 이미 내장되어 있습니다.
지금 바로 시도해 보세요
공식 공식을 외우는 것과 실제로 결과물을 뽑는 것은 별개입니다. SunoMV 오디오-투-비디오 생성기로 가서 최근 반복 재생 중인 노래 한 곡을 넣어보고, 모델 목록에서 Seedance를 선택해, 공식 방법론대로 구성한 prompt가 한 곡을 어떤 영상으로 만들어내는지 직접 확인해 보세요.
SunoMV 팀
인기 가이드
이 시리즈의 다른 글
- Seedance 2.0 vs 2.5 심층 비교: 52% 더 비싸진 대신 무엇을 얻었나? 작성법·성능·비용 한 번에 정리 (2026년 8월)
- FLUX 3 비디오 모델 실측: 텍스트-투-비디오부터 비디오 익스텐드까지, 뮤직비디오 크리에이터가 주목해야 할 점
- Suno v5.5 노래를 뮤직비디오로: SunoMV vs Freebeat vs VidMuse (2026)
- MiniMax H3(Hailuo 03)로 AI MV 만들기: 노래 자체를 모델에 입력해야 화면이 박자를 따라간다
- GEMA vs Suno: 뮌헨 법원 판결이 AI 음악 크리에이터에게 의미하는 것 (2026)