Guía Completa de Prompts para Seedance 2.5: Fórmula Oficial, Marcas de Tiempo por Segundo y Toma Única de 30 Segundos (Probado en Agosto de 2026)
Guía Completa de Prompts para Seedance 2.5: Fórmula Oficial, Marcas de Tiempo por Segundo y Toma Única de 30 Segundos (Probado en Agosto de 2026)
El 7 de agosto de 2026, ByteDance llevó oficialmente la API de Seedance 2.5 a Volcano Engine — generación directa de video de 30 segundos, hasta 50 referencias multimodales, y más de una decena de idiomas nativos. Pero lo que merece más de diez minutos de tu tiempo que el modelo en sí es la Guía de Prompts de Seedance 2.5 que se publicó al mismo tiempo: por primera vez convierte “cómo escribir un prompt para no obtener resultados aleatorios” en una metodología de ingeniería que puedes copiar directamente.
Pusimos la guía oficial, los prompts de ejemplo oficiales del día de lanzamiento, y nuestras propias pruebas reales de generación uno al lado del otro, y encontramos algo bastante contraintuitivo: muchos de los hábitos que la gente usa para escribir prompts de Seedance son exactamente lo que la guía oficial desaconsejaba explícitamente en 2.0 — y esos mismos hábitos se han convertido en una fortaleza en 2.5.
Este artículo aclara tres cosas: cómo usar la fórmula oficial, cuál es el mayor punto de divergencia (las marcas de tiempo) y cómo manejarlo, y las dos palancas seriamente subestimadas de luz/sombra y movimiento.

Uno: Primero entiende los límites de capacidad de 2.5 — qué está dirigiendo tu prompt
Antes de escribir un prompt, necesitas saber qué puede manejar el modelo. Las actualizaciones clave de Seedance 2.5 frente a 2.0:
| Capacidad | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| Duración de generación de un solo segmento | Hasta 15 segundos | Hasta 30 segundos |
| Límite de referencias | Aproximadamente 12 | 50 (≤30 imágenes, ≤10 videos, ≤10 pistas de audio) |
| Marcas de tiempo por segundo | Soporte oficialmente descrito como inestable | Respuesta eficiente, ciudadano de primera clase |
| Referencia de sujeto multi-vista | No recomendado | Compatible |
| Relación de aspecto de salida | 6 opciones fijas | Cualquier relación entre 0.4 y 2.5 |
| Nuevas capacidades de referencia | — | Renderizado wireframe, guion gráfico en cuadrícula, transiciones fluidas entre videos, edición por instrucciones |
La generación directa de 30 segundos resuelve el viejo problema de “un coro forzado a dividirse en tres generaciones y pegarse a la fuerza”; el límite de 50 referencias significa que todo un conjunto de imágenes de diseño de personaje, referencias de escena, e incluso audio de referencia se puede alimentar de una sola vez. Juntas, estas dos cosas hacen que la narrativa compleja sea “controlable” por primera vez, en lugar de “depender de la suerte.”
Regla práctica: La duración y el límite de material son solo el boleto de entrada — si puedes usarlos al máximo depende de si tu prompt está organizado según la fórmula oficial. Una descripción de 30 segundos que es solo una lista continua sigue siendo solo una lista continua de 30 segundos cuando sale.
Dos: La fórmula estructurada oficial — cópiala en cuatro partes
La estructura recomendada de la guía oficial es muy clara — cuatro partes, en un orden fijo:
- Referencia de material: Numera cada material subido y vincula su propósito — quién es el personaje, quién es la voz, cuál es la escena. Frase recomendada: “Define a la mujer con vestido rojo y sombrero de paja en la imagen 1 como sujeto 1”, y luego usa la misma etiqueta durante todo el prompt. La guía oficial advierte específicamente: no solo escribas el mapeo dentro de la imagen (como etiquetar “Zhang San” en la imagen de referencia y luego llamar a “Zhang San” directamente en el prompt) — en escenas con múltiples personas, esto puede causar confusión o duplicación de personajes.
- Resumen en una frase: Sujeto + lugar + evento + género/estilo + movimiento de cámara especial — una frase que aclare de qué trata el clip.
- Trama específica: Divide con marcas de tiempo o “Toma N”, y escribe la imagen, movimiento de cámara, acción, diálogo, y efectos de sonido para cada segmento, favoreciendo descripciones positivas. Las descripciones negativas solo deben usarse para control de subtítulos y audio (“sin subtítulos”, “sin música de fondo”).
- Cierre: Añade detalles que corren a través de todo el clip — hábitos de cámara, atmósfera ambiental, diseño de sonido, tono de luz y sombra.
Los prompts de ejemplo completos que se publicaron oficialmente el día de lanzamiento (un cortometraje de terror de 30 segundos, un drama de almacén con múltiples personajes, una persecución submarina) siguen todos estrictamente este esqueleto, y todos añaden un párrafo de “puntos clave a mantener” al final: consistencia de personaje, sin subtítulos ni marca de agua, arco de tensión. Esta “sección de reglas de cierre” vale mucho la pena copiar — equivale a trazar líneas rojas que el modelo no debe cruzar.
Regla práctica: Cuando el material de referencia en sí ya es lo suficientemente preciso, solo haz la referencia, no repitas la imagen. Las palabras oficiales son “sigue estrictamente el movimiento y la cámara del video 1” — es suficiente, no necesitas volver a escribir el movimiento fotograma por fotograma — escribir de más en realidad introduce conflictos.
Tres: ¿Marca de tiempo o número de toma? Las respuestas de las dos generaciones son completamente opuestas
Este es el hallazgo más grande de esta investigación, y también donde más gente cae en la trampa.
La guía oficial de Seedance 2.0 es muy directa: “El soporte del modelo para tiempos precisos (como 0-3 segundos) es inestable, y forzar límites de duración puede causar resultados de generación anormales”, recomendando en su lugar un guion gráfico basado en números como “Toma 1 / Toma 2 / Toma 3”, dejando que el modelo decida el ritmo por sí mismo.
Seedance 2.5, en cambio, ha convertido las marcas de tiempo por segundo en una capacidad estrella. Las palabras oficiales de la cuenta pública son “respuesta eficiente a las marcas de tiempo por segundo en el prompt”, la guía de 2.5 dice que “marca de tiempo o Toma N ambos funcionan”, y casi todos los ejemplos oficiales del día de lanzamiento usan el formato 0s-3s: / (0:00–0:05) — dirigiendo cada corte de cámara con precisión al segundo.
En otras palabras, si siempre has tenido el hábito de escribir marcas de tiempo duras como [0-4 seconds] para Seedance, en 2.0 en realidad estabas escribiendo en contra de la recomendación oficial, y parte de esa “inestabilidad aleatoria” probablemente venía de ahí; ese mismo estilo de escritura de repente funciona sin problemas en 2.5 — no es que tu habilidad de escritura haya mejorado, es que el modelo finalmente puede manejarlo.
Aquí hay un ejemplo de escritura de guion gráfico para cada generación:
Estilo recomendado para 2.0 (basado en números):
Toma 1: Toma lateral en el callejón, el hombre comienza a correr lentamente, con una sensación de respiración agitada.
Toma 2: El hombre choca contra un puesto de frutas, la cámara se sacude rápidamente y va a un primer plano de su expresión asustada.
Toma 3: El hombre desaparece sobre un muro bajo, la cámara se aleja lentamente y se congela en la calle vacía.
Estilo recomendado para 2.5 (marcas de tiempo por segundo):
0s-3s: Plano general bajo, un cachorro de panda se recuesta en una ladera verde de hierba, rodando lentamente hacia un lado por la pendiente, la luz del sol atravesando el bosque desde arriba a la izquierda.
3s-8s: El panda rueda hasta detenerse en la parte inferior derecha del encuadre, pasando de acostado de lado a boca abajo, su cara redonda vuelta hacia la cámara, la cabeza levantándose ligeramente y bajando de nuevo.
Regla práctica: Para contenido que necesita golpear el ritmo (videos musicales, montajes sincronizados al beat), elige 2.5 con marcas de tiempo; para contenido donde el ritmo se puede dejar al modelo (cortometrajes narrativos, piezas atmosféricas), el estilo de números de 2.0 también es suficiente. No fuerces marcas de tiempo por segundo en 2.0.
Esto es especialmente crítico para quienes hacen videos musicales — los cortes de cámara de un MV deben caer exactamente en el compás, y las marcas de tiempo por segundo son exactamente esas instrucciones de sincronización con el compás. Por eso consideramos 2.5 como el nuevo motor preferido para escenarios de transiciones y guion gráfico de videos musicales.
Cuatro: Luz y tono de color — la sección menos copiada de los ejemplos oficiales, pero la más valiosa
Si lees todos los prompts de ejemplo oficiales del día de lanzamiento, notarás algo en común: cada uno tiene una sección dedicada de luz y sombra, y está escrita con extrema especificidad — “luz de terror de tono bajo, dominada por sombras frías azul-verdosas, con un tubo fluorescente sobre la cabeza parpadeando de forma intermitente” o “el sol brilla oblicuamente desde detrás de la niña, formando un punto de luz Rembrandt brillante en su rostro.”
Esto no es floritura literaria, es una palanca. Ya desde la era de 2.0, los materiales oficiales concluían que, entre todos los modificadores como descripción de estilo, palabras de calidad de imagen y requisitos de resolución, la descripción de luz y sombra tiene el mayor impacto en la calidad de imagen. La mayoría de la gente solo escribe “cinematográfico, 8K” en su prompt, mientras que los ejemplos oficiales escriben la dirección de la fuente de luz, la textura de la luz, y el contraste entre luces y sombras.
La escritura del tono de color sigue el mismo patrón — los ejemplos oficiales usan uniformemente una estructura de tres capas:
- Color dominante: La base a gran escala (“sombras azul-verdosas desaturadas y concreto gris”)
- Color secundario: La capa media relacionada con el sujeto (“el pelaje húmedo y oscuro de la nutria, la chaqueta escolar azul marino”)
- Color de acento: Uno o dos toques de color pequeños y recurrentes (“el resplandor enfermizo del tubo fluorescente, el letrero verde tenue y distante de la salida de emergencia”)
Esta es la lógica de la gradación de color cinematográfica: la base establece el estado de ánimo, la capa media da forma al sujeto, y el color de acento guía la mirada. Escribir el tono de color siguiendo esta estructura de tres capas hace que la “sensación cinematográfica” de tu resultado no sea magia, sino una fórmula.
¿Cómo se ve cuando la sección de luz y sombra está bien escrita? Las capas de sombra y contornos de luz en esta escena final se escribieron siguiendo “dirección de fuente de luz + textura + contraste”:

Imagen: SunoMV Team · Ejemplo de iluminación de un resultado final de Seedance
Regla práctica: Reserva un párrafo en cada prompt dedicado a la luz — dirección de la fuente de luz + textura (luz dura/luz suave) + contraste (sombras oscuras de tono bajo/brillante y claro). Escribe esta sección, y podrás eliminar las palabras “sensación cinematográfica” de tu prompt.
Cinco: Cuatro reglas de movimiento y externalización emocional — haz que los personajes actúen como actores, no marionetas
La guía oficial da cuatro reglas específicas para describir el movimiento, cada una lista para copiar directamente en tu hábito de escritura:
- Detalle corporal + cuantificación de grado: Sé específico sobre manos, piernas, cabeza, y añade amplitud y velocidad — “levanta la mano lentamente”, “gira la cabeza rápidamente”, “pisa fuerte el suelo” — en lugar de “él se movió.”
- Prioriza movimientos pequeños, lentos y continuos: La guía oficial recomienda explícitamente evitar movimientos de alta explosividad como correr desenfrenadamente, saltar en grande, o dar volteretas violentas — esas son la zona de desastre donde las cosas se rompen. ¿Quieres alta energía? Delega esa energía al ritmo de edición y al movimiento de cámara, no hagas que el personaje haga una voltereta dentro de una sola toma.
- Escribe la conexión entre movimientos: “Levanta la mano aprovechando el impulso de girar” — describe claramente cómo el impulso de un movimiento fluye hacia el siguiente, para que la imagen se sienta coherente.
- Externaliza la emoción de forma concreta: No escribas “muy triste”; escribe “cabeza baja, hombros temblando ligeramente, dedos apretando inconscientemente el dobladillo de la ropa, lágrimas girando en los ojos pero sin caer.” La guía oficial incluso da una tabla directa de correspondencia entre emoción abstracta y detalle físico — vale la pena guardarla.
El ejemplo del vaquero del oeste del día de lanzamiento llevó esto al extremo: un primer plano facial de 10 segundos, la emoción pasando de “calma y enfoque” a “un destello en los ojos, una ceja ligeramente levantada” y luego a “las comisuras de la boca curvándose muy sutilmente hacia arriba” — todo transportado únicamente por micro-cambios en los ojos y la boca. La comprensión de la actuación de 2.5 ya puede manejar este nivel de instrucción.
Combinar guion gráfico con consistencia de personaje da este efecto en narrativa multi-escena:

Imagen: SunoMV Team · Ejemplo de consistencia de personaje entre tomas
Seis: Aplicar esta fórmula a videos musicales — cómo lo hace SunoMV
En este punto podrías estar pensando: una canción tiene decenas de tomas, y escribir cada una siguiendo la fórmula oficial suena a demasiado trabajo.
Eso es exactamente lo que hace SunoMV: divide automáticamente una canción en un guion de guion gráfico — el diseño de personajes, los motivos visuales y el arco emocional de las secciones son planificados primero de manera unificada por un director de IA, y luego se generan descripciones de toma específicas línea por línea de la letra, con las mejores prácticas oficiales sobre luz, tono de color y amplitud de movimiento integradas directamente en la lógica de generación. Toda la familia de modelos Seedance (incluida la vista previa anticipada de 2.5) está en la lista de modelos de video — elige tu modelo, entra una canción, y sale un video musical con transiciones y subtítulos.

Para quienes quieran profundizar en el flujo de trabajo completo, estos dos artículos lo desglosan con más detalle: el flujo de trabajo de cinco pasos de audio a resultado final con Seedance + Suno, qué significan Seedance 2.5 y 4K para los videos musicales. Para ver una demostración real, echa un vistazo a este tutorial de convertir una canción de Suno en un MV de IA completo (Roboverse, 12 minutos).
Preguntas frecuentes
P: ¿Qué tan largo puede ser un prompt para Seedance 2.5?
Los ejemplos oficiales generalmente tienen entre 500 y 1500 caracteres, y los ejemplos de narrativa compleja de 30 segundos son incluso más largos. Con el seguimiento de instrucciones reforzado de 2.5, la información en prompts largos básicamente no se pierde — siempre que esté organizada en las cuatro partes, en lugar de un solo párrafo continuo.
P: ¿Hay alguna herramienta oficial que me ayude a optimizar el prompt?
Sí. La guía oficial de 2.5 recomienda una skill de ajuste de prompts llamada sd25-pe (instalable vía npx) — introduce tu prompt en borrador y te ayudará a reescribirlo según las especificaciones oficiales.
P: ¿Cuánto más caro es 2.5 que 2.0? ¿Todavía puedo usar 2.0?
El precio oficial de 2.5 es de 70 yuanes por millón de tokens (sin incluir entrada de video), frente a 46 yuanes para 2.0 — aproximadamente un 52% más caro. 2.0 no ha sido descontinuado, y sigue siendo la opción más rentable para contenido diario — hemos escrito una comparación completa de cómo elegir entre las dos generaciones.
P: ¿Necesito escribir yo mismo el estilo de marcas de tiempo en SunoMV?
No. SunoMV organiza automáticamente el formato del guion gráfico según el modelo seleccionado — 2.5 usa marcas de tiempo por segundo, la familia 2.0 usa el estilo numerado — esta lógica de enrutamiento ya está integrada siguiendo las recomendaciones de la guía oficial.
Pruébalo ahora
Memorizar la fórmula oficial es una cosa; generar el resultado es otra. Ve al generador de audio a video de SunoMV, sube esa canción que has estado escuchando en repetición últimamente, elige Seedance en la lista de modelos, y mira con tus propios ojos en qué puede convertirse tu canción cuando el prompt está organizado siguiendo el método oficial.
SunoMV Team
Popular guides
- 01 Prompts de Suno que sí funcionan: 10 reglas + plantillas (2026)
- 02 Cómo convertir cualquier canción de Suno en un videoclip: El flujo de trabajo completo
- 03 7 Generadores de Música IA Realmente Gratis en 2026 (Suno, Udio, ACE-Step)
- 04 Guía Completa Suno v5 Música de IA (2026): De Página en Blanco a Sencillo Listo para Publicar
- 05 Descarga canciones de Suno como MP4 gratis: 3 formas comparadas (2026)
More in this series
- Seedance 2.0 vs 2.5 a Fondo: ¿Qué Compras Realmente con un 52% Más Caro? Estilo de Escritura, Capacidades y Costos, Todo Claro (Agosto de 2026)
- FLUX 3 a prueba: de texto a video a extensión de video, lo que le importa a los creadores de videos musicales
- De canción Suno v5.5 a video musical: SunoMV vs Freebeat vs VidMuse (2026)
- MiniMax H3 (Hailuo 03) para hacer un video musical con IA: si le das la canción al modelo, la imagen sigue el ritmo
- GEMA vs Suno: qué significa el veredicto de Múnich para los creadores de música con IA (2026)
Ver los 32 artículos de Comparativas de herramientas de IA para música y vídeo →