curl.
Variantes
Todas las variantes son asíncronas. Envía mediante
POST /api/v1/video/queue y luego haz polling de POST /api/v1/video/retrieve hasta que el cuerpo de la respuesta sea video/mp4. Consulta Generación de vídeo para el flujo general de cola.
El modelo “un modelo, cuatro flujos”
La variante reference-to-video (seedance-2-0-reference-to-video y su hermana Fast) es el mismo modelo subyacente sirviendo cuatro tareas diferentes. El modelo infiere la tarea a partir del prefijo del prompt y la forma de tus entradas. No hay un campo task o workflow — la sintaxis del prompt es el enrutamiento.
La sintaxis del prompt es canónica y sensible a mayúsculas: corchetes angulares, primera letra en mayúscula, un único espacio antes del número —
<Video 1>, <Image 1>, <Audio 1>.
Patrones de flujo
Flujo Reference
Usa los archivos de referencia subidos como donantes — sujeto, escena, movimiento, estilo, timbre vocal — para generar un vídeo completamente nuevo. Patrones canónicos de prompt:Refer to <Subject 1> in <Image 1> to generate a 5-second clip of the same character riding a horse through snow.Refer to the camera scene in <Video 1> to generate a similar establishing shot of a futuristic city at dawn.Refer to <Subject 1> in <Image 1> and use the timbre in <Audio 1> for the narrator describing the scene.(los donantes de audio deben emparejarse con al menos una referencia de imagen o vídeo — solo audio se rechaza)
Flujo Edit
Modifica un único vídeo de entrada. Cualquier cosa no nombrada explícitamente en el prompt se preserva. Úsalo cuando quieras un cambio localizado (cambio de sujeto, cambio de clima/color, añadir/eliminar elemento) en lugar de un vídeo totalmente nuevo. Patrón canónico de prompt:Strictly edit <Video 1>, changing its weather from sunny to a heavy rainstorm.Add snacks such as fried chicken and pizza to the countertop in <Video 1>.Remove the red car from <Video 1>, keeping the rest of the video content unchanged.Replace the perfume featured in <Video 1> with the face cream from <Image 1>, with all original motions and camera work preserved.
<Image 1> como donante visual para el reemplazo.
Flujo Extend
Continúa un único clip hacia adelante o hacia atrás en el tiempo. Por defecto, Seedance devuelve solo el contenido nuevo — no el clip de entrada original concatenado con la extensión. Esto es por diseño, para continuidad de transición; si quieres preservar el clip de entrada junto con la extensión, dilo explícitamente:Extend <Video 1>, generate a dramatic chase scene through narrow alleys at dusk.Extend <Video 1> backward, the same character walking toward the camera before the original shot begins.Extend <Video 1>, start with <Video 1>, then the camera pulls back to reveal a vast landscape.
Flujo Stitch (Track Completion)
Conecta 2-3 clips de entrada con transiciones generadas por IA. La duración total combinada de entrada debe ser ≤ 15 s. Patrón canónico de prompt:<Video 1> + a smooth seamless cut + followed by <Video 2><Video 1>. The moment a leaf falls to the ground, it sets off a special effect of golden particles. A gust of wind blows by, leading into <Video 2>.<Video 1> + a wisp of smoke transforms into a flock of birds + followed by <Video 2> + a slow dolly-in + followed by <Video 3>
Fórmula universal de prompt
En los cuatro flujos, la fórmula de autoría recomendada es:- Sujeto + Movimiento: la base lógica — define “Quién” está realizando “Qué acción”
- Entorno + Estética: fondo espacial, iluminación, estilo visual
- Cámara: tipo o movimiento explícito de toma
- Audio: efectos de sonido ambientales o dirección vocal para salida inmersiva
Strictly edit <Video 1>, changing its <subject + motion + environment + ...>) produce las salidas de mayor calidad.
Límites de entrada multimodal
Los valores siguientes son lo que acepta la API de Venice. Las solicitudes fuera de estos rangos se rechazan en la capa de schema con un 400 antes de llegar a la inferencia.Imágenes
Vídeos
Audio
El audio de referencia se admite solo en las variantes R2V. Cada entrada se reenvía al modelo como un elemento de contenido
role: "reference_audio" al que el prompt se dirige como <Audio 1>, <Audio 2>, <Audio 3> — el modelo usa cada clip para timbre vocal, efectos de sonido o música de fondo dependiendo de cómo el prompt lo encuadre. El campo singular heredado audio_url mapea a la misma forma de contenido y ahora es equivalente a pasar un reference_audio_urls de un elemento.
Tamaño de la solicitud
El endpoint de cola acepta cuerpos JSON de hasta 35 MB. Las data URLs inline para vídeos grandes pueden empujar más allá de esto — para Stitch multi-clip en particular, prefiere URLs en lugar de base64 inline.Precios
Llama aPOST /api/v1/video/quote para obtener una cotización para una forma de solicitud dada antes de enviarla a /video/queue. El endpoint de cotización es la única fuente autoritativa; los detalles de precio pueden cambiar y no deberían cachearse ni duplicarse en el cliente.
Cuando los vídeos de referencia forman parte de la solicitud, pasa también reference_video_total_duration (la suma de todas las duraciones de clips de referencia en segundos) para que la cotización coincida con lo que cobrará /video/queue:
Ejemplos completos
Todos los ejemplos asumen queVENICE_API_KEY está establecida en el entorno.
Text-to-video
Image-to-video (primer frame)
seedance-2-0-image-to-video (y su variante Fast) no aceptan aspect_ratio — el aspect ratio de salida se deriva automáticamente de las dimensiones de la imagen de entrada. Pasar el campo devuelve un 400 con “This model does not support aspect_ratio”. Usa las variantes T2V o R2V si necesitas control explícito de aspect ratio.Flujo Reference — donante de sujeto
Flujo Reference — donante de sujeto + audio
Flujo Edit
Flujo Edit con anclaje por imagen
Extender hacia adelante
Stitch (3 clips)
Polling de finalización
Tras cada envío a la cola, guarda elqueue_id devuelto y haz polling de /video/retrieve hasta que el cuerpo de la respuesta sea video/mp4:
{ "status": "queued" | "running" | "failed", ... }) hasta que el trabajo se complete, momento en el que el cuerpo de la respuesta cambia a bytes video/mp4. Consulta Generación de vídeo para el patrón completo de polling.
Resolución de problemas
At least one reference is required for this model
Los envíos de reference-to-video deben incluir al menos uno de reference_image_urls, reference_video_urls, image_references o video_references. La generación pura solo de texto no es un flujo R2V válido — usa seedance-2-0-text-to-video en su lugar. reference_audio_urls por sí solo no es suficiente (consulta la sección de Audio anterior).
reference_video_urls must have at most 3 videos
El modelo limita los vídeos de referencia a 3. Si necesitas más clips, haz un Stitch primero (3 → 1) y luego usa la salida como referencia para un seguimiento.
Per clip must be 2–15s / agregado > 15s
La duración por clip es [2, 15] segundos inclusive; la suma entre todos los vídeos de referencia también está limitada a 15 segundos. Recorta los clips en el cliente antes del envío.
El prompt enruta al flujo incorrecto
El flujo se infiere de la sintaxis del prompt. Errores de enrutamiento comunes:- Querer Extend pero escribir
Refer to ...→ el modelo trata tu vídeo como donante, no como lienzo a continuar - Querer Stitch pero escribir
Refer to ...→ el modelo elige uno como donante, ignora los demás - Querer Edit pero escribir
Generate a video based on <Video 1>→ ambiguo; el modelo puede caer en Reference por defecto
Strictly edit <Video 1>, ..., Extend <Video 1>, ..., <Video 1> + ... + followed by <Video 2>.
La cotización no coincide con el importe en cola
Si incluiste un vídeo de referencia pero no pasastereference_video_total_duration a /video/quote, la cotización y el importe en cola pueden diferir. Pasa siempre reference_video_total_duration (suma de todas las duraciones de clips de referencia, en segundos) cuando haya vídeos de referencia.
Referencias
- Endpoint de cola de vídeo de Venice:
POST /api/v1/video/queue - Endpoint de cotización de Venice:
POST /api/v1/video/quote - Guía complementaria: Reference to Video (cubre Kling O3 + Grok Imagine R2V)
- Guía complementaria: Generación de vídeo (visión general de cola / polling)