Puesto #1 Generación de Vídeo — Hollywood en un Cuadro de Texto
ByteDance (Seed Team)

Seedance 2.5

Un plató que recuerda toda la escena: hasta 30 segundos de vídeo y audio sincronizados, 50 referencias multimodales y correcciones puntuales sin regenerar la toma completa.

Actualizado 14 de agosto de 2026 30-Second VideoSynced Audio50 References
Ideal para

Un plató que recuerda toda la escena: hasta 30 segundos de vídeo y audio sincronizados, 50 referencias multimodales y correcciones puntuales sin regenerar la toma completa.

Por qué gana

El salto práctico es el control: historias de 30 segundos, extensiones sucesivas, hasta 30 imágenes + 10 vídeos + 10 audios, dirección por marcas de tiempo y edición localizada de personajes, acción, fondo o cámara.

Ten en cuenta

Aún no existe un Elo independiente para 2.5 y la API oficial sigue anunciada como próxima. Los primeros usuarios también mencionan coste alto, filtros más estrictos y fallos conocidos en manos o movimientos complejos.

01

Lo que realmente es

Seedance 2.5 deja de pensar como una máquina tragaperras y empieza a comportarse como un plató. Los generadores antiguos entregan un clip breve y obligan a tirar otra vez si una mano se derrite. El lanzamiento de ByteDance del 31 de julio conserva el espectáculo del movimiento con sonido sincronizado, pero añade memoria, instrucciones y una goma de borrar.

Sus 30 segundos duplican el lienzo oficial de 2.0. Lo importante no es solo durar, sino ordenar ese tiempo en planos conectados con planteamiento, desarrollo, giro y resolución. Las extensiones sucesivas pueden arrastrar personajes, entorno, lenguaje audiovisual y ritmo. No crea un largometraje automáticamente, pero elimina varias costuras que antes había que ocultar en edición.

Las 30 imágenes, 10 vídeos y 10 audios funcionan como departamentos de una pequeña producción: una imagen define al actor, otra el vestuario, un vídeo la cámara y un audio la voz. Los renders de arcilla aportan escenario, posiciones y trayectorias. Sin embargo, más referencias no siempre ayudan. Pruebas tempranas describen 2.5 como más literal que 2.0; un storyboard contradictorio puede hacer desaparecer muebles o imprimir rótulos dentro del vídeo.

La edición es donde probablemente se ahorra más. El prompt puede dividirse en intervalos y, después, una corrección localizada cambia acción, personaje, fondo o cámara sin desechar lo útil. Es como mover una lámpara equivocada en vez de volver a rodar toda la escena.

La evidencia necesita etiquetas. Las demostraciones de ByteDance prueban lo que puede lograr una salida seleccionada, no su tasa media de aciertos. La propia empresa admite que la física compleja y las interacciones entre varios sujetos deben mejorar. La comunidad está dividida: celebra caras, actuación, coreografía larga y fidelidad, pero critica artefactos, coste y censura.

Tampoco hay un liderazgo verificable. Artificial Analysis solo puntúa actualmente el endpoint 720p de 2.0. ByteDance está desplegando 2.5 en Jimeng y Doubao Pro; la API ModelArk y precios estables aún no están disponibles, y el anuncio no promete 4K nativo. Es quizá el flujo más dirigible, pero todavía no el mejor demostrado para toda clase de plano.

02

Puntos fuertes y límites honestos

Puntos fuertes

  • Un lienzo narrativo real de 30 segundos: Una generación puede incluir planteamiento, desarrollo, giro y desenlace. Las extensiones mantienen personajes, entorno, ritmo y sonido.
  • Hasta 50 referencias con función concreta: Acepta 30 imágenes, 10 vídeos y 10 audios. Apariencia, voz, movimiento, cámara, ritmo y estilo pueden proceder de materiales distintos.
  • Generación audiovisual nativa: Diálogo, ambiente, música y efectos nacen junto a la imagen, ayudando a que pasos, labios y cambios de escena compartan la misma línea temporal.
  • Generación y edición dirigidas: Las marcas de tiempo controlan intervalos concretos; después se puede modificar personaje, acción, fondo o cámara dentro de un segmento conservando el resto.
  • La previsualización se convierte en control: Los renders de arcilla fijan posiciones, trayectorias, ángulos y espacio. Seedance añade materiales, iluminación y estilo sobre ese plano tridimensional.

Limitaciones honestas

  • Sin resultado independiente para 2.5: A 14 de agosto, Artificial Analysis solo muestra Seedance 2.0: #3 con audio (1.222 Elo) y #4 sin audio (1.264). No son puntuaciones transferibles.
  • Acceso oficial todavía limitado: ByteDance cita Jimeng AI y Doubao Pro; la API de BytePlus ModelArk sigue ‘próximamente’. Precio, resolución, cola y funciones varían entre servicios.
  • Más duración no elimina los fallos: ByteDance reconoce problemas de física compleja y estabilidad con varios sujetos. Referencias contradictorias pueden provocar manos, objetos o continuidad defectuosos.
  • Coste y filtros frenan la iteración: La comunidad elogia actuación y fidelidad, pero critica el consumo de créditos y restricciones más duras que en 2.0. Fallar 30 segundos cuesta más que fallar cinco.
03

Resumen de Benchmarks

Elo independiente de Seedance 2.5 — Aún no listado

Artificial Analysis no había publicado una entrada de 2.5 el 14 de agosto de 2026. No está verificado que lidere una arena independiente.

Seedance 2.0 con audio — 1.222 Elo, #3

El predecesor ocupa el tercer puesto tras Gemini Omni Flash y MiniMax H3. Demuestra el nivel de la familia, no el de 2.5.

Capacidad de referencias — Hasta 50 entradas

ByteDance documenta 30 imágenes, 10 vídeos y 10 audios, clips de 30 segundos y múltiples rondas de extensión.

04

El Veredicto

Seedance 2.5 es el paso más convincente del generador de clips al espacio de producción. Su avance no es un botón mágico de película perfecta, sino la combinación de duración, referencias explícitas, sonido e imagen conjuntos y corrección quirúrgica. Es ideal para relatos con diálogo, anuncios, previsualización y trabajos guiados por referencias; 2.0 o un rival barato siguen teniendo sentido para experimentar, para acción bloqueada por filtros o cuando se necesita una API madura y precio previsible.

05

Preguntas frecuentes