Réplica en video con IA del Paraíso Celestial Chino: MiniMax-H3 vs SeeDance 2.0 vs Kling
La mujer con hanfu rojo sobre un puente sobre el mar de nubes: el video de IA de «paraíso celestial chino» más viral de 2026. Lo ejecutamos con MiniMax-H3, SeeDance 2.0 y Kling y dos fuentes de primer fotograma. Cuatro clips reales, comparados cara a cara.
Réplica en video con IA del Paraíso Celestial Chino: MiniMax-H3 vs SeeDance 2.0 vs Kling
A principios de agosto de 2026, los videos de IA de «paraíso celestial chino» se hicieron virales en las plataformas sociales: una mujer con hanfu rojo de pie sobre un puente de arco de piedra, mares de nubes en movimiento y complejos palaciegos dorados que aparecían a lo lejos. El creador original lo reprodujo con la API de MiniMax H3 y compartió el flujo de trabajo completo. Ejecutamos la misma escena con MiniMax-H3, SeeDance 2.0 y Kling a través de la pasarela multimodal de Neta Studio, con dos fuentes de fotogramas de referencia (un fotograma generado por Gemini frente a un fotograma clave del video original), para una comparación cara a cara.
Los fotogramas de referencia
Se utilizaron dos fuentes de primer fotograma. El fotograma generado por Gemini (izquierda) se creó puramente a partir de un prompt de texto. El fotograma clave original (derecha) se tomó del video viral, con la marca de agua inferior recortada: esto le da al modelo la composición exacta del original.



Cuatro resultados de generación: mira los videos
Los cuatro clips que aparecen a continuación se generaron a partir de los prompts de texto (o prompt + fotograma de referencia del primer fotograma), a 10s / 768P / 16:9. Reprodúcelos para comparar la fidelidad de la composición, la fluidez del movimiento y la consistencia de los detalles.
Los prompts que usamos
Estos son los prompts exactos, para que puedas replicarlos o remezclarlos. El prompt de texto a video (MiniMax-H3) describe la escena completa; los prompts de imagen a video describen solo el movimiento sobre un primer fotograma fijo.
Comparación de costo / estado
| Modelo | Primer fotograma | Costo | Estado |
|---|---|---|---|
| MiniMax-H3 | Solo texto | $0.68 | ✓ completado |
| SeeDance 2.0 | Fotograma Gemini | $3.76 | ✓ completado |
| Kling | Fotograma Gemini | $1.26 | ✓ completado |
| SeeDance 2.0 | Fotograma clave original | $3.76 | ✓ completado |
Veredicto: ¿qué modelo replica mejor el Paraíso Celestial Chino?
MiniMax-H3 (texto a video) ofrece la mejor relación calidad-precio: $0.68 por un clip de 10s a 768P, con una composición que reproduce fielmente el original — mujer con hanfu rojo, puente de arco de piedra, nubes en movimiento y palacio dorado, todo presente — y no necesita fotograma de referencia, solo un prompt.
SeeDance 2.0 produce el detalle más fino, pero cuesta 5× más ($3.76), y la fuente del primer fotograma importa mucho: usar el fotograma clave original da la composición y el ambiente más cercanos al video de origen.
Kling se sitúa en el medio ($1.26), con movimiento natural y un buen equilibrio entre calidad y precio.
Extra: la escena del «Palacio del Paraíso» — rápido vs refinado
Más allá de la escena del puente, también generamos una variante centrada en el palacio («中式仙境仙宫»): un mar de nubes en movimiento, un complejo palaciego dorado a lo lejos, un ave divina Kunpeng irrumpiendo entre las nubes en el plano medio y tres inmortales con túnicas conversando bajo un pino que saluda a los invitados en el primer plano. Se produjeron dos versiones con Seedance 2.0: un nivel rápido sin referencia y un nivel refinado con 2 fotogramas de referencia de estilo.


V1 · Seedance 2.0 Fast (sin referencia)
Generado a partir de texto puro: el prompt pide nubes en movimiento, un palacio resplandeciente, un Kunpeng irrumpiendo del mar de nubes y tres inmortales bajo un pino. Entrega todos los elementos a bajo costo, perfecto para validar una idea rápidamente.
V2 · Seedance 2.0 con 2 fotogramas de referencia de estilo
El mismo prompt más 2 capturas de referencia de estilo. El primer fotograma se verificó manualmente: tres inmortales con túnicas (un hombre y dos mujeres) sobre una plataforma de piedra en el acantilado, bajo un pino que saluda a los invitados, contemplando el palacio dorado entre la niebla; el Kunpeng en el plano medio. El ambiente general y la paleta están mucho más cerca del material de referencia: la mejor opción para la entrega final.
V1 vs V2: qué cambian los fotogramas de referencia
| Aspecto | V1 · Rápido | V2 · Refinado |
|---|---|---|
| Modelo | Seedance 2.0 Fast | Seedance 2.0 |
| Referencia de estilo | Ninguna (solo texto) | 2 fotogramas (alineados por estilo) |
| Función | Borrador rápido, validación de ideas | Entrega final |
| Resolución | 480P 864×496 | 480P 864×496 |
| Resultado | Todos los elementos presentes ✓ | Todos los elementos + más cercano a la referencia ✓ |
Conclusión: cuando la escena tiene requisitos de estilo marcados (paleta, atmósfera, detalle arquitectónico), los fotogramas de referencia de estilo importan: el contenido es idéntico, pero V2 se acerca mucho más al aspecto deseado. Para experimentos rápidos, el nivel rápido a 480P es más que suficiente.
El flujo de trabajo completo (replícalo tú mismo)
Escribe el prompt
Describe el sujeto, el entorno, la luz y la cámara. Ejemplo: «Plano cinematográfico de un paraíso celestial chino: mujer con hanfu rojo de espaldas sobre un puente de arco de piedra blanca, mar de nubes abajo, complejo palaciego dorado a lo lejos, cálida luz de atardecer, grulla planeando».
Genera un primer fotograma (opcional)
Usa un modelo de imagen para controlar la composición. Un fotograma de Gemini cuesta unos $0.07.
Genera el video
Elige MiniMax-H3 (texto a video) o SeeDance 2.0 / Kling (imagen a video) y configura 10s / 768P / 16:9.
Revisa y refina
Compara la fidelidad; si no estás satisfecho, ajusta el prompt o cambia el primer fotograma.
¿Por qué hacerlo en Neta Studio?
La pasarela multimodal de Neta Studio agrega MiniMax-H3, SeeDance 2.0, Kling, Seedance y más detrás de un solo comando, sin tener que gestionar varias claves API. Los resultados generados se suben automáticamente a la CDN, listos para incrustar o compartir.
Genera tu propio video con IA
Un solo prompt, o simplemente di «hazme un video de paraíso celestial chino»: Neta Studio se encarga. Empieza gratis, sin código.