Skip to content

Generador de vídeo

Crea clips de vídeo generados por IA a partir de descripciones de texto o imágenes de referencia

Inicia sesión para generar videos

Crea videos con IA a partir de texto o imágenes.

Funciones

  • Texto a vídeo - Describe cualquier escena y obtén un clip de vídeo
  • Imagen a vídeo - Sube una imagen como fotograma inicial y anímala
  • Guion gráfico con múltiples tomas - Crea secuencias de hasta 6 tomas, cada una con su propia indicación y duración
  • Fotogramas inicial y final - Fija imágenes específicas como primer o último fotograma de tu vídeo
  • Imágenes de referencia - Sube imágenes de referencia y usa @Element1, @Element2 en tu indicación para mantener la coherencia de los personajes
  • Audio nativo - Genera audio sincronizado compatible con diálogos (chino e inglés)
  • Clips de 3 a 15 segundos - Duración flexible, desde tomas rápidas hasta secuencias más largas
  • Indicación negativa - Especifica lo que no quieres que aparezca en tu vídeo
  • Fidelidad a la indicación - Ajusta con precisión cuánto debe ceñirse el modelo a tu descripción

Disposición

El generador utiliza el mismo orden de secciones en todos los modos:

  1. Selector de modo
  2. Entrada de escena (una sola indicación o tomas del guion gráfico)
  3. Fotogramas y personajes de referencia
  4. Controles de renderizado
  5. Opciones avanzadas

Consejos para obtener los mejores resultados

  • Describe claramente la escena, el sujeto y el movimiento en tu indicación
  • Incluye instrucciones de cámara cuando sean relevantes (por ejemplo, «panorámica lenta», «zoom dolly», «toma de seguimiento»)
  • Menciona la iluminación, la atmósfera y el estilo visual (por ejemplo, «cinematográfico», «hora dorada», «cine negro»)
  • Para lograr una mayor coherencia, centra cada indicación en una sola escena o acción
  • Usa la indicación negativa para excluir defectos habituales como el desenfoque y la distorsión
  • Baja el control deslizante de fidelidad a la indicación para obtener más libertad creativa o súbelo para tener un control más preciso
  • Para convertir una imagen en vídeo, describe el movimiento que quieres en lugar de repetir lo que aparece en la imagen
  • Para los diálogos, escribe las intervenciones con naturalidad en la indicación y Kling generará voces que coincidan

Guion gráfico con múltiples tomas

El modo Guion gráfico te permite crear una secuencia de vídeo a partir de varias tomas. Cada toma tiene su propia indicación y duración, y Kling las renderiza juntas en un único vídeo continuo.

Puedes añadir hasta 6 tomas. Hay dos modos de división disponibles: Duraciones personalizadas te permite establecer de forma independiente la duración de cada toma (entre 3 y 15 segundos cada una), mientras que División automática deja que el modelo decida cómo distribuir el tiempo entre tus tomas.

Piensa en cada toma como un corte de una película. Describe lo que ocurre en cada una: el encuadre, la acción y el movimiento de la cámara. El modelo se encarga de las transiciones entre ellas.

Fotogramas inicial y final

Usa la sección Fotogramas y personajes de referencia para subir un Fotograma inicial y un Fotograma final.

  • El Fotograma inicial es obligatorio en Imagen a vídeo
  • El Fotograma inicial también es obligatorio si usas un Fotograma final o Imágenes de referencia
  • El Fotograma final es opcional en todos los modos

Imágenes de referencia

Sube hasta 4 imágenes de referencia en la sección Fotogramas y personajes de referencia. Cada una recibe una etiqueta @Element (@Element1, @Element2, etc.) que puedes usar en tu indicación o en las indicaciones de las tomas para indicar al modelo qué personaje u objeto debe colocar.

Usa una foto frontal y nítida del personaje, con buena iluminación y sin obstrucciones. El modelo mantendrá la apariencia de ese personaje durante todo el vídeo, incluso en guiones gráficos con múltiples tomas.

Requisitos de las imágenes de referencia

Para las imágenes de entrada de Kling v3 Pro, asegúrate de que todas las imágenes iniciales, finales y de referencia tengan un tamaño mínimo de 300x300, una relación de aspecto de entre 0.40 y 2.50 y un tamaño de archivo inferior a 10MB. Los formatos PNG y JPEG funcionan bien.

Si una imagen tiene menos de 300 px en cualquiera de sus lados (por ejemplo, 591x295), la generación puede fallar aunque la indicación sea válida.

Ejemplos de indicaciones

Texto a vídeo:

  • «Un gato estirándose perezosamente en el alféizar de una ventana bañado por el sol, motas de polvo flotando en la cálida luz de la tarde, ambiente interior acogedor»
  • «Vuelo de dron sobre un río serpenteante que atraviesa un bosque otoñal, follaje de vivos tonos rojos y dorados, iluminación de la hora dorada»
  • «Primer plano de un espresso sirviéndose en una taza de cerámica, vapor elevándose, poca profundidad de campo, ambiente de cafetería»

Imagen a vídeo:

  • «El personaje se gira lentamente para mirar a la cámara y sonríe, mientras una suave brisa agita su cabello»
  • «La cámara se aleja lentamente mientras caen hojas del árbol, con una suave iluminación natural»
  • «El paisaje pasa del día a una puesta de sol dorada, con nubes desplazándose por el cielo»

Guion gráfico (3 tomas):

  1. «Plano general de situación de un valle montañoso cubierto de niebla al amanecer, con la cámara avanzando lentamente»
  2. «Plano medio de un excursionista solitario caminando por la cresta, con el viento agitando su chaqueta»
  3. «Primer plano de su rostro al llegar a la cima y sonreír, mientras una luz dorada atraviesa las nubes»

Con imágenes de referencia:

  • Sube una foto de una persona como @Element1 y, a continuación, usa esta indicación: «@Element1 camina por una concurrida calle de la ciudad, la cámara lo sigue desde un lado, con iluminación de la hora dorada»