Imagen a Video IACrear videos con IA a partir de texto gratisDesde 0,30 $ / video
El modelo de vídeo Kling O1 ofrece un flujo de trabajo versátil con entradas multimodales y garantiza una consistencia estable de los personajes en todas las tomas.
Aporte
Modo
Complete los campos obligatorios para ver el precio.
curl-X POST 'https://pollo.ai/api/platform/v1/generation/kling-ai/kling-video-o1/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "16:9", "duration": 5 }}'
Opcionalmente, incluya la URL del webhook para recibir una notificación cuando la tarea se complete con éxito o falle.
Campo de solicitud opcional
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"16:9","duration":5},"webhookUrl":"https://example.com/webhooks/pollo"}
Esquema
Campos de entrada para el punto final y el modo seleccionados.
Kling Video O1 genera vídeo a partir de un prompt escrito, imágenes de referencia o pares de fotograma inicial y final en una sola solicitud.
Con Kling Video O1 en Pollo API, los desarrolladores añaden este generador multimodal a sus apps, enviando entradas de texto, imagen o referencia y eligiendo la relación de aspecto y la duración del clip en cada llamada.
Funciones clave de la API de Kling Video O1
Compatibilidad con entrada multimodal
El modelo procesa texto, una sola imagen o un conjunto de imágenes de referencia mediante un único flujo de trabajo, así que un producto puede alternar entre generación basada en ideas y generación basada en recursos sin integraciones adicionales.
Consistencia con múltiples referencias
Hasta siete imágenes de referencia pueden guiar una sola generación, permitiendo que personajes, props o estilos de imágenes independientes aparezcan juntos en una misma escena, manteniendo la persistencia de rasgos y la consistencia de identidad.
Control del primer y último fotograma
Proporciona una imagen inicial y una imagen final, y el modelo interpola el movimiento entre ambas, dando un control preciso sobre cómo empieza un plano y dónde termina.
Estabilidad de fotograma a fotograma
Los sujetos, la iluminación y la composición se mantienen estables a lo largo del clip, por lo que las caras, los objetos y los fondos no se desvían ni se deforman entre fotogramas durante acciones más largas.
Prompting en varios pasos
Los prompts detallados de hasta 2.500 caracteres te permiten guionizar acciones secuenciadas y puesta en escena, para que el modelo siga un orden descrito de eventos en lugar de un único momento estático.
Encuadre flexible
Hay salidas en formato horizontal, vertical y cuadrado, adaptando la misma generación a reproductores panorámicos, feeds verticales o ubicaciones cuadradas.
Casos de uso de la API de Kling Video O1
Escenas con varios personajes: Combina imágenes de referencia de dos o tres personajes para que compartan un único plano con caras y vestuario consistentes.
Branding guiado por referencias: Introduce juntas imágenes de logotipo, producto y mascota para mantener los recursos de marca fieles al modelo en clips promocionales generados.
De storyboard a movimiento: Convierte un primer y un último fotograma en un plano animado, útil para herramientas de previz y pipelines guiados por layout.
Clips de acción secuencial: Guioniza movimientos en varios pasos en un solo prompt, como una figura que entra en plano, se sienta y luego reacciona a algo fuera de cámara.
Animación de historias ilustradas: Lleva personajes dibujados desde arte de referencia a escenas en movimiento para herramientas de libros infantiles, cómics o webtoons.
Movimiento de producto consistente: Anima un producto desde una sola imagen manteniendo fieles su forma, etiqueta y color durante todo el clip.
Automatización de contenido vertical: Genera clips en vertical a escala para feeds de formato corto usando texto o una sola imagen guía por solicitud.
Prototipado de concepto a vídeo: Permite a los equipos previsualizar un plano descrito a partir de un prompt antes de comprometer recursos de referencia o tiempo de producción.
Cómo usar la API de Kling Video O1
Obtén una clave API: Crea una cuenta de Pollo API y genera tu clave API desde el panel para desarrolladores.
Elige el modelo: Envía una solicitud POST al endpoint de Kling Video O1 en /generation/kling-ai/kling-video-o1.
Añade tus entradas: Pasa un objeto input para text-to-video (prompt), image-to-video (image más imageTail opcional) o reference-to-video (array images de hasta 7), y luego define aspectRatio y length.
Genera y recupera: Envía la tarea, consulta por sondeo el taskId devuelto y el estado, y descarga el vídeo cuando el procesamiento se complete correctamente.
Buenas prácticas de prompting para la API de Kling Video O1
Trata el prompt como una lista de planos. Nombra cada referencia con claridad, describe la secuencia de acciones en orden y luego define encuadre, movimiento y ambiente para que el modelo tenga un plan completo que seguir.
Una fórmula simple de prompt
Configuración de referencia o sujeto + acciones ordenadas paso a paso + cámara y encuadre + entorno e iluminación + estilo
Qué deberías tener en cuenta
Etiqueta tus referencias: Al usar varias imágenes, describe qué sujeto es cuál para que el modelo los coloque correctamente en la escena.
Ordena las acciones: Escribe los eventos en secuencia, ya que el modelo puede seguir una puesta en escena de varios pasos en lugar de un único momento congelado.
Ancla el fotograma final: Con una imagen final, describe cómo debe llegar el plano a ese punto para que la interpolación se sienta intencionada.
Ajusta la relación al destino: Elige horizontal, vertical o cuadrado desde el principio para encajar en el reproductor o feed objetivo.
Mantén los sujetos diferenciados: Da rasgos claros a cada personaje u objeto referenciado para mantener la consistencia a lo largo del clip.
Ejemplos de prompts
Encuentro con múltiples referencias
"Usando las tres imágenes de referencia —el joven inventor, el robot de cobre y el taller desordenado—, coloca a los tres en una misma escena. El inventor saluda con la mano, el robot inclina la cabeza en respuesta. Dolly-in lento, luz cálida de lámpara, estilo de ilustración dibujada a mano."
Transición del primer al último fotograma
"Empieza con el boceto a lápiz de un faro y termina en la versión final en acuarela. El color y la textura florecen por el encuadre de izquierda a derecha mientras el cielo se aclara. Cámara estática, luz diurna suave, transición pictórica delicada."
Pulso de acción secuencial
"Una panadera entra en plano llevando una bandeja, la deja sobre el mostrador, se sacude la harina de las manos y luego levanta la vista y sonríe a un cliente. Plano medio, luz de mañana por la ventana, estilo realista cálido, cámara en mano estable."
Movimiento de producto fiel a la referencia
"A partir de la imagen de referencia única de la tetera de cerámica, sirve té humeante en una taza a juego mientras el vapor se enrosca hacia arriba. Mantén exactos el patrón del esmalte y la forma. Primer plano lateral, luz de cocina suave, estilo realista limpio."
Kling Video O1 vs Vidu Q1 vs Runway Gen-4
Capacidad
Kling Video O1
Vidu Q1
Runway Gen-4
Entrada de múltiples referencias
✅ Hasta 7 imágenes de referencia
✅ Varios sujetos de referencia
✅ Guiado por referencias
Control del primer y último fotograma
✅ Imagen inicial y final
✅
❌ Limitado
Texto, imagen y referencia en un solo modelo
✅
✅
✅
Seguimiento de prompts en varios pasos
✅ Prompts largos ordenados
✅
✅
Opciones de relación de aspecto
16:9, 9:16, 1:1
Múltiples
16:9 y vertical
Recomendado para
Planos secuenciados con consistencia de referencias
Escenas de referencia con múltiples sujetos
Clips estilizados dirigidos por visión de dirección
¿Por qué elegir la API de Kling Video O1?
Kling Video O1 destaca cuando un plano debe combinar varias referencias, mantener todos los sujetos consistentes y seguir una secuencia ordenada de acciones en lugar de un momento aislado.
A través de Pollo API, accedes a Kling Video O1 con una sola clave API junto a más de 300 modelos líderes de vídeo e imagen, con documentación clara, sondeo de tareas y webhooks.
Empieza con el endpoint de Kling Video O1 en Pollo API para lanzar funciones de vídeo guiadas por referencias y en varios pasos, y luego compáralo con Vidu, Runway y otros modelos Kling sin tocar tu integración.
Preguntas frecuentes de la API de Kling Video O1
¿Qué es Kling Video O1?
Kling Video O1 es un modelo de vídeo multimodal de Kling AI que genera clips a partir de texto, una sola imagen o hasta siete imágenes de referencia, con gran consistencia entre fotogramas y prompting en varios pasos.
¿La API de Kling Video O1 admite imágenes de referencia?
Sí. Reference-to-video acepta hasta siete URL de imagen en una sola solicitud, de modo que varios personajes, productos o estilos pueden aparecer juntos en una única escena consistente.
¿Puede controlar el inicio y el final de un plano?
Sí. En image-to-video puedes proporcionar tanto una imagen inicial como una imagen final, y el modelo interpola el movimiento entre los dos fotogramas.
¿Qué relaciones de aspecto y duraciones hay disponibles?
Kling Video O1 genera en 16:9, 9:16 o 1:1, con duraciones de clip de 3 a 10 segundos según el modo de entrada que elijas en cada solicitud.
¿Cómo maneja las acciones secuenciadas?
Los prompts de hasta 2.500 caracteres te permiten describir eventos en orden, para que el modelo escenifique movimientos en varios pasos en lugar de un único momento estático.
¿Por qué ejecutar Kling Video O1 a través de Pollo API?
Pollo API ofrece una única integración para Kling Video O1 y más de 300 modelos adicionales, con documentación, seguimiento de tareas y webhooks.