Texto para imagemGerador de imagem para imagem com IATexto para vídeo com IAReferências para vídeoTransformar foto em vídeo com IADe 0,0308 $ / imagem
Kling 3.0 Omni génère des visuels multi-scènes cohérents avec une qualité cinématographique, une stabilité des personnages et des séquences d'images professionnelles.
curl-X POST 'https://pollo.ai/api/platform/v1/generation/kling-ai/kling-v3-omni/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "16:9", "duration": 5, "mode": "pro", "generateAudio": true }}'
Opcionalmente, inclua o webhookUrl para receber uma notificação quando a tarefa for concluída com sucesso ou falhar.
Campo de solicitação opcional
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"16:9","duration":5,"mode":"pro","generateAudio":true},"webhookUrl":"https://example.com/webhooks/pollo"}
Esquema
Campos de entrada para o ponto de extremidade e o modo selecionados.
Campo
Tipo
Obrigatório
Descrição
prompt
string
Sim
Text prompt describing the content to generate.
aspectRatio
string
Não
Output aspect ratio, as width:height (e.g. 16:9).
duration
integer
Não
The duration of the generated video, in seconds.
mode
string
Não
Generation mode of the model (e.g. a faster or higher-quality tier).
generateAudio
boolean
Não
Generate natural-sounding, fitting audio for the output video.
Kling 3.0 Omni génère de la vidéo à partir de plusieurs types d'entrées, notamment du texte, des images, des ensembles de sujets, des vidéos sources et de l'audio, dans une seule requête jusqu'à 4K.
Avec l'API Kling 3.0 Omni sur Pollo , les développeurs peuvent générer des vidéos de référence à partir d'un mélange de types de guides, en choisissant la longueur du clip, le format d'image et l'audio correspondant optionnel pour chaque requête.
Principales fonctionnalités de l'API Kling 3.0 Omni
Entrée de référence omnimodale
Le modèle accepte jusqu'à sept références simultanément, combinant une image, une vidéo source, un ensemble de sujets et un signal audio pour guider une seule génération.
Cohérence du sujet
Fournissez plusieurs images d'un personnage ou d'un objet. Le modèle conserve son identité tout au long du plan, même lorsque la scène se déplace.
Mouvement guidé par l'audio
Fournissez une référence audio et le modèle synchronise le mouvement, le rythme et le tempo avec le son, en alignant l'action sur les temps forts, la parole ou les indices ambiants du clip.
Simulation environnementale
La simulation spatiale permet de restituer des scènes mono-plan avec une lumière cohérente, une profondeur et une réaction environnementale réalistes lorsque la caméra et les sujets se déplacent dans l'espace.
Sortie volumétrique 4K
Les générations suivantes atteignent la résolution 4K, conservant des détails de texture et de profondeur fins en haute résolution pour les applications de diffusion et les écrans de grande taille.
Durée et cadrage flexibles
Les clips durent de 3 à 15 secondes au format paysage, portrait ou carré, permettant à une seule intégration de gérer la diffusion sur les réseaux sociaux, les produits et en plein écran à partir du même modèle.
Cas d'utilisation de l'API Omni de Kling 3.0
Contenu de personnage récurrent : Réutilisez un ensemble de sujets pour maintenir la cohérence d’une mascotte, d’un hôte ou d’un avatar dans les clips épisodiques sans avoir à redessiner son identité à chaque fois.
Clips de performance synchronisés audio : Pilotez un danseur, un musicien ou un orateur de manière à ce que ses mouvements se synchronisent avec une piste téléchargée, utile pour la musique et les outils de mouvement des lèvres.
Restyle à partir d'une vidéo : Utilisez un clip existant comme référence et régénérez-le avec une nouvelle direction tout en conservant intacts le mouvement et la mise en scène d'origine.
Flux de séquences : Combinez des références d'images et de vidéos pour prolonger un plan, en conservant la continuité de l'environnement et du sujet sur une séquence plus longue.
Storyboard multi-références : Fusionnez plusieurs images et un sujet en une seule séquence pour prévisualiser des scènes complexes avant de vous engager dans une étape de production complète.
Ressources de diffusion haute résolution : Générez des scènes 4K en plan unique pour l’affichage dynamique, les intros de streaming ou les grands écrans où la résolution et la profondeur sont importantes.
Variantes publicitaires localisées : Réutilisez un sujet et modifiez les références audio pour produire des versions spécifiques à chaque région, avec un rythme adapté et une image de marque cohérente.
Démonstrations d'environnements immersifs : Présentez un espace se remplissant de brouillard, d'eau ou de mouvement de foule où l'environnement réagit de manière crédible pour des aperçus immobiliers ou événementiels.
Comment utiliser l'API Omni de Kling 3.0
Obtenir une clé API : Créez un compte API Pollo et générez votre clé API depuis le tableau de bord développeur.
Choisissez le modèle : Envoyez des requêtes au point de terminaison Kling 3.0 Omni à l’adresse /generation/kling-ai/kling-v3-omni/ref2video.
Ajoutez vos entrées : Fournissez une invite et une à sept références (image, sujet, vidéo ou audio), puis définissez la duration (3-15), le aspectRatio et la resolution (720P, 1080P ou 4K).
Générer et récupérer : Soumettez la tâche, interrogez l'état de la tâche renvoyée et téléchargez la vidéo terminée, éventuellement avec generateAudio produisant une bande son correspondante.
Recommandations pour l'API Omni de Kling 3.0
Considérez cette consigne comme un ensemble de références à orienter plutôt que comme une description à partir de zéro. Indiquez le rôle de chaque référence, l'action souhaitée et comment la scène doit se dérouler autour de votre sujet.
Une formule simple pour les invites
Sujet et son rôle de référence + action spécifique + comportement dans la scène et l'environnement + mouvement de la caméra + indice audio ou de rythme
Ce que vous devez remarquer
Attribuer les rôles de référence : Indiquez au modèle quelle référence est le sujet, quelle référence est le décor et quelle référence pilote l’audio, afin que les indications ne soient pas contradictoires.
Gardez les sujets clairs : Fournissez des images nettes et variées d'un même personnage afin que son identité reste constante sur l'ensemble de la photo générée.
Décrire la réponse de l'environnement : Indiquez comment la lumière, les conditions météorologiques ou l'environnement doivent évoluer, étant donné que le modèle simule un espace plutôt qu'un arrière-plan plat.
Correspondance audio-action : Lorsque vous utilisez une référence audio, nommez le mouvement avec lequel elle doit se synchroniser afin que le rythme suive le son.
Choisissez la résolution en fonction de l'objectif : Choisissez la 4K pour la diffusion et les grands écrans, des paramètres inférieurs pour des brouillons et des itérations plus rapides.
Conserver une seule scène : Limitez chaque génération à un seul moment cohérent afin que le clip reste continu d'un bout à l'autre.
Exemples d'invites
Épisode de mascotte cohérent
« Utilisez comme sujet un renard roux illustré en uniforme de scout. Le renard traverse une bibliothèque baignée de soleil, s'arrête pour prendre un livre lumineux sur une étagère en hauteur et sourit. Lent travelling avant, lumière chaude et poussiéreuse. »
Danseuse de rue synchronisée avec l'audio
"Animer le danseur au rythme de la piste de batterie téléchargée. Des mouvements de pieds précis et des coups de bras résonnent à chaque temps dans un passage souterrain en béton au crépuscule, des ombres bleues froides, une caméra à l'épaule tournant autour de lui tandis que les pulsations de la basse montent en puissance."
Révélation de la simulation d'environnement
« À l’aube, une cour de pierre se remplit lentement d’un brouillard épais qui s’enroule autour de vieilles colonnes et capte les premiers rayons du soleil. La caméra s’élève pour révéler toute la scène : ambiance feutrée, style réaliste et apaisant. »
Refonte vidéo
« Prenez une séquence de référence montrant un cycliste sur une route côtière et réinterprétez-la comme une peinture à la main. Conservez le même itinéraire et le même mouvement de pédalage, ajoutez de l'herbe balayée par le vent, des mouettes qui passent et une douce lumière d'après-midi. »
Cohérence des sujets à partir des ensembles d'images
✅ Ensembles de sujets multi-images
✅
✅
Mouvement guidé par l'audio
✅ Synchronisation avec une référence audio
✅ Audio généré
✅ Audio synchronisé
Résolution maximale
Jusqu'à 4K
Jusqu'à 1080p
Jusqu'à 1080p
Durée des clips
3 à 15 secondes
Courts clips réalisés
Courts clips réalisés
Recommandé pour
Scènes mono-plan haute résolution avec références intégrées
Plans narratifs guidés par des prompts
Scènes créatives basées sur la physique
Pourquoi choisir l'API Kling 3.0 Omni ?
Kling 3.0 Omni convient aux produits qui s'appuient sur des ressources, vous permettant de fusionner des sujets, des clips sources et de l'audio en scènes cohérentes et haute résolution plutôt que de réaliser chaque prise de vue à l'aveugle.
Grâce à l'API Pollo , vous accédez à Kling 3.0 Omni avec une seule clé API, ainsi qu'à plus de 300 modèles vidéo et image de pointe, avec une documentation claire, un système d'interrogation des tâches et des webhooks.
Commencez par le point de terminaison Kling 3.0 Omni sur l'API Pollo pour déployer des fonctionnalités vidéo 4K de référence, puis comparez-le à Veo, Sora et d'autres modèles Kling sans modifier votre intégration.
FAQ sur l'API Omni de Kling 3.0
Qu'est-ce que Kling 3.0 Omni ?
Kling 3.0 Omni est un modèle vidéo Kling AI qui génère à partir de références combinées de texte, d'image, de sujet, de vidéo et d'audio, produisant des scènes cohérentes en une seule prise jusqu'à 4K.
Quelles entrées l'API Kling 3.0 Omni peut-elle combiner ?
Il accepte jusqu'à sept références dans une seule requête, combinant une image, une vidéo source, un ensemble d'images du sujet et un signal audio avec votre invite textuelle.
Comment fonctionne la cohérence des sujets ?
Vous fournissez un petit ensemble d'images d'un personnage ou d'un objet, et le modèle conserve ce sujet reconnaissable tout au long du clip généré, au fur et à mesure que la scène se déplace.
Quelles résolutions et longueurs sont prises en charge ?
L'API Kling 3.0 Omni produit des flux vidéo en 720P, 1080P ou 4K, avec des durées de clip sélectionnables de 3 à 15 secondes et un format paysage, portrait ou carré.
Peut-il générer un son correspondant ?
Oui. Il peut produire un son naturel pour la vidéo de sortie, et une référence audio peut également guider le timing et le rythme des mouvements à l'écran.
Pourquoi exécuter Kling 3.0 Omni via l'API Pollo ?
L'API Pollo offre une intégration pour Kling 3.0 Omni et plus de 300 autres modèles, avec documentation, suivi des tâches et webhooks.