curl-X POST 'https://pollo.ai/api/platform/v1/generation/kling-ai/kling-v3-omni/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "16:9", "duration": 5, "mode": "pro", "generateAudio": true }}'
È possibile includere facoltativamente l'URL del webhook per ricevere una notifica in caso di successo o fallimento dell'attività.
Campo di richiesta facoltativo
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"16:9","duration":5,"mode":"pro","generateAudio":true},"webhookUrl":"https://example.com/webhooks/pollo"}
Schema
Campi di input per l'endpoint e la modalità selezionati.
Campo
Tipo
Necessario
Descrizione
prompt
string
Sì
Text prompt describing the content to generate.
aspectRatio
string
NO
Output aspect ratio, as width:height (e.g. 16:9).
duration
integer
NO
The duration of the generated video, in seconds.
mode
string
NO
Generation mode of the model (e.g. a faster or higher-quality tier).
generateAudio
boolean
NO
Generate natural-sounding, fitting audio for the output video.
Kling 3.0 Omni genera video da diversi tipi di input, tra cui testo, immagini, set di soggetti, video sorgente e audio, in un'unica richiesta fino a 4K.
Con Kling 3.0 Omni su API Pollo , gli sviluppatori possono generare video basati su riferimenti, utilizzando una combinazione di tipi di guida e scegliendo la durata della clip, le proporzioni e, facoltativamente, l'audio corrispondente per ogni richiesta.
Caratteristiche principali dell'API Omni di Kling 3.0
Ingresso di riferimento omnimodale
Il modello accetta fino a sette riferimenti contemporaneamente, combinando un'immagine, un video sorgente, un set di soggetti e un segnale audio per guidare una singola generazione.
Coerenza del soggetto
Fornire più immagini di un personaggio o di un oggetto. Il modello mantiene l'identità del soggetto in tutta l'inquadratura, anche quando la scena si muove.
Movimento guidato dall'audio
Fornisci un riferimento audio e il modello sincronizzerà il movimento, il ritmo e la cadenza con il suono, allineando l'azione con i battiti, il parlato o i segnali ambientali presenti nella clip.
Simulazione ambientale
La simulazione spaziale permette di riprodurre scene a inquadratura singola con luce, profondità e reazione ambientale coerenti, man mano che la telecamera e i soggetti si muovono nello spazio.
Uscita volumetrica 4K
Le nuove generazioni raggiungono la risoluzione 4K, mantenendo dettagli precisi e profondità ad alta risoluzione per applicazioni broadcast e su grande schermo.
Durata e inquadratura flessibili
Le clip hanno una durata compresa tra 3 e 15 secondi e sono disponibili in formato orizzontale, verticale o quadrato, consentendo a una singola integrazione di gestire contenuti social, di prodotto e a schermo intero, utilizzando lo stesso modello.
Casi d'uso dell'API Omni di Kling 3.0
Contenuti dei personaggi ricorrenti: Riutilizza un set di soggetti per mantenere una mascotte, un presentatore o un avatar coerenti tra le clip episodiche senza doverne ridisegnare l'identità ogni volta.
Clip di performance sincronizzate con l'audio: Consente di sincronizzare i movimenti di un ballerino, un musicista o un oratore con una traccia audio caricata, utile per strumenti musicali e di sincronizzazione labiale.
Rimodellamento basato su video: Utilizza una clip esistente come riferimento e rigenerala con una nuova direzione, mantenendo intatti il movimento e la messa in scena originali.
Pipeline di continuazione della scena: Combina riferimenti di immagini e video per estendere un'inquadratura, mantenendo la continuità dell'ambiente e del soggetto in una sequenza più lunga.
Storyboarding multi-riferimento: Unisci diverse immagini e un soggetto in un unico prompt per visualizzare in anteprima scene complesse prima di procedere con la fase di produzione completa.
Risorse di trasmissione ad alta risoluzione: Genera scene in 4K a ripresa singola per segnaletica, introduzioni in streaming o grandi schermi dove risoluzione e profondità sono importanti.
Varianti di annunci localizzati: Riutilizza un soggetto e sostituisci i riferimenti audio per produrre versioni specifiche per regione con ritmo corrispondente e marchio coerente.
Demo di ambienti immersivi: Mostra uno spazio che si riempie di nebbia, acqua o movimento di folla, dove l'ambiente circostante reagisce in modo realistico, per anteprime di immobili o eventi.
Come utilizzare l'API Omni Kling 3.0
Ottieni una chiave API: Crea un account Pollo API e genera la tua chiave API dalla dashboard per sviluppatori.
Scegli il modello: Invia le richieste all'endpoint Kling 3.0 Omni all'indirizzo /generation/kling-ai/kling-v3-omni/ref2video.
Aggiungi i tuoi input: Fornisci un prompt e da uno a sette ref (immagine, soggetto, video o audio), quindi imposta la durata (3-15), il rapporto d'aspetto e la risoluzione (720P, 1080P o 4K).
Genera e recupera: Invia l'attività, verifica lo stato dell'attività restituito e scarica il video finito, eventualmente con generateAudio per produrre una colonna sonora corrispondente.
Suggerimenti sulle migliori pratiche per l'API Omni Kling 3.0
Considera la traccia come un'indicazione di riferimento, piuttosto che come una descrizione da zero. Indica il ruolo di ciascun riferimento, l'azione che desideri e come la scena dovrebbe interagire con il tuo soggetto.
Una semplice formula di richiesta
Soggetto e suo ruolo di riferimento + azione specifica + comportamento nella scena e nell'ambiente + movimento della telecamera + segnale audio o di ritmo
Cosa dovresti notare
Assegna ruoli di riferimento: Indica al modello quale riferimento è il soggetto, quale è l'ambientazione e quale controlla l'audio, in modo che la guida non sia in conflitto.
Mantieni i soggetti chiari: Fornisci immagini nitide e varie di un singolo personaggio, in modo che la sua identità rimanga invariata nell'intera inquadratura.
Descrivi la risposta ambientale: Indica come dovrebbero variare la luce, le condizioni meteorologiche o l'ambiente circostante, dato che il modello simula lo spazio anziché uno sfondo piatto.
Associa l'audio all'azione: Quando utilizzi un riferimento audio, specifica il movimento con cui deve essere sincronizzato in modo che il ritmo segua il suono.
Scegli la risoluzione in base allo scopo: Scegli 4K per trasmissioni e schermi di grandi dimensioni, impostazioni inferiori per bozze e iterazioni più rapide.
Mantieni una scena: Mantieni ogni generazione in un singolo momento coerente in modo che la clip rimanga continua dall'inizio alla fine.
Esempi di richieste
Episodio della mascotte coerente
"Utilizzate come riferimento l'immagine di una volpe rossa in uniforme da scout. La volpe cammina in una biblioteca illuminata dal sole, si ferma per prendere un libro luminoso da uno scaffale alto e sorride. Lenta carrellata in entrata, luce calda e polverosa."
Ballerino di strada sincronizzato con l'audio
"Anima il ballerino in base alla traccia di batteria caricata. Movimenti precisi dei piedi e colpi delle braccia a ogni battito all'interno di un sottopassaggio di cemento al crepuscolo, ombre blu fredde, telecamera a mano che ruota mentre le pulsazioni del basso si intensificano."
Rivelazione della simulazione ambientale
"Un cortile in pietra all'alba si riempie lentamente di una nebbia che si avvolge intorno alle antiche colonne e cattura i primi raggi di sole. La telecamera si alza per rivelare l'intera scena, con toni ambientali delicati e uno stile calmo e realistico."
Rimodellamento basato su video
"Prendi la clip di riferimento di un ciclista su una strada costiera e ricreala con un aspetto dipinto a mano. Mantieni lo stesso percorso e lo stesso movimento di pedalata, aggiungi l'erba mossa dal vento e i gabbiani di passaggio, e una morbida luce pomeridiana."
Scene a inquadratura singola ad alta risoluzione con fusione di immagini di riferimento
Inquadrature narrative guidate da prompt
Scene creative basate sulla fisica
Perché scegliere Kling 3.0 Omni API?
Kling 3.0 Omni è ideale per prodotti che si basano su risorse preesistenti, consentendo di fondere soggetti, clip sorgente e audio in scene coerenti e ad alta risoluzione, anziché dover impostare ogni singola ripresa alla cieca.
Tramite Pollo API, puoi accedere a Kling 3.0 Omni con un'unica chiave API, insieme a oltre 300 modelli di video e immagini leader del settore, con documentazione chiara, polling delle attività e webhook.
Inizia con l'endpoint Omni Kling 3.0 sull'API Pollo per implementare funzionalità video basate su riferimenti e pronte per il 4K, quindi confrontalo con Veo, Sora e altri modelli Kling senza modificare la tua integrazione.
Domande frequenti sull'API Omni Kling 3.0
Cos'è Kling 3.0 Omni?
Kling 3.0 Omni è un modello video Kling AI che genera contenuti combinando testo, immagini, soggetti, video e audio, producendo scene coerenti in un'unica ripresa fino a 4K.
Quali input può combinare l'API Omni Kling 3.0 ?
Accetta fino a sette riferimenti in una singola richiesta, combinando un'immagine, un video sorgente, una serie di immagini del soggetto e un segnale audio insieme al tuo prompt di testo.
Come funziona la coerenza del soggetto?
Si fornisce una piccola serie di immagini di un personaggio o di un oggetto, e il modello mantiene quel soggetto riconoscibile per tutta la durata della clip generata, man mano che la scena si sposta.
Quali risoluzioni e lunghezze sono supportate?
Kling 3.0 Omni API offre output a 720p, 1080p o 4K, con durata delle clip selezionabile da 3 a 15 secondi e inquadratura orizzontale, verticale o quadrata.
È in grado di generare un audio corrispondente?
Sì. Può produrre un audio dal suono naturale per il video in uscita e un riferimento audio può anche guidare la tempistica e il ritmo del movimento sullo schermo.
Perché eseguire Kling 3.0 Omni tramite l'API Pollo ?
Pollo API offre un'integrazione per Kling 3.0 Omni e oltre 300 altri modelli, con documentazione, tracciamento delle attività e webhook.