curl-X POST 'https://pollo.ai/api/platform/v1/generation/kling-ai/kling-v3-omni/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "16:9", "duration": 5, "mode": "pro", "generateAudio": true }}'
Optional kann webhookUrl angegeben werden, um eine Rückruffunktion zu erhalten, wenn die Aufgabe erfolgreich war oder fehlschlug.
Optionales Anfragefeld
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"16:9","duration":5,"mode":"pro","generateAudio":true},"webhookUrl":"https://example.com/webhooks/pollo"}
Schema
Eingabefelder für den ausgewählten Endpunkt und Modus.
Feld
Typ
Erforderlich
Beschreibung
prompt
string
Ja
Text prompt describing the content to generate.
aspectRatio
string
NEIN
Output aspect ratio, as width:height (e.g. 16:9).
duration
integer
NEIN
The duration of the generated video, in seconds.
mode
string
NEIN
Generation mode of the model (e.g. a faster or higher-quality tier).
generateAudio
boolean
NEIN
Generate natural-sounding, fitting audio for the output video.
Kling 3.0 Omni generiert Videos aus verschiedenen Eingabetypen, darunter Text, Bilder, Themensätze, Quellvideos und Audio, in einer einzigen Anfrage bis zu einer Auflösung von 4K.
Mit der Kling 3.0 Omni on Pollo API können Entwickler die referenzbasierte Videogenerierung anhand verschiedener Anleitungstypen steuern und dabei pro Anfrage die Cliplänge, das Seitenverhältnis und optional den passenden Ton auswählen.
Hauptmerkmale der Kling 3.0 Omni API
Omnimodaler Referenzeingang
Das Modell verarbeitet bis zu sieben Referenzen gleichzeitig und kombiniert ein Bild, ein Quellvideo, eine Themengruppe und einen Audiohinweis, um eine einzelne Generation zu steuern.
Subjektkonsistenz
Stellen Sie mehrere Bilder einer Figur oder eines Objekts bereit. Das Model behält seine Identität während der gesamten Aufnahme bei, auch wenn sich die Szene bewegt.
Audiogeführte Bewegung
Stellen Sie eine Audioreferenz bereit, und das Modell synchronisiert Bewegung, Rhythmus und Tempo mit dem Ton, indem es die Aktionen mit Takten, Sprache oder Umgebungsgeräuschen im Clip in Einklang bringt.
Umweltsimulation
Die räumliche Simulation erzeugt Szenen in einer einzigen Aufnahme mit kohärentem Licht, Tiefe und Umgebungsreaktion, während sich Kamera und Motive im Raum bewegen.
4K-Volumenausgabe
Die Generationen erreichen Auflösungen bis zu 4K und bieten feine Textur- und Tiefeninformationen in hoher Auflösung für Anwendungen im Rundfunk und auf großen Bildschirmen.
Flexible Dauer und Rahmung
Die Clips sind zwischen 3 und 15 Sekunden lang und können im Quer-, Hoch- oder Quadratformat ausgeliefert werden. So kann eine einzige Integration Social Media, Produktpräsentationen und Vollbilddarstellungen mit demselben Modell bedienen.
Anwendungsfälle der Kling 3.0 Omni API
Wiederkehrende Charakterinhalte: Ein Themenset kann wiederverwendet werden, um ein Maskottchen, einen Moderator oder einen Avatar in den einzelnen Episodenclips konsistent zu halten, ohne die Identität jedes Mal neu zeichnen zu müssen.
Audio-synchronisierte Performance-Clips: Steuern Sie einen Tänzer, Musiker oder Sprecher so, dass seine Bewegungen mit einem hochgeladenen Track synchronisiert werden; nützlich für Musik- und Lippenbewegungs-Tools.
Videobasiertes Redesign: Verwenden Sie einen vorhandenen Clip als Referenz und erstellen Sie daraus eine neue Regieanweisung, wobei die ursprüngliche Bewegung und Inszenierung erhalten bleiben.
Szenenfortsetzungs-Pipelines: Bild- und Videoreferenzen werden kombiniert, um eine Aufnahme fortzusetzen und so die Kontinuität von Umgebung und Motiv über eine längere Sequenz hinweg zu gewährleisten.
Multi-Referenz-Storyboarding: Mehrere Bilder und ein Motiv zu einer einzigen Eingabeaufforderung kombinieren, um komplexe Szenen vor der endgültigen Produktionsphase zu visualisieren.
Hochauflösende Broadcast-Assets: Generieren Sie 4K-Einzelaufnahmen für Digital Signage, Streaming-Intros oder große Displays, bei denen Auflösung und Tiefe wichtig sind.
Lokalisierte Werbevarianten: Ein Thema wird wiederverwendet und Audioreferenzen werden ausgetauscht, um regionsspezifische Versionen mit angepasstem Erzähltempo und einheitlichem Branding zu erstellen.
Immersive Umgebungsdemos: Zeigen Sie einen Raum, der sich mit Nebel, Wasser oder Menschenmengen füllt, wobei die Umgebung glaubhaft reagiert – ideal für Immobilien- oder Event-Vorschauen.
So verwenden Sie die Kling 3.0 Omni API
API-Schlüssel anfordern: Erstellen Sie ein Pollo API-Konto und generieren Sie Ihren API-Schlüssel im Entwickler-Dashboard.
Wählen Sie das Modell: Senden Sie Anfragen an den Kling 3.0 Omni-Endpunkt unter /generation/kling-ai/kling-v3-omni/ref2video.
Fügen Sie Ihre Eingaben hinzu: Geben Sie eine Eingabeaufforderung und ein bis sieben Referenzen (Bild, Motiv, Video oder Audio) an und legen Sie dann die Dauer (3-15), das Seitenverhältnis und die Auflösung (720P, 1080P oder 4K) fest.
Generieren und Abrufen: Senden Sie die Aufgabe ab, fragen Sie den zurückgegebenen Aufgabenstatus ab und laden Sie das fertige Video herunter. Optional können Sie mit generateAudio eine passende Tonspur erstellen.
Best Practices für die Kling 3.0 Omni API
Betrachten Sie die Aufgabenstellung eher als Orientierungshilfe denn als Beschreibung von Grund auf. Benennen Sie die Rolle jeder Referenz, die gewünschte Handlung und wie sich die Szene um Ihr Subjekt herum verhalten soll.
Eine einfache Formel für eine Eingabeaufforderung
Subjekt und seine Bezugsrolle + spezifische Handlung + Szenen- und Umgebungsverhalten + Kamerabewegung + Audio- oder Tempohinweis
Was Sie beachten sollten
Referenzrollen zuweisen: Weisen Sie dem Modell zu, welche Referenz das Subjekt, welche die Umgebung und welche den Ton steuert, damit die Anweisungen nicht miteinander konkurrieren.
Achten Sie auf klare Motive: Stellen Sie klare, abwechslungsreiche Bilder einer Person bereit, damit deren Identität im gesamten Bild erhalten bleibt.
Beschreibung der Reaktion der Umgebung: Geben Sie an, wie sich Licht, Wetter oder Umgebung verändern sollten, da das Modell den Raum und nicht eine flache Kulisse simuliert.
Audio an Aktion anpassen: Wenn Sie eine Audioreferenz verwenden, benennen Sie die Bewegung, mit der sie synchronisiert werden soll, damit das Tempo dem Ton folgt.
Wählen Sie die Auflösung je nach Verwendungszweck: Wählen Sie 4K für Broadcast-Auftritte und große Bildschirme, niedrigere Einstellungen für schnellere Entwürfe und Iterationen.
Szene beibehalten: Jede Generation soll einen einzigen zusammenhängenden Moment darstellen, damit der Clip von Anfang bis Ende durchgehend flüssig bleibt.
Beispielhafte Eingabeaufforderungen
Folge mit dem Maskottchen
„Nutzen Sie das Motiv eines illustrierten Rotfuchses in Pfadfinderuniform. Der Fuchs schreitet durch eine sonnendurchflutete Bibliothek, hält inne, um ein leuchtendes Buch aus einem hohen Regal zu nehmen, und grinst. Langsame Kamerafahrt, warmes, staubiges Licht.“
Audio-synchronisierter Straßentänzer
„Animiere die Tänzerin zum hochgeladenen Drum-Track. Präzise Fußarbeit und Armbewegungen treffen auf jeden Schlag in einer Betonunterführung in der Abenddämmerung, kühle blaue Schatten, die Handkamera kreist, während die Bassimpulse anschwellen.“
Enthüllung der Umgebungssimulation
„Ein Steinhof füllt sich im Morgengrauen langsam mit aufsteigendem Bodennebel, der sich um alte Säulen kräuselt und das erste Licht einfängt. Die Kamera schwenkt nach oben und enthüllt die gesamte Szene; ruhige, stimmungsvolle Töne, ein gelassener, realistischer Stil.“
Videoreferenziertes Restyle
„Nehmen Sie den Referenzclip eines Radfahrers auf einer Küstenstraße und gestalten Sie ihn wie ein handgemaltes Bild. Behalten Sie die gleiche Strecke und die gleiche Tretbewegung bei, fügen Sie vom Wind bewegtes Gras und vorbeifliegende Möwen sowie sanftes Nachmittagslicht hinzu.“
Referenzgemischte, hochauflösende Szenen in einer einzigen Einstellung
Erzählsequenzen mit vorgegebenen Anweisungen
Physikbasierte kreative Szenen
Warum die Kling 3.0 Omni API wählen?
Kling 3.0 Omni eignet sich für Produkte, die auf Basis von Assets arbeiten, und ermöglicht es Ihnen, Motive, Quellclips und Audio zu konsistenten, hochauflösenden Szenen zu verschmelzen, anstatt jede Aufnahme einzeln manuell zu steuern.
Über die Pollo API erhalten Sie mit einem einzigen API-Schlüssel Zugriff auf Kling 3.0 Omni sowie auf mehr als 300 führende Video- und Bildmodelle, inklusive übersichtlicher Dokumentation, Aufgabenabfrage und Webhooks.
Beginnen Sie mit dem Kling 3.0 Omni-Endpunkt auf der Pollo API, um referenzbasierte, 4K-fähige Videofunktionen bereitzustellen, und vergleichen Sie ihn dann mit Veo, Sora und anderen Kling Modellen, ohne Ihre Integration zu verändern.
Häufig gestellte Fragen zur Kling 3.0 Omni API
Was ist Kling 3.0 Omni?
Kling 3.0 Omni ist ein Kling AI , das aus kombinierten Text-, Bild-, Motiv-, Video- und Audioreferenzen konsistente Einzelaufnahmen in bis zu 4K-Auflösung generiert.
Welche Eingaben kann die Kling 3.0 Omni API kombinieren?
Es akzeptiert bis zu sieben Referenzen in einer Anfrage und kombiniert ein Bild, ein Quellvideo, eine Bilderserie zum Thema und einen Audiohinweis mit Ihrer Textvorgabe.
Wie funktioniert Subjektkonsistenz?
Sie liefern eine kleine Auswahl an Bildern einer Figur oder eines Objekts, und das Modell sorgt dafür, dass dieses Motiv während des gesamten generierten Clips, während sich die Szene bewegt, erkennbar bleibt.
Welche Auflösungen und Längen werden unterstützt?
Die Kling 3.0 Omni API gibt Videos in 720P, 1080P oder 4K aus, wobei die Clip-Dauer von 3 bis 15 Sekunden und das Bildformat (Querformat, Hochformat oder quadratisch) wählbar sind.
Kann es passendes Audio erzeugen?
Ja. Es kann einen natürlich klingenden Ton für das Ausgabevideo erzeugen, und eine Audioreferenz kann auch das Timing und den Rhythmus der Bewegungen auf dem Bildschirm steuern.
Warum sollte man Kling 3.0 Omni über die Pollo API ausführen?
Die Pollo API bietet eine Integration für Kling 3.0 Omni und über 300 weitere Modelle, inklusive Dokumentation, Aufgabenverfolgung und Webhooks.