Das Kling O1 Videomodell bietet einen vielseitigen Workflow mit multimodalen Eingaben und gewährleistet eine stabile Zeichenkonsistenz über alle Aufnahmen hinweg.
Eingang
Modus
Füllen Sie die Pflichtfelder aus, um den Preis zu sehen.
curl-X POST 'https://pollo.ai/api/platform/v1/generation/kling-ai/kling-video-o1/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "16:9", "duration": 5 }}'
Optional kann webhookUrl angegeben werden, um eine Rückruffunktion zu erhalten, wenn die Aufgabe erfolgreich war oder fehlschlug.
Optionales Anfragefeld
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"16:9","duration":5},"webhookUrl":"https://example.com/webhooks/pollo"}
Schema
Eingabefelder für den ausgewählten Endpunkt und Modus.
Kling Video O1 generiert Videos aus einer schriftlichen Vorgabe, Referenzbildern oder Start- und Endbildpaaren in einer einzigen Anfrage.
Mit Kling Video O1 auf der Pollo API können Entwickler diesen multimodalen Generator in ihre Apps integrieren, indem sie Text-, Bild- oder Referenzeingaben senden und pro Aufruf das Seitenverhältnis und die Cliplänge auswählen.
Hauptmerkmale der Kling Video O1 API
Unterstützung für multimodale Eingaben
Das Modell liest Text, ein einzelnes Bild oder eine Reihe von Referenzbildern über einen einzigen Workflow, sodass ein Produkt ohne zusätzlichen Aufwand zwischen ideenorientierter und ressourcenorientierter Generierung wechseln kann.
Konsistenz bei mehreren Referenzen
Bis zu sieben Referenzbilder können als Grundlage für eine einzelne Generierung dienen, sodass Charaktere, Requisiten oder Stile aus separaten Standbildern in einer Szene zusammen erscheinen können, während gleichzeitig die Merkmalskonsistenz und die Identitätskonsistenz erhalten bleiben.
Kontrolle des ersten und letzten Frames
Man gibt ein Startbild und ein Endbild an, und das Modell interpoliert die Bewegung zwischen ihnen, wodurch man präzise steuern kann, wie eine Aufnahme beginnt und wo sie endet.
Stabilität von Bild zu Bild
Motive, Beleuchtung und Komposition bleiben im gesamten Clip gleich, sodass Gesichter, Objekte und Hintergründe bei längeren Aktionen zwischen den Einzelbildern nicht verschwimmen oder sich verändern.
Mehrstufige Eingabeaufforderung
Detaillierte Anweisungen mit bis zu 2.500 Zeichen ermöglichen es Ihnen, sequenzielle Aktionen und Inszenierungen zu skripten, sodass das Modell einer beschriebenen Abfolge von Ereignissen folgen kann, anstatt einem statischen Takt.
Flexible Rahmenkonstruktion
Es stehen Ausgaben im Quer-, Hoch- und Quadratformat zur Verfügung, die mit Breitbildplayern, vertikalen Bildzuführungen oder quadratischen Aufstellungen kompatibel sind.
Anwendungsfälle der Kling Video O1 API
Szenen mit mehreren Charakteren: Kombinieren Sie Referenzbilder von zwei oder drei Charakteren, sodass sie in einer einzigen Aufnahme mit einheitlichen Gesichtern und Outfits zu sehen sind.
Referenzbasiertes Branding: Logo-, Produkt- und Maskottchenbilder werden zusammengeführt, um die Markenwerte in den generierten Werbeclips einheitlich zu gestalten.
Storyboard-to-Motion: Ein erstes und ein letztes Bild werden zu einer animierten Szene verarbeitet. Dies ist nützlich für Previz-Tools und layoutgetriebene Pipelines.
Sequenzielle Aktionsclips: Skripten Sie mehrstufige Bewegungen in einer einzigen Eingabeaufforderung, z. B. eine Figur, die hereinkommt, sich hinsetzt und dann auf etwas außerhalb des Bildschirms reagiert.
Illustrierte Story-Animation: Erwecken Sie gezeichnete Charaktere aus Referenzzeichnungen zu bewegten Szenen für Kinderbücher, Comics oder Webtoons zum Leben.
Konsistente Produktbewegung: Animieren Sie ein Produkt anhand eines einzelnen Bildes, wobei Form, Etikett und Farbe im gesamten Clip erhalten bleiben.
Automatisierte vertikale Inhaltserstellung: Generiert Porträtclips in großem Umfang für Kurzform-Feeds mithilfe von Text oder einem einzelnen Leitbild pro Anfrage.
Konzept-zu-Video-Prototyping: Teams können sich anhand einer Vorgabe eine Vorschau einer beschriebenen Szene ansehen, bevor Referenzmaterial oder Produktionszeit gebunden wird.
So verwenden Sie die Kling Video O1 API
API-Schlüssel anfordern: Erstellen Sie ein Pollo API-Konto und generieren Sie Ihren API-Schlüssel im Entwickler-Dashboard.
Wählen Sie das Modell aus: Senden Sie eine POST-Anfrage an den Kling Video O1-Endpunkt unter /generation/kling-ai/kling-video-o1.
Fügen Sie Ihre Eingaben hinzu: Übergeben Sie ein input-Objekt für Text-zu-Video (Eingabeaufforderung), Bild-zu-Video (image plus optionales imageTail) oder Referenz-zu-Video (images-Array mit bis zu 7 Elementen) und legen Sie dann aspectRatio und length fest.
Generieren und Abrufen: Senden Sie die Aufgabe ab, fragen Sie die zurückgegebene taskId und den Status ab und laden Sie das Video herunter, sobald die Verarbeitung erfolgreich war.
Empfehlungen für bewährte Vorgehensweisen bei der Kling Video O1 API
Behandeln Sie die Vorgaben wie eine Shotlist. Benennen Sie jede Referenz eindeutig, beschreiben Sie die Abfolge der Aktionen und legen Sie dann Bildausschnitt, Bewegung und Stimmung fest, damit das Model einen vollständigen Plan hat, dem es folgen kann.
Eine einfache Formel für eine Eingabeaufforderung
Referenz- oder Themenaufbau + geordnete Aktionen Schritt für Schritt + Kamera und Bildausschnitt + Einstellung und Beleuchtung + Stil
Was Sie beachten sollten
Beschriften Sie Ihre Referenzen: Wenn Sie mehrere Bilder verwenden, beschreiben Sie, welches Motiv welches ist, damit das Modell sie korrekt in der Szene platziert.
Aktionen in die richtige Reihenfolge bringen: Schreiben Sie die Ereignisse nacheinander, da das Modell mehrstufigen Abläufen folgen kann und nicht nur einem einzigen eingefrorenen Moment.
Verankern Sie das letzte Bild: Beschreiben Sie anhand eines Schlussbildes, wie die Aufnahme dort ankommen soll, damit die Interpolation gewollt wirkt.
Passen Sie das Seitenverhältnis zur Platzierung an: Wählen Sie frühzeitig das Querformat, Hochformat oder Quadrat, um es an den Zielspieler oder die Zielzuordnung anzupassen.
Themen klar voneinander abgrenzen: Geben Sie jeder erwähnten Figur oder jedem erwähnten Objekt eindeutige Merkmale, damit die Konsistenz im gesamten Clip gewahrt bleibt.
Beispielhafte Eingabeaufforderungen
Treffen mit mehreren Referenzen
„Anhand der drei Referenzbilder – des jungen Erfinders, des Kupferroboters und der unordentlichen Werkstatt – platzieren Sie alle drei in einer Szene. Der Erfinder winkt, der Roboter neigt daraufhin den Kopf. Langsame Kamerafahrt, warmes Lampenlicht, handgezeichneter Illustrationsstil.“
Übergang vom ersten zum letzten Frame
„Ausgehend von der Bleistiftskizze eines Leuchtturms, endend mit der fertigen Aquarellversion. Farbe und Textur entfalten sich im Bildausschnitt von links nach rechts, während der Himmel heller wird. Statische Kamera, sanftes Tageslicht, zarter, malerischer Übergang.“
Sequenzieller Handlungstakt
„Eine Bäckerin betritt das Bild mit einem Tablett, stellt es auf die Theke, klopft sich das Mehl von den Händen, blickt dann auf und lächelt einen Kunden an. Halbtotale, Morgenlicht am Fenster, warmer, realistischer Stil, ruhige Handkamera.“
Referenzgetreue Produktbewegung
„Gießen Sie, ausgehend von dem einzelnen Referenzbild der Keramik-Teekanne, dampfenden Tee in eine passende Tasse, während der Dampf nach oben steigt. Achten Sie auf die exakte Wiedergabe des Glasurmusters und der Form. Nahaufnahme von der Seite, sanftes Küchenlicht, klarer, realistischer Stil.“
Kling Video O1 vs Vidu Q1 vs Runway Gen-4
Fähigkeit
Kling Video O1
Vidu Q1
Runway Gen-4
Eingabe mehrerer Referenzbilder
✅ Bis zu 7 Referenzbilder
✅ Mehrere Referenzobjekte
✅ Referenzgeführt
Steuerung des ersten und letzten Bildes
✅ Start- und Endbild
✅
❌ Eingeschränkt
Text, Bild und Referenz in einem Modell
✅
✅
✅
Mehrstufige Eingabeaufforderung
✅ Lange Eingabeaufforderungen in geordneter Reihenfolge
✅
✅
Optionen für das Seitenverhältnis
16:9, 9:16, 1:1
Mehrere
16:9 und vertikal
Empfohlen für
Referenzkonsistente, sequenzielle Aufnahmen
Referenzszenen mit mehreren Personen
Stilisierte, vom Regisseur inszenierte Clips
Warum die Kling Video O1 API wählen?
Kling Video O1 zeichnet sich dadurch aus, dass eine Aufnahme mehrere Referenzen kombinieren, jedes Motiv konsistent halten und einer geordneten Abfolge von Aktionen folgen muss, anstatt einen isolierten Moment festzuhalten.
Über die Pollo API erreichen Sie Kling Video O1 mit nur einem API-Schlüssel sowie über 300 führende Video- und Bildmodelle, inklusive übersichtlicher Dokumentation, Aufgabenabfrage und Webhooks.
Beginnen Sie mit dem Kling Video O1-Endpunkt auf der Pollo API, um referenzgesteuerte, mehrstufige Videofunktionen bereitzustellen, und vergleichen Sie ihn dann mit Vidu, Runway und anderen Kling Modellen, ohne Ihre Integration zu verändern.
Häufig gestellte Fragen zur Kling Video O1 API
Was ist Kling Video O1?
Kling Video O1 ist ein multimodales Videomodell von Kling AI , das Clips aus Text, einem einzelnen Bild oder bis zu sieben Referenzbildern mit hoher Frame-Konsistenz und mehrstufiger Eingabeaufforderung generiert.
Unterstützt die Kling Video O1 API Referenzbilder?
Ja. Reference-to-video akzeptiert bis zu sieben Bild-URLs in einer Anfrage, sodass mehrere Charaktere, Produkte oder Stile in einer einzigen, konsistenten Szene zusammen erscheinen können.
Kann es den Beginn und das Ende eines Schusses steuern?
Ja. Bei der Bild-zu-Video-Konvertierung können sowohl ein Startbild als auch ein Endbild angegeben werden, und das Modell interpoliert die Bewegung zwischen den beiden Bildern.
Welche Seitenverhältnisse und Längen sind verfügbar?
Kling Video O1 gibt Bilder im Format 16:9, 9:16 oder 1:1 aus, wobei die Cliplänge je nach gewähltem Eingangsmodus zwischen 3 und 10 Sekunden liegt.
Wie werden sequenzielle Aktionen verarbeitet?
Mithilfe von Eingabeaufforderungen mit bis zu 2.500 Zeichen können Sie Ereignisse der Reihe nach beschreiben, sodass das Modell mehrstufige Bewegungen anstelle eines einzelnen statischen Taktes ausführen kann.
Warum sollte man Kling Video O1 über die Pollo API betreiben?
Die Pollo API bietet eine Integration für Kling Video O1 und über 300 weitere Modelle, inklusive Dokumentation, Aufgabenverfolgung und Webhooks.