curl-X POST 'https://pollo.ai/api/platform/v1/generation/kling-ai/kling-video-o1/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "16:9", "duration": 5 }}'
Opcjonalnie dołącz webhookUrl, aby otrzymać wywołanie zwrotne w przypadku powodzenia lub niepowodzenia zadania.
Opcjonalne pole żądania
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"16:9","duration":5},"webhookUrl":"https://example.com/webhooks/pollo"}
Schemat
Pola wejściowe dla wybranego punktu końcowego i trybu.
Pole
Typ
Wymagany
Opis
prompt
string
Tak
Text prompt describing the content to generate.
aspectRatio
string
NIE
Output aspect ratio, as width:height (e.g. 16:9).
duration
number
NIE
The duration of the generated video, in seconds.
Błędy
Typowe publiczne kody odpowiedzi API.
400
Nieprawidłowe dane wejściowe lub ograniczenie modelu
Kling Video O1 generuje wideo na podstawie pisemnego polecenia, obrazów referencyjnych lub par klatek początkowych i końcowych w ramach jednego żądania.
Dzięki Kling Video O1 w Pollo API programiści dodają ten multimodalny generator do swoich Apps, wysyłając tekst, obraz lub dane referencyjne, a także wybierając współczynnik proporcji i długość klipu dla każdego połączenia.
Kluczowe funkcje interfejsu API Kling Video O1
Obsługa multimodalnego wprowadzania danych
Model odczytuje tekst, pojedynczy obraz lub zestaw obrazów referencyjnych w ramach jednego procesu roboczego, dzięki czemu produkt może przełączać się między generacją opartą na pomyśle a generacją opartą na zasobach bez dodatkowych czynności.
Spójność wieloodniesieniowa
Pojedyncze pokolenie może posłużyć się maksymalnie siedmioma obrazami referencyjnymi, dzięki czemu postacie, rekwizyty lub style z oddzielnych statycznych kadrów mogą pojawić się razem w jednej scenie, zachowując jednocześnie trwałość cech i spójność tożsamości.
Kontrola pierwszej i ostatniej klatki
Podaj obraz początkowy i obraz końcowy, a model interpoluje ruch między nimi, zapewniając precyzyjną kontrolę nad tym, jak rozpoczyna się ujęcie i gdzie ląduje.
Stabilność między klatkami
Tematy, oświetlenie i kompozycja pozostają stabilne w całym klipie, dzięki czemu twarze, obiekty i tła nie zmieniają się ani nie przemieszczają między klatkami podczas dłuższych akcji.
Monity wieloetapowe
Szczegółowe monity liczące do 2500 znaków umożliwiają tworzenie skryptów sekwencji działań i scenografii, dzięki czemu model może podążać za opisaną kolejnością zdarzeń, a nie jednym statycznym rytmem.
Elastyczne kadrowanie
Dostępne są wyjścia poziome, pionowe i kwadratowe, dostosowane do odtwarzaczy szerokoekranowych, kanałów pionowych i rozmieszczenia kwadratowego tej samej generacji.
Przykłady zastosowań interfejsu API Kling Video O1
Sceny z wieloma postaciami: Połącz zdjęcia referencyjne dwóch lub trzech postaci, tak aby znalazły się na jednym ujęciu z zachowaniem spójnych twarzy i strojów.
Branding oparty na odniesieniach: Połącz obrazy logo, produktu i maskotki, aby zachować spójność marki w generowanych klipach promocyjnych.
Storyboard-to-Motion: Zmień pierwszą i ostatnią klatkę w animowane ujęcie, przydatne w narzędziach do wstępnej wizualizacji i procesach sterowanych układem.
Klipy akcji sekwencyjnej: Scenariusze ruchów składających się z wielu kroków w jednym poleceniu, np. postać, która wchodzi, siada, a następnie reaguje na coś znajdującego się poza ekranem.
Ilustrowana animacja fabularna: Przenieś narysowane postacie ze sztuki referencyjnej do ruchomych scen w książkach dla dzieci, komiksach lub kreskówkach internetowych.
Spójny ruch produktu: Animuj produkt na podstawie pojedynczego obrazu, zachowując wierność jego kształtu, etykiety i koloru w całym klipie.
Automatyzacja treści pionowych: Generuj klipy portretowe na dużą skalę na potrzeby krótkich kanałów informacyjnych, wykorzystując tekst lub pojedynczy obraz pomocniczy na żądanie.
Prototypowanie od koncepcji do wersji wideo: Umożliw zespołom podgląd opisanego ujęcia na podstawie polecenia przed zatwierdzeniem zasobów referencyjnych lub czasem produkcji.
Jak korzystać z interfejsu API Kling Video O1
Uzyskaj klucz API: Utwórz konto API Pollo i wygeneruj klucz API z poziomu pulpitu programisty.
Wybierz model: Wyślij żądanie POST do punktu końcowego Kling Video O1 w /generation/kling-ai/kling-video-o1.
Dodaj swoje dane wejściowe: Przekaż obiekt input dla tekstu na wideo (prompt), obrazu na wideo (image plus opcjonalny imageTail) lub odniesienia do wideo (tablica images do 7), a następnie ustaw aspectRatio i length.
Generowanie i pobieranie: Prześlij zadanie, sprawdź zwrócony taskId i status, a po pomyślnym przetworzeniu pobierz wideo.
Najlepsze praktyki dotyczące monitów dla interfejsu API Kling Video O1
Potraktuj polecenie jak listę ujęć. Jasno nazwij każde odniesienie, opisz sekwencję działań, a następnie ustal kadrowanie, ruch i nastrój, aby modelka miała pełny plan działania.
Prosta formuła podpowiedzi
Konfiguracja obiektu odniesienia + uporządkowane działania krok po kroku + kamera i kadrowanie + ustawienie i oświetlenie + styl
Na co powinieneś zwrócić uwagę
Oznacz swoje odniesienia: W przypadku korzystania z wielu obrazów opisz, który obiekt jest który, aby model mógł je poprawnie umieścić w scenie.
Uporządkuj działania: Zapisuj zdarzenia w kolejności, ponieważ model może uwzględniać etapowanie wieloetapowe, a nie pojedynczy zamrożony moment.
Zakotwicz klatkę końcową: W przypadku obrazu końcowego opisz, w jaki sposób ujęcie powinno do niego dotrzeć, aby interpolacja wydawała się zamierzona.
Dopasuj aspekt do umiejscowienia: Wybierz na początku orientację poziomą, pionową lub kwadratową, aby dopasować ją do docelowego gracza lub kanału.
Zachowaj wyrazistość obiektów: Nadaj każdej postaci lub obiektowi wyraźne cechy, aby zachować spójność w całym klipie.
Przykładowe monity
Spotkanie Multi-Reference
Wykorzystując trzy obrazy referencyjne – młodego wynalazcę, miedzianego robota i zagracony warsztat – umieść wszystkie trzy w jednej scenie. Wynalazca macha, robot w odpowiedzi przechyla głowę. Powolne wjeżdżanie wózkiem, ciepłe światło lampy, ręcznie rysowany styl ilustracji.
Przejście ramki od pierwszej do ostatniej
„Zacznij od szkicu latarni morskiej ołówkiem, a zakończ na gotowej wersji akwarelowej. Kolor i faktura rozkwitają na kadrze od lewej do prawej, w miarę jak niebo się rozjaśnia. Statyczna kamera, miękkie światło dzienne, delikatne, malarskie przejścia.”
Sekwencyjne działanie
Piekarz wchodzi w kadr z tacą, stawia ją na blacie, otrzepuje ręce z mąki, po czym podnosi wzrok i uśmiecha się do klienta. Ujęcie pośrednie, poranne światło wpadające przez okno, ciepły, realistyczny styl, stabilna kamera z ręki.
Odniesienie-wierny ruch produktu
„Na podstawie pojedynczego zdjęcia ceramicznego czajniczka, nalej parującą herbatę do pasującej filiżanki, podczas gdy para unosi się ku górze. Zachowaj dokładny wzór i kształt szkliwa. Ujęcie z bliska, delikatne światło kuchni, czysty, realistyczny styl.”
Kling Video O1 vs Vidu Q1 vs Runway Gen-4
Zdolność
Kling Wideo O1
Vidu Q1
Runway Gen-4
Wejście wieloreferencyjne
✅ Do 7 obrazów referencyjnych
✅ Wiele obiektów referencyjnych
✅ Kierowane przez odniesienie
Kontrola pierwszej i ostatniej klatki
✅ Obraz początkowy i końcowy
✅
❌ Ograniczony
Tekst, obraz i odniesienie w jednym modelu
✅
✅
✅
Wieloetapowe podpowiedzi
✅ Długo ułożone podpowiedzi
✅
✅
Opcje proporcji obrazu
16:9, 9:16, 1:1
Wiele
16:9 i pionowo
Polecane dla
Spójne, sekwencyjne ujęcia
Sceny referencyjne z wieloma tematami
Stylizowane klipy reżyserskie
Dlaczego warto wybrać Kling Video O1 API?
Kling Video O1 wyróżnia się, gdy ujęcie musi łączyć w sobie kilka punktów odniesienia, przedstawiać spójny temat i przedstawiać uporządkowaną sekwencję działań, a nie jeden wyizolowany moment.
Za pośrednictwem Pollo API uzyskujesz dostęp do Kling Video O1 za pomocą jednego klucza API, a także ponad 300 wiodących modeli wideo i obrazów, z przejrzystą dokumentacją, sondowaniem zadań i webhookami.
Zacznij od punktu końcowego Kling Video O1 w interfejsie API Pollo , aby wdrożyć referencyjne, wieloetapowe funkcje wideo, a następnie porównaj je z Vidu, Runway i innymi modelami Kling bez konieczności wprowadzania zmian w integracji.
Najczęściej zadawane pytania dotyczące interfejsu API Kling Video O1
Czym jest Kling Video O1?
Kling Video O1 to multimodalny model wideo firmy Kling AI , który generuje klipy na podstawie tekstu, pojedynczego obrazu lub maksymalnie siedmiu obrazów referencyjnych, z zachowaniem wysokiej spójności klatek i wieloetapowym podpowiadaniem.
Czy interfejs API Kling Video O1 obsługuje obrazy referencyjne?
Tak. Odwołanie do wideo akceptuje do siedmiu adresów URL obrazów w jednym żądaniu, dzięki czemu kilka postaci, produktów lub stylów może pojawić się razem w jednej spójnej scenie.
Czy można kontrolować początek i koniec ujęcia?
Tak. W przypadku konwersji obrazu na wideo można dostarczyć zarówno obraz początkowy, jak i obraz końcowy, a model interpoluje ruch pomiędzy tymi dwiema klatkami.
Jakie proporcje obrazu i długości są dostępne?
Kling Video O1 generuje obraz w formacie 16:9, 9:16 lub 1:1, a długość klipu wynosi od 3 do 10 sekund, w zależności od wybranego trybu wejściowego.
Jak radzi sobie z sekwencyjnymi działaniami?
Podpowiedzi składające się z maksymalnie 2500 znaków umożliwiają opisywanie zdarzeń w kolejności chronologicznej, dzięki czemu model może tworzyć ruch składający się z wielu etapów zamiast pojedynczego statycznego uderzenia.
Dlaczego warto uruchomić Kling Video O1 przez API Pollo ?
API Pollo umożliwia integrację z Kling Video O1 i ponad 300 innymi modelami, z dokumentacją, śledzeniem zadań i webhookami.