curl-X POST 'https://pollo.ai/api/platform/v1/generation/alibaba/wan-v2-6/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "negativePrompt": "blurry, low quality, distorted, watermark, text", "duration": 5, "resolution": "720p", "aspectRatio": "1:1", "generateAudio": true, "multiShot": false }}'
Opcjonalnie dołącz webhookUrl, aby otrzymać wywołanie zwrotne w przypadku powodzenia lub niepowodzenia zadania.
Opcjonalne pole żądania
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","negativePrompt":"blurry, low quality, distorted, watermark, text","duration":5,"resolution":"720p","aspectRatio":"1:1","generateAudio":true,"multiShot":false},"webhookUrl":"https://example.com/webhooks/pollo"}
Schemat
Pola wejściowe dla wybranego punktu końcowego i trybu.
Pole
Typ
Wymagany
Opis
audio
string
NIE
Reference audio URL (HTTP(S)).
prompt
string
Tak
Text prompt describing the content to generate.
negativePrompt
string
NIE
Text describing elements to avoid in the generated output.
duration
integer
NIE
The duration of the generated video, in seconds.
resolution
string
NIE
Output resolution of the generated media (e.g. 720p, 1080p, 2K, 4K). Values are case-insensitive.
aspectRatio
string
NIE
Output aspect ratio, as width:height (e.g. 16:9).
seed
integer
NIE
Random seed for reproducible generation.
generateAudio
boolean
NIE
Generate natural-sounding, fitting audio for the output video.
multiShot
boolean
NIE
Generate a multi-shot video (multiple scene cuts with automatic transitions) instead of a single continuous shot.
Błędy
Typowe publiczne kody odpowiedzi API.
400
Nieprawidłowe dane wejściowe lub ograniczenie modelu
Wan 2.6 obsługuje generowanie wideo wieloujęciowego do krótkich form narracyjnych. Potrafi połączyć kilka ujęć w jednym klipie, jednocześnie pomagając utrzymać spójność wyglądu postaci, stylu wizualnego i ruchu.
W Pollo API deweloperzy korzystają z Wan 2.6 do generowania text-to-video i image-to-video z dopasowanym dźwiękiem, długością klipu do 15 sekund oraz wyjściem 720P lub 1080P na każde żądanie.
Kluczowe funkcje API Wan 2.6
Sekwencje wieloujęciowe
Zamiast jednego ciągłego ujęcia, Wan 2.6 może łączyć kilka ujęć w jednej generacji, dzięki czemu krótka historia może przechodzić między kadrami i momentami bez zrywania ciągłości.
Dłuższe długości klipów
Klipy mogą trwać od dwóch do piętnastu sekund, dając przestrzeń na wprowadzenie, reakcję i puentę, które krótsze modele często ucinają, zanim pomysł wybrzmi.
Zsynchronizowane wyjście audio
Model może generować pasujące audio razem z obrazem albo podążać za dostarczoną przez Ciebie ścieżką audio, dzięki czemu dźwięk i ruch są zgrane zamiast powstawać w dwóch osobnych krokach.
Spójność postaci i stylu
Kierowany referencjami wizualnymi, Wan 2.6 utrzymuje stabilny wygląd obiektu i ogólny kierunek artystyczny między ujęciami, co ma znaczenie, gdy twarz lub produkt wraca w sekwencji.
Elastyczne kadrowanie
Każde proporcje obrazu są dostępne w obu rozdzielczościach, więc formaty kwadratowe, pionowe i panoramiczne renderują się z pełnym detalem bez kompromisu między kształtem a jakością.
Niezawodna logika scen
Opisane działania, kolejność ujęć i ustawienie sceny są odwzorowywane wiernie, więc sekwencja trzyma się zamierzonej logiki zamiast odpływać w niepowiązany ruch lub kompozycję.
Przypadki użycia API Wan 2.6
Mini-reklamy narracyjne: Twórz krótkie spoty oparte na historii, które przechodzą przez dwa lub trzy ujęcia, prowadząc produkt lub ideę od zajawki do rozwiązania w jednym klipie.
Klipy wyjaśniające i tutoriale: Pokazuj proces etapami, po jednym na ujęcie, z dopasowaną narracją audio — idealne do materiałów instruktażowych i onboardingowych.
Sceny prowadzone muzyką i dźwiękiem: Dodaj ścieżkę audio i pozwól, by obraz podążał za jej rytmem — przydatne w klipach z tekstem, materiałach promocyjnych i nastrojowych.
Sekwencje produktowe: Pokaż produkt od prezentacji do użycia z kilku perspektyw, zachowując spójność jego kształtu, koloru i wykończenia.
Krótkie formy oparte na postaci: Utrzymuj ten sam wygląd powracającej postaci między ujęciami w treściach epizodycznych, serialowych lub z maskotką.
Historie od obrazu do ruchu: Ożyw pojedynczy statyczny obraz w dłuższą sekwencję ruchu z dźwiękiem, rozszerzając jeden zasób do pełnej sceny.
Pionowe formaty social media: Renderuj pionowe klipy do piętnastu sekund pod storytelling natywny dla feedu, który domyka pomysł w jednym przewinięciu.
Jak używać API Wan 2.6
Pobierz klucz API: Utwórz konto Pollo API i wygeneruj klucz API w panelu deweloperskim.
Wybierz model: Wysyłaj żądania do endpointu Wan 2.6 pod adresem /generation/wanx/wan-v2-6.
Dodaj dane wejściowe: Podaj prompt dla text-to-video albo URL image dla image-to-video, następnie ustaw length (2 do 15), resolution (720P lub 1080P) oraz opcjonalnie audioUrl, generateAudio lub multiClip.
Wygeneruj i pobierz: Wyślij zadanie, odpytyj zwrócony status zadania i pobierz gotowe wideo po pomyślnym zakończeniu przetwarzania.
Dobre praktyki promptowania dla API Wan 2.6
Pisz prompty do Wan 2.6 jak listę ujęć. Nazwij każdy moment po kolei, opisz obiekt i jego ruch oraz określ dźwięk, aby pacing wieloujęciowy i audio miały jasny cel.
Prosta formuła promptu
Obiekt i sceneria + działania ujęcie po ujęciu w kolejności + ruch i tempo + wskazówka audio lub dźwiękowa + styl i kadrowanie
Na co warto zwrócić uwagę
Ułóż sekwencję ujęć: Opisz, co dzieje się najpierw, potem i na końcu, żeby model wiedział, gdzie każde ujęcie się zaczyna i kończy.
Zakotwicz obiekt: Opisz spójny wygląd każdej postaci lub produktu, który wraca między ujęciami.
Wskaż dźwięk: Powiedz, co ma być słyszalne — szum tła, głos lub muzyka dopasowana do akcji.
Ustal tempo: Dłuższe klipy wymagają wyraźnych punktów rytmu, więc zaznacz, gdzie moment zwalnia lub przyspiesza.
Dopasuj rozdzielczość do celu: Wybierz 1080P dla sekwencji pełnych detali i 720P dla szybszych wersji roboczych oraz iteracji.
Ustal kadr: Wybierz proporcje obrazu pasujące do miejsca publikacji, ponieważ każdy format renderuje się w obu rozdzielczościach.
Przykładowe prompty
Wieloujęciowy segment kulinarny
"Trzy ujęcia: dłonie wbijają jajka do miski, trzepaczka ubija mieszankę na pianę, potem ciasto wylewa się na gorącą patelnię i zaczyna bąbelkować. Ciepłe światło kuchenne, bliskie ujęcie z góry, delikatny skwierczący dźwięk, czysty realistyczny styl."
Spacer po muzeum
"Zwiedzający idzie powoli obok wysokich szkieletów dinozaurów, kamera jedzie równolegle, potem cięcie na niski kąt patrzący w górę na klatkę piersiową. Miękki pogłos kroków i ciche ambientowe audio hali, naturalne oświetlenie, dokumentalny realizm."
Uliczny muzyk prowadzony dźwiękiem
"Wiolonczelista gra o zmierzchu na kamiennym moście, smyczek porusza się zgodnie z melodią, potem kadr się poszerza i pokazuje mały gromadzący się tłum. Ciepłe brzmienie strun zsynchronizowane z ruchem, złota godzina, kadrowanie z ręki."
Sekwencja dzikiej przyrody
"Lis wychodzi z wysokiej trawy, porusza uszami, potem skacze do przodu, a kamera panoramuje, podążając za nim przez mglistą łąkę. Dźwięk szeleszczącej trawy i odległego śpiewu ptaków, chłodne poranne światło, osadzony naturalny styl."
Wan 2.6 vs Sora 2 vs Kling 2.6
Funkcja
Wan 2.6
Sora 2
Kling 2.6
Sekwencje wieloujęciowe
✅ Natywne łączenie ujęć
✅ Mocne zszywanie scen
➖ Głównie pojedyncze ujęcia reżyserowane
Zakres długości klipów
2 do 15 sekund
Krótkie stałe długości
Krótkie reżyserowane klipy
Generowany lub sterowany audio dźwięk
✅ Obsługa obu trybów
✅ Generowane audio
❌ Ograniczone natywne audio
Elastyczność proporcji obrazu
✅ Wszystkie proporcje w obu rozdzielczościach
✅
✅
Opcje rozdzielczości
720P i 1080P
Do 1080P
Do 1080P
Spójność postaci
✅ Prowadzona referencjami
✅
✅
Rekomendowane do
Dłuższych historii wieloujęciowych z audio
Spójnych generowanych scen
Ruchu postaci i detalu
Dlaczego wybrać API Wan 2.6?
Wan 2.6 pasuje do produktów, które potrzebują czegoś więcej niż pojedynczy klip, prowadząc postać lub ideę przez wiele ujęć z dopasowanym audio i długością klipów do piętnastu sekund.
Przez Pollo API uzyskujesz dostęp do Wan 2.6 jednym kluczem API obok ponad 300 czołowych modeli wideo i obrazu, z przejrzystą dokumentacją, odpytywaniem statusu zadań i szybszym generowaniem.
Zacznij od endpointu Wan 2.6 w Pollo API, aby wdrażać dłuższe funkcje storytellingowe zsynchronizowane z dźwiękiem, a następnie porównaj go z Sora 2, Kling i Veo bez naruszania integracji.
FAQ API Wan 2.6
Czym jest Wan 2.6?
Wan 2.6 to model generowania wideo wanx zbudowany pod storytelling wieloujęciowy, obsługujący text-to-video i image-to-video ze zsynchronizowanym audio, spójnymi postaciami oraz klipami od dwóch do piętnastu sekund.
Czy API Wan 2.6 obsługuje wejścia tekstowe i obrazowe?
Tak. Możesz generować z promptu tekstowego albo animować URL obrazu, co daje elastyczność zarówno dla workflow zaczynających od pomysłu, jak i od gotowych zasobów.
Czy Wan 2.6 potrafi tworzyć filmy wieloujęciowe?
Tak. Potrafi połączyć kilka ujęć w jednym klipie przy zachowaniu spójności postaci i stylu, dzięki czemu krótka historia przechodzi między momentami bez widocznych przerw.
Jak działa audio w Wan 2.6?
Model może wygenerować pasujące audio do klipu albo podążać za dostarczoną przez Ciebie ścieżką audio, wyrównując dźwięk z ruchem na ekranie w tym samym żądaniu.
Jakie długości klipów i rozdzielczości są dostępne?
Wan 2.6 obsługuje długości klipów od dwóch do piętnastu sekund w 720P lub 1080P, a każda proporcja obrazu jest dostępna w obu rozdzielczościach.
Dlaczego uruchamiać Wan 2.6 przez Pollo API?
Pollo API daje jedną integrację dla Wan 2.6 i ponad 300 innych modeli, z jasną dokumentacją, śledzeniem zadań i generowaniem w niższym koszcie niż u porównywalnych dostawców.