Tekst na wideoObraz do wideoOdnośnik do filmuOd 0,12 $ / S
Happy Horse 1.0 generuje zsynchronizowany dźwięk i obraz z dokładną synchronizacją ruchu warg, realistycznym ruchem i kinową narracją składającą się z wielu ujęć.
curl-X POST 'https://pollo.ai/api/platform/v1/generation/alibaba/happyhorse-1-0/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "duration": 5, "resolution": "720p", "aspectRatio": "1:1" }}'
Opcjonalnie dołącz webhookUrl, aby otrzymać wywołanie zwrotne w przypadku powodzenia lub niepowodzenia zadania.
Opcjonalne pole żądania
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","duration":5,"resolution":"720p","aspectRatio":"1:1"},"webhookUrl":"https://example.com/webhooks/pollo"}
Schemat
Pola wejściowe dla wybranego punktu końcowego i trybu.
Pole
Typ
Wymagany
Opis
prompt
string
Tak
Text prompt describing the content to generate.
duration
integer
NIE
The duration of the generated video, in seconds.
resolution
string
NIE
Output resolution of the generated media (e.g. 720p, 1080p, 2K, 4K). Values are case-insensitive.
aspectRatio
string
NIE
Output aspect ratio, as width:height (e.g. 16:9).
seed
integer
NIE
Random seed for reproducible generation.
Błędy
Typowe publiczne kody odpowiedzi API.
400
Nieprawidłowe dane wejściowe lub ograniczenie modelu
Happy Horse 1.0 generuje dźwięk i obraz jednocześnie. Wypowiedzi głosowe są dopasowane do ruchu ust, dźwięk otoczenia pasuje do sceny, a ruchy kamery podążają za podpowiedzią, dzięki czemu klipy wydają się być udźwiękowione, a nie wyciszone.
Dzięki Happy Horse 1.0 opartemu na API Pollo twórcy aplikacji mogą dodać do swoich Apps funkcję generowania tekstu do wideo i obrazów do wideo, z wyjściem w rozdzielczości 720P lub 1080P i długością klipów od 3 do 15 sekund.
Kluczowe funkcje API Happy Horse 1.0
Synchronizowana mowa i dźwięk
Zadbaj o to, aby dialogi, ton i dźwięk były spójne z obrazem, dzięki czemu osoba mówiąca będzie mówiła w rytm, a nie gubiła własnego głosu.
Dokładna synchronizacja ruchu warg
Zadbaj o to, aby kształt ust odpowiadał wypowiadanym słowom, dzięki czemu ujęcia skupiające się na mówcy pozostaną wiarygodne, gdy postać wygłasza kwestię, liczy słowa lub reaguje na kamerze.
Dostawa wielojęzyczna
Generuj dopasowane komunikaty głosowe na podstawie monitów w różnych językach, obsługując zlokalizowane wersje tego samego skryptu bez konieczności przełączania narzędzi w trakcie pracy.
Ruchy kamery sterowane impulsowo
Opisz ruch wsuwany, przesuwany lub powolny, a model przedstawi ruch, dając ukierunkowane ujęcia zamiast statycznej klatki z mówiącą głową.
Precyzyjna kontrola długości
Ustaw długość klipu od 3 do 15 sekund w krokach co sekundę, aby dokładnie dopasować ją do mówionej kwestii, rytmu napisów lub pętli.
Początek tekstu i obrazu
Zacznij od napisanej sceny lub dostarczonego obrazu, umożliwiając scenariuszom, w których na pierwszym miejscu jest pomysł, oraz opiniom, w których na pierwszym miejscu są zasoby, korzystanie z tej samej ścieżki generowania.
Przykłady użycia API Happy Horse 1.0
Mówiące awatary: Wygeneruj osobę mówiącą, która czyta scenariusz na głos, dostosowując ruchy ust do przepływów wprowadzających i narzędzi wirtualnego prezentera.
Zlokalizowane warianty reklam: Przygotuj ten sam krótki spot w kilku językach, każdy z zsynchronizowaną ścieżką dźwiękową, dzięki czemu jedna kampania będzie wysyłana do różnych regionów w ramach jednej integracji.
Fragmenty wyjaśniające: Zmień opisany krok w klip z narracją, w którym postać wypowiada instrukcję, a kamera przesuwa się w kierunku opisywanego szczegółu.
Kwestie głosowe postaci: Zmień nieruchomy obraz postaci w krótką scenę mówioną, dzięki czemu Apps do opowiadań, gier lub treści dla fanów zyskają postać mówiącą.
Opisy produktów: Poproś prezentera, aby przed kamerą wymienił nazwę funkcji i cenę, a jego głos i słowa powinny być spójne, co przyda się w krótkich wystąpieniach zakupowych i społecznościowych.
Przebudowa scen z dubbingiem: Odtwórz zaplanowaną scenę w nowym języku dzięki nowej synchronizacji ruchu warg, co pozwala narzędziom lokalizacyjnym wyjść poza nakładanie napisów.
Klipy z rozmowami społecznościowymi: Umieść refreny w pionowych lub kwadratowych formatach trwających od 3 do 15 sekund w przypadku kanałów, w których udźwiękowione ruchy sprawdzają się lepiej niż bezdźwięczne nagrania.
Jak korzystać z API Happy Horse 1.0
Uzyskaj klucz API: Utwórz konto API Pollo i wygeneruj klucz API z poziomu pulpitu programisty.
Wybierz model: Wyślij żądania do punktu końcowego Happy Horse 1.0 pod adresem /generation/wanx/ HappyHorse-1.0.
Dodaj swoje dane wejściowe: Podaj „monit” dla tekstu na wideo lub adres URL „obrazu” dla obrazu na wideo, a następnie ustaw „rozdzielczość” (720P lub 1080P) i „długość” (od 3 do 15). Tekst na wideo obsługuje również „aspectRatio”.
Generowanie i pobieranie: Prześlij zadanie, sprawdź status zwróconego zadania i pobierz ukończony film po pomyślnym przetworzeniu.
Najlepsze praktyki dotyczące podpowiedzi dla API Happy Horse 1.0
Potraktuj polecenie jak scenariusz z listą ujęć. Napisz dokładną kwestię, podaj nazwisko mówcy i język, a następnie opisz kamerę i scenerię, aby dźwięk i ruch były spójne.
Prosta formuła podpowiedzi
Mówca + kwestia w cudzysłowie i język + wyrażenie lub gest + ruch kamery + ustawienie i sygnał dźwiękowy
Na co powinieneś zwrócić uwagę
Cytuj dialog: Wpisz rzeczywiste słowa w podpowiedź, aby synchronizacja ust z tekstem przebiegała według dokładnego wersu, a nie była parafrazą.
Nazwij język: Podaj język mówiony, jeśli potrzebujesz zlokalizowanej przekazu, ponieważ model dopasowuje mowę do tego, co określisz.
Pojedynczy ruch kamery: Poproś o pojedynczy ruch, taki jak wsunięcie kamery lub przesunięcie kamery, aby zachować kontrolę nad ujęciem w całym klipie.
Skup się na jednym mówcy: Ustaw kadr w centrum osoby mówiącej, aby ruchy ust i głos były spójne.
Ustaw długość wiersza: Wybierz długość zbliżoną do rzeczywistego tempa mówionego wiersza, aby mowa nie była pospieszna lub wydłużona.
Przykładowe monity
Rzecznik wielojęzyczny
„Przyjazny kasjer patrzy w kamerę i mówi po hiszpańsku: »Otwórz tu rachunek w ciągu dwóch minut«. Ciepłe oświetlenie oddziału, delikatny uśmiech, delikatne wciśnięcie przycisku, czysty, zsynchronizowany głos i cicha atmosfera biura”.
Mówiąca postać z obrazu
„Ożyw dostarczonego ilustrowanego lisa tak, aby odwrócił się do kamery i powiedział: »Gotowy na dzisiejszą historię?« miękkim, bajkowym głosem. Przytulny pokój oświetlony lampą, powolne przesuwanie kamery po biurku, dopasowany ruch ust.”
Wezwanie dostawcy na rynku
Sprzedawca ulicznego jedzenia podnosi szpikulec i woła: „Świeżo z grilla, pięć dolarów za sztukę!”. Unosi się para, za nim ruchliwe stoisko, kamera ręczna zbliża się, słychać ożywione odgłosy targu i zsynchronizowany głos.
Liczba trenerów fitness
Trener w jasnym studiu stoi twarzą do kamery i liczy: „Trzy, dwa, jeden, czekaj”, gestykulując w dół. Spokojna klatka z powolnym ruchem, radosny ton głosu, ruch ust dopasowany do każdej wypowiadanej liczby.
Happy Horse 1.0 kontra Veo 3.1 kontra Kling 2.6
Możliwości
Happy Horse 1.0
Veo 3.1
Kling 2.6
Synchronizacja mowy i dźwięku
✅ Wbudowane w generację
✅ Dźwięk natywny
⚠️ Synchronizacja ruchu ust jako osobny krok
Dokładność synchronizacji ruchu ust
✅ Dobra w kwestiach mówionych
✅ Mocna
✅ Dobra z dodatkiem
Dostawa wielojęzyczna
✅
✅
⚠️ Ograniczona
Długość klipu
od 3 do 15 sekund, co 1 s
Krótkie, stałe klipy
Krótkie, ukierunkowane klipy
Opcje rozdzielczości
720P i 1080P
Do 1080P
Do 1080P
Polecane dla
Klipy z dialogami i lokalizacja
Wysokiej jakości ujęcia audiowizualne
Ruch postaci i stylizowane sceny
Dlaczego warto wybrać API Happy Horse 1.0?
Happy Horse 1.0 jest rozwiązaniem przeznaczonym dla produktów, które wymagają od ludzi lub postaci przemawiających przed kamerą, łącząc w jednym pokoleniu dokładną synchronizację ruchu warg, wielojęzyczną ścieżkę dźwiękową i ruchy kamery sterowane podpowiedziami.
Za pomocą API Pollo uzyskasz Happy Horse 1.0 za pomocą jednego klucza API, a także ponad 300 wiodących modeli wideo i obrazów, z przejrzystą dokumentacją, sondowaniem stanu zadań i generowaniem.
Najczęściej zadawane pytania dotyczące API Happy Horse 1.0
Czym jest Happy Horse 1.0?
Happy Horse 1.0 to model generowania wideo, który tworzy zsynchronizowane klipy audiowizualne z dokładną synchronizacją ruchu ust, wielojęzyczną mową, realistycznym ruchem i ruchami kamery sterowanymi za pomocą komunikatów.
Czy API Happy Horse 1.0 obsługuje wprowadzanie tekstu i obrazów?
Tak. Możesz generować na podstawie monitu tekstowego lub animować adres URL obrazu, dzięki czemu zarówno przepływy pracy oparte na skrypcie, jak i na zasobach przebiegają przez ten sam model.
Jak działa dźwięk i synchronizacja ruchu ust?
Mowa i dźwięk są generowane za pomocą wideo i dopasowywane do ruchu ust, dzięki czemu słowa wypowiadane przez osobę są zsynchronizowane z jej ustami i nie wymagają oddzielnej synchronizacji.
Jakie rozdzielczości i długości klipów są dostępne?
Happy Horse 1.0 generuje obraz w rozdzielczości 720P lub 1080P i obsługuje długości klipów od 3 do 15 sekund, wybierane co sekundę na żądanie.
Czy może produkować wideo w wielu językach?
Tak. Komunikaty głosowe napisane w różnych językach generują dopasowane komunikaty głosowe dla zlokalizowanych reklam, narzędzi dubbingowych i wariantów regionalnych.
Dlaczego warto uruchomić Happy Horse 1.0 za pomocą API Pollo ?
API Pollo umożliwia integrację z Happy Horse 1.0 i ponad 300 innymi modelami, z dokumentacją, śledzeniem zadań i generowaniem niższych kosztów.