Texto para vídeo com IATransformar foto em vídeo com IAReferências para vídeoDe $ 0,12 / s
Happy Horse 1.0 gera áudio e vídeo sincronizados com sincronização labial precisa, movimentos realistas e narrativa cinematográfica com múltiplas tomadas.
curl-X POST 'https://pollo.ai/api/platform/v1/generation/alibaba/happyhorse-1-0/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "duration": 5, "resolution": "720p", "aspectRatio": "1:1" }}'
Opcionalmente, inclua o webhookUrl para receber uma notificação quando a tarefa for concluída com sucesso ou falhar.
Campo de solicitação opcional
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","duration":5,"resolution":"720p","aspectRatio":"1:1"},"webhookUrl":"https://example.com/webhooks/pollo"}
Esquema
Campos de entrada para o ponto de extremidade e o modo selecionados.
Campo
Tipo
Obrigatório
Descrição
prompt
string
Sim
Text prompt describing the content to generate.
duration
integer
Não
The duration of the generated video, in seconds.
resolution
string
Não
Output resolution of the generated media (e.g. 720p, 1080p, 2K, 4K). Values are case-insensitive.
O Happy Horse 1.0 gera som e vídeo juntos. As falas ficam alinhadas aos movimentos da boca, o áudio ambiente combina com a cena e os movimentos de câmera seguem o prompt, então os clipes parecem sonoros e bem sincronizados, não vídeos mudos com áudio adicionado depois.
Com o Happy Horse 1.0 na Pollo API, desenvolvedores podem adicionar geração de texto para vídeo e imagem para vídeo aos seus apps, com saída em 720P ou 1080P e duração de clipes de 3 a 15 segundos.
Principais recursos da API do Happy Horse 1.0
Fala e áudio sincronizados
Mantenha diálogo, tom e som alinhados com o visual, para que um personagem falando fique no tempo certo em vez de sair de sincronia com a própria voz.
Lip-sync preciso
Mantenha os formatos da boca alinhados às palavras faladas, para que cenas focadas no locutor continuem críveis quando um personagem fala uma frase, faz contagem ou reage na câmera.
Entrega multilíngue
Gere fala correspondente a partir de prompts em diferentes idiomas, com suporte a versões localizadas do mesmo roteiro sem trocar de ferramenta no meio do fluxo.
Movimentos de câmera guiados por prompt
Descreva um push-in, pan ou órbita lenta e o modelo encena o movimento, entregando tomadas dirigidas em vez de um quadro estático com talking head.
Controle fino de duração
Defina a duração do clipe de 3 a 15 segundos em passos de 1 segundo para combinar exatamente com uma fala, o ritmo de uma legenda ou um loop.
Início por texto e imagem
Comece com uma cena escrita ou com uma imagem fornecida, permitindo que roteiros idea-first e briefs asset-first usem o mesmo caminho de geração.
Casos de uso da API do Happy Horse 1.0
Avatares falantes: Gere um porta-voz que lê um roteiro em voz alta com movimento labial correspondente para fluxos de onboarding e ferramentas de apresentador virtual.
Variações de anúncios localizados: Produza o mesmo spot curto em vários idiomas, cada um com fala sincronizada, para que uma campanha seja lançada em várias regiões a partir de uma única integração.
Trechos explicativos: Transforme uma etapa escrita em um clipe narrado no qual um personagem fala a instrução enquanto a câmera se move para o detalhe descrito.
Falas de personagens: Anime uma imagem estática de personagem em uma tomada curta falada, dando aos apps de histórias, jogos ou conteúdo de fãs uma figura que fala.
Destaques de produto: Faça um apresentador citar um recurso e um preço na câmera, com boca e palavras alinhadas, para peças curtas de social e compráveis.
Reconstrução de cenas dubladas: Recrie um momento roteirizado em um novo idioma com novo lip-sync, ajudando ferramentas de localização a irem além de sobreposições de legenda.
Clipes falados para social: Encaixe ganchos falados em formatos verticais ou quadrados de 3 a 15 segundos para feeds em que movimento com voz supera stock silencioso.
Como usar a API do Happy Horse 1.0
Obtenha uma chave de API: Crie uma conta na Pollo API e gere sua chave de API no painel do desenvolvedor.
Escolha o modelo: Envie requisições para o endpoint do Happy Horse 1.0 em /generation/wanx/happyhorse-1.0.
Adicione suas entradas: Forneça um prompt para texto para vídeo ou uma URL de image para imagem para vídeo, depois defina resolution (720P ou 1080P) e length (3 a 15). Texto para vídeo também aceita aspectRatio.
Gere e recupere: Envie a tarefa, consulte o status da tarefa retornada e baixe o vídeo finalizado quando o processamento for concluído com sucesso.
Boas práticas de prompt para a API do Happy Horse 1.0
Trate o prompt como um roteiro mais uma lista de tomadas. Escreva a fala exata, indique quem fala e o idioma, depois descreva câmera e cenário para que áudio e movimento fiquem alinhados.
Uma fórmula simples de prompt
Falante + fala entre aspas e idioma + expressão ou gesto + movimento de câmera + cenário e indicação de áudio
O que você deve observar
Coloque o diálogo entre aspas: Inclua as palavras reais no prompt para que o lip-sync tenha uma fala exata para seguir, em vez de uma paráfrase.
Nomeie o idioma: Informe o idioma falado quando precisar de entrega localizada, já que o modelo combina a fala com o que você especifica.
Direcione um único movimento de câmera: Peça um único movimento, como push-in ou pan, para que a tomada permaneça controlada ao longo do clipe.
Mantenha foco em um único falante: Centralize o quadro na pessoa que fala para que detalhe da boca e voz permaneçam fortemente alinhados.
Ajuste a duração à fala: Escolha uma duração próxima ao ritmo real da fala para que o áudio não fique apressado nem com preenchimento artificial.
Exemplos de prompts
Porta-voz multilíngue
"A friendly bank teller looks at camera and says in Spanish, 'Abrir tu cuenta toma dos minutos.' Warm branch lighting, slight smile, gentle push-in, clean synced speech with quiet office ambience."
Personagem falante a partir de uma imagem
"Animate the supplied illustrated fox so it turns to camera and says, 'Ready for tonight's story?' in a soft storybook voice. Cozy lamplit room, slow pan across the desk, matched lip movement."
Chamada de vendedor de mercado
"A street food vendor holds up a skewer and calls, 'Fresh off the grill, five dollars each!' Steam rising, busy stall behind, handheld camera drifting closer, lively market sound and synced voice."
Contagem de coach fitness
"A coach in a bright studio faces camera and counts, 'Three, two, one, hold,' while gesturing downward. Steady frame with a slow orbit, upbeat room tone, mouth movement matched to each spoken number."
Happy Horse 1.0 vs Veo 3.1 vs Kling 2.6
Capacidade
Happy Horse 1.0
Veo 3.1
Kling 2.6
Fala e áudio sincronizados
✅ Integrado à geração
✅ Áudio nativo
⚠️ Lip-sync como etapa separada
Precisão de lip-sync
✅ Forte em falas
✅ Forte
✅ Boa com complemento
Entrega multilíngue
✅
✅
⚠️ Limitada
Duração do clipe
3 a 15 segundos, passos de 1s
Clipes curtos fixos
Clipes curtos dirigidos
Opções de resolução
720P e 1080P
Até 1080P
Até 1080P
Recomendado para
Clipes falados e localização
Tomadas de áudio-vídeo premium
Movimento de personagem e cenas estilizadas
Por que escolher a API do Happy Horse 1.0?
O Happy Horse 1.0 é ideal para produtos que precisam de pessoas ou personagens falando na câmera, combinando lip-sync preciso, áudio multilíngue e movimentos de câmera guiados por prompt em uma única geração.
Pela Pollo API, você acessa o Happy Horse 1.0 com uma única chave de API ao lado de mais de 300 modelos líderes de vídeo e imagem, com documentação clara, consulta de status de tarefas e geração.
FAQs da API do Happy Horse 1.0
O que é o Happy Horse 1.0?
O Happy Horse 1.0 é um modelo de geração de vídeo que cria clipes de áudio e vídeo sincronizados com lip-sync preciso, fala multilíngue, movimento realista e movimentos de câmera guiados por prompt.
A API do Happy Horse 1.0 oferece suporte a entradas de texto e imagem?
Sim. Você pode gerar a partir de um prompt de texto ou animar uma URL de imagem, então fluxos script-first e asset-first passam pelo mesmo modelo.
Como funcionam o áudio e o lip-sync?
A fala e o som são gerados com o vídeo e alinhados ao movimento da boca, então as palavras do personagem combinam com os lábios sem precisar de uma etapa separada de sincronização.
Quais resoluções e durações de clipe estão disponíveis?
O Happy Horse 1.0 gera em 720P ou 1080P e suporta clipes de 3 a 15 segundos, escolhidos de um em um segundo por requisição.
Ele pode produzir vídeo em vários idiomas?
Sim. Prompts escritos em diferentes idiomas geram fala correspondente para anúncios localizados, ferramentas de dublagem e variantes específicas por região.
Por que executar o Happy Horse 1.0 pela Pollo API?
A Pollo API oferece uma única integração para o Happy Horse 1.0 e mais de 300 outros modelos, com documentação, rastreamento de tarefas e geração de menor custo.