Billede til videoTekst til videoFra $ 0,30 / video
O modelo de vídeo Kling O1 oferece um fluxo de trabalho versátil com entradas multimodais e garante uma consistência de personagem estável em todas as cenas.
curl-X POST 'https://pollo.ai/api/platform/v1/generation/kling-ai/kling-video-o1/video'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "16:9", "duration": 5 }}'
Inkluder eventuelt webhookUrl for at modtage et callback, når opgaven lykkes eller mislykkes.
Valgfrit anmodningsfelt
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"16:9","duration":5},"webhookUrl":"https://example.com/webhooks/pollo"}
O Kling Video O1 gera vídeo a partir de um prompt escrito, imagens de referência ou pares de quadros inicial e final em uma única solicitação.
Com o Kling Video O1 na Pollo API, desenvolvedores adicionam esse gerador multimodal aos seus apps, enviando entradas de texto, imagem ou referência e escolhendo proporção e duração do clipe por chamada.
Principais recursos da API do Kling Video O1
Suporte a entrada multimodal
O modelo processa texto, uma única imagem ou um conjunto de imagens de referência em um único fluxo de trabalho, então seu produto pode alternar entre geração orientada por ideia e geração orientada por ativo sem trabalho extra de infraestrutura.
Consistência com múltiplas referências
Até sete imagens de referência podem orientar uma única geração, permitindo que personagens, objetos de cena ou estilos de imagens separadas apareçam juntos em uma cena, mantendo persistência de características e consistência de identidade.
Controle de primeiro e último quadro
Forneça uma imagem inicial e uma imagem final, e o modelo interpola o movimento entre elas, dando controle preciso sobre como um take começa e onde termina.
Estabilidade quadro a quadro
Sujeitos, iluminação e composição se mantêm estáveis ao longo do clipe, para que rostos, objetos e fundos não desviem nem se deformem entre quadros durante ações mais longas.
Prompting em múltiplas etapas
Prompts detalhados de até 2.500 caracteres permitem que você roteirize ações em sequência e mise-en-scène, para que o modelo siga uma ordem descrita de eventos em vez de um único momento estático.
Enquadramento flexível
Saídas em paisagem, retrato e quadrado estão todas disponíveis, adaptando a mesma geração para players widescreen, feeds verticais ou posicionamentos quadrados.
Casos de uso da API do Kling Video O1
Cenas com múltiplos personagens: Combine imagens de referência de dois ou três personagens para que eles compartilhem um único take com rostos e figurinos consistentes.
Branding guiado por referência: Envie imagens de logo, produto e mascote juntas para manter os ativos da marca fiéis ao modelo em clipes promocionais gerados.
Storyboard para movimento: Transforme um primeiro e um último quadro em um take animado, útil para ferramentas de previz e pipelines guiados por layout.
Clipes de ação sequencial: Roteirize movimentos em múltiplas etapas em um único prompt, como uma figura que entra em cena, senta e depois reage a algo fora de quadro.
Animação de histórias ilustradas: Leve personagens desenhados de artes de referência para cenas em movimento em ferramentas de livros infantis, quadrinhos ou webtoons.
Movimento consistente de produto: Anime um produto a partir de uma única imagem mantendo forma, rótulo e cor fiéis em todo o clipe.
Automação de conteúdo vertical: Gere clipes em retrato em escala para feeds de formato curto usando texto ou uma única imagem guia por solicitação.
Prototipagem de conceito para vídeo: Permita que equipes visualizem um take descrito a partir de um prompt antes de comprometer ativos de referência ou tempo de produção.
Como usar a API do Kling Video O1
Obtenha uma chave de API: Crie uma conta na Pollo API e gere sua chave de API no dashboard de desenvolvedor.
Escolha o modelo: Envie uma solicitação POST para o endpoint do Kling Video O1 em /generation/kling-ai/kling-video-o1.
Adicione suas entradas: Passe um objeto input para text-to-video (prompt), image-to-video (image mais imageTail opcional) ou reference-to-video (array images de até 7), e depois defina aspectRatio e length.
Gere e recupere: Envie a tarefa, faça polling do taskId retornado e do status, e baixe o vídeo quando o processamento for concluído com sucesso.
Boas práticas de prompting para a API do Kling Video O1
Trate o prompt como uma lista de takes. Nomeie cada referência com clareza, descreva a sequência de ações em ordem e depois defina enquadramento, movimento e clima para que o modelo tenha um plano completo para seguir.
Uma fórmula simples de prompt
Configuração da referência ou do sujeito + ações ordenadas passo a passo + câmera e enquadramento + cenário e iluminação + estilo
O que você deve observar
Identifique suas referências: Ao usar múltiplas imagens, descreva qual sujeito é qual para que o modelo os posicione corretamente na cena.
Ordene as ações: Escreva os eventos em sequência, já que o modelo pode seguir uma encenação em múltiplas etapas em vez de um único momento congelado.
Ancore o quadro final: Com uma imagem final, descreva como o take deve chegar até ela para que a interpolação pareça intencional.
Combine a proporção com o destino: Escolha paisagem, retrato ou quadrado cedo para encaixar no player ou feed de destino.
Mantenha sujeitos distintos: Dê traços claros para cada personagem ou objeto referenciado para manter a consistência em todo o clipe.
Exemplos de prompts
Encontro com múltiplas referências
"Usando as três imagens de referência — o jovem inventor, o robô de cobre e a oficina bagunçada — coloque os três na mesma cena. O inventor acena, o robô inclina a cabeça em resposta. Dolly-in lento, luz quente de luminária, estilo de ilustração desenhada à mão."
Transição do primeiro para o último quadro
"Comece com o esboço a lápis de um farol e termine na versão final em aquarela. Cor e textura florescem pelo quadro da esquerda para a direita enquanto o céu clareia. Câmera estática, luz diurna suave, transição pictórica delicada."
Batida de ação sequencial
"Uma padeira entra em quadro carregando uma bandeja, coloca-a no balcão, tira a farinha das mãos e então levanta o olhar e sorri para um cliente. Plano médio, luz da manhã pela janela, estilo realista acolhedor, câmera de mão estável."
Movimento de produto fiel à referência
"A partir da imagem única de referência do bule de cerâmica, despeje chá fumegante em uma xícara combinando enquanto o vapor sobe em espiral. Mantenha o padrão do esmalte e a forma exatos. Close lateral, luz de cozinha suave, estilo realista limpo."
Kling Video O1 vs Vidu Q1 vs Runway Gen-4
Capacidade
Kling Video O1
Vidu Q1
Runway Gen-4
Entrada com múltiplas referências
✅ Até 7 imagens de referência
✅ Múltiplos sujeitos de referência
✅ Guiado por referência
Controle de primeiro e último quadro
✅ Imagem inicial e final
✅
❌ Limitado
Texto, imagem e referência em um único modelo
✅
✅
✅
Seguimento de prompt em múltiplas etapas
✅ Prompts longos ordenados
✅
✅
Opções de proporção
16:9, 9:16, 1:1
Múltiplas
16:9 e vertical
Recomendado para
Takes sequenciados com consistência de referência
Cenas de referência com múltiplos sujeitos
Clipes estilizados com direção autoral
Por que escolher a API do Kling Video O1?
O Kling Video O1 se destaca quando um take precisa combinar várias referências, manter todos os sujeitos consistentes e seguir uma sequência ordenada de ações em vez de um momento isolado.
Pela Pollo API, você acessa o Kling Video O1 com uma única chave de API ao lado de mais de 300 modelos líderes de vídeo e imagem, com documentação clara, polling de tarefas e webhooks.
Comece com o endpoint do Kling Video O1 na Pollo API para lançar recursos de vídeo guiados por referência e em múltiplas etapas, depois compare com Vidu, Runway e outros modelos Kling sem mexer na sua integração.
FAQs da API do Kling Video O1
O que é o Kling Video O1?
Kling Video O1 é um modelo de vídeo multimodal da Kling AI que gera clipes a partir de texto, uma única imagem ou até sete imagens de referência, com forte consistência entre quadros e prompting em múltiplas etapas.
A API do Kling Video O1 suporta imagens de referência?
Sim. O modo reference-to-video aceita até sete URLs de imagem em uma solicitação, para que vários personagens, produtos ou estilos apareçam juntos em uma única cena consistente.
Ele consegue controlar o início e o fim de um take?
Sim. Em image-to-video você pode fornecer uma imagem inicial e uma imagem final, e o modelo interpola o movimento entre os dois quadros.
Quais proporções e durações estão disponíveis?
O Kling Video O1 gera em 16:9, 9:16 ou 1:1, com clipes de 3 a 10 segundos dependendo do modo de entrada escolhido por solicitação.
Como ele lida com ações em sequência?
Prompts de até 2.500 caracteres permitem descrever eventos em ordem, para que o modelo encene movimentos em múltiplas etapas em vez de um único momento estático.
Por que executar o Kling Video O1 pela Pollo API?
A Pollo API oferece uma integração única para o Kling Video O1 e mais de 300 outros modelos, com documentação, rastreamento de tarefas e webhooks.