Explora los últimos modelos de IA para vídeo e imagen con la API de Pollo.

GPT Image 2, diseñada para elementos visuales listos para producción.

Crea imágenes nítidas en 4K con una representación de texto fiable, un amplio conocimiento del mundo y una comprensión precisa de instrucciones complejas.

Modelos de API populares

Descubre las capacidades de cada modelo y sus estilos de salida para elegir la mejor API para tu proyecto.

Laboratorios modelo

Novedades

Destacados

MiniMax H3
New
MiniMax H3
Text to videoImage to videoReference to video

Minimax H3 crea secuencias de múltiples tomas con audio sincronizado nativo, control preciso de la cámara y edición avanzada de fotogramas clave para lograr narrativas coherentes.

0,07 $/s
GPT Image 2
New
GPT Image 2
Image to imageText to image

GPT Image 2 ofrece una representación de texto casi perfecta, salida de producción en 4K, realismo basado en el conocimiento del mundo y una capacidad extrema para seguir instrucciones en múltiples materias.

Nano Banana 2
New
Nano Banana 2
Image to imageText to image

Nano Banana 2 ofrece conocimiento del mundo en tiempo real, razonamiento lógico, coherencia entre múltiples temas y resolución 4K Ultra HD nativa con relaciones de aspecto extremas.

0,034 $/Image
Pollo 2.5
Pollo 2.5
Image to videoText to video

Pollo 2.5 crea vídeos multitoma coherentes con audio sincronizado, personajes consistentes y un control preciso del estilo, el movimiento y el trabajo de cámara.

0,12 $/s
Kling 3.0
Kling 3.0
Text to videoImage to video

Kling 3.0 genera vídeos cinematográficos hiperrealistas que presentan un modelado de movimiento complejo, una adherencia superior a las indicaciones y una simulación física de nivel profesional.

0,066 $/s
Wan 2.6
Wan 2.6
Text to videoImage to video

Wan 2.6 genera secuencias de varias tomas con narrativas visuales más largas, referencias de vídeo, personajes coherentes y audio sincronizado.

0,18 $/s
Veo 3.1
Veo 3.1
Text to videoImage to video

Veo 3.1 ofrece un audio nativo más rico, un control de fotogramas avanzado y la capacidad de guiar la generación de vídeo con imágenes de referencia.