GPT Image 2 offre un rendu de texte quasi parfait, une sortie de production 4K, un réalisme basé sur les connaissances du monde et un suivi extrême des instructions multi-matières.
Saisir
Mode
Remplissez les champs obligatoires pour voir le prix
curl-X POST 'https://pollo.ai/api/platform/v1/generation/openai/gpt-image-2/image'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "1:1", "resolution": "1K", "quality": "low", "background": "auto" }}'
Incluez éventuellement webhookUrl pour recevoir une notification en cas de succès ou d'échec de la tâche.
Champ de requête facultatif
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"1:1","resolution":"1K","quality":"low","background":"auto"},"webhookUrl":"https://example.com/webhooks/pollo"}
Schéma
Champs de saisie pour le point de terminaison et le mode sélectionnés.
Champ
Taper
Requis
Description
prompt
string
Oui
Text prompt describing the content to generate.
aspectRatio
string
Non
Output aspect ratio, as width:height (e.g. 16:9).
resolution
string
Non
Output resolution of the generated media (e.g. 720p, 1080p, 2K, 4K). Values are case-insensitive.
quality
string
Non
Output quality tier of the generation.
background
string
Non
Background of the generated image: auto lets the model decide, transparent produces an alpha background (PNG), opaque forces a solid background.
GPT Image 2 se distingue par sa capacité à rendre le texte lisible à l'intérieur d'une image. Les titres, les étiquettes et les petits caractères s'affichent avec netteté, permettant ainsi de créer des affiches, des emballages et des diagrammes prêts à l'emploi.
Avec GPT Image 2 sur l'API Pollo , les développeurs ajoutent la conversion de texte en image, l'édition d'images et la composition multi-images à leurs Apps, générant une sortie jusqu'à 4K avec des rapports d'aspect choisis par requête.
Principales fonctionnalités de l'API GPT Image 2
Texte fiable intégré à l'image
La typographie reste cohérente entre les titres, les légendes et les étiquettes denses, ce qui rend ce modèle fiable pour les menus, les infographies et toute mise en page où le texte doit être lisible et non un simple remplissage décoratif.
Instructions extrêmes
Les consignes longues et détaillées sont scrupuleusement respectées, de sorte que le nombre d'objets, leur emplacement, leurs couleurs et les phrases écrites soient conformes aux descriptions, au lieu de donner lieu à une interprétation approximative.
Édition au niveau du pixel
Intégrez une image existante et modifiez une région avec précision, en échangeant des objets, en ajustant du texte ou en affinant des détails, tandis que les parties non modifiées de l'image restent intactes.
Connaissances du monde ancrées
Les scènes reflètent les relations réelles entre les objets, les matériaux et les décors, de sorte qu'un outil, un plat ou une devanture de magasin décrits paraissent plausibles plutôt qu'assemblés à partir de pièces disparates.
Sortie 4K
Les appareils Generations prennent en charge la résolution 4K, offrant une résolution suffisante pour les mises en page imprimées, les grandes bannières et les photos de produits détaillées, sans étape de mise à l'échelle supplémentaire dans le flux de travail.
Composition multi-images
Combinez plusieurs images de référence en une seule requête pour fusionner des sujets, placer un produit dans une nouvelle scène ou créer un composite qui conserve la reconnaissance de chaque source.
Cas d'utilisation de l'API GPT Image 2
Maquettes d'emballage et d'étiquettes : Générez des boîtes, des bouteilles et des sachets avec des noms de marque lisibles, des listes d'ingrédients et des petits caractères positionnés comme spécifié dans les instructions.
Infographies et diagrammes : Créez des graphiques, des schémas légendés et des organigrammes où le texte et la structure véhiculent le sens, et pas seulement les éléments visuels.
Menus et panneaux d'affichage : Créez des menus de restaurant, des tableaux de prix et des panneaux d'affichage pour magasins avec une formulation précise et une typographie cohérente pour les outils destinés aux secteurs de l'hôtellerie et du commerce de détail.
Retouches photo ciblées : Permettent aux utilisateurs de sélectionner une zone et de modifier un élément, comme la couleur d’un vêtement ou le remplacement d’un logo, tout en préservant le reste.
Composition de produits : Intégrez un produit d’une image à un nouvel environnement, en conservant sa forme et sa finition, pour les catalogues e-commerce et les images lifestyle.
Mises en page des affiches et des publicités : Créez des mises en page promotionnelles où le titre, le sous-titre et l’appel à l’action doivent apparaître exactement tels qu’ils sont écrits et rester lisibles.
Concepts d'application et d'interface utilisateur : Créer des maquettes d'interface et des idées d'écran avec de véritables étiquettes de boutons et du texte de menu pour la conception et le prototypage Apps.
Variantes localisées des ressources : Régénérez la même mise en page avec un texte différent pour produire des variantes linguistiques ou de campagne à grande échelle.
Comment utiliser l'API GPT Image 2
Obtenir une clé API : Créez un compte API Pollo et générez votre clé API depuis le tableau de bord développeur.
Choisissez le modèle : Envoyez des requêtes au point de terminaison GPT Image 2 à l’adresse /generation/ OpenAI/gpt-image-2-0/image.
Ajoutez vos entrées : Transmettez une prompt pour le texte en image, ou fournissez imageUrl ou images pour l'édition et la composition, puis définissez aspectRatio, resolution (1K, 2K, 4K) et quality.
Générer et récupérer : Soumettez la tâche, interrogez le taskId et le status renvoyés, et téléchargez l'image une fois qu'elle a réussi.
Recommandations concernant les bonnes pratiques pour l'API GPT Image 2
Rédigez les instructions comme une fiche technique. Citez le texte exact à afficher, indiquez l'emplacement des éléments et nommez les couleurs et les matériaux afin que les instructions soient claires et précises.
Une formule simple pour les invites
Sujet et lieu + texte exact entre guillemets + mise en page et placement + style et couleur + détails des matériaux ou de l'éclairage
Ce que vous devez remarquer
Citer le texte : Placez entre guillemets le texte que vous souhaitez voir rendu, afin que le modèle le traite comme une copie littérale et non comme un thème général.
Emplacement du nom : Indiquez l’emplacement de chaque élément, par exemple la bannière supérieure ou le coin inférieur gauche, afin de contrôler la mise en page.
Décrivez la zone à modifier : Pour la retouche d’image, précisez exactement ce qui doit être modifié afin que les zones non modifiées restent inchangées.
Définissez le format d'image dès le départ : Choisissez le format qui correspond au format final afin que la composition soit correctement cadrée dès le début.
Adaptez la résolution à l'utilisation : Choisissez la résolution 4K pour l'impression et les grands formats, et des résolutions inférieures pour des brouillons et des itérations plus rapides.
Concentrez-vous sur un seul élément par modification : Modifiez un seul élément par étape de modification pour obtenir des résultats prévisibles et nets.
Exemples d'invites
Emballage du produit
« Un sachet de café en kraft mat posé sur une étagère en bois clair. L'étiquette avant porte l'inscription « MORNING ROOT — Single Origin » en caractères gras à empattement, avec la mention « Net 340 g » en petits caractères en bas. Lumière naturelle douce, faible profondeur de champ, prise de vue du produit en 4K. »
Infographie légendée
« Une infographie épurée au style plat intitulée « Comment fonctionne le compostage » avec quatre étapes numérotées disposées de gauche à droite, chacune accompagnée d'une icône simple et d'une courte légende. Palette de couleurs vert et beige discrets, texte sans empattement net et lisible. »
Modification de la région
« À partir de la photo de la façade téléchargée, remplacez l’enseigne suspendue vierge par une enseigne portant l’inscription « AZURE BOOKS » en lettres peintes à la main dans un style chaleureux. Conservez le bâtiment, l’auvent et la rue inchangés, en respectant la lumière du jour et les ombres d’origine. »
Composite multi-images
« Combinez l'image de la basket fournie et l'image de fond du studio de manière à ce que la basket soit centrée sur un socle réfléchissant, avec un projecteur venant du coin supérieur gauche et un reflet subtil au sol, en conservant la couleur exacte et les détails de couture de la chaussure. »
GPT Image 2 vs Google Imagen 4 vs FLUX.1 Kontext
Capacité
GPT Image 2
Image Google Imagen 4
FLUX.1 Kontext
Rendu du texte dans l'image
✅ Excellent pour les textes longs et petits
✅ Bonne typographie
⚠️ Axé sur l'édition, texte moins performant
Respect des consignes
✅ Gestion des invites détaillées à plusieurs éléments
✅ Forte adhésion
✅ Excellente capacité à modifier les instructions
Édition au pixel près
✅
⚠️ Limité
✅ Force principale
Composition multi-images
✅
❌
⚠️ Basée sur des références
Résolution maximale
Jusqu'à 4K
Jusqu'à la classe 2K
Jusqu'à la classe 4MP
Recommandé pour
Ressources riches en texte et modifications précises
Génération photoréaliste
Retouche d'images itérative
Pourquoi choisir l'API GPT Image 2 ?
GPT Image 2 convient aux produits qui nécessitent un texte lisible et des modifications fidèles, qu'il s'agisse d'emballages, d'infographies ou de changements de région ciblés, le tout à des résolutions suffisamment élevées pour l'impression.
Grâce à l'API Pollo , vous accédez à GPT Image 2 avec une seule clé API, ainsi qu'à plus de 300 modèles d'images et de vidéos de pointe, avec une documentation claire, un suivi de l'état des tâches et une génération qui coûte moins cher que Fal AI.
Commencez par utiliser le point de terminaison GPT Image 2 de l'API Pollo pour envoyer des caractéristiques d'image précises au niveau du texte, puis comparez-le à Imagen, Flux et autres sans modifier votre intégration.
FAQ sur l'API GPT Image 2
Qu'est-ce que GPT Image 2?
GPT Image 2 est un modèle d'image OpenAI connu pour son texte précis dans l'image, son suivi d'instructions robuste et son édition au niveau du pixel, prenant en charge la conversion de texte en image, l'édition d'images et la composition multi-images jusqu'à 4K.
L'API GPT Image 2 affiche-t-elle le texte de manière fiable ?
Oui. C'est l'un de ses principaux atouts : la gestion des titres, des étiquettes et des petits caractères, ce qui la rend parfaitement adaptée aux emballages, aux menus, aux affiches et aux infographies.
Peut-il modifier une image existante ?
Oui. Fournissez une image et décrivez la modification ; le modèle modifiera une zone ciblée tout en conservant le reste de l’image intact.
Quelles résolutions et quels formats d'image sont pris en charge ?
La résolution de sortie peut atteindre 1K, 2K ou 4K, avec des formats d'image allant du carré et du portrait au grand écran et à l'ultra-large, choisis sur demande.
Peut-il combiner plusieurs images ?
Oui. Vous pouvez transmettre plusieurs images de référence dans une seule requête pour fusionner des sujets ou placer un produit dans une nouvelle scène tout en conservant la reconnaissance de chaque source.
Pourquoi exécuter GPT Image 2 via l'API Pollo ?
L'API Pollo offre une intégration pour GPT Image 2 et plus de 300 autres modèles, avec une documentation claire, un suivi des tâches et une génération à moindre coût que les fournisseurs comparables.