curl-X POST 'https://pollo.ai/api/platform/v1/generation/openai/gpt-image-2/image'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "1:1", "resolution": "1K", "quality": "low", "background": "auto" }}'
Du kan eventuelt inkludere webhookUrl for å motta et tilbakekall når oppgaven lykkes eller mislykkes.
Valgfritt forespørselsfelt
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"1:1","resolution":"1K","quality":"low","background":"auto"},"webhookUrl":"https://example.com/webhooks/pollo"}
Skjema
Inndatafelt for det valgte endepunktet og modusen.
Felt
Type
Obligatorisk
Beskrivelse
prompt
string
Ja
Text prompt describing the content to generate.
aspectRatio
string
Ingen
Output aspect ratio, as width:height (e.g. 16:9).
resolution
string
Ingen
Output resolution of the generated media (e.g. 720p, 1080p, 2K, 4K). Values are case-insensitive.
quality
string
Ingen
Output quality tier of the generation.
background
string
Ingen
Background of the generated image: auto lets the model decide, transparent produces an alpha background (PNG), opaque forces a solid background.
Lesbar tekst inne i et bilde er der GPT Image 2 virkelig skiller seg ut. Overskrifter, etiketter og liten skrift gjengis rent, så plakater, emballasje og diagrammer blir klare til bruk.
Med GPT Image 2 på Pollo API kan utviklere legge til tekst-til-bilde, bilderedigering og komposisjon av flere bilder i appene sine, og generere opptil 4K-utdata med sideforhold valgt per forespørsel.
Nøkkelfunksjoner i GPT Image 2 API
Pålitelig tekst i bilde
Typografien holder seg stabil på tvers av overskrifter, bildetekster og tette etiketter, noe som gjør modellen pålitelig for menyer, infografikk og alle oppsett der teksten må være lesbar, ikke bare dekor.
Ekstrem instruksjonsfølgning
Lange, detaljerte prompt følges tett, så spesifikke antall objekter, plasseringer, farger og skrevne fraser blir som beskrevet i stedet for å drive over i en løs tolkning.
Redigering på pikselnivå
Gi et eksisterende bilde og endre et område presist: bytt objekter, juster tekst eller finpuss detaljer, mens urørte deler av rammen forblir intakte.
Forankret verdensforståelse
Scener gjenspeiler reelle forhold mellom objekter, materialer og miljøer, så et beskrevet verktøy, en rett eller en butikkfasade ser troverdig ut i stedet for satt sammen av deler som ikke passer.
4K-utdata
Genereringer skalerer til 4K, som gir nok oppløsning for trykklayout, store bannere og detaljerte produktbilder uten et eget oppskaleringssteg i arbeidsflyten.
Komposisjon av flere bilder
Kombiner flere referansebilder i én forespørsel for å slå sammen motiver, plassere et produkt i en ny scene eller bygge en kompositt som gjør hver kilde gjenkjennelig.
Bruksområder for GPT Image 2 API
Emballasje- og etikettmockups: Generer esker, flasker og poser med lesbare merkenavn, ingredienslister og liten skrift plassert som spesifisert i prompten.
Infografikk og diagrammer: Lag grafer, merkede skjemategninger og trinnoppsett der tekst og struktur bærer meningen, ikke bare det visuelle.
Meny- og skiltflater: Lag restaurantmenyer, pristavler og butikkskilt med korrekt ordlyd og konsekvent typografi for verktøy i servering og retail.
Målrettede bilderedigeringer: La brukere velge et område og endre ett element, som å endre farge på et plagg eller bytte en logo, mens resten bevares.
Produktkompositering: Plasser et produkt fra ett bilde inn i et nytt miljø, med form og finish intakt for netthandelskataloger og livsstilsbilder.
Plakat- og annonselayout: Bygg kampanjeoppsett der overskrift, underoverskrift og handlingsoppfordring må vises nøyaktig som skrevet og være lesbare.
App- og UI-konsepter: Gjengi grensesnittmockups og skjermidéer med ekte knappetekster og menytekst for design- og prototypingapper.
Lokaliserte 에셋-varianter: Regenerer samme oppsett med ulik tekst for å produsere språk- eller kampanjevarianter i stor skala.
Slik bruker du GPT Image 2 API
Skaff en API-nøkkel: Opprett en Pollo API-konto og generer API-nøkkelen din fra utviklerdashbordet.
Velg modellen: Send forespørsler til GPT Image 2-endepunktet på /generation/openai/gpt-image-2-0/image.
Legg til input: Send inn en prompt for tekst-til-bilde, eller oppgi imageUrl eller images for redigering og komposisjon, og sett deretter aspectRatio, resolution (1K, 2K, 4K) og quality.
Generer og hent ut: Send inn oppgaven, poll returnert taskId og status, og last ned bildet når den er fullført.
Beste praksis for prompting med GPT Image 2 API
Skriv prompten som et spesifikasjonsark. Siter den eksakte teksten du vil ha gjengitt, angi hvor elementene skal stå, og oppgi farger og materialer slik at instruksjonsfølgning får tydelige mål.
En enkel promptformel
Motiv og setting + eksakt tekst i anførselstegn + layout og plassering + stil og farge + materiale- eller lysdetalj
Dette bør du legge merke til
Siter teksten: Sett ordlyden du vil ha gjengitt i anførselstegn så modellen behandler den som bokstavelig tekst, ikke et løst tema.
Navngi plassering: Si hvor hvert element skal være, for eksempel toppbanner eller nedre venstre hjørne, for å kontrollere layouten.
Beskriv redigeringsområdet: For bilderedigering, spesifiser nøyaktig hva som skal endres så urørte områder forblir som de var.
Sett sideforhold tidlig: Velg forholdet som passer sluttformatet så komposisjonen rammes inn riktig fra start.
Match oppløsning til bruk: Velg 4K for trykk og store formater, lavere oppløsninger for raskere utkast og iterasjon.
Hold ett fokus per redigering: Endre ett enkelt element per redigeringsrunde for å holde resultatene forutsigbare og rene.
Eksempelprompter
Produktemballasje
"En matt kraftkaffepose som står på en lys trehylle, frontetikett med teksten 'MORNING ROOT — Single Origin' i fet serif, med 'Net 340g' i liten tekst nederst. Mykt dagslys, liten dybdeskarphet, 4K produktfoto."
Merket infografikk
"En ren infografikk i flat stil med tittelen 'How Composting Works', med fire nummererte trinn arrangert fra venstre til høyre, hvert med et enkelt ikon og en kort bildetekst. Dempet grønn og beige palett, skarp og lesbar sans-serif-tekst."
Områderedigering
"Bruk det opplastede butikkfrontbildet og erstatt det tomme hengeskiltet med ett som sier 'AZURE BOOKS' i varm håndmalt bokstavstil. Behold bygningen, markisen og gaten uendret, og match originalt dagslys og skygger."
Kompositt av flere bilder
"Kombiner det oppgitte sneaker-bildet og studiobakgrunnsbildet slik at sneakeren står sentrert på en reflekterende pidestall, med spotlight fra øvre venstre, subtil gulvrefleksjon, og behold skoens eksakte fargevariant og sømdetaljer."
GPT Image 2 vs Google Imagen 4 vs FLUX.1 Kontext
Kapasitet
GPT Image 2
Google Imagen 4
FLUX.1 Kontext
Tekstrendering i bilde
✅ Sterk på lang og liten tekst
✅ God typografi
⚠️ Redigeringsfokusert, svakere tekst
Instruksjonsfølgning
✅ Håndterer detaljerte prompt med flere elementer
✅ God etterlevelse
✅ Sterk på redigeringsinstruksjoner
Redigering på pikselnivå
✅
⚠️ Begrenset
✅ Kjernekompetanse
Komposisjon av flere bilder
✅
❌
⚠️ Referansebasert
Maks oppløsning
Opptil 4K
Opptil 2K-klasse
Opptil 4MP-klasse
Anbefalt for
Teksttunge 에셋 og presise redigeringer
Fotorealistisk generering
Iterativ bilderedigering
Hvorfor velge GPT Image 2 API?
GPT Image 2 passer produkter som trenger lesbar tekst og trofaste redigeringer, fra emballasje og infografikk til målrettede områdendringer, alt i oppløsninger høye nok for trykk.
Gjennom Pollo API får du tilgang til GPT Image 2 med én API-nøkkel sammen med 300+ ledende bilde- og videomodeller, med ryddig dokumentasjon, polling av oppgavestatus og generering som koster mindre enn Fal AI.
Start med GPT Image 2-endepunktet på Pollo API for å levere tekstnøyaktige bildefunksjoner, og sammenlign deretter med Imagen, FLUX og andre uten å røre integrasjonen din.
Vanlige spørsmål om GPT Image 2 API
Hva er GPT Image 2?
GPT Image 2 er en OpenAI-bildemodell kjent for nøyaktig tekst i bilde, sterk instruksjonsfølgning og redigering på pikselnivå, med støtte for tekst-til-bilde, bilderedigering og komposisjon av flere bilder opptil 4K.
Gjengir GPT Image 2 API tekst pålitelig?
Ja. Det er en av de definerende styrkene, med god håndtering av overskrifter, etiketter og liten skrift, noe som gjør den godt egnet for emballasje, menyer, plakater og infografikk.
Kan den redigere et eksisterende bilde?
Ja. Gi et bilde og beskriv endringen, så redigerer modellen et målrettet område mens resten av rammen holdes intakt.
Hvilke oppløsninger og sideforhold støttes?
Utdata kan skaleres til 1K, 2K eller 4K, med sideforhold fra kvadratisk og portrett til widescreen og ultrawide valgt per forespørsel.
Kan den kombinere flere bilder?
Ja. Du kan sende flere referansebilder i én forespørsel for å slå sammen motiver eller plassere et produkt i en ny scene, samtidig som hver kilde forblir gjenkjennelig.
Hvorfor kjøre GPT Image 2 via Pollo API?
Pollo API gir én integrasjon for GPT Image 2 og 300+ andre modeller, med ryddig dokumentasjon, oppgavesporing og rimeligere generering enn sammenlignbare leverandører.