GPT Image 2 menghadirkan rendering teks yang hampir sempurna, output produksi 4K, realisme pengetahuan dunia, dan kemampuan mengikuti instruksi multi-subjek yang ekstrem.
Maak een taak aan voor het genereren van een model.
Verzoek
curl-X POST 'https://pollo.ai/api/platform/v1/generation/openai/gpt-image-2/image'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "1:1", "resolution": "1K", "quality": "low", "background": "auto" }}'
Voeg optioneel een webhookUrl toe om een callback te ontvangen wanneer de taak is geslaagd of mislukt.
Optioneel aanvraagveld
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"1:1","resolution":"1K","quality":"low","background":"auto"},"webhookUrl":"https://example.com/webhooks/pollo"}
Schema
Invoervelden voor het geselecteerde eindpunt en de modus.
Veld
Type
Vereist
Beschrijving
prompt
string
Ja
Text prompt describing the content to generate.
aspectRatio
string
Nee
Output aspect ratio, as width:height (e.g. 16:9).
resolution
string
Nee
Output resolution of the generated media (e.g. 720p, 1080p, 2K, 4K). Values are case-insensitive.
quality
string
Nee
Output quality tier of the generation.
background
string
Nee
Background of the generated image: auto lets the model decide, transparent produces an alpha background (PNG), opaque forces a solid background.
Teks yang terbaca jelas di dalam gambar adalah hal yang membuat GPT Image 2 benar-benar unggul. Judul, label, dan tulisan kecil dirender dengan rapi, jadi poster, kemasan, dan diagram langsung siap dipakai.
Dengan GPT Image 2 di Pollo API, developer bisa menambahkan text-to-image, pengeditan gambar, dan komposisi multi-gambar ke aplikasi mereka, menghasilkan output hingga 4K dengan rasio aspek yang dipilih per permintaan.
Fitur Utama GPT Image 2 API
Teks Dalam Gambar yang Andal
Tipografi tetap konsisten pada judul, caption, dan label padat, sehingga model ini andal untuk menu, infografik, dan layout apa pun yang menuntut teks harus terbaca, bukan sekadar elemen dekoratif.
Mengikuti Instruksi Secara Ekstrem
Prompt yang panjang dan detail diikuti dengan sangat baik, jadi jumlah objek tertentu, penempatan, warna, dan frasa tertulis muncul sesuai deskripsi, bukan bergeser ke interpretasi yang longgar.
Pengeditan Tingkat Piksel
Masukkan gambar yang sudah ada lalu ubah area tertentu secara presisi—ganti objek, sesuaikan teks, atau haluskan detail—sementara bagian frame yang tidak disentuh tetap utuh.
Pengetahuan Dunia Nyata yang Terjangkar
Adegan mencerminkan relasi nyata antara objek, material, dan lingkungan, jadi alat, hidangan, atau etalase toko yang dideskripsikan terlihat masuk akal, bukan seperti gabungan bagian yang tidak nyambung.
Output 4K
Hasil generasi bisa diskalakan hingga 4K, memberi resolusi yang cukup untuk layout cetak, banner besar, dan foto produk detail tanpa langkah upscaling terpisah di alur kerja.
Komposisi Multi-Gambar
Gabungkan beberapa gambar referensi dalam satu permintaan untuk menggabungkan subjek, menempatkan produk ke adegan baru, atau membuat komposit yang tetap mempertahankan ciri tiap sumber.
Use Case GPT Image 2 API
Mockup Kemasan dan Label: Buat kotak, botol, dan pouch dengan nama brand yang terbaca, daftar bahan, dan tulisan kecil yang diposisikan sesuai prompt.
Infografik dan Diagram: Hasilkan chart, skema berlabel, dan layout langkah demi langkah di mana teks dan struktur membawa makna, bukan hanya visual.
Papan Menu dan Signage: Buat menu restoran, papan harga, dan signage toko dengan wording yang akurat serta tipografi konsisten untuk alat hospitality dan retail.
Edit Foto Tertarget: Biarkan pengguna memilih area dan mengubah satu elemen, seperti mewarnai ulang pakaian atau mengganti logo, sambil mempertahankan bagian lainnya.
Komposit Produk: Masukkan produk dari satu gambar ke setting baru, dengan bentuk dan finishing tetap terjaga untuk katalog ecommerce dan citra lifestyle.
Layout Poster dan Iklan: Bangun layout promosi di mana judul, subjudul, dan call to action harus muncul persis seperti ditulis dan tetap mudah dibaca.
Konsep App dan UI: Render mockup antarmuka dan ide layar dengan label tombol serta teks menu nyata untuk aplikasi desain dan prototyping.
Varian Assets Terlokalisasi: Regenerasi layout yang sama dengan teks berbeda untuk menghasilkan varian bahasa atau kampanye dalam skala besar.
Cara Menggunakan GPT Image 2 API
Dapatkan API Key: Buat akun Pollo API dan hasilkan API key kamu dari dashboard developer.
Pilih Model: Kirim permintaan ke endpoint GPT Image 2 di /generation/openai/gpt-image-2-0/image.
Tambahkan Input Kamu: Kirim prompt untuk text-to-image, atau berikan imageUrl atau images untuk editing dan komposisi, lalu atur aspectRatio, resolution (1K, 2K, 4K), dan quality.
Generate dan Ambil Hasil: Submit task, lakukan polling pada taskId dan status yang dikembalikan, lalu unduh gambar saat proses berhasil.
Praktik Terbaik Prompting untuk GPT Image 2 API
Tulis prompt seperti lembar spesifikasi. Kutip teks persis yang ingin kamu render, jelaskan posisi elemen, dan sebutkan warna serta material agar model punya target instruksi yang jelas.
Formula Prompt Sederhana
Subjek dan setting + teks persis dalam tanda kutip + layout dan penempatan + gaya dan warna + detail material atau pencahayaan
Hal yang Perlu Kamu Perhatikan
Kutip Teksnya: Masukkan kalimat yang ingin dirender ke dalam tanda kutip agar model memperlakukannya sebagai salinan literal, bukan tema longgar.
Sebutkan Penempatan: Jelaskan posisi tiap elemen, seperti banner atas atau sudut kiri bawah, untuk mengontrol layout.
Deskripsikan Area Edit: Untuk pengeditan gambar, sebutkan secara spesifik apa yang harus diubah agar area lain tetap seperti semula.
Tentukan Rasio Aspek Sejak Awal: Pilih rasio yang sesuai format akhir supaya komposisi terbingkai dengan benar sejak awal.
Sesuaikan Resolusi dengan Kebutuhan: Gunakan 4K untuk cetak dan format besar, resolusi lebih rendah untuk draft cepat dan iterasi.
Satu Fokus per Edit: Ubah satu elemen saja di tiap tahap editing agar hasil tetap bersih dan mudah diprediksi.
Contoh Prompt
Kemasan Produk
"Sebuah kantong kopi kraft matte berdiri di rak kayu terang, label depan bertuliskan 'MORNING ROOT — Single Origin' dengan serif tebal, serta 'Net 340g' dalam teks kecil di bagian bawah. Cahaya siang lembut, depth of field dangkal, foto produk 4K."
Infografik Berlabel
"Infografik bersih bergaya flat berjudul 'How Composting Works' dengan empat langkah bernomor tersusun dari kiri ke kanan, masing-masing dengan ikon sederhana dan caption singkat. Palet hijau dan krem yang muted, teks sans-serif tajam dan terbaca."
Edit Area
"Menggunakan foto etalase toko yang diunggah, ganti papan gantung kosong dengan papan bertuliskan 'AZURE BOOKS' dengan lettering hangat bergaya lukis tangan. Pertahankan bangunan, kanopi, dan jalan tetap sama, cocokkan cahaya siang dan bayangan aslinya."
Komposit Multi-Gambar
"Gabungkan gambar sneaker yang diberikan dan gambar latar studio sehingga sneaker berada di tengah di atas pedestal reflektif, spotlight dari kiri atas, refleksi lantai yang halus, sambil mempertahankan colorway dan detail jahitan sepatu secara presisi."
GPT Image 2 vs Google Imagen 4 vs FLUX.1 Kontext
Kapabilitas
GPT Image 2
Google Imagen 4
FLUX.1 Kontext
Rendering teks dalam gambar
✅ Kuat untuk teks panjang dan kecil
✅ Tipografi bagus
⚠️ Fokus editing, teks lebih lemah
Mengikuti instruksi
✅ Menangani prompt detail multi-elemen
✅ Kepatuhan solid
✅ Kuat untuk instruksi edit
Pengeditan tingkat piksel
✅
⚠️ Terbatas
✅ Kekuatan utama
Komposisi multi-gambar
✅
❌
⚠️ Berbasis referensi
Resolusi maksimum
Hingga 4K
Hingga kelas 2K
Hingga kelas 4MP
Direkomendasikan untuk
Assets kaya teks dan edit presisi
Generasi fotorealistik
Pengeditan gambar iteratif
Kenapa Memilih GPT Image 2 API?
GPT Image 2 cocok untuk produk yang butuh teks terbaca dan edit yang akurat, dari kemasan dan infografik hingga perubahan area tertarget, semuanya pada resolusi yang cukup tinggi untuk cetak.
Melalui Pollo API, kamu bisa mengakses GPT Image 2 dengan satu API key bersama 300+ model gambar dan video terkemuka, dengan dokumentasi rapi, polling status task, dan biaya generasi yang lebih rendah dibanding Fal AI.
Mulai dari endpoint GPT Image 2 di Pollo API untuk merilis fitur gambar yang akurat terhadap teks, lalu bandingkan dengan Imagen, FLUX, dan model lainnya tanpa menyentuh integrasi kamu.
FAQ GPT Image 2 API
Apa itu GPT Image 2?
GPT Image 2 adalah model gambar OpenAI yang dikenal karena akurasi teks dalam gambar, kemampuan mengikuti instruksi yang kuat, dan pengeditan tingkat piksel, mendukung text-to-image, editing gambar, dan komposisi multi-gambar hingga 4K.
Apakah GPT Image 2 API merender teks dengan andal?
Ya. Ini adalah salah satu kekuatan utamanya, mampu menangani judul, label, dan tulisan kecil, sehingga sangat cocok untuk kemasan, menu, poster, dan infografik.
Bisakah model ini mengedit gambar yang sudah ada?
Ya. Berikan gambar lalu jelaskan perubahannya, dan model akan mengedit area tertarget sambil menjaga bagian frame lainnya tetap utuh.
Resolusi dan rasio aspek apa saja yang didukung?
Output bisa diskalakan ke 1K, 2K, atau 4K, dengan rasio aspek dari persegi dan potret hingga widescreen dan ultrawide yang dipilih per permintaan.
Bisakah menggabungkan beberapa gambar?
Ya. Kamu bisa mengirim beberapa gambar referensi dalam satu permintaan untuk menggabungkan subjek atau menempatkan produk ke adegan baru sambil mempertahankan tiap sumber tetap mudah dikenali.
Kenapa menjalankan GPT Image 2 lewat Pollo API?
Pollo API menyediakan satu integrasi untuk GPT Image 2 dan 300+ model lainnya, dengan dokumentasi yang jelas, pelacakan task, dan biaya generasi lebih rendah dibanding penyedia sekelas.