ข้อความเป็นรูปภาพ ภาพต่อภาพ
GPT Image 2 มอบการแสดงผลข้อความที่เกือบสมบูรณ์แบบ ผลผลิตระดับ 4K ความสมจริงที่เทียบเท่าความรู้ระดับโลก และความสามารถในการติดตามการเรียนการสอนหลายวิชาได้อย่างยอดเยี่ยม
สนามเด็กเล่น ราคา API ประวัติการใช้งาน อ่านไฟล์
ข้อมูลอินพุต กรอกข้อมูลในช่องที่จำเป็นเพื่อดูราคา
Text To Image · 1K · low
สร้าง โหมด ความละเอียด ประเภท ราคา high 1K ภาพต่อภาพ — ข้อความเป็นรูปภาพ — 2K ภาพต่อภาพ — ข้อความเป็นรูปภาพ — 4K ภาพต่อภาพ — ข้อความเป็นรูปภาพ — low 1K ภาพต่อภาพ — ข้อความเป็นรูปภาพ — 2K ภาพต่อภาพ — ข้อความเป็นรูปภาพ — 4K ภาพต่อภาพ — ข้อความเป็นรูปภาพ — medium 1K ภาพต่อภาพ — ข้อความเป็นรูปภาพ — 2K ภาพต่อภาพ — ข้อความเป็นรูปภาพ — 4K ภาพต่อภาพ — ข้อความเป็นรูปภาพ —
จุดสิ้นสุด
POST https://pollo.ai/api/platform/v1/generation/openai/gpt-image-2/imageสำเนา โหมด
Text To Image Image To Image
ดูเอกสารประกอบ API ฉบับเต็ม รัน GPT Image 2 บน Pollo API
จุดเด่นของ GPT Image 2 คือการแสดงข้อความที่อ่านได้ชัดเจนภายในภาพ หัวข้อ คำบรรยาย และตัวอักษรขนาดเล็กแสดงผลได้อย่างคมชัด ทำให้โปสเตอร์ บรรจุภัณฑ์ และแผนภาพต่างๆ พร้อมใช้งานได้ทันที
ด้วย GPT Image 2 บน Pollo API นักพัฒนาสามารถเพิ่มฟังก์ชันแปลงข้อความเป็นภาพ การแก้ไขภาพ และการรวมภาพหลายภาพลงใน Apps ของตน โดยสร้างเอาต์พุตความละเอียดสูงสุด 4K พร้อมอัตราส่วนภาพที่เลือกได้ตามคำขอ
คุณสมบัติหลักของ GPT Image 2 API
ข้อความในรูปภาพที่เชื่อถือได้
รูปแบบตัวอักษรมีความสอดคล้องกันทั้งในหัวข้อ คำบรรยาย และป้ายกำกับที่มีความหนาแน่น ทำให้รูปแบบนี้เชื่อถือได้สำหรับเมนู อินโฟกราฟิก และการจัดวางใดๆ ที่ข้อความต้องอ่านได้ ไม่ใช่แค่ส่วนประกอบตกแต่ง
คำแนะนำขั้นสุด
คำแนะนำที่ยาวและละเอียดจะได้รับการเคารพอย่างเคร่งครัด ดังนั้นจำนวนวัตถุ ตำแหน่ง สี และวลีที่เขียนไว้จะถูกนำมาใส่ตามที่อธิบายไว้ แทนที่จะตีความอย่างคลุมเครือ
การแก้ไขระดับพิกเซล
ป้อนภาพที่มีอยู่แล้วเข้าไป แล้วทำการเปลี่ยนแปลงเฉพาะส่วนอย่างแม่นยำ เช่น สลับวัตถุ ปรับข้อความ หรือปรับแต่งรายละเอียดต่างๆ ในขณะที่ส่วนอื่นๆ ของเฟรมยังคงเหมือนเดิม
ความรู้โลกที่ฝังรากลึก
ฉากต่างๆ สะท้อนให้เห็นถึงความสัมพันธ์ที่แท้จริงระหว่างวัตถุ วัสดุ และสภาพแวดล้อม ดังนั้นเครื่องมือ จาน หรือหน้าร้านที่บรรยายไว้จึงดูสมจริงมากกว่าที่จะดูเหมือนประกอบขึ้นจากชิ้นส่วนที่ไม่เข้ากัน
เอาต์พุต 4K
จอภาพรุ่นนี้รองรับความละเอียด 4K ซึ่งให้ความละเอียดเพียงพอสำหรับการจัดวางงานพิมพ์ แบนเนอร์ขนาดใหญ่ และภาพถ่ายผลิตภัณฑ์ที่มีรายละเอียดสูง โดยไม่ต้องทำการปรับเพิ่มความละเอียดในขั้นตอนการทำงานเพิ่มเติม
การจัดองค์ประกอบภาพหลายภาพ
รวมภาพอ้างอิงหลายภาพไว้ในคำขอเดียว เพื่อผสานภาพต่างๆ เข้าด้วยกัน วางผลิตภัณฑ์ลงในฉากใหม่ หรือสร้างภาพประกอบที่ยังคงจดจำแหล่งที่มาแต่ละภาพได้
ตัวอย่างการใช้งาน GPT Image 2 API
แบบจำลองบรรจุภัณฑ์และฉลาก: สร้างกล่อง ขวด และถุงบรรจุที่มีชื่อแบรนด์ รายชื่อส่วนผสม และตัวอักษรขนาดเล็กที่อ่านง่าย โดยจัดวางตำแหน่งตามที่ระบุไว้ในคำสั่ง
อินโฟกราฟิกและไดอะแกรม: สร้างแผนภูมิ แผนผังที่มีป้ายกำกับ และแผนผังขั้นตอนต่างๆ โดยที่ข้อความและโครงสร้างเป็นตัวสื่อความหมาย ไม่ใช่แค่ภาพเพียงอย่างเดียว
เมนูและป้ายประกาศ: สร้างเมนูร้านอาหาร ป้ายราคา และป้ายประกาศร้านค้าด้วยถ้อยคำที่ถูกต้องและรูปแบบตัวอักษรที่สม่ำเสมอ สำหรับธุรกิจบริการและค้าปลีก
การแก้ไขภาพแบบเจาะจง: ช่วยให้ผู้ใช้เลือกบริเวณและเปลี่ยนแปลงองค์ประกอบเพียงอย่างเดียว เช่น เปลี่ยนสีเสื้อผ้าหรือเปลี่ยนโลโก้ โดยคงส่วนอื่นๆ ไว้เหมือนเดิม
การจัดวางภาพสินค้า: นำสินค้าจากภาพหนึ่งไปวางในฉากใหม่ โดยคงรูปทรงและพื้นผิวของสินค้าไว้ เพื่อใช้สำหรับแคตตาล็อกอีคอมเมิร์ซและภาพไลฟ์สไตล์
การออกแบบโปสเตอร์และโฆษณา: สร้างรูปแบบการโปรโมตที่หัวข้อหลัก หัวข้อย่อย และคำกระตุ้นการตัดสินใจต้องปรากฏตรงตามที่เขียนไว้และอ่านได้ชัดเจน
แนวคิดแอปและ UI: สร้างภาพจำลองอินเทอร์เฟซและแนวคิดหน้าจอพร้อมป้ายกำกับปุ่มและข้อความเมนูจริงสำหรับการออกแบบและสร้างต้นแบบ Apps
รูปแบบเนื้อหาที่ปรับให้เข้ากับภาษาท้องถิ่น: สร้างเค้าโครงเดียวกันใหม่โดยใช้ข้อความที่แตกต่างกัน เพื่อสร้างรูปแบบต่างๆ สำหรับภาษาหรือแคมเปญจำนวนมาก
วิธีการใช้งาน GPT Image 2 API
รับคีย์ API: สร้างบัญชี Pollo API และสร้างคีย์ API ของคุณจากแดชบอร์ดสำหรับนักพัฒนา
เลือกโมเดล: ส่งคำขอไปยังเอนด์พอยต์ GPT Image 2 ที่ /generation/ OpenAI/gpt-image-2-0/image
เพิ่มข้อมูลของคุณ: ป้อน prompt สำหรับการแปลงข้อความเป็นรูปภาพ หรือระบุ imageUrl หรือ images สำหรับการแก้ไขและจัดองค์ประกอบ จากนั้นตั้งค่า aspectRatio, resolution (1K, 2K, 4K) และ quality
สร้างและเรียกดู: ส่งงาน ตรวจสอบ taskId และ status ที่ส่งกลับมา และดาวน์โหลดรูปภาพเมื่อสำเร็จ
แนวทางปฏิบัติที่ดีที่สุดสำหรับการใช้งาน GPT Image 2 API เขียนคำสั่งเหมือนเอกสารข้อมูลจำเพาะ อ้างอิงข้อความที่ต้องการให้แสดงผลอย่างแม่นยำ ระบุตำแหน่งขององค์ประกอบต่างๆ และตั้งชื่อสีและวัสดุ เพื่อให้คำแนะนำต่อไปนี้มีเป้าหมายที่ชัดเจน
สูตรคำสั่งแบบง่าย หัวเรื่องและฉาก + ข้อความต้นฉบับในเครื่องหมายคำพูด + รูปแบบและการจัดวาง + สไตล์และสี + รายละเอียดวัสดุหรือแสง
อ้างอิงข้อความ: ใส่ข้อความที่คุณต้องการให้แสดงผลไว้ในเครื่องหมายอัญประกาศ เพื่อให้โมเดลถือว่าเป็นข้อความที่คัดลอกมาตรงๆ ไม่ใช่แค่แนวคิดหลัก
การกำหนดตำแหน่งชื่อ: ระบุตำแหน่งที่แต่ละองค์ประกอบควรอยู่ เช่น แบนเนอร์ด้านบน หรือมุมล่างซ้าย เพื่อควบคุมการจัดวาง
อธิบายขอบเขตการแก้ไข: สำหรับการแก้ไขรูปภาพ ให้ระบุอย่างชัดเจนว่าต้องการเปลี่ยนแปลงอะไรบ้าง เพื่อให้ส่วนที่ไม่ได้แก้ไขยังคงเหมือนเดิม
กำหนดอัตราส่วนภาพตั้งแต่เนิ่นๆ: เลือกอัตราส่วนที่เหมาะสมกับรูปแบบสุดท้าย เพื่อให้องค์ประกอบภาพถูกจัดวางอย่างถูกต้องตั้งแต่เริ่มต้น
เลือกความละเอียดที่เหมาะสม: เลือก 4K สำหรับงานพิมพ์และรูปแบบขนาดใหญ่ เลือกความละเอียดต่ำกว่าสำหรับงานร่างและการแก้ไขที่รวดเร็วยิ่งขึ้น
เน้นเพียงจุดเดียวในการแก้ไขแต่ละครั้ง: เปลี่ยนเพียงองค์ประกอบเดียวในแต่ละรอบการแก้ไข เพื่อให้ผลลัพธ์คาดเดาได้และดูเรียบร้อย
ตัวอย่างคำถาม
บรรจุภัณฑ์สินค้า "ถุงกาแฟกระดาษคราฟท์ด้านวางอยู่บนชั้นวางไม้สีอ่อน ฉลากด้านหน้าเขียนว่า 'MORNING ROOT — Single Origin' ด้วยตัวอักษรหนาแบบมีเชิง และมีข้อความ 'Net 340g' ขนาดเล็กอยู่ที่ฐาน ถ่ายด้วยแสงธรรมชาติอ่อนๆ ระยะชัดตื้น ความละเอียด 4K"
อินโฟกราฟิกที่มีป้ายกำกับ "อินโฟกราฟิกสไตล์เรียบง่ายที่ดูสะอาดตา ชื่อเรื่อง 'วิธีการทำปุ๋ยหมัก' ประกอบด้วยสี่ขั้นตอนเรียงจากซ้ายไปขวา แต่ละขั้นตอนมีไอคอนง่ายๆ และคำบรรยายสั้นๆ โทนสีเขียวและเบจที่ดูสบายตา ตัวอักษรแบบไม่มีเชิงที่คมชัดอ่านง่าย"
แก้ไขภูมิภาค "ใช้รูปหน้าร้านที่อัปโหลดมา เปลี่ยนป้ายแขวนที่ว่างเปล่าเป็นป้ายที่มีข้อความว่า 'AZURE BOOKS' ด้วยตัวอักษรที่เขียนด้วยมือในโทนสีอบอุ่น คงสภาพอาคาร กันสาด และถนนไว้เหมือนเดิม โดยให้แสงและเงาตรงกับต้นฉบับ"
การรวมภาพหลายภาพเข้าด้วยกัน "นำภาพรองเท้าผ้าใบที่ให้มาและภาพพื้นหลังของสตูดิโอมาผสานกัน โดยให้รองเท้าผ้าใบวางอยู่ตรงกลางบนแท่นสะท้อนแสง มีแสงสปอตไลท์ส่องมาจากด้านบนซ้าย มีแสงสะท้อนจากพื้นเล็กน้อย พร้อมทั้งคงสีและรายละเอียดการเย็บของรองเท้าไว้ให้เหมือนเดิม"
GPT Image 2 กับ Google Imagen 4 กับ FLUX.1 Kontext ความสามารถ GPT Image 2 รูปภาพ Google Imagen 4 FLUX.1 Kontext การแสดงผลข้อความในภาพ ✅ ดีเยี่ยมสำหรับข้อความยาวและเล็ก ✅ การจัดวางตัวอักษรที่ดี ⚠️ เน้นการแก้ไข ข้อความจึงด้อยกว่า ปฏิบัติตามคำแนะนำ ✅ จัดการกับคำแนะนำที่มีรายละเอียดหลายองค์ประกอบได้ ✅ ปฏิบัติตามอย่างเคร่งครัด ✅ เหมาะสำหรับการแก้ไขคำแนะนำ การแก้ไขระดับพิกเซล ✅ ⚠️ มีข้อจำกัด ✅ ความแข็งแกร่งหลัก การจัดองค์ประกอบภาพหลายภาพ ✅ ❌ ⚠️ อ้างอิงจากภาพต้นแบบ ความละเอียดสูงสุด สูงสุด 4K สูงสุด 2K สูงสุด 4MP เหมาะสำหรับ งานที่มีข้อความจำนวนมากและการแก้ไขที่แม่นยำ การสร้างภาพเสมือนจริง การแก้ไขภาพแบบวนซ้ำ
เหตุใดจึงควรเลือกใช้ GPT Image 2 API? GPT Image 2 เหมาะสำหรับผลิตภัณฑ์ที่ต้องการข้อความที่อ่านง่ายและการแก้ไขที่ถูกต้องแม่นยำ ตั้งแต่บรรจุภัณฑ์และอินโฟกราฟิก ไปจนถึงการเปลี่ยนแปลงเฉพาะภูมิภาค โดยทั้งหมดนี้มีความละเอียดสูงพอสำหรับการพิมพ์
ด้วย Pollo API คุณสามารถเข้าถึง GPT Image 2 ได้ด้วยคีย์ API เดียว พร้อมกับโมเดลภาพและวิดีโอชั้นนำกว่า 300 แบบ พร้อมเอกสารที่ชัดเจน การตรวจสอบสถานะงาน และการสร้างภาพที่มีต้นทุนต่ำกว่า Fal AI
เริ่มต้นด้วยการใช้เอนด์พอยต์ GPT Image 2 บน Pollo API เพื่อส่งมอบฟีเจอร์รูปภาพที่มีความถูกต้องแม่นยำตามข้อความ จากนั้นเปรียบเทียบกับ Imagen, Flux และอื่นๆ โดยไม่ต้องแก้ไขการผสานรวมของคุณ
คำถามที่พบบ่อยเกี่ยวกับ API GPT Image 2
GPT Image 2 คืออะไร?
GPT Image 2 เป็นโมเดลภาพของ OpenAI ที่ขึ้นชื่อเรื่องการใส่ข้อความลงในภาพได้อย่างแม่นยำ การปฏิบัติตามคำสั่งได้อย่างดีเยี่ยม และการแก้ไขในระดับพิกเซล รองรับการแปลงข้อความเป็นภาพ การแก้ไขภาพ และการรวมภาพหลายภาพเข้าด้วยกันได้ถึงระดับ 4K
API GPT Image 2 แสดงผลข้อความได้อย่างน่าเชื่อถือหรือไม่?
ใช่แล้ว จุดเด่นอย่างหนึ่งของมันคือการจัดการกับหัวข้อข่าว ป้ายกำกับ และตัวอักษรขนาดเล็ก ซึ่งทำให้เหมาะอย่างยิ่งสำหรับบรรจุภัณฑ์ เมนู โปสเตอร์ และอินโฟกราฟิก
สามารถแก้ไขรูปภาพที่มีอยู่แล้วได้หรือไม่?
ใช่ค่ะ เพียงแค่ส่งภาพและอธิบายการเปลี่ยนแปลงมา โมเดลก็จะแก้ไขเฉพาะบริเวณที่ต้องการ โดยคงส่วนอื่นๆ ของภาพไว้เหมือนเดิม
รองรับความละเอียดและอัตราส่วนภาพแบบใดบ้าง? สามารถปรับขนาดเอาต์พุตเป็น 1K, 2K หรือ 4K โดยมีอัตราส่วนภาพตั้งแต่สี่เหลี่ยมจัตุรัสและแนวตั้ง ไปจนถึงจอกว้างและจอกว้างพิเศษ ให้เลือกตามความต้องการ
สามารถรวมภาพหลายภาพเข้าด้วยกันได้หรือไม่?
ใช่ คุณสามารถส่งภาพอ้างอิงหลายภาพในคำขอเดียวเพื่อรวมภาพหรือวางผลิตภัณฑ์ลงในฉากใหม่โดยยังคงระบุแหล่งที่มาของแต่ละภาพได้
เหตุใดจึงต้องใช้งาน GPT Image 2 ผ่าน Pollo API? Pollo API ให้การผสานรวมสำหรับ GPT Image 2 และโมเดลอื่นๆ อีกกว่า 300 รุ่น พร้อมเอกสารประกอบที่ชัดเจน การติดตามงาน และต้นทุนการสร้างที่ต่ำกว่าผู้ให้บริการที่เทียบเคียงได้