GPT Image 2 обеспечивает практически идеальную отрисовку текста, вывод изображения в разрешении 4K, реалистичность в передаче информации о мире и исключительную точность воспроизведения инструкций по различным предметам.
Maak een taak aan voor het genereren van een model.
Verzoek
curl-X POST 'https://pollo.ai/api/platform/v1/generation/openai/gpt-image-2/image'\-H'Content-Type: application/json'\-H'x-api-key: YOUR_API_KEY'\-d'{ "input": { "prompt": "A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field", "aspectRatio": "1:1", "resolution": "1K", "quality": "low", "background": "auto" }}'
Voeg optioneel een webhookUrl toe om een callback te ontvangen wanneer de taak is geslaagd of mislukt.
Optioneel aanvraagveld
{"input":{"prompt":"A cinematic shot of a golden retriever running through a field of sunflowers at sunset, warm rim light, shallow depth of field","aspectRatio":"1:1","resolution":"1K","quality":"low","background":"auto"},"webhookUrl":"https://example.com/webhooks/pollo"}
Schema
Invoervelden voor het geselecteerde eindpunt en de modus.
Veld
Type
Vereist
Beschrijving
prompt
string
Ja
Text prompt describing the content to generate.
aspectRatio
string
Nee
Output aspect ratio, as width:height (e.g. 16:9).
resolution
string
Nee
Output resolution of the generated media (e.g. 720p, 1080p, 2K, 4K). Values are case-insensitive.
quality
string
Nee
Output quality tier of the generation.
background
string
Nee
Background of the generated image: auto lets the model decide, transparent produces an alpha background (PNG), opaque forces a solid background.
Главное преимущество GPT Image 2 — читаемый текст внутри изображения. Заголовки, подписи и мелкий шрифт отображаются четко, поэтому плакаты, упаковка и схемы получаются готовыми к использованию.
Благодаря GPT Image 2 на Pollo API разработчики могут добавить в свои Apps преобразования текста в изображение, редактирования изображений и композиции из нескольких изображений, генерируя выходные данные в разрешении до 4K с соотношением сторон, выбираемым по запросу.
Основные особенности API GPT Image 2
Надежный текст на изображении
Типографика хорошо сочетается с заголовками, подписями и объемными пояснениями, что делает эту модель надежной для меню, инфографики и любого макета, где текст должен быть читаемым, а не декоративным заполнителем.
Экстремальное следование инструкциям
Длинные, подробные инструкции строго соблюдаются, поэтому конкретное количество предметов, их расположение, цвета и написанные фразы соответствуют описанию, а не допускают вольную интерпретацию.
Редактирование на уровне пикселей
Вставьте существующее изображение и точно измените область, поменяв местами объекты, скорректировав текст или уточнив детали, при этом нетронутые части кадра останутся неизменными.
Обоснованные знания о мире
Сцены отражают реальные взаимосвязи между объектами, материалами и обстановкой, поэтому описанный инструмент, блюдо или витрина выглядят правдоподобно, а не собраны из разрозненных частей.
Вывод 4K
Новые поколения мониторов масштабируются до разрешения 4K, обеспечивая достаточное разрешение для печатных макетов, больших баннеров и детальных снимков продукции без отдельного этапа масштабирования в рабочем процессе.
Композиция из нескольких изображений
Объедините несколько эталонных изображений в одном запросе, чтобы слить воедино объекты, поместить продукт в новую сцену или создать композицию, в которой каждый источник будет узнаваем.
Примеры использования API GPT Image 2
Макеты упаковки и этикеток: Создайте коробки, бутылки и пакеты с разборчивыми названиями брендов, списками ингредиентов и мелким шрифтом, расположенным в соответствии с указанными в задании параметрами.
Инфографика и диаграммы: Создавайте диаграммы, схемы с подписями и пошаговые схемы, где смысл несут текст и структура, а не только визуальные элементы.
Меню и вывески: Создавайте меню для ресторанов, прайс-листы и вывески для магазинов с точным текстом и единообразным шрифтом для предприятий общественного питания и розничной торговли.
Целенаправленная обработка фотографий: Позволяет пользователям выбрать область и изменить один элемент, например, изменить цвет одежды или заменить логотип, сохранив при этом остальную часть изображения.
Композитинг товаров: Переместите товар с одного изображения в новое окружение, сохранив его форму и отделку, для использования в каталогах электронной коммерции и в качестве изображений для образа жизни.
Макеты плакатов и рекламных объявлений: Создавайте рекламные макеты, в которых заголовок, подзаголовок и призыв к действию должны отображаться точно так, как написано, и оставаться читаемыми.
Концепции приложений и пользовательского интерфейса: Создание макетов интерфейса и идей экранов с реальными надписями кнопок и текстом меню для проектирования и прототипирования Apps.
Локализованные варианты ресурсов: Воспроизводите один и тот же макет с другим текстом, чтобы создавать языковые или рекламные варианты в больших масштабах.
Как использовать API GPT Image 2
Получить ключ API: Создайте учетную запись Pollo API и сгенерируйте ключ API на панели разработчика.
Выберите модель: Отправляйте запросы на конечную точку GPT Image 2 по адресу /generation/ OpenAI/gpt-image-2-0/image.
Добавьте свои входные данные: Передайте prompt для преобразования текста в изображение или укажите imageUrl или images для редактирования и композиции, затем установите aspectRatio, resolution (1K, 2K, 4K) и quality.
Создание и получение: Отправьте задачу, запросите возвращенные taskId и status и загрузите образ после успешного завершения.
Рекомендации по использованию API GPT Image 2
Опишите задание в виде технической спецификации. Приведите точный текст, который вы хотите отобразить, укажите расположение элементов, а также назовите цвета и материалы, чтобы инструкции были четко ориентированы на результат.
Простая формула подсказки
«Тема и обстановка + точный текст в кавычках + макет и расположение + стиль и цвет + детали материала или освещения»
На что следует обратить внимание
Цитирование текста: Заключите желаемый текст в кавычки, чтобы модель воспринимала его как дословный текст, а не как свободную тему.
Размещение названия: Укажите, где должен располагаться каждый элемент, например, в верхнем баннере или в нижнем левом углу, чтобы управлять макетом.
Опишите область редактирования: При редактировании изображения точно укажите, что нужно изменить, чтобы нетронутые области остались в исходном виде.
Установите соотношение сторон заранее: Выберите соотношение сторон, соответствующее конечному формату, чтобы композиция была правильно выстроена с самого начала.
Выберите подходящее разрешение: Для печати и больших форматов выбирайте разрешение 4K, для более быстрой обработки черновиков и внесения изменений — более низкое разрешение.
Сосредоточьтесь на одном элементе за каждый этап редактирования: Изменяйте только один элемент за один проход редактирования, чтобы результаты были предсказуемыми и чистыми.
Примеры подсказок
Упаковка продукции
«Пакет кофе из матовой крафт-бумаги стоит на светлой деревянной полке. На лицевой стороне этикетка с надписью «MORNING ROOT — Single Origin» жирным шрифтом с засечками, а внизу мелким шрифтом указано «Net 340g». Мягкий дневной свет, малая глубина резкости, снимок товара в разрешении 4K».
Инфографика с подписями
«Четкая инфографика в плоском стиле под названием «Как работает компостирование», состоящая из четырех пронумерованных шагов, расположенных слева направо, каждый из которых снабжен простой иконкой и кратким описанием. Приглушенная зелено-бежевая палитра, четкий и легко читаемый текст без засечек».
Редактирование региона
«Используя загруженное фото витрины, замените пустую подвесную вывеску на вывеску с надписью „AZURE BOOKS“, выполненной теплыми, нарисованными от руки буквами. Сохраните здание, навес и улицу без изменений, подобрав первоначальный дневной свет и тени».
Композитное изображение из нескольких частей
«Сочетайте предоставленные кроссовки и изображение студийного фона так, чтобы кроссовки располагались по центру отражающей подставки, свет от точечного источника сверху слева, а отражение в полу было едва заметным, при этом сохраняя точную цветовую гамму и детали швов обуви».
GPT Image 2 против Google Imagen 4 против FLUX.1 Kontext
Возможности
GPT Image 2
Google Imagen 4
FLUX.1 Kontext
Отображение текста на изображении
✅ Отлично подходит для длинного и короткого текста
✅ Хорошая типографика
⚠️ Текст ориентирован на редактирование, текст менее эффективен
GPT Image 2 подходит для товаров, требующих читаемого текста и точной обработки, от упаковки и инфографики до целенаправленных изменений отдельных областей, и все это с разрешением, достаточным для печати.
Через API Pollo вы получаете доступ к GPT Image 2 с помощью одного ключа API, а также к более чем 300 ведущим моделям изображений и видео, с чистой документацией, опросом статуса задачи и генерацией, которая стоит дешевле, чем Fal AI.
Начните с использования конечной точки GPT Image 2 в API Pollo для предоставления функций обработки изображений с высокой точностью отображения текста, а затем сравните ее с Imagen, Flux и другими сервисами, не затрагивая вашу интеграцию.
Часто задаваемые вопросы об API GPT Image 2
Что такое GPT Image 2?
GPT Image 2 — это модель обработки изображений от OpenAI, известная своей точностью отображения текста на изображениях, строгим следованием инструкциям и редактированием на уровне пикселей, поддерживающая преобразование текста в изображение, редактирование изображений и композицию нескольких изображений с разрешением до 4K.
Надежно ли отображает текст API GPT Image 2 ?
Да. Это одно из его главных преимуществ: возможность работы с заголовками, этикетками и мелким шрифтом, что делает его хорошо подходящим для упаковки, меню, плакатов и инфографики.
Может ли программа редактировать существующее изображение?
Да. Предоставьте изображение и опишите изменение, и модель отредактирует целевую область, сохранив при этом остальную часть кадра нетронутой.
Какие разрешения и соотношения сторон поддерживаются?
Разрешение вывода может быть 1K, 2K или 4K, а соотношение сторон — от квадратного и портретного до широкоэкранного и сверхширокоформатного — выбирается по запросу.
Может ли он объединять несколько изображений?
Да. Вы можете передать несколько эталонных изображений в одном запросе, чтобы объединить объекты или поместить продукт в новую сцену, сохраняя при этом узнаваемость каждого исходного изображения.
Зачем запускать GPT Image 2 через Pollo API?
Pollo API предоставляет единую интеграцию для GPT Image 2 и более 300 других моделей, с понятной документацией, отслеживанием задач и более низкой стоимостью генерации по сравнению с аналогичными поставщиками.