OpenAI официально представила ChatGPT Images 2.0 — обновление, которое не просто «еще одна версия», а попытка закрепиться в роли лидера на фоне давления со стороны Google и его линейки Gemini Nano Banana.
Ещё в начале 2025 года OpenAI уже сделала мощный ход, выпустив обновленную модель генерации изображений, которая быстро разлетелась по соцсетям и фактически стала магнитом для новой аудитории. Миллионы пользователей пришли в ChatGPT именно ради картинок, и, похоже, компания решила не сбавлять темп.
Что нового в ChatGPT Images 2.0
Главный фокус обновления — точность, причем не абстрактная, а практически болезненно детализированная.
Теперь модель:
- заметно лучше работает с текстом внутри изображений (да, тот самый больной вопрос всех генераторов)
- аккуратно соблюдает инструкции пользователя
- корректно передает мелкие элементы: иконки, UI, плотные композиции
- не разваливается на сложных сценах с множеством деталей
Проще говоря, если раньше генерация интерфейса выглядела как «примерно похоже», теперь это уже ближе к «почти можно запускать продукт».
Во время презентации, где выступал Сэм Альтман, показали кейсы с генерацией интерфейсов, включая окна macOS и чат-приложения, и там текст больше не превращается в абракадабру.
Две версии: instant и thinking
OpenAI разделила модель на два режима:
- Images 2.0 instant — быстрый вариант для повседневных задач
- Images 2.0 thinking — более «вдумчивый» режим с доступом к актуальным данным
Во втором случае модель может подтягивать информацию из интернета и использовать ее при генерации. Это уже не просто «нарисуй картинку», а попытка превратить генератор в инструмент с элементами анализа.
Дополнительно:
- можно генерировать несколько вариантов за один запрос
- модель умеет перепроверять результат
- лучше работает с нелатинскими языками (китайский, японский, корейский и др.)
Разрешение и гибкость
Images 2.0 поддерживает генерацию до 2K и гибкие соотношения сторон:
- ультраширокие (3:1),
- вертикальные форматы (1:3),
- и все между ними.
Это делает модель удобной не только для арта, но и для баннеров, UI-дизайна и контента под соцсети.
Конкуренция с Google усиливается
Параллельно Google развивает свою линейку Gemini, включая Nano Banana 2 (он же Gemini 3.1 Flash Image). Эта модель уже позиционируется как решение уровня Pro, и именно с ней OpenAI теперь напрямую конкурирует.
Если раньше это была гонка возможностей, теперь это гонка точности и практического применения.
API и цены
Для разработчиков доступна модель gpt-image-2 через API:
- $8.00 — входные данные
- $2.00 — кэшированные входные данные
- $30.00 — выход
Цены выглядят как заявка на профессиональный сегмент, а не просто игрушку для генерации мемов.
Доступность
- Images 2.0 instant — доступна всем пользователям ChatGPT и Codex
- Images 2.0 thinking — только для подписок Plus, Pro и Business
Вывод
ChatGPT Images 2.0 — это попытка закрыть ключевые слабые места генеративной графики: текст, детали и предсказуемость результата.
Если модель действительно будет стабильно выдавать точные UI, читаемый текст и сложные сцены — это уже инструмент для работы, а не просто развлечение.