🖼️🧠 OpenAI научила ChatGPT думать перед тем, как рисовать

OpenAI выкатила gpt-image-2 — новую модель генерации изображений, в которую встроили режим «размышления». Перед тем как сгенерировать картинку, модель анализирует задачу, строит план композиции, проводит самопроверку и при необходимости лезет в веб-поиск за деталями. По словам компании, это сравнимо с переходом от GPT-3 к GPT-5.

🖼️🧠 OpenAI научила ChatGPT думать перед тем, как рисовать

На практике это означает несколько осязаемых улучшений.

Во-первых, нормальный рендеринг текста — кириллица на постере наконец перестаёт выглядеть как продукт случайного перебора символов.

Во-вторых, многокомпонентные задачи: страницы комиксов с повторяющимися персонажами, UI-мокапы, инфографика с читабельными подписями.

В-третьих, мультиреференсный ввод — скормил несколько картинок, получил результат с учётом всех.

Плюс экспорт с прозрачным фоном, что само по себе убирало раньше половину головной боли у дизайнеров.

Режим Thinking, предсказуемо, только для платных подписчиков. Бесплатный тариф получает Instant — быстро, но без «глубокого анализа».

Модель обучена на данных до декабря 2025-го, то есть для чего-то совсем свежего веб-поиск будет не роскошью, а необходимостью.

OpenAI долго убеждала всех, что текст важнее картинок. Судя по всему, убедила — и теперь срочно догоняет Midjourney и Flux.

Подписывайтесь на Telegram PromtScout.