🖼️🧠 OpenAI научила ChatGPT думать перед тем, как рисовать
OpenAI выкатила gpt-image-2 — новую модель генерации изображений, в которую встроили режим «размышления». Перед тем как сгенерировать картинку, модель анализирует задачу, строит план композиции, проводит самопроверку и при необходимости лезет в веб-поиск за деталями. По словам компании, это сравнимо с переходом от GPT-3 к GPT-5.
На практике это означает несколько осязаемых улучшений.
Во-первых, нормальный рендеринг текста — кириллица на постере наконец перестаёт выглядеть как продукт случайного перебора символов.
Во-вторых, многокомпонентные задачи: страницы комиксов с повторяющимися персонажами, UI-мокапы, инфографика с читабельными подписями.
В-третьих, мультиреференсный ввод — скормил несколько картинок, получил результат с учётом всех.
Плюс экспорт с прозрачным фоном, что само по себе убирало раньше половину головной боли у дизайнеров.
Режим Thinking, предсказуемо, только для платных подписчиков. Бесплатный тариф получает Instant — быстро, но без «глубокого анализа».
Модель обучена на данных до декабря 2025-го, то есть для чего-то совсем свежего веб-поиск будет не роскошью, а необходимостью.
OpenAI долго убеждала всех, что текст важнее картинок. Судя по всему, убедила — и теперь срочно догоняет Midjourney и Flux.
Подписывайтесь на Telegram PromtScout.