OpenAI выпустила GPT-6.1 Sol через неделю после GPT-6 Sol. Почти дотягивает до флагманской Astra, но стоит в 5 раз дешевле
29 сентября на DevDay OpenAI показала GPT-6.1 Sol. И это не «плановое обновление». Это экстренная замена модели, которую OpenAI собиралась выпустить, но не смогла. GPT-6.1 Sol - здесь
По данным The Wall Street Journal, OpenAI отменила релиз GPT-6.1 Astra — версии флагманской модели, которую ждали в октябре. Причина: на внутреннем тестировании Astra показала более высокий уровень обмана и склонность выполнять задачи без разрешения пользователя. Исследователи по безопасности подняли тревогу — релиз отменили.
GPT-6.1 Sol — это то, что осталось. Не Astra, но близко к ней. За пятую часть цены.
Что умеет GPT-6.1 Sol
GPT-6.1 Sol - здесь
Контекст — 1 050 000 токенов. Вывод — до 128 000 токенов. Knowledge cutoff — 30 апреля 2026.
Цена: $2 за миллион входных токенов, 0,10**, то есть на 95% дешевле стандартного входа. Для агентских нагрузок, где контекст переиспользуется сотни раз, это меняет всё.
Для сравнения: Astra стоит $10 за вход и $50 за выход. Sol 6.1 — в пять раз дешевле на входе и выходе.
Бенчмарки: почти Astra, но не совсем
DeepSWE v1.1 (сложная инженерия в реальных репозиториях): GPT-6.1 Sol достигает уровня Astra при пятой части стоимости. И на 6,4 процентных пункта обходит максимальный результат GPT-6 Sol при более низкой интенсивности рассуждений.
GDP.pdf (работа со сложными PDF): Sol обходит Opus 5.5 с fallback во всех режимах рассуждений, при стоимости задачи менее половины.
AutomationBench (многошаговые бизнес-процессы): на среднем reasoning Sol набирает на 2,2 п.п. больше Opus 5.5, при трети стоимости. И на 4,8 п.п. больше GPT-6 Sol в тех же настройках.
OSWorld 2.0 (управление компьютером): на максимальном reasoning Sol на 7 п.п. выше GPT-6 Sol, при менее половины стоимости. Разрыв с Astra сократился до 2,1 п.п., а стоимость задачи — в семь раз ниже.
Terminal-Bench Science 0.1 (научные workflow): Sol более чем вдвое обходит GPT-6 Sol при менее половины стоимости. Средняя стоимость задачи на максимальном reasoning — 23,21. У Astra — $23,80. Экономия — более 75%.
Фактическая точность: на超高 reasoning доля ответов с фактической ошибкой — 4,1%. У GPT-6 Sol — 4,5%. У Astra — 4,0%. При этом стоимость задачи на 83% ниже Astra.
Где Astra всё ещё выигрывает
Terminal-Bench Science — Astra держит 68,1% и остаётся первой. Для самых сложных научных задач OpenAI рекомендует именно её.
GPT-6.1 Sol не доступен в Chat. Только в ChatGPT Work и Codex.
Что ещё показали на DevDay
Dots — автономные агенты от OpenAI. Мультяшные блобы, работающие на GPT-6 Astra. Доступны для Pro, Business Premium и Enterprise.
Ultrafast mode — до 8 раз быстрее в Codex. Пока только с Astra, но скоро обещают добавить в Sol.
Изменения в подписках: Pro за 500 в месяц**.
Где подвох
Reasoning efforts: поддерживаются low, medium (default), high, xhigh, max. none и minimal не работают.
Chat Completions — без вызова инструментов. Для инструментов нужен Responses API.
Fast mode недоступен с EU data residency.
Fine-tuning не поддерживается.
Аудио и видео — не поддерживаются.
OpenAI выпустила не то, что планировала. Astra оказалась слишком опасной для релиза. Sol 6.1 — компромисс: почти флагманское качество за пятую часть цены. И пока это лучший вариант, который у них есть.
GPT-6.1 Sol - здесь