Удар по Claude Opus 5
Главная проблема любого сложного автономного агента — экономика. Когда для решения одной инженерной задачи модель перебирает десятки шагов, гонять флагманскую GPT-6 Astra по $10 за входные и $50 за выходные токены становится разорительно.
OpenAI официально представила модели GPT-6 Sol и GPT-6 Luna, закрыв дыру между запредельно дорогим «хай-эндом» и базовыми легковесными сетками.
Новая тарифная сетка в два раза дешевле предшественников
Линейка GPT-6 теперь четко разделена под разные сценарии разработки. Разработчики не просто обновили веса, но и на 50% уронили расценки на API (за 1 миллион токенов) по сравнению с прошлым поколением:
- GPT-6 Astra ($10.00 вход / $50.00 выход). Флагманская модель без скидок. Её стоит дергать только для самых тяжелых архитектурных задач и глубоких рассуждений, когда бюджет отходит на второй план.
- GPT-6 Sol ($2.00 вход / $10.00 выход). Основная рабочая лошадка. Ценник срезали ровно вдвое (раньше было $4 / $20). Идеальна для сложного кодинга, автономных продакшен-агентов и повседневного стека.
- GPT-6 Luna ($0.10 вход / $0.50 выход). Копеечная сетка для быстрых задач, которая тоже подешевела в два раза (было $0.20 / $1.20). Отличный вариант для черновой сортировки данных, парсинга, роутинга и микрорешений в фоне.
GPT-6 Sol убийца флагманов в тестах на автономность
Версия Sol позиционируется как рабочая лошадка для разработчиков. При цене $2 / $10 она напрямую наступает на пятки топовым моделям конкурентов:
- Кодинг (DeepSWE). Sol обошла Claude Opus 5 и Fable 5.1, показав более чистое решение алгоритмических задач и исправление багов.
- Автономные сценарии (AutomationBench, OSWorld 2.0) в тестах на управление окружением и последовательное выполнение цепочек задач модель показала превосходство по успешным запускам, сожрав в разы меньший бюджет на токены.
Меньше маркетингового бреда и 90% экономии на кэше
Кроме сухих цифр скорости и цен, в релизе есть три инженерных изменения, которые напрямую влияют на качество работы:
- Сокращение галлюцинаций вдвое, модели стали жестче привязываться к фактам и существенно реже «привирают» о статусе выполнения задачи (проблема, когда агент отчитывается об успехе, ничего реально не сделав).
- Лаконичность ответов, разработчики вычистили лишний жаргон, водянистые вступления и навязчивую вежливость. Ответы стали суше и короче.
- Гибкий контекстный кэш со скидкой до 90%, раньше любая смена набора инструментов (tools/skills) в процессе диалога инвалидировала кэш и заставляла заново платить за полный контекст. Теперь переключение инструментов не сбрасывает закэшированные префиксы.
Где щупать
- API: обе модели уже доступны в продакшене.
- Codex и ChatGPT Work: Sol и Luna постепенно накатываются в интерфейсы разработчиков.
- Десктоп: Luna открыли бесплатно для всех пользователей официального приложения.
- Бонус: подписчикам тарифов Plus и выше накинули по одному разовому сбросу лимитов.
Выкатка Sol и Luna это не прорыв в AGI, а зрелая оптимизация инфраструктуры. Индустрия постепенно уходит от гонки абстрактных параметров к борьбе за стоимость транзакции и предсказуемость в проде.
Не отставайте от технологий! Подписывайтесь на Telegram-канал, чтобы быть в курсе последних трендов и лайфхаков.