Удар по Claude Opus 5

Главная проблема любого сложного автономного агента — экономика. Когда для решения одной инженерной задачи модель перебирает десятки шагов, гонять флагманскую GPT-6 Astra по $10 за входные и $50 за выходные токены становится разорительно.

OpenAI официально представила модели GPT-6 Sol и GPT-6 Luna, закрыв дыру между запредельно дорогим «хай-эндом» и базовыми легковесными сетками.

Новая тарифная сетка в два раза дешевле предшественников

Линейка GPT-6 теперь четко разделена под разные сценарии разработки. Разработчики не просто обновили веса, но и на 50% уронили расценки на API (за 1 миллион токенов) по сравнению с прошлым поколением:

  • GPT-6 Astra ($10.00 вход / $50.00 выход). Флагманская модель без скидок. Её стоит дергать только для самых тяжелых архитектурных задач и глубоких рассуждений, когда бюджет отходит на второй план.
  • GPT-6 Sol ($2.00 вход / $10.00 выход). Основная рабочая лошадка. Ценник срезали ровно вдвое (раньше было $4 / $20). Идеальна для сложного кодинга, автономных продакшен-агентов и повседневного стека.
  • GPT-6 Luna ($0.10 вход / $0.50 выход). Копеечная сетка для быстрых задач, которая тоже подешевела в два раза (было $0.20 / $1.20). Отличный вариант для черновой сортировки данных, парсинга, роутинга и микрорешений в фоне.

GPT-6 Sol убийца флагманов в тестах на автономность

Версия Sol позиционируется как рабочая лошадка для разработчиков. При цене $2 / $10 она напрямую наступает на пятки топовым моделям конкурентов:

  • Кодинг (DeepSWE). Sol обошла Claude Opus 5 и Fable 5.1, показав более чистое решение алгоритмических задач и исправление багов.
  • Автономные сценарии (AutomationBench, OSWorld 2.0) в тестах на управление окружением и последовательное выполнение цепочек задач модель показала превосходство по успешным запускам, сожрав в разы меньший бюджет на токены.

Меньше маркетингового бреда и 90% экономии на кэше

Кроме сухих цифр скорости и цен, в релизе есть три инженерных изменения, которые напрямую влияют на качество работы:

  1. Сокращение галлюцинаций вдвое, модели стали жестче привязываться к фактам и существенно реже «привирают» о статусе выполнения задачи (проблема, когда агент отчитывается об успехе, ничего реально не сделав).
  2. Лаконичность ответов, разработчики вычистили лишний жаргон, водянистые вступления и навязчивую вежливость. Ответы стали суше и короче.
  3. Гибкий контекстный кэш со скидкой до 90%, раньше любая смена набора инструментов (tools/skills) в процессе диалога инвалидировала кэш и заставляла заново платить за полный контекст. Теперь переключение инструментов не сбрасывает закэшированные префиксы.

Где щупать

  • API: обе модели уже доступны в продакшене.
  • Codex и ChatGPT Work: Sol и Luna постепенно накатываются в интерфейсы разработчиков.
  • Десктоп: Luna открыли бесплатно для всех пользователей официального приложения.
  • Бонус: подписчикам тарифов Plus и выше накинули по одному разовому сбросу лимитов.

Выкатка Sol и Luna это не прорыв в AGI, а зрелая оптимизация инфраструктуры. Индустрия постепенно уходит от гонки абстрактных параметров к борьбе за стоимость транзакции и предсказуемость в проде.

Не отставайте от технологий! Подписывайтесь на Telegram-канал, чтобы быть в курсе последних трендов и лайфхаков.

11