Anthropic выпустила Opus 5.5: дешевле на 40%, быстрее на 30%, и она обходит GPT-6
Claude Opus 5.5. Это прямой удар по позициям OpenAI: модель превосходит Fable 5.1 и GPT-6 по ключевым бенчмаркам.
Opus 5.5 - здесь
Вы платили $25 за миллион выходных токенов. Ждали, пока Opus 5 допишет ответ. Мирились с тем, что модель «умная, но медленная». 22 сентября Anthropic выкатила Opus 5.5 — и переписала правила. Цена упала на 40%, скорость выросла на 30%, а бенчмарки обошли GPT-6 Astra на ключевых тестах.
Что изменилось в цифрах
Цена: $4 за миллион входных токенов, $20 за выходные. Против $5 и $25 у Opus 5. Кэш-чтения — $0.20 вместо $0.50, падение на 60%. Именно кэш составляет большую часть расходов в агентской работе и кодинге.
Скорость: генерация быстрее более чем на 30%. Есть Fast mode — до 2.5x быстрее за 40.
Лимиты: пятичасовой лимит на Pro, Max и Team вырос на 20%. Плюс подписчики получили возможность сохранить сброс лимита и потратить его, когда нужно.
Бенчмарки, которые говорят сами за себя
Opus 5.5 - здесь
Terminal-Bench 4.0: 66.4% против 52.3% у Opus 5 и 57.9% у GPT-6 Astra.
FrontierCode: 54.4%. CursorBench: 57.8%. GDPval-AA v2.1: 1 846 Elo — оценка реальной профессиональной работы по 44 профессиям.
На Artificial Analysis Intelligence Index Opus 5.5 набрала 58 баллов — высший результат, который они когда-либо измеряли. Лидирует в шести из десяти тестов, включая Humanity's Last Exam (61.4%), SciCode (66.9%) и AA-Briefcase (1822 Elo, +143 над Fable 5.1).
Где GPT-6 всё ещё впереди
Честно: не везде. На Terminal-Bench-Science Astra набирает 64.6% против 58.7% у Opus 5.5. На AutomationBench — 52.0% против 40.0%. Opus 5.5 выигрывает в кодинге, агентских задачах и знаниях, но проигрывает в научных и автоматизационных тестах.
Что сломается в вашем коде
Anthropic честно предупреждает о четырёх breaking changes. Thinking нельзя отключить — адаптивное мышление всегда включено. Принудительный вызов инструментов возвращает ошибку. Thinking-блоки привязаны к модели и диалогу — они не переносятся между сессиями. Старый инструмент computer_20251124 больше не принимается на Claude API и Google Cloud.
Ещё нюанс: default effort упал с high до medium. Модель думает меньше по умолчанию, но за счёт лучшего качества на каждом шаге — результат не хуже. Anthropic советует начинать с medium и тестировать уровни на своих задачах.
Почему это важно
Opus 5.5 — не «ещё одна модель». Это смена позиционирования. Anthropic убирает барьер цены, который мешал использовать флагманскую модель в продакшене. $4 за миллион входных токенов — это уровень, на котором можно строить агентов, не считая каждый вызов. Кэш за $0.20 — это разница между «работает» и «работает быстро и дёшево».
Один тестировщик мигрировал 680 000 строк кода менее чем за день. Работа, на которую у инженерной команды ушли бы недели.
Opus 5.5 не просто обошла конкурентов. Она сделала то, чего от неё не ждали: стала дешевле, быстрее и умнее одновременно. Вопрос не в том, переходить ли. Вопрос в том, как быстро вы это сделаете.
Claude Opus 5.5 - здесь