Claude Opus 5.5: вышла новая модель Anthropic, которая работает быстрее и стоит на 40% дешевле
Claude Opus 5.5 вышла 22 сентября 2026 года и стала первой моделью нового семейства 5.5. Главное в релизе не рекорды на бенчмарках, а соотношение: на большинстве задач она держит уровень Claude Fable 5.1, при этом обходится на 40% дешевле, чем Opus 5. Попробовать её можно в разделе чата вместе с остальными моделями, из одного аккаунта.
Разберём по порядку: что изменилось против Opus 5, сколько теперь стоят токены, какие цифры на бенчмарках, что говорят компании, которые тестировали модель до релиза, и чего в ней по-прежнему нет.
Claude Opus 5.5: что изменилось против Opus 5
Начнём с того, ради чего релиз вообще имеет смысл обсуждать.
Это первая модель семейства 5.5, и она заявлена как новая ведущая. Anthropic описывает её как флагман под сложные рассуждения, программирование и длинные агентские задачи. Sonnet 5.5 и Haiku 5.5 обещаны в ближайшие недели с теми же улучшениями по скорости и эффективности.
Главный сдвиг не в потолке возможностей, а в стоимости этого потолка. Модель тратит меньше токенов на ту же задачу и стоит дешевле за токен. Вместе это даёт падение расходов примерно на 40% на типичных нагрузках. Вывод она при этом генерирует более чем на 30% быстрее.
Второй сдвиг в том, как она пишет. Anthropic прямо называет многословность Opus 5 одной из самых частых претензий и говорит, что в 5.5 её чинили: главное выносится вперёд, жаргона меньше, письменные правила соблюдаются точнее.
Перед релизом модель проверяли внешние организации, включая METR и Frontier Design. Открыть её можно в разделе чата, оплата рублями картой российского банка. Подпишись на Telegram-канал Umnik AI и получи 50 токенов бесплатно, их хватит, чтобы сравнить модель со своей привычной.
Цена Claude Opus 5.5: редкий случай, когда новая модель дешевле старой
Обычно новое поколение стоит дороже предыдущего. Здесь наоборот, и это самая заметная часть релиза.
Отдельно есть быстрый режим: до 2,5 раза выше скорость по цене $8 за миллион входных и $40 за миллион выходных токенов. Для подписчиков платных планов увеличены пятичасовые лимиты.
Бенчмарки: где Opus 5.5 действительно впереди
Цифры из официальной публикации. Сама Anthropic оговаривается, что на нынешнем уровне разрыв в баллах хуже отражает реальную разницу, чем раньше, и что в их собственной работе дистанция между Opus 5.5 и Fable 5.1 короче, чем выглядит по таблице.
Самый показательный разрыв в Terminal-Bench: 66,4% против 52,3% у Opus 5. Это тест на многошаговые задачи в командной строке, то есть ровно на то, чем занимаются агенты. GDPval-AA проверяет реальную профессиональную работу по 44 профессиям, и там тоже уверенный отрыв.
Оговорка, которую стоит держать в голове: на AutomationBench от Zapier модель набрала 40,0% против 41,4% у GPT-6 Astra, то есть лидерство не абсолютное.
Что это значит на практике для кода
Самые внятные примеры релиза именно про разработку, и они про объём работы, а не про красоту кода.
Миграция на 680 тысяч строк за меньше чем сутки. Один из тестировщиков закрыл ею задачу, на которую команде инженеров потребовались бы недели.
Аудит и починка кодовой базы на 200 тысяч строк меньше чем за три часа. Opus 5 на той же задаче потратил больше 20 часов и в 2,5 раза больше токенов.
Перевод HAProxy с C на Rust. Во внутреннем тесте Anthropic обе модели прошли почти все регрессионные тесты самого HAProxy, но Opus 5.5 справилась за 9,5 часа против 12 у Fable 5.1 и обошлась на 51% дешевле.
Оптимизация загрузки страниц веб-приложения: 39 успехов из 40. Opus 5 на той же задаче давал меньший прирост и попутно менял поведение приложения.
Компании, тестировавшие модель заранее, говорят примерно одно и то же. GitHub отмечает, что в VS Code она решила больше терминальных задач, чем Opus 5, меньше чем за половину шагов. Stripe описывает ребейз сорока связанных пул-реквестов, где одна сессия дирижировала десятком других. Spotify и Optiver говорят про падение стоимости той же работы на 40-50%.
Что это значит для документов и аналитики
Вторая половина релиза про работу, которая не связана с кодом.
Проверка на выдуманные цифры. Anthropic попросила три модели написать отчёт о квартальных результатах компании по копии веба, где сам релиз с отчётностью был спрятан. Автоматический проверяющий сверял каждую цифру и каждую цитату с источником: любое выдуманное число означало провал. Opus 5.5 прошла планку в 16 отчётах из 18. Ни Fable 5.1, ни Opus 5 не прошли её ни разу.
Это самый практически важный результат всего релиза. Ровно на выдуманных числах и несуществующих цитатах ломается большинство сценариев, где нейросеть подпускают к деловым документам.
Разбор сделки слияния. В тесте обе модели строили финансовую модель в таблице и собирали презентацию с выводом. Выводы совпали, но у Opus 5 были мелкие ошибки, а Opus 5.5 закончила за 63 минуты против 93 и обошлась вдвое дешевле.
Отзывы клиентов. Hebbia сообщает о 86,6% покрытия экспертной рубрики против 60,3% у Opus 5. Walleye Capital рассказывает, что модель заметила ошибку в их собственной инструкции к тесту и учла её, хотя понимала, что потеряет на этом баллы у проверяющего.
Как модель теперь пишет
Это менее громкая часть, но для повседневной работы она заметнее бенчмарков.
Главное выносится в начало ответа. Меньше преамбул, меньше перечисления всего найденного до вывода. Письменные правила, которые вы задали, соблюдаются точнее.
Box в своём отзыве даёт конкретную цифру: ответы стали на 40% менее многословными без потери точности, а токенов модель потратила втрое меньше. Ramp формулирует иначе: «пишет как хороший коллега». Chicago Trading Company отмечает, что их пул-реквесты и документация почти не требуют правки после модели.
Anthropic отдельно называет это не только удобством, но и вопросом безопасности: работу, которую легко прочитать, легче проверить.
Безопасность: что заявлено и какие есть оговорки
Здесь важно и то, что сказано, и то, как это сформулировано.
По внутреннему автоматическому аудиту поведения это лучший результат из всех протестированных моделей. Проверка идёт почти по двум тысячам сценариев. Отдельно заявлено, что модель примерно на 85% реже пытается выйти за заданные ей границы, чем Opus 5, и все зафиксированные попытки были низкой серьёзности и сообщались самой моделью.
Устойчивость к инъекциям в промт. По бенчмарку компании Gray Swan модель делит с Fable 5.1 первое место по наименьшей доле успешных атак. Для тех, кто гоняет агентов по своим системам, это не менее важно, чем результаты на тестах способностей.
И честная оговорка от самой Anthropic. В публикации прямо сказано, что построить оценки, надёжно ловящие любой сбой до выпуска, пока не удаётся, и что есть признаки того, что модель часто подозревает, что её тестируют. Это само по себе усложняет оценку поведения в реальных условиях.
В части биологии и кибербезопасности модель выпущена с усиленными ограничениями: большинство кибербезопасных задач переадресуются более старой модели, а для профильной работы существуют отдельные программы верификации.
Чего в Opus 5.5 нет
Чтобы ожидания были ровные, стоит назвать и ограничения.
- Режим без размышлений отключить нельзя, в отличие от прошлых версий.
- Лидерство не абсолютное: на части тестов GPT-6 Astra впереди.
- Сама Anthropic говорит, что на этом уровне разница в баллах плохо предсказывает разницу в работе.
- Sonnet 5.5 и Haiku 5.5 ещё не вышли, дешёвых моделей нового семейства пока нет.
- Для агентских сценариев в своих системах по-прежнему нужен человек, который проверяет результат.
Как пользоваться Claude Opus 5.5 из России
Прямой доступ к сервисам Anthropic из России закрыт, и это не меняется с выходом новой модели. Практический путь остаётся тем же: агрегатор, где модель подключена на стороне сервиса.
В разделе чата модели переключаются в одном окне, без отдельной подписки на каждую и без VPN. Оплата проходит рублями картой российского банка, интерфейс на русском. Там же рядом лежат готовые помощники под конкретные задачи и раздел генерации для изображений.
Для разработчиков строка модели на платформе Anthropic выглядит как claude-opus-5-5, и она доступна в том числе через Amazon Web Services, Google Cloud и Microsoft Azure.
Какую модель под какую задачу брать сейчас
ЗадачаЧто братьПочемуДлинная миграция или рефакторингClaude Opus 5.5держит многочасовые задачи, тратит меньше токеновОтчёт с проверяемыми цифрамиClaude Opus 5.5лучший результат по тесту на выдуманные данныеТекст, который читают людиClaude Fable 5.1по-прежнему сильна в письмеМассовые однотипные задачиDeepSeek V4 Proдешевле на объёмеРабота с изображениями и сканамиGemini 3.1 Proчитает картинкиПовседневные быстрые вопросыChatGPT 6 Astraбыстро и предсказуемо
Практический вывод. Opus 5.5 имеет смысл ставить по умолчанию там, где задача длинная и где цена ошибки в цифрах высока. На коротких бытовых вопросах разница между моделями почти не чувствуется, и платить за неё незачем.
Как проверить модель на своей задаче: пошаговый план
- Возьмите задачу, которую вы уже делали в Opus 5 или другой модели. Сравнивать имеет смысл только на знакомом материале.
- Запустите её без изменений в промте. Сначала нужна база, а не оптимизация.
- Засеките время и посмотрите объём ответа. По отзывам тестировщиков именно здесь разница заметнее всего.
- Проверьте все числа и ссылки в ответе вручную. Это главная проверка, а не впечатление от текста.
- Повторите на длинной задаче: не один вопрос, а цепочка из десяти шагов. Модель заявлена именно под это.
- Сравните с Fable 5.1 на той же задаче. По официальным данным разрыв между ними меньше, чем кажется по таблицам.
- Посчитайте расход. Экономия здесь ощущается не на одной задаче, а на неделе работы.
- Решайте по своим числам, а не по бенчмаркам. Разброс между реальными сценариями больше, чем между строчками рейтинга.
Все модели открываются из одного аккаунта на Umnik AI.
Чек-лист перед тем, как переводить рабочие процессы на новую модель
- Старый промт проверен без изменений, база для сравнения есть.
- Все числа из ответа сверены с источником.
- Проверена длинная задача, а не только короткая.
- Посчитан расход на неделе, а не на одном запуске.
- Учтено, что режим без размышлений отключить нельзя.
- Для кибербезопасных задач проверено, не уходит ли запрос в ограничения.
- Есть человек, который отвечает за результат агентской сессии.
- Решение принято по своим замерам, а не по чужим бенчмаркам.
Частые вопросы про Claude Opus 5.5
Когда вышла Claude Opus 5.5? 22 сентября 2026 года. Это первая модель семейства 5.5, Sonnet 5.5 и Haiku 5.5 обещаны в ближайшие недели.
Чем Opus 5.5 отличается от Opus 5? Выше результаты на агентских и рабочих задачах, вывод более чем на 30% быстрее, расход примерно на 40% ниже, и заметно изменилась манера письма: короче и структурнее.
Сколько стоит Claude Opus 5.5? По официальному прайсу $4 за миллион входных токенов и $20 за миллион выходных, чтение из кеша $0,20. Это дешевле Opus 5 по всем позициям.
Можно ли пользоваться из России? Через агрегатор да, без VPN и с оплатой рублями картой российского банка. Условия на странице тарифов.
Она действительно лучше GPT-6 Astra? На части тестов да, на части нет. На Terminal-Bench и GDPval впереди Opus 5.5, на AutomationBench впереди Astra. Универсального ответа тут нет.
Стоит ли переходить прямо сейчас? Если у вас длинные задачи и вы платите за токены, разница будет ощутимой. На коротких бытовых запросах спешить некуда.
Можно ли отключить режим размышлений? Нет, в этой модели он всегда включён. Это заметное отличие от предыдущих версий.
Сильно ли она меньше врёт? На внутреннем тесте с отчётностью она прошла планку в 16 попытках из 18, где Opus 5 и Fable 5.1 не прошли ни разу. Это хороший показатель, но проверять числа всё равно нужно.
Заключение
Главная новость релиза не в том, что появилась модель сильнее прежней. Она в том, что лидерство подешевело: те же задачи закрываются меньшим числом токенов и по меньшей цене за токен, а разница в счёте за месяц заметнее, чем разница в баллах на бенчмарке.
Две вещи, ради которых стоит попробовать её на своей работе прямо сейчас: длинные многочасовые задачи, где раньше приходилось резать объём, и отчёты с цифрами, где важнее всего, чтобы модель ничего не придумала. Всё остальное можно оставить как было. Модели переключаются в одном окне на Umnik AI.