Claude Opus 5: новый флагман Anthropic за полцены от Fable 5
24 июля Anthropic выпустила Claude Opus 5 - модель, которая в большинстве бенчмарков обходит флагманскую Fable 5, стоит в два раза дешевле и уже доступна на базовой подписке Pro. Разбираю, что внутри, где отрыв реальный, а где маркетинг, и как попробовать модель из России.
Если коротко: это самый интересный релиз Anthropic за год. Не потому, что модель рекордно умная - а потому, что почти вся мощь Fable 5 теперь продаётся по цене обычного Opus. Дальше по фактам.
Почему Opus 5 ждали и при чём тут Fable 5
Сюрприза не случилось. По слухам, первые версии Claude Mythos - закрытой модели, на которой строится коммерческая Fable 5 - сотрудники Anthropic крутили ещё в феврале. В апреле стартовал закрытый Project Glasswing, а Fable 5 вообще собирались выпустить в начале июня, но отложили после вмешательства властей США.
Пяти месяцев с запасом хватает, чтобы из архитектуры топовой модели собрать массовый флагман. Им и стал Opus 5: та же родословная, срезанные издержки, вменяемый ценник.
Официальный анонс Anthropic формулирует это аккуратнее: Opus 5 «приближается к фронтирному интеллекту Fable 5 за половину цены» и становится моделью по умолчанию на подписке Max и самой сильной моделью на Pro. Перевожу с корпоративного: покупать дорогую подписку ради Fable 5 теперь нужно далеко не всем.
Бенчмарки: где отрыв настоящий
Отрыв от Fable 5 реальный в трёх местах, зато важных:
• агентское программирование - 43,3 против 33,7;
• бизнес-задачи на AutomationBench от Zapier - 26,0 против 17,4;
• работа за компьютером на OSWorld 2.0 - 70,6 против 66,1.
Что общего у этих трёх пунктов: везде модель пашет долго и без присмотра. Именно такие сценарии Anthropic и продаёт - агенты, которым дал задачу утром и проверил вечером.
Остальное - размен. На HLE 56,3 против 56,5, на паре кодовых бенчмарков отставание в десятые доли. Заметно проигрывает Opus 5 только в юриспруденции и медицине. Для модели вдвое дешевле - это не проигрыш, а прайс-лист.
ARC-AGI-3: результат, который выбивается из ряда
Самая громкая цифра релиза - 30,2% на ARC-AGI-3 против 7,8% у прошлого лидера, GPT-5.6 Sol. Почти четырёхкратный отрыв на бенчмарке абстрактного мышления: модель сажают в пошаговую игру без единого объяснения правил, и она методом проб и ошибок должна сама понять, как играть, а потом выиграть. Игр много, каждая со своими особенностями.
Но есть нюанс. ARC-AGI-3 представили 25 марта - явно раньше, чем закончилось обучение Opus 5. Открытых задач в бенчмарке минимум, большинство держат в секрете, но изучить доступные и целенаправленно подтянуть модель под такой формат - вполне рабочая гипотеза. Официально об этом нигде ни слова, и всё же совпадение удобное.
«Сообразительность» при этом не заперта в одном бенчмарке - она видна и в живых задачах. Одна из них ниже.
Кейс с чертежом: модель собрала себе зрение из подручных средств
Мой любимый эпизод из блогпоста Anthropic. Opus 5 дали файл с чертежом механической детали и попросили написать программу, которая соберёт эту деталь в FreeCAD. Подвох: компьютерное зрение модели намеренно отключили, файл есть, а посмотреть его нельзя.
Другие модели в этой ситуации честно останавливались и сообщали, что задача невыполнима. Opus 5 открыл картинку как то, чем она является физически - длинную таблицу чисел, по три на каждую точку экрана. И написал с нуля программу, которая по этим числам находит прямые, окружности и размерные стрелки. То есть смастерил себе простенькое компьютерное зрение и довёл задачу до конца. По данным Anthropic, ни одна конкурирующая модель не справилась и за пять попыток.
Там же ещё два показательных случая. Модели дали реальный баг из популярного пакетного менеджера - она нашла первопричину и закрыла краевой случай, который пропустил даже патч сообщества. А инженер трейдинговой фирмы за одну сессию собрал с Opus 5 парсер биржевых данных для новой биржи: живого потока котировок для проверки не было, так модель сама построила тестовый стенд, чтобы убедиться, что код разбирает данные корректно.
В этом главное отличие пятого Opus от предшественников: он проверяет свою работу и дожимает задачу, а не сдаёт первый попавшийся результат.
Цена и доступность: главный аргумент релиза
Теперь то, ради чего всё затевалось. В API вход стоит 5 долларов за миллион токенов, выход - 25: ценник не сдвинулся с Opus 4.8 и ровно вдвое ниже тарифа Fable 5. С подписками ещё веселее: модель открыта уже на базовом Pro, на Max стоит по умолчанию, и лимит на неё уходит целиком - а не половина, как было устроено у Fable 5.
Есть и Fast-режим - около 2,5 обычной скорости за двойную цену. Когда агент гоняет десятки итераций подряд, эта опция окупает себя быстро.
Разработчикам модель отдают как claude-opus-5 в API. Из приятного - Anthropic докинула две беты: смену инструментов посреди диалога без сброса кеша промпта и автоматический fallback на уровне API.
Если не вылезет какой-то косяк вроде кривого стиля письма или галлюцинаций - Fable 5 можно отправлять на пенсию до выхода 5.1.
Безопасность: реже отказывает и не учится взлому
Отдельная история - фильтры. Fable 5 в своё время раздражала отказами на безобидные вопросы: у автора канала ai_exee она не хотела объяснять ни парадокс Ферми, ни устройство мозга осьминога. В Opus 5 классификаторы перенастроили: сама Anthropic ожидает, что срабатывать они станут реже примерно на 85%. А спорный запрос теперь не упирается в глухую стену - его тихо подхватывает Opus 4.8.
Любопытный факт про кибербезопасность. Opus 5 намеренно не обучали взлому - но в поиске уязвимостей модель набрала 79,4% против 80% у закрытой Mythos. Закономерность, которую уже не получается игнорировать: если учить модель хорошо писать код, она автоматом учится находить в нём дыры. Разница в том, что превращать найденные дыры в рабочие эксплойты Opus 5 умеет заметно хуже - на этом Anthropic и строит свою линию защиты.
С биологией зеркальная ситуация: ограничения остались на уровне Opus 4.8, поэтому для научных задач это теперь самая способная общедоступная модель компании.
Как попробовать Claude Opus 5 в России
Официальной оплаты российскими картами у Anthropic нет, поэтому рабочих пути два.
Первый - полноценная подписка Claude Pro, если модель нужна каждый день: под рабочие проекты, код, длинные документы. На Озоне активация Claude Pro лежит как обычный цифровой товар за 3300 рублей: оплатили - код тут же падает на электронную почту, поездка в пункт выдачи не потребуется.
Активация Claude Pro 👉 купить на Озоне за 3300 рублей
Второй путь - для разовых задач, без подписки. Opus 5 уже доступен в нашем боте Cyber AI - можно зайти и погонять модель на своих запросах: TG | MAX
FAQ: частые вопросы про Claude Opus 5
Чем Claude Opus 5 отличается от Fable 5?
Это модель на той же архитектурной базе, но вдвое дешевле. В агентских задачах - программирование, работа за компьютером, бизнес-процессы - Opus 5 даже сильнее. Fable 5 остаётся чуть точнее в знаниях, юриспруденции и медицине.
Сколько стоит Claude Opus 5?
В API токены стоят как у Opus 4.8: 5 долларов вход и 25 выход за миллион. По подпискам: есть на Pro, на Max без урезания лимитов. Активация подписки Claude Pro продаётся на Озоне за 3300 рублей.
Claude Opus 5 подходит как нейросеть для кода?
Да, сейчас это одна из самых сильных моделей для написания кода: 43,3 балла в агентском программировании против 33,7 у Fable 5. Отдельный плюс - модель сама проверяет и чинит свой код, а не сдаёт первый вариант.
Как пользоваться нейросетью Claude в России?
Вариантов два: взять активацию Claude Pro на Озоне или открыть наш бот Cyber AI в Telegram и MAX - там Opus 5 работает без всякой подписки Anthropic, что удобно для теста и разовых задач.
Что за fallback на Opus 4.8?
Если запрос показался классификаторам подозрительным, его обрабатывает не Opus 5, а более консервативный Opus 4.8. Ответ вы всё равно получаете, просто от другой модели. Такой же механизм был у Fable 5, но срабатывал он сильно чаще.
Правда ли Opus 5 натаскали на ARC-AGI-3?
Официально - нет. Но бенчмарк показали публике 25 марта, до конца обучения модели, и результат 30,2% против 7,8% у ближайшего конкурента выглядит слишком аккуратно. Даже если подтянули - способность разбираться в незнакомых правилах у модели правда есть, это видно по другим задачам.
Что в итоге
Opus 5 - это не революция, а грамотно посчитанная экономика: почти вся сила Fable 5 за половину цены, плюс заметный отрыв там, где модели работают без присмотра. Именно такой прогресс и был нужен, чтобы флагманские возможности перестали быть игрушкой для избранных.
Если материал был полезен - закиньте лайк, так статью увидит больше людей. И расскажите в комментариях: уже успели погонять Opus 5 и на чём?
Больше разборов новых моделей - в нашем ТГ-канале Промты GS