Anthropic выпустила Claude Opus 5 — модель, которая почти догоняет флагманский Fable 5 по интеллекту, но стоит вдвое дешевле
Вслед за Fable 5 (начало июня), Sonnet 5 (конец июня) и Opus 4.8 выходит новая Opus 5. В коде новинка отстаёт всего на 0,5%, в агентских задачах обгоняет конкурентов, а вот GPT-5.6 Sol оставляет её позади почти везде. Протестировать модель можно - здесь
Цена: прежняя — возможности новые
Ключевой козырь Opus 5 — ценник остался на уровне Opus 4.8: $5 за миллион входных токенов и $25 за миллион выходных. Для сравнения, Fable 5 стоит $10 и $50 соответственно — ровно вдвое дороже.
При этом на 8 из 13 бенчмарков Opus 5 обходит Fable 5 при половинной стоимости. В итоге средняя стоимость задачи на Opus 5 составляет $2.03 против $2.75 у Fable 5 — экономия 26%.
Модель стала стандартной для Claude Max и самой мощной в Claude Pro. Для тех, кому нужна скорость, доступен Fast-режим: 2.5× быстрее за 2× цену.
Код: 0.5% отставания при 50% экономии
В программной инженерии Opus 5 показывает впечатляющие результаты:
- Frontier-Bench v0.1: Opus 5 обходит все модели, более чем вдвое превосходя Opus 4.8 при меньшей стоимости задачи.
- CursorBench 3.2 (реальные задачи разработки): на максимальном усилии (max effort) Opus 5 достигает 70.0%, уступая пику Fable 5 (70.5%) всего 0.5%. При этом стоимость задачи — $8.23 против $17.32 у Fable 5, а токенов тратится на 40% меньше.
- На режимах High и Xhigh Opus 5 уже обходит Fable 5 на том же уровне усилия, оставаясь дешевле.
Anthropic также приводит впечатляющий пример: в тесте, где модели нужно было восстановить 3D-модель детали по чертежу без прямого доступа к изображению, Opus 5 написала собственный компьютерный vision-пайплайн и успешно справилась с задачей — ни одна конкурирующая модель не решила её за пять попыток.
Протестировать Opus 5 - здесь
Агентские задачи: новый лидер
В агентской работе и решении сложных задач Opus 5 выходит на первое место:
Бенчмарк и Результат Opus 5
- Artificial Analysis Intelligence Index - 61 балл (Fable 5 — 60, GPT-5.6 Sol — 59, Kimi K3 — 57)
- GDPval-AA v2 (агентская knowledge-работа) - 1861 Elo, на 100+ баллов впереди Fable 5 и GPT-5.6 Sol
- AA-Briefcase - 1720 Elo, на 146 баллов впереди Fable 5
- ARC-AGI 3 (решение новых логических задач) В 3 раза выше, чем у ближайшего конкурента
- Zapier AutomationBench (бизнес-автоматизация) В 1.5 раза выше проходимость, чем у конкурентов при равной стоимости
- OSWorld 2.0 (управление компьютером) Превосходит лучший результат Fable 5 при ~⅓ стоимости
- Terminal-Bench v2.1 89% — на уровне лидера GPT-5.6 Sol
По данным Artificial Analysis, Opus 5 возглавила Coding Agent Index вместе с Claude Code.
GPT-5.6 Sol: факт-чекинг и наука — за OpenAI
Несмотря на успехи, Opus 5 уступает GPT-5.6 Sol в ряде ключевых областей:
- Фактологические знания (AA-Omniscience): Opus 5 существенно отстаёт от Fable 5 (что объясняется меньшим размером модели) и, соответственно, от GPT-5.6 Sol.
- Галлюцинации: точность Opus 5 выросла на 7 пунктов по сравнению с Opus 4.8, но частота галлюцинаций подскочила на 14 пунктов до 50% — модель чаще отвечает, когда не уверена.
- Научное рассуждение: на физическом бенчмарке CritPt Opus 5 и Fable 5 идут наравне, но уступают GPT-5.6 Sol, GPT-5.5 Pro и GPT-5.6 Terra.
В тестах на узких задачах GPT-5.6 Sol также показывает преимущество: например, при расшифровке аудиофайлов Sol достигла 100% точности на всех тестах, тогда как Opus 5 — 100% и 88.4%.
Безопасность: умная, но «безопасная»
Opus 5 не обучалась на задачах кибербезопасности. Её безопасность заметно выше: срабатывания защитных классификаторов на 85% реже, чем у Fable 5.
В тестах на поиск уязвимостей Opus 5 близка к Mythos 5, но значительно отстаёт в создании эксплойтов.
Итог: Fable 5 за полцены?
Claude Opus 5 — это умный и доступный инструмент для повседневной работы: кодинг, агентские задачи, бизнес-аналитика и научные исследования. За полцены вы получаете 99.5% возможностей Fable 5 в программировании и превосходство в агентских задачах.
Главные компромиссы: уступает GPT-5.6 Sol в фактологии и научных рассуждениях, у модели высокий уровень галлюцинаций, а Fable 5 остаётся выбором для самых амбициозных проектов.
Но если вам нужен мощный, безопасный и доступный ИИ-ассистент — Opus 5 становится лучшим предложением на рынке.
Попробовать новую модель от Anthropic - здесь