Anthropic выпустила Claude Opus 5 — модель, которая почти догоняет флагманский Fable 5 по интеллекту, но стоит вдвое дешевле

Вслед за Fable 5 (начало июня), Sonnet 5 (конец июня) и Opus 4.8 выходит новая Opus 5. В коде новинка отстаёт всего на 0,5%, в агентских задачах обгоняет конкурентов, а вот GPT-5.6 Sol оставляет её позади почти везде. Протестировать модель можно - здесь

Anthropic выпустила Claude Opus 5 — модель, которая почти догоняет флагманский Fable 5 по интеллекту, но стоит вдвое дешевле

Цена: прежняя — возможности новые

Ключевой козырь Opus 5 — ценник остался на уровне Opus 4.8: $5 за миллион входных токенов и $25 за миллион выходных. Для сравнения, Fable 5 стоит $10 и $50 соответственно — ровно вдвое дороже.

При этом на 8 из 13 бенчмарков Opus 5 обходит Fable 5 при половинной стоимости. В итоге средняя стоимость задачи на Opus 5 составляет $2.03 против $2.75 у Fable 5 — экономия 26%.

Модель стала стандартной для Claude Max и самой мощной в Claude Pro. Для тех, кому нужна скорость, доступен Fast-режим: 2.5× быстрее за 2× цену.

Код: 0.5% отставания при 50% экономии

В программной инженерии Opus 5 показывает впечатляющие результаты:

  • Frontier-Bench v0.1: Opus 5 обходит все модели, более чем вдвое превосходя Opus 4.8 при меньшей стоимости задачи.
  • CursorBench 3.2 (реальные задачи разработки): на максимальном усилии (max effort) Opus 5 достигает 70.0%, уступая пику Fable 5 (70.5%) всего 0.5%. При этом стоимость задачи — $8.23 против $17.32 у Fable 5, а токенов тратится на 40% меньше.
  • На режимах High и Xhigh Opus 5 уже обходит Fable 5 на том же уровне усилия, оставаясь дешевле.

Anthropic также приводит впечатляющий пример: в тесте, где модели нужно было восстановить 3D-модель детали по чертежу без прямого доступа к изображению, Opus 5 написала собственный компьютерный vision-пайплайн и успешно справилась с задачей — ни одна конкурирующая модель не решила её за пять попыток.


Протестировать Opus 5 - здесь

Агентские задачи: новый лидер

В агентской работе и решении сложных задач Opus 5 выходит на первое место:

Бенчмарк и Результат Opus 5

  • Artificial Analysis Intelligence Index - 61 балл (Fable 5 — 60, GPT-5.6 Sol — 59, Kimi K3 — 57)
  • GDPval-AA v2 (агентская knowledge-работа) - 1861 Elo, на 100+ баллов впереди Fable 5 и GPT-5.6 Sol
  • AA-Briefcase - 1720 Elo, на 146 баллов впереди Fable 5
  • ARC-AGI 3 (решение новых логических задач) В 3 раза выше, чем у ближайшего конкурента
  • Zapier AutomationBench (бизнес-автоматизация) В 1.5 раза выше проходимость, чем у конкурентов при равной стоимости
  • OSWorld 2.0 (управление компьютером) Превосходит лучший результат Fable 5 при ~⅓ стоимости
  • Terminal-Bench v2.1 89% — на уровне лидера GPT-5.6 Sol

По данным Artificial Analysis, Opus 5 возглавила Coding Agent Index вместе с Claude Code.

GPT-5.6 Sol: факт-чекинг и наука — за OpenAI

Несмотря на успехи, Opus 5 уступает GPT-5.6 Sol в ряде ключевых областей:

  • Фактологические знания (AA-Omniscience): Opus 5 существенно отстаёт от Fable 5 (что объясняется меньшим размером модели) и, соответственно, от GPT-5.6 Sol.
  • Галлюцинации: точность Opus 5 выросла на 7 пунктов по сравнению с Opus 4.8, но частота галлюцинаций подскочила на 14 пунктов до 50% — модель чаще отвечает, когда не уверена.
  • Научное рассуждение: на физическом бенчмарке CritPt Opus 5 и Fable 5 идут наравне, но уступают GPT-5.6 Sol, GPT-5.5 Pro и GPT-5.6 Terra.

В тестах на узких задачах GPT-5.6 Sol также показывает преимущество: например, при расшифровке аудиофайлов Sol достигла 100% точности на всех тестах, тогда как Opus 5 — 100% и 88.4%.

Безопасность: умная, но «безопасная»

Opus 5 не обучалась на задачах кибербезопасности. Её безопасность заметно выше: срабатывания защитных классификаторов на 85% реже, чем у Fable 5.

В тестах на поиск уязвимостей Opus 5 близка к Mythos 5, но значительно отстаёт в создании эксплойтов.

Итог: Fable 5 за полцены?

Claude Opus 5 — это умный и доступный инструмент для повседневной работы: кодинг, агентские задачи, бизнес-аналитика и научные исследования. За полцены вы получаете 99.5% возможностей Fable 5 в программировании и превосходство в агентских задачах.

Главные компромиссы: уступает GPT-5.6 Sol в фактологии и научных рассуждениях, у модели высокий уровень галлюцинаций, а Fable 5 остаётся выбором для самых амбициозных проектов.

Но если вам нужен мощный, безопасный и доступный ИИ-ассистент — Opus 5 становится лучшим предложением на рынке.

Попробовать новую модель от Anthropic - здесь

3