Sonnet 5: умнее почти как Opus, но не такая же экономичная как 4.6

Anthropic выкатила Claude Sonnet 5 — и обещает почти уровень флагмана Opus 4.8 по цене среднего тарифа. Звучит как мечта: переключил свой бюджетный Claude Code с 4.6 на пятёрку — и получил мозги Opus за копейки. Но прежде чем все радостно мигрируют, разберём то, о чём в пресс-релизе пишут мелким шрифтом: будет ли пятёрка жрать лимиты как не в себя — или останется такой же экономной, как 4.6.

Sonnet 5: умнее почти как Opus, но не такая же экономичная как 4.6

30 июня Anthropic представила Sonnet 5 — «самый агентный Sonnet»: сам строит планы, лазит по браузеру и терминалу, долго работает автономно. По бенчмаркам он уверенно бьёт 4.6 и вплотную подходит к Opus 4.8: на агентном кодинге 63,2% против 58,1% у 4.6 и 69,2% у Opus, а на одном тесте по «работе со знаниями» даже чуть обошёл флагман. Цена на старте — 2 доллара за миллион входных токенов и 10 за миллион выходных, до 31 августа; потом стандартные 3 и 15 — ровно как у 4.6. По прайс-листу пятёрка не дороже предшественника. Казалось бы, чистый апгрейд.

Но вот твой главный вопрос: лимиты

А теперь мелкий шрифт, ради которого и стоит читать. Per-token цена — это не то же самое, что счёт за задачу. И тут две подножки. Первая: у Sonnet 5 новый токенизатор — тот же самый текст теперь раскладывается на величину до 1,35 раза больше токенов. То есть даже при той же цене за токен одна и та же работа стоит дороже просто потому, что токенов стало больше. Anthropic выставила вступительную скидку как раз чтобы переход вышел «примерно по нулям» — но скидка кончится 31 августа. Вторая подножка серьёзнее: модель агентнее. Она делает больше шагов, активнее дёргает инструменты, дольше «думает» — а каждый шаг это токены. То же самое было при переходе Opus с 4.6 на 4.7 — формально не дороже, а на практике расход вырос.

И вот косвенное доказательство: Anthropic сама подняла лимиты в Chat, Cowork и Claude Code — по её формулировке, «чтобы вместить возросший расход токенов». Подняли лимиты не от щедрости. Подняли, потому что знают: пятёрка ест больше.

Так экономнее или нет — честный ответ

Зависит от того, как ты её гоняешь. Если используешь на простых задачах с низким «уровнем усилий» — будет близко к 4.6 по расходу, но умнее. Если спускаешь её в длинные автономные забеги, как она любит, — готовься, что на ту же задачу уйдёт заметно больше токенов, чем на 4.6, и экономия от низкой цены растворится. Грубо: per-token дешевле, per-задачу — скорее всего дороже, особенно после 31 августа.

Совет бедолагам с 4.6 простой и трезвый. Переключаться стоит — пятёрка действительно умнее и доводит до конца то, на чём 4.6 спотыкался. Но не жди, что «мозги Opus достались даром». Жди другого: модель, которая делает больше — и съедает больше.

Если интересно — встретимся у меня в Telegram-канале @wbindexes

1