Лимиты подорожали на треть за одну ночь. Как я пересобрал работу с ИИ, чтобы не платить вдвое

31 августа заканчивается акция, которая с середины мая держала недельный лимит Claude Code на 50 % выше обычного. Формально это возврат к базе. Практически — минус треть недельной ёмкости у всех, кто за три с половиной месяца успел к ней привыкнуть и построить на ней рабочий процесс.

Я как раз из тех, кто построил. Расскажу, во что это обходится в людях и часах, что я поменял до того, как лимит кончился, и почему самое дешёвое решение оказалось не «переехать на другой инструмент», а перестать тратить дорогую модель на дешёвые задачи.

Техническую версию этого разбора — с конкретными командами, версиями и параметрами конфигурации — я опубликовал на Хабре. Здесь про деньги и решения.

Сколько это стоит в рабочих днях

Треть недельной ёмкости для разработчика, который пользуется ИИ-ассистентом плотно, — это примерно полтора дня из пяти. Не «стало чуть медленнее», а «во вторник вечером упёрлись, до понедельника ждём». Для команды из пяти человек на одинаковых подписках это семь с половиной человеко-дней в неделю, которые надо либо чем-то закрыть, либо списать.

И есть второй множитель, который почти никто не считает, потому что он не объявлялся как изменение тарифа. Модели нового поколения используют другой токенизатор: тот же самый текст обходится примерно на 30 % дороже в токенах. Хуже всех досталось файлу с инструкциями для ассистента — он подорожал в 1,445 раза, и читается он в начале каждой сессии.

Сложите: минус треть ёмкости и плюс треть расхода на том же объёме работы. Отсюда ощущение «лимит кончается вдвое быстрее», хотя формально урезали только треть.

Слева — недельная ёмкость до и после 31 августа. Справа — во сколько раз новый токенизатор удорожает тот же текст.
Слева — недельная ёмкость до и после 31 августа. Справа — во сколько раз новый токенизатор удорожает тот же текст.

Первое, что я сделал, — бесплатное

Прежде чем считать бюджеты и смотреть на конкурентов, я потратил вечер на то, что не стоит ничего.

Почистил файл инструкций. У меня он разросся до нескольких сотен строк за месяцы работы: правила, написанные под ситуации, которые случились один раз. После смены токенизатора каждая лишняя строка там стоит в полтора раза дороже, чем весной, и платится это при каждом запуске. Раньше чистка была вопросом гигиены, теперь — прямой экономии.

Развёл задачи по моделям. Самый недооценённый рычаг вообще не про деньги. У конкурирующего инструмента разница между флагманской моделью и облегчённой — двадцатипятикратная по объёму допустимой работы: сто сообщений против двух тысяч на том же тарифе. У Claude Code есть встроенный режим, где дорогая модель составляет план, а дешёвая его исполняет. Мы почему-то считаем нормальным гонять флагман на переименовании переменных, а потом удивляемся, что бюджет кончился к четвергу.

Посмотрел, куда вообще уходит лимит. Недавно появилась команда, которая показывает расход с разбивкой по конкретным инструментам и расширениям. У меня выяснилось, что заметную долю съедали фоновые проверки, которые я сам когда-то включил и забыл.

Это дало больше, чем любая смена инструмента, и заняло один вечер — до всяких разговоров про переезд и вторые подписки.

Что стоит денег, а что времени

Дальше решения разделились по цене входа, и полезно понимать, чем именно вы платите.

Деньгами. У Codex можно докупать кредиты, не переходя на более дорогой тариф: они живут год и общие для нескольких продуктов. Есть ещё механизм разового сброса лимита — про него много пишут как про «кнопку», но важная деталь в другом: его нельзя ни купить, ни выпросить у поддержки. Это промо-бонус, который прилетает по акциям, живёт месяц и сгорает, так что планировать работу на него не выйдет.

Временем. Переезд на другой инструмент — это не только настройка, но и перестройка привычек команды. Здесь порог входа неожиданно низкий: одна команда переносит из Claude Code навыки, вложенных агентов, хуки, конфигурацию расширений и переписку за последний месяц. То есть попробовать — это вечер, а не спринт.

Риском. Дешёвые альтернативы выглядят соблазнительно: китайская GLM-5.3-Flash, та самая нашумевшая «анонимная модель, обошедшая DeepSeek», стоит в 66 раз дешевле флагмана Anthropic по входным токенам. Я подключил её и померил.

Четыре способа пережить сокращение: что работает сразу, что требует переезда и где подводные камни.
Четыре способа пережить сокращение: что работает сразу, что требует переезда и где подводные камни.

Про дешёвые альтернативы, честно

Замеры получились такие: доступность 80 %, задержка от 16 до 153 секунд на одном и том же запросе, заявленный контекст в миллион токенов не подтвердился — на половине этого объёма модель вернула пустой ответ. Девять одновременных запросов положили сервис.

По качеству разбора кода претензий нет — на тестовой задаче модель нашла оба дефекта, включая тот, о котором её не спрашивали. Но 80 % доступности — это простыми словами так: каждый пятый запрос не дойдёт. Для личных экспериментов терпимо. Для процесса, на котором висит команда, — нет.

Отдельно про бенчмарки, потому что тут легко обмануться. Производитель в собственных материалах сравнивает свою модель не с текущим флагманом Anthropic, а с предыдущим поколением. На единственном публичном тесте с прямым сравнением флагман Anthropic выигрывает. А на официальном лидерборде, где прогоны проверяются независимо, записей этой модели вообще нет — все цифры, которые ходят по обзорам, взяты из материалов вендора.

Есть область, где эта модель действительно первая в мире, — поиск уязвимостей в коде. И, что интереснее, разработчики уходят туда не из-за баллов, а потому что Claude часто отказывается работать с задачами, смежными с безопасностью, даже когда речь о собственном коде.

Чего я делать не стал

Три идеи ниже выглядят разумно, и я их проверял — ни одна не работает.

Открыть несколько параллельных подключений ради ёмкости. Проверил: при нагрузке приходит отказ с прямым указанием, что маршруты делят общий пул у провайдера. Это не увеличение ёмкости, а несколько дверей в одну и ту же комнату.

Поднять модель локально. Флагманская модель в сжатом виде — это без малого триста гигабайт весов, и на хорошей рабочей станции она выдаёт меньше токена в секунду. Для интерактивной работы неприменимо.

Рассчитывать на разовый сброс лимита. Он промо-бонус, а не инструмент. Прилетел — хорошо, но строить на нём планирование нельзя.

Что это значит для руководителя

Если у вас команда на таких подписках, на этой неделе стоит сделать три вещи.

Первое: снять текущие цифры расхода до 31 августа. После отмены акции сравнивать будет не с чем, и разговор «стало хуже» превратится в спор об ощущениях.

Второе: разделить задачи по цене инструмента. Часть работы, которую сейчас делает флагманская модель, спокойно делается моделью попроще — это не вопрос экономии на качестве, это вопрос соответствия инструмента задаче.

Третье: не переводить процесс на дешёвые альтернативы под давлением срока. Восемьдесят процентов доступности — это нормально для эксперимента и неприемлемо для процесса. Если экономить, то на распределении задач, а не на надёжности.

И общий вывод, который я вынес из этой истории: изменение тарифов — хороший повод посмотреть, за что вы платили всё это время. Треть моего лимита уходила на то, что я никогда бы не оплатил осознанно, — на раздутый файл инструкций, забытые фоновые проверки и флагманскую модель там, где хватало простой. Акция закончится, а привычка считать останется.

Про то, как ИИ меняет работу команд — без обещаний «замены людей» и без слепой веры в пилоты, — пишу в канале «Готовим ИИшницу».

Кейсы и контакты — мой сайт.

Если после этого текста захочется попробовать самому, а порог входа окажется техническим, — у меня есть Ника, агент-помощник по настройке: t.me/vibecodeguidebot. Готовая конфигурация, установщик и видео-гайд на семь минут. Бесплатно, без регистрации.