Я сжёг $100 кредита Claude Code за 3 дня после 15 июня: разбираю 4 паттерна

Я сжёг $100 кредита Claude Code за 3 дня после 15 июня: разбираю 4 паттерна

Я был уверен, что $100 кредита на Max 5x хватит на месяц спокойной автоматизации. Хватило ровно на 3 дня.

15 июня Anthropic вынес Agent SDK, claude -p и GitHub Actions из общего пула подписки Pro/Max в отдельный месячный кредит. Подписка осталась как была, но автоматизация теперь платит отдельной строчкой. Я знал об этом, ничего не менял в инфраструктуре - зачем, у меня же кредит лежит, - и спокойно работал свой обычный режим. К утру четверга кредита уже не было, а overflow billing успел списать сверху ещё $16: я его включил «на всякий случай» месяц назад и забыл, что теперь оно работает совсем по-другому.

Дальше - что я делал в эти 3 дня, в каком месте бюджет уехал, и как теперь та же автоматизация работает в 5-10 раз дешевле. Без переезда на чистый API, без отказа от GitHub Actions, без обиды на Anthropic.

Что случилось 15 июня - короткий итог

Anthropic разделил подписку на два пула. Первый - интерактивный: чат на claude.ai, мобильное приложение и Claude Code в терминале, когда ты руками пишешь команды. Второй - автоматизация: всё, что ходит в Claude без участия твоих рук в моменте. Сюда входят claude -p, Agent SDK на Python и TypeScript, Claude Code в GitHub Actions и сторонние клиенты типа Zed, Conductor, OpenClaw, которые авторизуются через твою подписку.

Кредит: Pro - $20/мес, Max 5x - $100, Max 20x - $200. Расходуется по обычным API-ставкам: Опус 4.7 - $5/$25 за миллион входных/выходных токенов, Хайку 4.5 - в 5-10 раз дешевле. По умолчанию: кончился кредит - автоматизация просто встала. Чтобы продолжала работать, надо вручную включить «usage credits» (overflow billing).

Звучит просто. На практике у меня оказалось 4 разных способа потратить $100, и про три из них я не думал, пока не открыл биллинг.

Паттерн 1: GitHub Action «проверь PR раз в час» - $32 за 2 дня

Самая частая ловушка и самая неочевидная. Action настроен ещё в апреле: каждый push в feature-ветку триггерит Claude Code Action, тот делает review и оставляет коммент в PR. До 15 июня это уходило в подписку Max 5x, и я расхода не замечал.

Цифры моих первых двух дней после переключения:

  • 2 активных PR, 16 push-событий за 2 дня
  • Action под Опус 4.7, средний прогон 28K + 14K токенов
  • ~$0.5 за запуск × ~64 запуска ≈ $32

Откуда 64 запуска при 16 push? Action на один push гоняет 3-4 запроса внутри: анализ diff, контекст-сборка, написание комментария, иногда правки. 16 × 4 = ~64.

Самое неприятное - это слепая точка. Action работал фоном с весны, и в моих глазах это была «бесплатная плюшка подписки». Сейчас бесплатной плюшки нет - есть конкретный счёт.

Два изменения в workflow, которые срезают расход в 4-5 раз без потери смысла:

# .github/workflows/claude-review.yml on: pull_request: types: [opened, ready_for_review] # НЕ synchronize - не на каждый push branches: [main, develop] workflow_dispatch: # ручной запуск через UI jobs: review: if: ${{ !contains(github.event.pull_request.labels.*.name, 'wip') }} runs-on: ubuntu-latest steps: - uses: actions/checkout@v4 - uses: anthropic-ai/claude-code-action@v1 with: claude_api_key: ${{ secrets.ANTHROPIC_API_KEY }} model: claude-haiku-4-5 # ХАЙКУ, не Опус max_turns: 4

Три точки:

  1. Trigger переключён с synchronize на opened/ready_for_review. Claude смотрит PR один раз, когда автор закончил, а не на каждый коммит.
  2. Label wip блокирует прогоны для в-работе веток.
  3. Модель - хайку. Для PR-review с диффом 200-500 строк хайку даёт сравнимое качество за 5-10x меньше.

После этого 16 push в день = 2-3 запуска вместо 16, каждый в 5-7 раз дешевле. По прикидке: те же выходные обошлись бы в $1.20 вместо $32.

Паттерн 2: ночной long-running агент через claude -p - $40 за один прогон

Во вторую ночь после 15 июня у меня в tasks.md лежал бэклог рефакторинга на 23 задачи. Запустил claude -p с инструкцией «пройди по списку, реши каждую или пометь как требует ручного разбора». До 15 июня - стандартная ночная история, ложился спать без раздумий.

Теперь это запрос в Agent SDK pool. Опус 4.7 ел контекст с аппетитом: каждая задача - 40-60K input, 15-30K output. 23 задачи × ~$1.75 средняя цена = ~$40.

Утром смотрю на биллинг - кредит уже на $30. За одну ночь сжёг почти 40% от того, что осталось от первого дня с Action.

Что было не так, в порядке убывания вины:

Не было --max-turns. Claude уходил в дебри на сложных задачах: 8-12 turn-loop за один прогон вместо 3-4. Каждый turn - перечитывание контекста и новый раунд токенов. Без жёсткого потолка Claude дожимает себя сам, и счёт раздувается экспоненциально.

Не было --output-format json. Я не мог по логам понять, что съело сколько токенов. Все жалобы на расход - апостериори через биллинг.

Не было инструкции «escalate если сложно». Claude брался решать всё одним заходом. На сложных задачах из 23 - вгрызался в каждую вместо «помечу, пойду дальше».

Опус, когда хайку бы справился. Из 23 задач 18 были рутинные - переименовать переменные, поправить типы, выровнять стили. На рутинных хайку даёт результат в той же категории за 5-10x дешевле.

Артефакт. Как я переписал команду:

claude -p "обработай задачи из tasks.md по очереди" \ --max-turns 5 \ --output-format stream-json \ --append-system-prompt "$(cat budget-prompt.md)" \ --model claude-haiku-4-5 \ --permission-mode bypassPermissions \ 2>&1 | tee claude-night-run.jsonl

budget-prompt.md короткий:

ПРАВИЛА БЮДЖЕТА: 1. Если задача требует >3 рассуждений вслух - пометь "ESCALATE" в tasks.md и переходи к следующей. 2. Не перечитывай project context повторно - он уже в системном промте. 3. После 5 turn без законченной задачи - сам завершай прогон по этой задаче. 4. В конце каждой задачи - одна строка отчёта: "DONE" / "ESCALATE" / "SKIP".

После этих изменений тот же бэклог из 23 задач ночью съел $4.20 вместо $40. Десятикратная экономия на одной строчке Bash.

Я отдельно разбирал, как ставить лимиты Claude Code, после того как один знакомый агент за ночь сжёг $6500 в AWS - там и про hooks, и про permission-profiles, и про bash-обёртки. Скорми Клоду эту инструкцию - сам всё поднимет.

Паттерн 3: цикл из Agent SDK без контекстного контроля - $5 на один прогон

Третий паттерн я завёл два месяца назад из любопытства. Python-скрипт раз в полчаса парсит 100-150 RSS-источников по ИИ-новостям, фильтрует через Claude по правилу «релевантно теме / нет», ранжирует топ-10 и складывает в очередь Telegram-черновиков. Раньше я даже не замечал, что он работает.

Скрипт использует anthropic.AnthropicSDK (с 15 июня переименован в claude-agent-sdk) - и это, как ни странно, попадает в Agent SDK pool. Я думал, что прямой вызов API через подписку идёт в общий пул. Нет.

Считаю на Опусе 4.7 один цикл:

  • 150 источников × ~4500 input токенов × $5/M = $3.37 input
  • 150 ответов × ~250 output токенов × $25/M = $0.94 output
  • Промежуточный ranking-запрос: $0.5-1
  • Итого: ~$5 на один цикл

При запуске каждые 30 минут - это 48 циклов × $5 = $240/сутки. С 15 июня это означает, что скрипт мог сожрать кредит за пол-дня, и я бы не понял, куда оно делось, потому что он работает фоном.

Спасло то, что я успел остановить таск на втором дне после биллинг-чека, когда увидел расход на ~$15. Что сделал, чтобы скрипт продолжал работать:

  1. Переключил модель на Хайку 4.5. Фильтрация «релевантно / не релевантно» - задача, на которой хайку не отличишь от Опуса. Хайку - $0.80/$4 за миллион. Экономия в 6-7x по сумме токенов. С $5 на цикл стало ~$0.70.
  1. Включил prompt caching. System-prompt и инструкция фильтра - одинаковые для всех 150 вызовов. Через cache_control это считается один раз, не 150. Anthropic берёт за кэш 10% от обычной ставки на input. Минус ещё $0.30 с цикла.
  1. Перешёл на batch API. Фильтрация новостей не требует мгновенного ответа - отправляю 150 запросов одной пачкой и забираю результаты через 20 минут. Batch - 50% от обычной цены.

Итог: $5 на цикл → $0.20-0.30 на цикл. Месяц при расписании раз в час - $144-216 вместо $3600. Перевёл расписание на «раз в час» - 48 циклов в сутки превратились в 24, влез в $80/мес.

Урок: Agent SDK pool теперь зеркалит твои неаккуратные привычки в API-расходах. Раньше они растворялись в подписке - сейчас лежат на виду в биллинге.

Паттерн 4: третьесторонний клиент с Pro/Max - невидимый дренаж

Самый коварный из четырёх. У меня в Zed-редакторе настроен Claude Code как backend через мою Max 5x подписку. Это работало без моего участия: каждое автодополнение, каждое «спроси Claude про этот код», каждое подбадривание «допиши функцию» - всё шло через Agent SDK с моей авторизацией.

До 15 июня - невидимая часть подписки. После - пишет в кредит каждое нажатие Tab.

За 3 дня Zed съел у меня где-то $7 мелкими порциями по $0.03-0.15. Средний autocomplete-запрос - 2-3K input, 100-150 output, цена $0.015-0.025. За день я нажимаю Tab 200-400 раз. То есть $3-10 в сутки на одно фоновое автодополнение. Без моего сознательного действия.

Ровно так Cursor работает: 200 раз нажал Tab за день - потратил $3-5, и в обычном режиме ты этого не видишь, потому что у тебя «безлимитная» подписка. Cursor честно показал, во что выливаются эти 200 нажатий, отдельной плашкой в интерфейсе. Anthropic пока показывает только конечный счёт.

Что сделал:

  • Отключил автодополнение через Claude в Zed. Оставил локальную LSP-модель - она быстрее и не съедает кредит. Claude в Zed остался для команды «объясни этот код».
  • Conductor с фоновой активностью отключил полностью. Conductor - это «постоянный Claude рядом», слушает буфер и предлагает рефакторинги. Удобно, но дорого в новом мире.
  • На сторонние клиенты повесил отдельный API-ключ. Создал ключ на platform.claude.com, привязал к Zed и Conductor. Биллинг сторонних теперь по pay-as-you-go отдельной строкой - видно, кто сколько ест.

Базовый принцип после 15 июня: если ты не в курсе, что инструмент жрёт твою подписку - он будет жрать в новом пуле кредита, и это очень больно мелкими порциями.

5 правил, чтобы не повторить $100 за 3 дня

После четырёх паттернов я повесил себе в CLAUDE.md отдельную секцию - она ездит вместе с проектом, и Claude её сам видит при каждом запуске. Забирай и адаптируй:

## Бюджет Agent SDK после 15 июня 2026 1. Любой `claude -p` запускается с `--max-turns ≤ 5` и `--output-format stream-json`. Без потолка Claude уходит в дебри. Без stream-json нет данных для разбора. 2. Хайку (claude-haiku-4-5), не Опус для всего, что не требует архитектурного мышления: рефакторинг по паттерну, классификация, фильтрация, перевод, PR-review. Экономия 5-10x при сравнимом качестве. 3. Никаких GitHub Actions на каждый push. Триггер только `opened` / `ready_for_review`. Label `wip` блокирует прогоны. 4. Сторонние клиенты (Zed, Conductor, OpenClaw) - на отдельный API-ключ через platform.claude.com. Подписка только под мою терминальную работу руками. 5. `cache_control` на повторяющийся system-prompt в любом цикле от 50 вызовов. Anthropic берёт за кэш 10% от обычной ставки. Экономия 90% на input в цикле.

Скорми эту секцию своему Claude перед началом ночного прогона и попроси сверить план с правилами. У меня после этого Claude сам говорит «эта задача требует Опус» или «эту в хайку справлюсь за 1/10 цены». Как будто получил junior-аналитика, который защищает мой бюджет.

Российский подвох: overflow billing не включается через карту посредника

Эта часть для тех, кто в РФ.

Если ты купил подписку через Oplatym.ru, RBC, Easypay или другого посредника, overflow billing включить не получится. Anthropic для активации «usage credits» (доплаты сверх кредита по API-ставкам) требует ту же карту, что и для подписки. У посредника там виртуалка, к которой у тебя доступа нет. Значит, как только кредит кончился - автоматизация остановилась, и без US-доступной карты ничего не сделаешь.

Я попробовал два пути.

Путь первый - заявка в саппорт Anthropic с просьбой включить overflow на ту же карту, что подписка. Ответ за 2 дня: «We can only enable usage credits on a valid payment method registered to your account directly». Тупик.

Путь второй - отдельная подписка на Claude Platform через того же посредника. Это уже не Pro/Max, а отдельный сервис: API-ключ с pay-as-you-go. Посредник обычно умеет оплатить и эту подписку (Oplatym поддерживает). Дальше Agent SDK скрипты переключаешь на API-ключ, подписку Pro/Max оставляешь под интерактивную работу или отменяешь.

Реальные варианты:

  1. Отдельная подписка на Claude Platform через посредника. Гоняешь Agent SDK через API-ключ, подписку Pro/Max - только под терминал.
  2. Codex CLI вместо Agent SDK для автоматизации. ChatGPT Plus за $20 - там нет split, ночные прогоны идут в подписку как раньше. У многих ChatGPT уже оплачен, миграция занимает день.
  3. Жить в кредите. Знай свой $100 как потолок, выключи Action для feature-веток, поставь hard-cap в Agent SDK скриптах, используй хайку.

Подробнее - отдельный гайд как настроить Claude Code из России в 2026 без жертв подписке. Там готовые карты схем оплаты и что делать, если посредник перестал работать.

Что забрать с собой

После 3 дней палева главное:

  • Автоматизация перестала быть бесплатной. Если у тебя что-то ходит в Claude без твоего ведома, иди и считай прямо сейчас. По умолчанию ответ - больше, чем ты думаешь.
  • Хайку - новый базовый выбор для фоновых задач. Опус нужен реже, чем кажется. Все остальные задачи хайку тянет в 5-10 раз дешевле.
  • GitHub Actions нужно перестроить. Не на каждый push, только на готовый PR. В среднем 4-5x меньше прогонов с тем же качеством review.
  • Третьесторонние клиенты - на отдельный API-ключ. Подписка только под руки. Иначе ты не увидишь, кто сколько ест.
  • Хороший CLAUDE.md и контекст-инжиниринг. Когда Claude каждый прогон не перечитывает доки заново, кредит вытягивает 3-5x больше задач. Это базовая защита, которая работала и до 15 июня, просто теперь измеряется в деньгах напрямую, а не косвенно.

И визионерское. Следующий шаг Anthropic - это, скорее всего, посекундный биллинг с budget-alerts из коробки. Текущая «потратил кредит → встало без предупреждения» - переходная мера. Через 6-12 месяцев придёт «жмёшь Action на PR - видишь оценку в $0.50 заранее, можешь отказаться». Cursor так уже работает. Следующее поколение Claude Code будет про прозрачность счёта, а не про лимиты.

Финальный вопрос, на который хочу услышать ответы в комментариях: сколько вы реально жгли на Agent SDK за эти первые 3-4 дня, и какой паттерн съел больше всего? Если у меня $100 ушёл на 4 паттерна - у вас, скорее всего, найдётся пятый, которого я не учёл.

22