Отправляли всё в топовую модель Claude по умолчанию: пересчитал бюджет и треть задач перевёл на модель подешевле

Отправляли всё в топовую модель Claude по умолчанию: пересчитал бюджет и треть задач перевёл на модель подешевле

С начала года любая текстовая задача в отделе маркетинга по умолчанию уходила в топовую модель Claude, Opus 5. Разбор Ramp о потолке цены на топовые модели вышел 23 августа, но разводить задачи по цене мы начали чуть раньше, во второй неделе месяца. Считаю, что перевели на модель подешевле, а что вернули обратно.

За август отдел завёл в трекер 92 задачи с участием нейросети. У 61 из них не было объективной причины идти именно в дорогую модель: расшифровка интервью, классификация отзывов, варианты заголовков для рассылок, разбор сводных таблиц по медиапланам.

Привычку отправлять всё в одну модель завёл я сам. Год назад казалось разумным не усложнять процесс выбором модели под задачу, пусть команда просто открывает один и тот же чат. Разбор Ramp напомнил, что за эту простоту мы платим отдельной строкой.

Дальше по этапам: что нашли аналитики рынка, что показал наш собственный трекер, и куда в итоге легли 92 задачи.

Считаю по порядку.

Что нашла Ramp: топ-модель Anthropic перестала расти в деньгах

23 августа 2026 года платёжный сервис Ramp опубликовал разбор по данным 70 000 американских компаний. Через два месяца после запуска топовая модель Anthropic, Fable 5, держит около 11,4% денежных трат клиентов на продукты Anthropic и только 6% токенов.

Разница в долях объясняет всё остальное. Fable 5 стоит порядка 10 долларов за миллион токенов, это примерно вдвое дороже топовой модели OpenAI, GPT-5.6 Sol. В июле Fable 5 принесла Anthropic только 75% от выручки, которую за тот же месяц собрала топовая модель конкурента.

С Fable 5 мы нашли новый потолок того, сколько бизнес готов платить за ИИ.

Ара Харазян, ведущий экономист Ramp

Топовую модель Anthropic обошла собственная модель подешевле. Claude Opus 5 вышла в конце июля по более низкой цене и уже забрала часть корпоративных трат у Fable 5, сообщил Ramp изданию Financial Times. При этом по общему числу подключивших хоть один продукт компаний Anthropic всё ещё впереди OpenAI, 43,5% против 39,7% в июле.

Большинству компаний не нужно работать на переднем крае.

Майлз Клементс, партнёр Accel

Дальше про наш собственный счёт.

Что я поднял у себя: 92 задачи и один и тот же дорогой маршрут

Стратегия и сложный ресёрч. Позиционирование квартальной кампании, разбор конкурентной выдачи, вычитка договора с новым подрядчиком, 14 задач за август.

Рутина. Первое, расшифровка 9 интервью с клиентами и классификация около 300 собранных отзывов. Второе, анализ видимости бренда в 9 нейросетях через сервис brandfound, тариф от 1900 рублей. Третье, отбор лучших заголовков для рассылок, свыше 40 вариантов, и разбор сводных таблиц по медиапланам. Всего 61 задача. Ещё 17 задач легли где-то посередине, их не считаю ни в одну из групп.

До второй недели августа все 92 задачи шли по одному маршруту, через Opus 5, по привычке, которая тянется с начала года. Если бы август целиком прошёл по старому маршруту, при среднем расходе прошлых месяцев на сопоставимом объёме счёт вышел бы в районе 60 000-65 000 рублей.

Вот здесь и вылезла экономия. Но не вся она оказалась настоящей.

Где дешёвая модель не окупилась: классификация отзывов вернулась обратно

Перевёл рутину на Claude Haiku 4.5 со второй недели августа. Расшифровки интервью и варианты заголовков прошли без потерь, человек правил примерно столько же, сколько и раньше, в районе 10-15% выдачи. С классификацией отзывов вышло иначе.

На Opus 5 доля меток, которые модератор возвращал на переразметку, держалась около 9%. На Haiku 4.5 за первые две недели она выросла до 20-25%. Отзывы с двойным смыслом, где клиент хвалит продукт и ругает доставку в одном предложении, дешёвая модель размечала грубее.

Через две недели классификацию негативных и смешанных отзывов вернул на Opus 5. Разница в цене на этом узком участке, около 8 рублей на сотню отзывов, не окупала лишние часы модератора на переразметку.

Где сломалось. Дешёвая модель экономит на объёме, но не на смысловых оттенках. Чем выше цена ошибки одного объекта, тем меньше смысла экономить на модели для его разметки.

Сведу два счёта.

Закладывал экономию в районе 15%, получилось около трети, и то не сразу.

Цена вопроса. Opus 5 для стратегии, ресёрча и разметки чувствительных отзывов, 34 100 рублей за август. Haiku 4.5 для расшифровок, заголовков и разбора таблиц, 8 700 рублей. Итого 42 800 рублей против 60 000-65 000 по старому маршруту при том же объёме задач, экономия от 17 000 до 22 000 рублей, около трети счёта.

Разница не только в экономии. На перенастройку маршрутов, тестовую неделю с классификацией и разбор, куда вернуть отзывы, ушло около шести часов моего времени и ещё четыре часа модератора. В деньгах это не считал, но в следующий раз заложу такую неделю заранее.

Что поменяли в процессе

Завели в брифе поле «модель по умолчанию», его заполняет постановщик задачи, а не исполнитель. Три категории. Стратегия и репутационные риски, всегда Opus 5. Расшифровки, заголовки, таблицы, всегда Haiku 4.5. Классификация отзывов и обращений, тоже Opus 5, отдельным пунктом, потому что цена ошибки здесь выше цены токена.

Смотрели ещё GPT-5.6 Sol для черновиков заголовков, у OpenAI цена ниже, чем у Opus 5. Отказались после согласования с безопасностью: данные о кампаниях клиентов не должны уходить второму поставщику без отдельного договора.

Проверка раз в месяц простая. Открываю трекер и смотрю долю задач, которые ушли не в ту модель по привычке, а не по брифу. В августе таких было 12 из 92, к концу сентября хочу видеть меньше пяти.

Что забираю в работу

Подтвердилось то, с чего начал: топовая модель нужна не для каждой строки в трекере, и экономия на рутине настоящая, а не бумажная. Не подтвердилось то, что маршрутизацию можно один раз настроить и забыть: классификация отзывов показала, что дешёвая модель экономит ровно там, где цена ошибки низкая, и обратный перенос тоже стоит времени.

  • Завести в брифе поле «модель по умолчанию» с готовыми категориями задач.
  • Проверять раз в месяц, сколько задач ушло не в ту модель по привычке.
  • Считать экономию вместе со временем на перенастройку, а не только цену токена.

Для отдела это не повод резать подписку на топовую модель. Это повод завести под маршрутизацию отдельную строку в отчёте и раз в месяц проверять, не уехали ли задачи обратно в дорогую модель по привычке. Посчитать это сейчас дешевле, чем через квартал объяснять генеральному, откуда взялась разница в 20 000 рублей.

Что у вас в отделе уже разъехалось по моделям: дорогая для стратегии и дешёвая для рутины, или всё ещё один тариф на всё?

Если расчёт пригодился, поставьте плюс. Так его увидят те, кто сейчас как раз сводит похожий счёт.

Пишу здесь про то, как отдел маркетинга работает с нейросетями: процессы, бюджеты, найм. Подписывайтесь, если это ваша повестка.

22