Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная
Агент собран, тестовый прогон прошёл, дальше решается, на чём он поедет в продакшене. Выбор идёт не между позициями в рейтинге, а между четырьмя режимами доступа к модели: у каждого своя цена и своё условие входа. Мы собираем агентов под задачи заказчиков и упираемся в это на каждом проекте.
Ниже — четыре пути: что вы платите и что стоит между компанией и доступом. Цифры сверены по страницам вендоров 20–21 августа 2026 года.
TL;DR
- Модель подключается четырьмя способами: подписка вендора, свой ключ API, единый ключ агрегатора, локальный запуск.
- Условия входа не взаимозаменяемы: оплата не снимает страновое ограничение.
- Прайс OpenAI на 20.08.2026 — от $0,20 до $5 за 1M входных токенов, кэш вдесятеро дешевле.
- У агрегатора сверху ложится 5,5% при пополнении картой, минимум $0,80.
- Локальный запуск бесплатен и страну не спрашивает, но упирается в железо.
Что вы выбираете, когда выбираете модель для агента
Выбор сводится к трём параметрам: класс задачи, режим доступа и условие входа. Позиция в рейтинге вторична.
ИИ-агент состоит из двух частей. Оболочка разбивает задачу на шаги и вызывает инструменты; модель на каждом шаге принимает решение. Оболочки вроде OpenClaw и Hermes открыты, бесплатны и страну не спрашивают. Платит и ограничивает вас модель.
Отсюда четыре режима доступа — подписка вендора, свой ключ API, единый ключ агрегатора и локальный запуск. Ниже каждый разобран отдельно.
Деталь, которую редко считают. Агент гоняет один и тот же системный контекст и историю шагов по кругу на каждой итерации, поэтому ставка за кэшированный вход весит для бюджета больше цены выходных токенов. Это расчёт по опубликованным ставкам, а не замер.
Выбирать по одной цене — задокументированно дорого. Ассистент Klarna на моделях OpenAI за первый месяц 2024 года взял 2,3 млн диалогов и около $40 млн заявленной экономии. К 2025–2026 годам глава компании признал: «стоимость была преобладающим фактором оценки», качество вышло ниже, людей вернули в поддержку.
Сначала класс задачи, потом режим доступа, и только потом конкретная модель.
Подписка вендора: за что платите фиксированную сумму?
Подписка даёт предсказуемый бюджет, но привязывает работу агента к живому аккаунту и правилам вендора.
Платёж фиксирован, лимиты описаны тарифом, счёта за токены нет. Так устроены агентные режимы внутри ChatGPT и Claude и сам Claude Code — агент в терминале, оплачиваемый подпиской.
Где подписка заканчивается: агент живёт по чужим лимитам. Как только вызов модели нужно встроить в свой сервис или запустить агента по расписанию, задача уходит на второй путь. Из потребительских условий Anthropic в деловой контур попадает одна формулировка — перепродажа услуг запрещена.
Когда это не подходит. Здесь теряются не деньги на балансе, а рабочий инструмент вместе с историей. Обращение 51583 в anthropics/claude-code: у платного подписчика Claude Code Max аккаунт выключен с формулировкой «This organization has been disabled» без предупреждения — после работы через корпоративный сетевой шлюз, обязательный по политике компании. Поддержка не помогла, обращение закрыто со статусом not planned.
Обращение 26825: подписчик Claude Pro около года, Тайвань — поддерживаемая страна, Claude Code не использовал, предупреждений не получал. Экран тот же, апелляция и почта поддержки ответа не дали.
Подписка отвечает за предсказуемость расхода, но не за устойчивость доступа.
Свой ключ API: во что обходится агент на токенах?
Оплата идёт по факту потребления: от $0,20 до $5 за 1M входных токенов по прайсу OpenAI от 20.08.2026.
Ставки для контекста менее 270K:
- GPT-5.6 Sol — $5 за 1M входных токенов и $30 за 1M выходных, кэшированный вход $0,50;
- GPT-5.6 Terra — $2 и $12, кэшированный вход $0,20;
- GPT-5.6 Luna — $0,20 и $1,20, кэшированный вход $0,02.
Кэшированный вход у всех трёх моделей ровно в десять раз дешевле обычного: стабильный системный контекст экономит не проценты, а порядок. Разрыв по выходным токенам между старшей и младшей моделью — двадцатипятикратный: маршрутизация простых шагов на Luna, а сложных на Sol меняет счёт сильнее любой скидки.
Условие входа. России нет в списке поддерживаемых стран ни у OpenAI, ни у Anthropic, ни у Google Gemini API. Казахстан, Армения, Грузия и Турция есть у всех трёх. Формулировка OpenAI единственная прямая среди трёх:
«Accessing or offering access to our services outside of the countries and territories listed below may result in your account being blocked or suspended».
Страница описывает доступ к API, на ChatGPT её переносить нельзя. Источники — список поддерживаемых стран OpenAI и список Anthropic, сверены 20.08.2026.
Ограничение срабатывает ещё до оплаты: Claude API отдаёт 403 с российских адресов до проверки авторизации — наблюдение Евгения Игнатьева на Хабре от 18.07.2026, одинаковое у двух независимых российских провайдеров.
Свой ключ — самый управляемый по деньгам путь, но вопрос «чем платить» решается после вопроса «дойдёт ли запрос».
Единый ключ агрегатора: зачем платить комиссию сверху?
Агрегатор даёт один баланс на модели разных вендоров и берёт 5,5% при пополнении картой.
У OpenRouter это 5,5% при пополнении картой с минимумом $0,80 и 5% в USDC — сверх ставок самих моделей.
За комиссию покупается право менять модель в агенте, не переписывая интеграцию и не заводя счёт у каждого вендора.
НУЖНО УТОЧНИТЬ: страновые условия и способы оплаты OpenRouter — не сверены.
Агрегатор — не способ сэкономить, а способ не привязываться к одному вендору.
Локальная модель: путь без чужих правил
Локальный запуск не спрашивает страну и не требует оплаты, но качество упирается в ваше железо.
Модель скачивается и работает на вашей машине, агент обращается к ней по локальному адресу: ни списка стран, ни платежа, ни риска отключения аккаунта снаружи. Ollama и LM Studio для локального запуска бесплатны, платится только облако: у Ollama это $20 в месяц или $200 в год за Pro и $100 в месяц за Max.
Честная граница: модель, помещающаяся в доступную видеопамять, слабее топовой облачной, длинный контекст упирается в объём памяти, скорость — в GPU. Цикл, который в облаке проходит за минуту, локально может занять десять.
В условиях LM Studio списка стран нет — есть санкционная оговорка: сервисом нельзя пользоваться, находясь в стране под территориальными санкциями (сверено 24.08.2026). Выбор локальной модели и требования к железу — тема отдельного материала.
Локальный путь стоит держать запасным контуром даже при основной работе на облачной модели.
Что с Gemini, Perplexity и китайскими моделями?
У Google свой список стран и возрастное условие, у остальных провайдеров вопрос смещается на верификацию и оплату.
Google, Gemini API. России и Беларуси в списке доступных стран и территорий нет; страница предлагает вариант через Gemini Enterprise Agent Platform, отдельное условие — 18+ и подтверждённый возраст в аккаунте Google.
Perplexity. Подтверждаем только платёжное ограничение: российские карты сервис не принимает (21.08.2026).
Китайские модели — DeepSeek, Qwen, Kimi, GLM — устроены иначе: вопрос смещается со страны на верификацию личности и оплату, а у части моделей открыты веса. Тема отдельного разбора.
Условия входа здесь проверяют до того, как агент написан под формат ответа.
Как оплатить доступ к модели из России?
Механика простая: ссылка на страницу оплаты или реквизиты иностранной карты. Считаем в долларах — так, как напечатано в прайсе.
Российские карты зарубежные ИИ-сервисы не принимают. Вариантов два:
- ссылка на страницу оплаты — переходите и оплачиваете тариф или пополнение;
- реквизиты иностранной карты — получаете номер, срок и CVV и вводите их в форму сервиса как обычную карту.
Командный сценарий: рабочий баланс на $50. Напрямую у вендора это ровно $50 токенов. По прайсу от 20.08.2026 — 25 млн входных токенов Terra либо около 4,2 млн выходных; арифметика по ставкам, а не замер расхода вашего агента.
Тот же баланс через агрегатора. Чтобы на счёте оказалось $50, платите $52,75: комиссия платформы 5,5% при пополнении картой даёт надбавку $2,75, в USDC ставка 5% и надбавка $2,50. Это 1,4 млн входных токенов Terra — столько стоит право менять модель значением в настройке.
Где комиссия перестаёт быть процентом. Минимум $0,80 бьёт по мелким пополнениям: на $5 это 16% сверху, втрое дороже заявленной ставки. Перелом — около $14,55: ниже платите фиксированные $0,80, выше — честные 5,5%. Три пополнения по $5 дают $2,40 комиссии, одно на $15 — $0,83.
Правило для команды: у агрегатора выгоден редкий крупный платёж, у вендора напрямую размер пополнения на цену токена не влияет.
FAQ
Пять вопросов о выборе модели, стоимости доступа и рисках.
Какая модель лучше для ИИ-агента?
Универсального лидера нет: сравнивать нужно связки «класс задачи — режим доступа — цена». Для массовых однотипных шагов выигрывает младшая модель прайса, для сложных решений — старшая, и в одном агенте они уживаются. Подборки лучших агентов отвечают на другой вопрос — про оболочку.
Можно ли собрать агента прямо в ChatGPT или Claude?
Да, оба сервиса позволяют собрать агента внутри своего интерфейса на подписке, без единой строки кода. Ограничение в том, что такой агент живёт по чужим лимитам: встроить его в собственный сервис или запустить по расписанию не выйдет — для этого нужен свой ключ API.
Нужна ли агенту мультимодальная модель?
Только если на вход реально идут не тексты: сканы, скриншоты, фотографии, аудио. Мультимодальность расширяет типы входных данных, а не качество рассуждений. Для агента, который ходит по API и работает с текстом, это лишняя статья расходов.
Что дешевле для команды — подписка или свой ключ API?
Подписка выигрывает при ровной ежедневной нагрузке на одного-двух человек: платёж известен заранее. Свой ключ выигрывает в автоматизации, где агент работает пачками. Gartner прогнозирует, что свыше 40% проектов агентного ИИ будут отменены до конца 2027 года, среди причин — рост затрат (пресс-релиз 25.06.2025).
Можно ли подключить к одному агенту несколько моделей?
Да, для агентов это скорее норма: дешёвая модель на разбор и маршрутизацию, дорогая — на финальное решение. Решается единым ключом агрегатора либо конфигурацией, где провайдер меняется значением в настройке, а не переписыванием кода. Протоколы вроде MCP и внешняя база знаний от выбора модели не зависят.
Что делать дальше
План из четырёх шагов вместо перебора наугад.
Шаг 1. Определите класс задачи. Массовые однотипные шаги и сложные решения — разные модели прайса, они сочетаются в одном агенте.
Шаг 2. Выберите режим доступа. Ровная нагрузка на пару человек — подписка, автоматизация — свой ключ, сравнение вендоров — агрегатор, независимость от чужих правил — локальный запуск.
Шаг 3. Проверьте условие входа именно для этого режима — список стран, комиссия и порог пополнения либо требования к железу.
Шаг 4. Оплатите. Баланс на $50 напрямую у вендора — это 25 млн входных токенов Terra; тот же баланс через агрегатора стоит $52,75.