Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Агент собран, тестовый прогон прошёл, дальше решается, на чём он поедет в продакшене. Выбор идёт не между позициями в рейтинге, а между четырьмя режимами доступа к модели: у каждого своя цена и своё условие входа. Мы собираем агентов под задачи заказчиков и упираемся в это на каждом проекте.

Ниже — четыре пути: что вы платите и что стоит между компанией и доступом. Цифры сверены по страницам вендоров 20–21 августа 2026 года.

TL;DR

  • Модель подключается четырьмя способами: подписка вендора, свой ключ API, единый ключ агрегатора, локальный запуск.
  • Условия входа не взаимозаменяемы: оплата не снимает страновое ограничение.
  • Прайс OpenAI на 20.08.2026 — от $0,20 до $5 за 1M входных токенов, кэш вдесятеро дешевле.
  • У агрегатора сверху ложится 5,5% при пополнении картой, минимум $0,80.
  • Локальный запуск бесплатен и страну не спрашивает, но упирается в железо.

Что вы выбираете, когда выбираете модель для агента

Выбор сводится к трём параметрам: класс задачи, режим доступа и условие входа. Позиция в рейтинге вторична.

ИИ-агент состоит из двух частей. Оболочка разбивает задачу на шаги и вызывает инструменты; модель на каждом шаге принимает решение. Оболочки вроде OpenClaw и Hermes открыты, бесплатны и страну не спрашивают. Платит и ограничивает вас модель.

Отсюда четыре режима доступа — подписка вендора, свой ключ API, единый ключ агрегатора и локальный запуск. Ниже каждый разобран отдельно.

Деталь, которую редко считают. Агент гоняет один и тот же системный контекст и историю шагов по кругу на каждой итерации, поэтому ставка за кэшированный вход весит для бюджета больше цены выходных токенов. Это расчёт по опубликованным ставкам, а не замер.

Выбирать по одной цене — задокументированно дорого. Ассистент Klarna на моделях OpenAI за первый месяц 2024 года взял 2,3 млн диалогов и около $40 млн заявленной экономии. К 2025–2026 годам глава компании признал: «стоимость была преобладающим фактором оценки», качество вышло ниже, людей вернули в поддержку.

Сначала класс задачи, потом режим доступа, и только потом конкретная модель.

Четыре способа подключить модель. Цены и правила сверены 20–21.08.2026.
Четыре способа подключить модель. Цены и правила сверены 20–21.08.2026.

Подписка вендора: за что платите фиксированную сумму?

Подписка даёт предсказуемый бюджет, но привязывает работу агента к живому аккаунту и правилам вендора.

Платёж фиксирован, лимиты описаны тарифом, счёта за токены нет. Так устроены агентные режимы внутри ChatGPT и Claude и сам Claude Code — агент в терминале, оплачиваемый подпиской.

Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Где подписка заканчивается: агент живёт по чужим лимитам. Как только вызов модели нужно встроить в свой сервис или запустить агента по расписанию, задача уходит на второй путь. Из потребительских условий Anthropic в деловой контур попадает одна формулировка — перепродажа услуг запрещена.

Когда это не подходит. Здесь теряются не деньги на балансе, а рабочий инструмент вместе с историей. Обращение 51583 в anthropics/claude-code: у платного подписчика Claude Code Max аккаунт выключен с формулировкой «This organization has been disabled» без предупреждения — после работы через корпоративный сетевой шлюз, обязательный по политике компании. Поддержка не помогла, обращение закрыто со статусом not planned.

Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Обращение 26825: подписчик Claude Pro около года, Тайвань — поддерживаемая страна, Claude Code не использовал, предупреждений не получал. Экран тот же, апелляция и почта поддержки ответа не дали.

Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Подписка отвечает за предсказуемость расхода, но не за устойчивость доступа.

Свой ключ API: во что обходится агент на токенах?

Оплата идёт по факту потребления: от $0,20 до $5 за 1M входных токенов по прайсу OpenAI от 20.08.2026.

Ставки для контекста менее 270K:

  • GPT-5.6 Sol — $5 за 1M входных токенов и $30 за 1M выходных, кэшированный вход $0,50;
  • GPT-5.6 Terra — $2 и $12, кэшированный вход $0,20;
  • GPT-5.6 Luna — $0,20 и $1,20, кэшированный вход $0,02.
Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Кэшированный вход у всех трёх моделей ровно в десять раз дешевле обычного: стабильный системный контекст экономит не проценты, а порядок. Разрыв по выходным токенам между старшей и младшей моделью — двадцатипятикратный: маршрутизация простых шагов на Luna, а сложных на Sol меняет счёт сильнее любой скидки.

Условие входа. России нет в списке поддерживаемых стран ни у OpenAI, ни у Anthropic, ни у Google Gemini API. Казахстан, Армения, Грузия и Турция есть у всех трёх. Формулировка OpenAI единственная прямая среди трёх:

«Accessing or offering access to our services outside of the countries and territories listed below may result in your account being blocked or suspended».

Страница описывает доступ к API, на ChatGPT её переносить нельзя. Источники — список поддерживаемых стран OpenAI и список Anthropic, сверены 20.08.2026.

Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Ограничение срабатывает ещё до оплаты: Claude API отдаёт 403 с российских адресов до проверки авторизации — наблюдение Евгения Игнатьева на Хабре от 18.07.2026, одинаковое у двух независимых российских провайдеров.

Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Свой ключ — самый управляемый по деньгам путь, но вопрос «чем платить» решается после вопроса «дойдёт ли запрос».

Единый ключ агрегатора: зачем платить комиссию сверху?

Агрегатор даёт один баланс на модели разных вендоров и берёт 5,5% при пополнении картой.

У OpenRouter это 5,5% при пополнении картой с минимумом $0,80 и 5% в USDC — сверх ставок самих моделей.

Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

За комиссию покупается право менять модель в агенте, не переписывая интеграцию и не заводя счёт у каждого вендора.

НУЖНО УТОЧНИТЬ: страновые условия и способы оплаты OpenRouter — не сверены.

Агрегатор — не способ сэкономить, а способ не привязываться к одному вендору.

Локальная модель: путь без чужих правил

Локальный запуск не спрашивает страну и не требует оплаты, но качество упирается в ваше железо.

Модель скачивается и работает на вашей машине, агент обращается к ней по локальному адресу: ни списка стран, ни платежа, ни риска отключения аккаунта снаружи. Ollama и LM Studio для локального запуска бесплатны, платится только облако: у Ollama это $20 в месяц или $200 в год за Pro и $100 в месяц за Max.

Какую модель подключить к ИИ-агенту в 2026 году: OpenAI, Claude, Gemini или локальная

Честная граница: модель, помещающаяся в доступную видеопамять, слабее топовой облачной, длинный контекст упирается в объём памяти, скорость — в GPU. Цикл, который в облаке проходит за минуту, локально может занять десять.

В условиях LM Studio списка стран нет — есть санкционная оговорка: сервисом нельзя пользоваться, находясь в стране под территориальными санкциями (сверено 24.08.2026). Выбор локальной модели и требования к железу — тема отдельного материала.

Локальный путь стоит держать запасным контуром даже при основной работе на облачной модели.

Что с Gemini, Perplexity и китайскими моделями?

У Google свой список стран и возрастное условие, у остальных провайдеров вопрос смещается на верификацию и оплату.

Google, Gemini API. России и Беларуси в списке доступных стран и территорий нет; страница предлагает вариант через Gemini Enterprise Agent Platform, отдельное условие — 18+ и подтверждённый возраст в аккаунте Google.

Perplexity. Подтверждаем только платёжное ограничение: российские карты сервис не принимает (21.08.2026).

Китайские модели — DeepSeek, Qwen, Kimi, GLM — устроены иначе: вопрос смещается со страны на верификацию личности и оплату, а у части моделей открыты веса. Тема отдельного разбора.

Условия входа здесь проверяют до того, как агент написан под формат ответа.

Как оплатить доступ к модели из России?

Механика простая: ссылка на страницу оплаты или реквизиты иностранной карты. Считаем в долларах — так, как напечатано в прайсе.

Российские карты зарубежные ИИ-сервисы не принимают. Вариантов два:

  • ссылка на страницу оплаты — переходите и оплачиваете тариф или пополнение;
  • реквизиты иностранной карты — получаете номер, срок и CVV и вводите их в форму сервиса как обычную карту.

Командный сценарий: рабочий баланс на $50. Напрямую у вендора это ровно $50 токенов. По прайсу от 20.08.2026 — 25 млн входных токенов Terra либо около 4,2 млн выходных; арифметика по ставкам, а не замер расхода вашего агента.

Тот же баланс через агрегатора. Чтобы на счёте оказалось $50, платите $52,75: комиссия платформы 5,5% при пополнении картой даёт надбавку $2,75, в USDC ставка 5% и надбавка $2,50. Это 1,4 млн входных токенов Terra — столько стоит право менять модель значением в настройке.

Где комиссия перестаёт быть процентом. Минимум $0,80 бьёт по мелким пополнениям: на $5 это 16% сверху, втрое дороже заявленной ставки. Перелом — около $14,55: ниже платите фиксированные $0,80, выше — честные 5,5%. Три пополнения по $5 дают $2,40 комиссии, одно на $15 — $0,83.

Правило для команды: у агрегатора выгоден редкий крупный платёж, у вендора напрямую размер пополнения на цену токена не влияет.

Один и тот же баланс напрямую и через агрегатора. Ставки сверены 20–21.08.2026.
Один и тот же баланс напрямую и через агрегатора. Ставки сверены 20–21.08.2026.

FAQ

Пять вопросов о выборе модели, стоимости доступа и рисках.

Какая модель лучше для ИИ-агента?

Универсального лидера нет: сравнивать нужно связки «класс задачи — режим доступа — цена». Для массовых однотипных шагов выигрывает младшая модель прайса, для сложных решений — старшая, и в одном агенте они уживаются. Подборки лучших агентов отвечают на другой вопрос — про оболочку.

Можно ли собрать агента прямо в ChatGPT или Claude?

Да, оба сервиса позволяют собрать агента внутри своего интерфейса на подписке, без единой строки кода. Ограничение в том, что такой агент живёт по чужим лимитам: встроить его в собственный сервис или запустить по расписанию не выйдет — для этого нужен свой ключ API.

Нужна ли агенту мультимодальная модель?

Только если на вход реально идут не тексты: сканы, скриншоты, фотографии, аудио. Мультимодальность расширяет типы входных данных, а не качество рассуждений. Для агента, который ходит по API и работает с текстом, это лишняя статья расходов.

Что дешевле для команды — подписка или свой ключ API?

Подписка выигрывает при ровной ежедневной нагрузке на одного-двух человек: платёж известен заранее. Свой ключ выигрывает в автоматизации, где агент работает пачками. Gartner прогнозирует, что свыше 40% проектов агентного ИИ будут отменены до конца 2027 года, среди причин — рост затрат (пресс-релиз 25.06.2025).

Можно ли подключить к одному агенту несколько моделей?

Да, для агентов это скорее норма: дешёвая модель на разбор и маршрутизацию, дорогая — на финальное решение. Решается единым ключом агрегатора либо конфигурацией, где провайдер меняется значением в настройке, а не переписыванием кода. Протоколы вроде MCP и внешняя база знаний от выбора модели не зависят.

Что делать дальше

План из четырёх шагов вместо перебора наугад.

Шаг 1. Определите класс задачи. Массовые однотипные шаги и сложные решения — разные модели прайса, они сочетаются в одном агенте.

Шаг 2. Выберите режим доступа. Ровная нагрузка на пару человек — подписка, автоматизация — свой ключ, сравнение вендоров — агрегатор, независимость от чужих правил — локальный запуск.

Шаг 3. Проверьте условие входа именно для этого режима — список стран, комиссия и порог пополнения либо требования к железу.

Шаг 4. Оплатите. Баланс на $50 напрямую у вендора — это 25 млн входных токенов Terra; тот же баланс через агрегатора стоит $52,75.