Две бесплатные LLM для AI-агентов, проверенные руками (2026)

В интернете много списков «бесплатных LLM для разработки», но на проверку большинство оказывается нерабочими: где-то лимиты 5 запросов в день, где-то модель отваливается через час, где-то бесплатные LLM давно убрали.

Я собрал рабочий агентский стек за 0 рублей и протестировал десятки моделей руками. Здесь — две, которые реально тянут задачи. Подробно про архитектуру, настройку и подводные камни — в большой статье про бесплатный агентский стек.

1. DeepSeek V4 Pro через NVIDIA NIM (основной выбор)

Что это: флагманская модель DeepSeek — самая мощная из бесплатных на сегодня. Доступна через NVIDIA Build API.

Доступ: регистрация на build.nvidia.com, верификация по номеру телефона. Российского, белорусского и казахстанского номеров в списке нет. Сначала попробовал оформить на одноразовый бесплатный номер для СМС из интернета — после двух попыток забанили на сутки. Через какое-то время в списке появился Кипр, оформил через свою кипрскию сим — всё заработало.

Лимит: 40 запросов в минуту.

Что тянет:

  • Сложный многоступенчатый reasoning
  • Написание и отладку кода
  • Длинные контексты и стратегические задачи
  • Работает стабильно при соблюдении лимита

2. Tencent Hy3 (запасной вариант)

Что это: 295B-параметровая MoE-модель от Tencent, специально заточенная под агентские задачи. Топ-1 в рейтинге OpenRouter по использованию. И нет никаких лимитов!

Доступ — два пути:

  • Через OpenRouter (tencent/hy3:free) — работает с любым OpenAI-совместимым клиентом.
  • Через Nous Portal (внутренний агрегатор Hermes) — только внутри Hermes Agent, без СМС-верификаций

OpenRouter и Nous Portal не работает с российскими IP, надо сменить.

Что тянет:

  • Агентские задачи (планирование, браузерная автоматизация)
  • Написание кода средней сложности
  • Работает как backup, когда DeepSeek упал с 429-ошибкой

Что не тянет: сложные многоступенчатые задачи с длинным контекстом — здесь DeepSeek значительно сильнее. В общем, модель меня удивила в хорошую сторону. Подробности в основной статье.

Как обыграть лимит 40 RPM для DeepSeek

  1. Rate limiter в коде: обязательная пауза 1.5с между запросами + сброс счётчика раз в минуту
  2. Batch-обработка: группируй задачи по 5-8 штук, пауза 15с между батчами
  3. Fallback на Hy3: если DeepSeek вернул 429, переключаешься на Hy3
  4. Кэширование результатов: повторяющиеся запросы берёшь из локального кэша
  5. Ночные прогоны: массовые задачи запускаешь в 3-4 утра, когда нагрузка минимальна

Итог:

DeepSeek V4 Pro — для основных задач, Hy3 — как страховка или как основная если нет возможности получить СМС от Nvidia. Оба бесплатны, оба работают в России, но нужны танцы с бубном.

Добавляй список в закладки. А если не боишься много букв - читай основную статью.

2