Две бесплатные LLM для AI-агентов, проверенные руками (2026)
В интернете много списков «бесплатных LLM для разработки», но на проверку большинство оказывается нерабочими: где-то лимиты 5 запросов в день, где-то модель отваливается через час, где-то бесплатные LLM давно убрали.
Я собрал рабочий агентский стек за 0 рублей и протестировал десятки моделей руками. Здесь — две, которые реально тянут задачи. Подробно про архитектуру, настройку и подводные камни — в большой статье про бесплатный агентский стек.
1. DeepSeek V4 Pro через NVIDIA NIM (основной выбор)
Что это: флагманская модель DeepSeek — самая мощная из бесплатных на сегодня. Доступна через NVIDIA Build API.
Доступ: регистрация на build.nvidia.com, верификация по номеру телефона. Российского, белорусского и казахстанского номеров в списке нет. Сначала попробовал оформить на одноразовый бесплатный номер для СМС из интернета — после двух попыток забанили на сутки. Через какое-то время в списке появился Кипр, оформил через свою кипрскию сим — всё заработало.
Лимит: 40 запросов в минуту.
Что тянет:
- Сложный многоступенчатый reasoning
- Написание и отладку кода
- Длинные контексты и стратегические задачи
- Работает стабильно при соблюдении лимита
2. Tencent Hy3 (запасной вариант)
Что это: 295B-параметровая MoE-модель от Tencent, специально заточенная под агентские задачи. Топ-1 в рейтинге OpenRouter по использованию. И нет никаких лимитов!
Доступ — два пути:
- Через OpenRouter (tencent/hy3:free) — работает с любым OpenAI-совместимым клиентом.
- Через Nous Portal (внутренний агрегатор Hermes) — только внутри Hermes Agent, без СМС-верификаций
OpenRouter и Nous Portal не работает с российскими IP, надо сменить.
Что тянет:
- Агентские задачи (планирование, браузерная автоматизация)
- Написание кода средней сложности
- Работает как backup, когда DeepSeek упал с 429-ошибкой
Что не тянет: сложные многоступенчатые задачи с длинным контекстом — здесь DeepSeek значительно сильнее. В общем, модель меня удивила в хорошую сторону. Подробности в основной статье.
Как обыграть лимит 40 RPM для DeepSeek
- Rate limiter в коде: обязательная пауза 1.5с между запросами + сброс счётчика раз в минуту
- Batch-обработка: группируй задачи по 5-8 штук, пауза 15с между батчами
- Fallback на Hy3: если DeepSeek вернул 429, переключаешься на Hy3
- Кэширование результатов: повторяющиеся запросы берёшь из локального кэша
- Ночные прогоны: массовые задачи запускаешь в 3-4 утра, когда нагрузка минимальна
Итог:
DeepSeek V4 Pro — для основных задач, Hy3 — как страховка или как основная если нет возможности получить СМС от Nvidia. Оба бесплатны, оба работают в России, но нужны танцы с бубном.
Добавляй список в закладки. А если не боишься много букв - читай основную статью.