100% бесплатные API для 150+ ИИ-моделей, которые останутся бесплатными навсегда (ну наверное)

Не платите за нейросети.

100% бесплатные API для 150+ ИИ-моделей, которые останутся бесплатными навсегда (ну наверное)

Подключите готовые API к своим ботам, приложениям и ИИ-агентам.

Я собрал в одну таблицу: Google AI Studio, OpenRouter, Groq, OpenCode, NVIDIA, Mistral, GitHub Models и десятки других ИИ-сервисов с точными лимитами запросов.

Как пользоваться:

  1. Откройте таблицу с ИИ-провайдерами (или читайте статью ниже)
  2. Выберите сервис, зарегистрируйтесь и создайте API key
  3. Используй API key в своем коде, ИИ-агенте, телеграм-боте, n8n, Make, OpenCode или другом инструменте.

Проще всего начать с OpenRouter, Google AI Studio или Groq, там относительно понятный вход и много готовых моделей.

Так выглядит таблица с ИИ-провайдерами

На GitHub проект <a href="https://api.vc.ru/v2.8/redirect?to=https%3A%2F%2Fgithub.com%2Fcheahjs%2Ffree-llm-api-resources&postId=3041968" rel="nofollow noreferrer noopener" target="_blank">собрал </a>уже 27 тысяч звезд. Посмотреть, как хорошо модели вывозят задачи, можете на <a href="https://api.vc.ru/v2.8/redirect?to=https%3A%2F%2Fartificialanalysis.ai%2F&postId=3041968" rel="nofollow noreferrer noopener" target="_blank">Artificial Analysis</a>.
На GitHub проект собрал уже 27 тысяч звезд. Посмотреть, как хорошо модели вывозят задачи, можете на Artificial Analysis.

1. ИИ-провайдеры с бесплатным доступом

OpenRouter

Единая платформа с множеством ИИ-моделей от разных провайдеров. Удобно для тех, кто хочет легко переключаться между моделями без необходимости настраивать отдельное подключение к каждой компании.

  • Лимиты: 20 запросов в минуту и 50 запросов в день.
  • После пополнения счета минимум на 10 долларов за все время лимит может увеличиться до 1 000 запросов в день.
  • Все модели используют общую квоту.

Доступные модели

  • Hermes 3 Llama 3.1 405B
  • Llama 3.2 3B Instruct*
  • Llama 3.3 70B Instruct*
  • cognitivecomputations/dolphin-mistral-24b-venice-edition:free
  • cohere/north-mini-code:free
  • google/gemma-4-26b-a4b-it:free
  • google/gemma-4-31b-it:free
  • nvidia/nemotron-3-nano-30b-a3b:free
  • nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free
  • nvidia/nemotron-3-super-120b-a12b:free
  • nvidia/nemotron-3-ultra-550b-a55b:free
  • nvidia/nemotron-3.5-content-safety:free
  • nvidia/nemotron-nano-12b-v2-vl:free
  • nvidia/nemotron-nano-9b-v2:free
  • openai/gpt-oss-20b:free
  • poolside/laguna-m.1:free
  • poolside/laguna-xs-2.1:free
  • qwen/qwen3-coder:free
  • qwen/qwen3-next-80b-a3b-instruct:free
  • tencent/hy3:free

Google AI Studio

Google предлагает онлайн-сервис, где можно протестировать модель Gemini и получить API-ключ. Это удобно для тех, кто хочет сначала попробовать модель, а потом использовать ее в своем приложении.

Модели и лимиты

100% бесплатные API для 150+ ИИ-моделей, которые останутся бесплатными навсегда (ну наверное)

NVIDIA NIM

Список готовых моделей искусственного интеллекта от компании NVIDIA. Их можно использовать с помощью готовых инструментов или установить на свои компьютеры и сервера. Есть возможность попробовать некоторые модели бесплатно, даже если у вас нет своего сервера.

  • Контекстное окно моделей обычно ограничено.
  • Лимит: 40 запросов в минуту.

Доступные модели

Каталог моделей: https://build.nvidia.com/models

Mistral (La Plateforme)

Официальная платформа Mistral AI для доступа к моделям компании через API. Здесь можно получить ключ, проверить модель в Playground и подключить ее к приложению.

Лимиты для каждой модели: 1 запрос в секунду, 500 000 токенов в минуту и 1 000 000 000 токенов в месяц.

Доступные модели

Каталог моделей: https://docs.mistral.ai/models/overview

Mistral (Codestral)

Отдельный доступ к Codestral - модели Mistral для программирования. ИИ помогает писать, дополнять и разбирать код через API.

Лимиты: 30 запросов в минуту и 2 000 запросов в день.

Hugging Face Inference Providers

Единый интерфейс Hugging Face для запуска сотен моделей у разных вычислительных провайдеров. Одного токена Hugging Face достаточно, чтобы не подключать каждый сервис отдельно.

Каталог моделей: https://huggingface.co/models

  • Hugging Face Serverless Inference обычно доступен для моделей размером меньше 10 GB.
  • Некоторые популярные модели поддерживаются, даже если их размер превышает 10 GB.

Vercel AI Gateway

Шлюз между приложением и моделями разных компаний. Он упрощает переключение провайдеров, маршрутизацию запросов и контроль использования API.

Доступные модели: https://vercel.com/docs/ai-gateway

  • Шлюз направляет запросы к различным поддерживаемым провайдерам.
  • Бесплатный лимит: 5 долларов в месяц.

OpenCode Zen

ИИ-шлюз с отобранными моделями, рассчитанный прежде всего на инструменты для программирования. Его можно использовать из OpenCode и других совместимых клиентов.

  • ИИ-шлюз с отобранным набором моделей.
  • Данные бесплатных моделей могут использоваться для улучшения сервиса.

Доступные модели

  • Big Pickle Stealth
  • Nemotron 3 Super Free
  • DeepSeek V4 Flash Free

Cerebras

Облачный API для быстрого запуска языковых моделей на специализированных системах Cerebras. Подходит для задач, где особенно важна скорость генерации текста.

Модели и лимиты

100% бесплатные API для 150+ ИИ-моделей, которые останутся бесплатными навсегда (ну наверное)

Groq

Сервис быстрого запуска ИИ-моделей на специализированных процессорах Groq. Подходит для чатов, голосовых приложений и других задач, где важна низкая задержка.

Модели и лимиты

100% бесплатные API для 150+ ИИ-моделей, которые останутся бесплатными навсегда (ну наверное)

Cohere

Платформа с моделями для генерации текста, поиска по документам, embeddings и переранжирования результатов. Подходит для чат-ботов, RAG и корпоративного поиска.

  • Лимиты: 20 запросов в минуту и 1 000 запросов в месяц.
  • Все модели используют общую месячную квоту.

Доступные модели

  • c4ai-aya-expanse-32b
  • c4ai-aya-vision-32b
  • command-a-03-2025
  • command-a-plus-05-2026
  • command-a-reasoning-08-2025
  • command-a-translate-08-2025
  • command-a-vision-07-2025
  • command-r-08-2024
  • command-r-plus-08-2024
  • command-r7b-12-2024
  • command-r7b-arabic-02-2025

GitHub Models

Каталог моделей внутри GitHub, где их можно сравнивать в Playground и вызывать через API. Удобен для прототипов и разработчиков, которые уже работают с GitHub.

  • Лимиты входных и выходных токенов очень строгие.
  • Лимиты зависят от уровня подписки GitHub Copilot: Free, Pro, Pro+, Business или Enterprise.

Доступные модели

  • Codestral 25.01
  • Cohere Command A
  • DeepSeek-R1
  • DeepSeek-R1-0528
  • DeepSeek-V3-0324
  • Llama 4 Maverick 17B 128E Instruct FP8*
  • Llama 4 Scout 17B 16E Instruct*
  • Llama-3.2-11B-Vision-Instruct*
  • Llama-3.2-90B-Vision-Instruct*
  • Llama-3.3-70B-Instruct*
  • Meta-Llama-3.1-405B-Instruct*
  • Meta-Llama-3.1-8B-Instruct*
  • Ministral 3B
  • Mistral Medium 3 (25.05)
  • Mistral Small 3.1
  • OpenAI GPT-4.1
  • OpenAI GPT-4.1-mini
  • OpenAI GPT-4.1-nano
  • OpenAI GPT-4o
  • OpenAI GPT-4o mini
  • OpenAI Text Embedding 3 (large)
  • OpenAI Text Embedding 3 (small)
  • OpenAI gpt-5
  • OpenAI gpt-5-chat (preview)
  • OpenAI gpt-5-mini
  • OpenAI gpt-5-nano
  • OpenAI o1
  • OpenAI o1-mini
  • OpenAI o1-preview
  • OpenAI o3
  • OpenAI o3-mini
  • OpenAI o4-mini
  • Phi-4
  • Phi-4-mini-instruct
  • Phi-4-mini-reasoning
  • Phi-4-multimodal-instruct
  • Phi-4-reasoning

Cloudflare Workers AI

Сервис запуска ИИ-моделей в облачной сети Cloudflare. Подходит приложениям на Cloudflare Workers, которым нужен API без отдельного сервера с GPU.

  • Лимит: 10 000 neurons в день. Neurons - расчетная единица Cloudflare Workers AI.

Доступные модели

  • @cf/aisingapore/gemma-sea-lion-v4-27b-it
  • @cf/google/gemma-4-26b-a4b-it
  • @cf/ibm-granite/granite-4.0-h-micro
  • @cf/moonshotai/kimi-k2.6
  • @cf/moonshotai/kimi-k2.7-code
  • @cf/nvidia/nemotron-3-120b-a12b
  • @cf/openai/gpt-oss-120b
  • @cf/openai/gpt-oss-20b
  • @cf/qwen/qwen3-30b-a3b-fp8
  • @cf/zai-org/glm-4.7-flash
  • @cf/zai-org/glm-5.2
  • DeepSeek R1 Distill Qwen 32B
  • Gemma 2B Instruct (LoRA)
  • Gemma 7B Instruct (LoRA)
  • Llama 2 7B Chat (LoRA)*
  • Llama 3.1 8B Instruct (FP8)*
  • Llama 3.2 11B Vision Instruct*
  • Llama 3.2 1B Instruct*
  • Llama 3.2 3B Instruct*
  • Llama 3.3 70B Instruct (FP8)*
  • Llama 4 Scout Instruct*
  • Llama Guard 3 8B*
  • Mistral 7B Instruct v0.2 (LoRA)
  • Mistral Small 3.1 24B Instruct
  • Qwen 2.5 Coder 32B Instruct
  • Qwen QwQ 32B

2. Провайдеры с пробными кредитами

Fireworks

Облачная платформа для быстрого запуска и настройки открытых ИИ-моделей через API. Подходит для прототипов и рабочих приложений, которым важны скорость и выбор моделей.

Каталог моделей: https://fireworks.ai/models

Baseten

Платформа для развертывания ИИ-моделей как масштабируемых API. Идеальна для команд, желающих запустить готовую или собственную модель без необходимости управлять серверами.

Каталог моделей: https://www.baseten.co/library/

  • Пробные кредиты: 30 долларов.
  • Можно использовать любую поддерживаемую модель, оплата рассчитывается по времени вычислений.

Nebius

Облачный сервис для запуска открытых моделей через API на инфраструктуре с GPU. Позволяет тестировать и использовать модели без собственного оборудования.

Каталог моделей: https://tokenfactory.nebius.com/models

Novita

Облачная платформа с API для языковых, графических, видео- и других ИИ-моделей. Подходит, если в одном проекте нужны разные виды генерации.

Каталог моделей: https://novita.ai/models

AI21

Платформа разработчиков AI21 с доступом к семейству моделей Jamba через API. Подходит для текстовых приложений, обработки длинных документов и корпоративных задач.

Upstage

Платформа с моделями Solar и инструментами для работы с документами через API. Подходит для чат-ботов, извлечения данных и обработки деловых документов.

NLP Cloud

Сервис с готовыми API для языковых моделей и обработки текста. Подходит новичкам, которым нужны генерация, перевод, суммаризация или классификация без настройки своей инфраструктуры.

Alibaba Cloud Model Studio (International)

Международная платформа Alibaba Cloud для доступа к моделям Qwen и другим моделям через API. Подходит для разработки и тестирования ИИ-приложений в облаке Alibaba.

  • Пробные кредиты: 1 000 000 токенов для каждой модели.
  • Модели: различные открытые и проприетарные модели Qwen.

Modal

Облачная платформа, где Python-код и ИИ-модели запускаются на серверных GPU по запросу. Подходит разработчикам, которым нужна гибкая инфраструктура без постоянного сервера.

  • После регистрации предоставляется 5 долларов кредитов в месяц.
  • После добавления способа оплаты предоставляется 30 долларов кредитов в месяц.
  • Можно использовать любую поддерживаемую модель, оплата рассчитывается по времени вычислений.

Inference.net

Облачный API для запуска открытых ИИ-моделей на распределенной вычислительной инфраструктуре. Дает готовый доступ к моделям без самостоятельного развертывания.

  • Пробные кредиты: 1 доллар. Еще 25 долларов можно получить за ответ на опрос, присланный по электронной почте.
  • Модели: различные открытые модели.

Hyperbolic

Облачная платформа с API для открытых языковых моделей и арендой GPU. Подходит для тестирования моделей и запуска собственных ИИ-задач.

Модели

  • DeepSeek V3 0324
  • Llama 3.3 70B Instruct*
  • deepseek-ai/deepseek-r1-0528
  • qwen/qwen3-coder-480b-a35b-instruct

SambaNova Cloud

Облачный сервис быстрого доступа к крупным открытым моделям на системах SambaNova. Подходит для генерации текста, рассуждений и программирования через API.

  • Пробные кредиты: 5 долларов сроком на три месяца.

Модели

  • deepseek-v3.1
  • deepseek-v3.2
  • gemma-4-31b-it
  • gpt-oss-120b
  • meta-llama-3.3-70b-instruct*
  • minimax-m2.7

Scaleway Generative APIs

Европейский облачный API для языковых, embedding, речевых и мультимодальных моделей. Подходит тем, кому нужен готовый ИИ-сервис в инфраструктуре Scaleway.

  • Пробные кредиты: 1 000 000 бесплатных токенов.

Модели

  • BGE-Multilingual-Gemma2
  • Gemma 3 27B Instruct
  • Llama 3.3 70B Instruct*
  • Pixtral 12B (2409)
  • Whisper Large v3
  • devstral-2-123b-instruct-2512
  • gemma-4-26b-a4b-it
  • glm-5.2
  • gpt-oss-120b
  • holo2-30b-a3b
  • mistral-medium-3.5-128b
  • mistral-small-3.2-24b-instruct-2506
  • qwen3-235b-a22b-instruct-2507
  • qwen3-coder-30b-a3b-instruct
  • qwen3-embedding-8b
  • qwen3.5-397b-a17b
  • qwen3.6-35b-a3b
  • Voxtral-small-24b-2507

* принадлежит корпорации Meta, которая признана в РФ экстремистской

Другие мои подборки и гайды

Спасибо, что дочитали

Присоединяйтесь к 18 000+ подписчиков в телеграм-канале Бегин (или макс-канал), где я выкладываю ИИ-подборки каждую неделю.

3
2