100% бесплатные API для 150+ ИИ-моделей, которые останутся бесплатными навсегда (ну наверное)
Не платите за нейросети.
Подключите готовые API к своим ботам, приложениям и ИИ-агентам.
Я собрал в одну таблицу: Google AI Studio, OpenRouter, Groq, OpenCode, NVIDIA, Mistral, GitHub Models и десятки других ИИ-сервисов с точными лимитами запросов.
Как пользоваться:
- Откройте таблицу с ИИ-провайдерами (или читайте статью ниже)
- Выберите сервис, зарегистрируйтесь и создайте API key
- Используй API key в своем коде, ИИ-агенте, телеграм-боте, n8n, Make, OpenCode или другом инструменте.
Проще всего начать с OpenRouter, Google AI Studio или Groq, там относительно понятный вход и много готовых моделей.
Так выглядит таблица с ИИ-провайдерами
1. ИИ-провайдеры с бесплатным доступом
OpenRouter
Единая платформа с множеством ИИ-моделей от разных провайдеров. Удобно для тех, кто хочет легко переключаться между моделями без необходимости настраивать отдельное подключение к каждой компании.
Сайт: https://openrouter.ai/
- Лимиты: 20 запросов в минуту и 50 запросов в день.
- После пополнения счета минимум на 10 долларов за все время лимит может увеличиться до 1 000 запросов в день.
- Все модели используют общую квоту.
Доступные модели
- Hermes 3 Llama 3.1 405B
- Llama 3.2 3B Instruct*
- Llama 3.3 70B Instruct*
- cognitivecomputations/dolphin-mistral-24b-venice-edition:free
- cohere/north-mini-code:free
- google/gemma-4-26b-a4b-it:free
- google/gemma-4-31b-it:free
- nvidia/nemotron-3-nano-30b-a3b:free
- nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free
- nvidia/nemotron-3-super-120b-a12b:free
- nvidia/nemotron-3-ultra-550b-a55b:free
- nvidia/nemotron-3.5-content-safety:free
- nvidia/nemotron-nano-12b-v2-vl:free
- nvidia/nemotron-nano-9b-v2:free
- openai/gpt-oss-20b:free
- poolside/laguna-m.1:free
- poolside/laguna-xs-2.1:free
- qwen/qwen3-coder:free
- qwen/qwen3-next-80b-a3b-instruct:free
- tencent/hy3:free
Google AI Studio
Google предлагает онлайн-сервис, где можно протестировать модель Gemini и получить API-ключ. Это удобно для тех, кто хочет сначала попробовать модель, а потом использовать ее в своем приложении.
Модели и лимиты
NVIDIA NIM
Список готовых моделей искусственного интеллекта от компании NVIDIA. Их можно использовать с помощью готовых инструментов или установить на свои компьютеры и сервера. Есть возможность попробовать некоторые модели бесплатно, даже если у вас нет своего сервера.
- Контекстное окно моделей обычно ограничено.
- Лимит: 40 запросов в минуту.
Доступные модели
Каталог моделей: https://build.nvidia.com/models
Mistral (La Plateforme)
Официальная платформа Mistral AI для доступа к моделям компании через API. Здесь можно получить ключ, проверить модель в Playground и подключить ее к приложению.
Лимиты для каждой модели: 1 запрос в секунду, 500 000 токенов в минуту и 1 000 000 000 токенов в месяц.
Доступные модели
Каталог моделей: https://docs.mistral.ai/models/overview
Mistral (Codestral)
Отдельный доступ к Codestral - модели Mistral для программирования. ИИ помогает писать, дополнять и разбирать код через API.
Лимиты: 30 запросов в минуту и 2 000 запросов в день.
Hugging Face Inference Providers
Единый интерфейс Hugging Face для запуска сотен моделей у разных вычислительных провайдеров. Одного токена Hugging Face достаточно, чтобы не подключать каждый сервис отдельно.
Каталог моделей: https://huggingface.co/models
- Hugging Face Serverless Inference обычно доступен для моделей размером меньше 10 GB.
- Некоторые популярные модели поддерживаются, даже если их размер превышает 10 GB.
Vercel AI Gateway
Шлюз между приложением и моделями разных компаний. Он упрощает переключение провайдеров, маршрутизацию запросов и контроль использования API.
Доступные модели: https://vercel.com/docs/ai-gateway
- Шлюз направляет запросы к различным поддерживаемым провайдерам.
- Бесплатный лимит: 5 долларов в месяц.
OpenCode Zen
ИИ-шлюз с отобранными моделями, рассчитанный прежде всего на инструменты для программирования. Его можно использовать из OpenCode и других совместимых клиентов.
- ИИ-шлюз с отобранным набором моделей.
- Данные бесплатных моделей могут использоваться для улучшения сервиса.
Доступные модели
- Big Pickle Stealth
- Nemotron 3 Super Free
- DeepSeek V4 Flash Free
Cerebras
Облачный API для быстрого запуска языковых моделей на специализированных системах Cerebras. Подходит для задач, где особенно важна скорость генерации текста.
Модели и лимиты
Groq
Сервис быстрого запуска ИИ-моделей на специализированных процессорах Groq. Подходит для чатов, голосовых приложений и других задач, где важна низкая задержка.
Модели и лимиты
Cohere
Платформа с моделями для генерации текста, поиска по документам, embeddings и переранжирования результатов. Подходит для чат-ботов, RAG и корпоративного поиска.
Сайт: https://cohere.com/
- Лимиты: 20 запросов в минуту и 1 000 запросов в месяц.
- Все модели используют общую месячную квоту.
Доступные модели
- c4ai-aya-expanse-32b
- c4ai-aya-vision-32b
- command-a-03-2025
- command-a-plus-05-2026
- command-a-reasoning-08-2025
- command-a-translate-08-2025
- command-a-vision-07-2025
- command-r-08-2024
- command-r-plus-08-2024
- command-r7b-12-2024
- command-r7b-arabic-02-2025
GitHub Models
Каталог моделей внутри GitHub, где их можно сравнивать в Playground и вызывать через API. Удобен для прототипов и разработчиков, которые уже работают с GitHub.
- Лимиты входных и выходных токенов очень строгие.
- Лимиты зависят от уровня подписки GitHub Copilot: Free, Pro, Pro+, Business или Enterprise.
Доступные модели
- Codestral 25.01
- Cohere Command A
- DeepSeek-R1
- DeepSeek-R1-0528
- DeepSeek-V3-0324
- Llama 4 Maverick 17B 128E Instruct FP8*
- Llama 4 Scout 17B 16E Instruct*
- Llama-3.2-11B-Vision-Instruct*
- Llama-3.2-90B-Vision-Instruct*
- Llama-3.3-70B-Instruct*
- Meta-Llama-3.1-405B-Instruct*
- Meta-Llama-3.1-8B-Instruct*
- Ministral 3B
- Mistral Medium 3 (25.05)
- Mistral Small 3.1
- OpenAI GPT-4.1
- OpenAI GPT-4.1-mini
- OpenAI GPT-4.1-nano
- OpenAI GPT-4o
- OpenAI GPT-4o mini
- OpenAI Text Embedding 3 (large)
- OpenAI Text Embedding 3 (small)
- OpenAI gpt-5
- OpenAI gpt-5-chat (preview)
- OpenAI gpt-5-mini
- OpenAI gpt-5-nano
- OpenAI o1
- OpenAI o1-mini
- OpenAI o1-preview
- OpenAI o3
- OpenAI o3-mini
- OpenAI o4-mini
- Phi-4
- Phi-4-mini-instruct
- Phi-4-mini-reasoning
- Phi-4-multimodal-instruct
- Phi-4-reasoning
Cloudflare Workers AI
Сервис запуска ИИ-моделей в облачной сети Cloudflare. Подходит приложениям на Cloudflare Workers, которым нужен API без отдельного сервера с GPU.
Каталог моделей: https://developers.cloudflare.com/workers-ai/models/
- Лимит: 10 000 neurons в день. Neurons - расчетная единица Cloudflare Workers AI.
Доступные модели
- @cf/aisingapore/gemma-sea-lion-v4-27b-it
- @cf/google/gemma-4-26b-a4b-it
- @cf/ibm-granite/granite-4.0-h-micro
- @cf/moonshotai/kimi-k2.6
- @cf/moonshotai/kimi-k2.7-code
- @cf/nvidia/nemotron-3-120b-a12b
- @cf/openai/gpt-oss-120b
- @cf/openai/gpt-oss-20b
- @cf/qwen/qwen3-30b-a3b-fp8
- @cf/zai-org/glm-4.7-flash
- @cf/zai-org/glm-5.2
- DeepSeek R1 Distill Qwen 32B
- Gemma 2B Instruct (LoRA)
- Gemma 7B Instruct (LoRA)
- Llama 2 7B Chat (LoRA)*
- Llama 3.1 8B Instruct (FP8)*
- Llama 3.2 11B Vision Instruct*
- Llama 3.2 1B Instruct*
- Llama 3.2 3B Instruct*
- Llama 3.3 70B Instruct (FP8)*
- Llama 4 Scout Instruct*
- Llama Guard 3 8B*
- Mistral 7B Instruct v0.2 (LoRA)
- Mistral Small 3.1 24B Instruct
- Qwen 2.5 Coder 32B Instruct
- Qwen QwQ 32B
2. Провайдеры с пробными кредитами
Fireworks
Облачная платформа для быстрого запуска и настройки открытых ИИ-моделей через API. Подходит для прототипов и рабочих приложений, которым важны скорость и выбор моделей.
Сайт: https://fireworks.ai/
Каталог моделей: https://fireworks.ai/models
Baseten
Платформа для развертывания ИИ-моделей как масштабируемых API. Идеальна для команд, желающих запустить готовую или собственную модель без необходимости управлять серверами.
Сайт: https://app.baseten.co/
Каталог моделей: https://www.baseten.co/library/
- Пробные кредиты: 30 долларов.
- Можно использовать любую поддерживаемую модель, оплата рассчитывается по времени вычислений.
Nebius
Облачный сервис для запуска открытых моделей через API на инфраструктуре с GPU. Позволяет тестировать и использовать модели без собственного оборудования.
Каталог моделей: https://tokenfactory.nebius.com/models
Novita
Облачная платформа с API для языковых, графических, видео- и других ИИ-моделей. Подходит, если в одном проекте нужны разные виды генерации.
Сайт: https://novita.ai/
Каталог моделей: https://novita.ai/models
AI21
Платформа разработчиков AI21 с доступом к семейству моделей Jamba через API. Подходит для текстовых приложений, обработки длинных документов и корпоративных задач.
Upstage
Платформа с моделями Solar и инструментами для работы с документами через API. Подходит для чат-ботов, извлечения данных и обработки деловых документов.
NLP Cloud
Сервис с готовыми API для языковых моделей и обработки текста. Подходит новичкам, которым нужны генерация, перевод, суммаризация или классификация без настройки своей инфраструктуры.
Alibaba Cloud Model Studio (International)
Международная платформа Alibaba Cloud для доступа к моделям Qwen и другим моделям через API. Подходит для разработки и тестирования ИИ-приложений в облаке Alibaba.
Каталог моделей: https://www.alibabacloud.com/en/product/modelstudio
- Пробные кредиты: 1 000 000 токенов для каждой модели.
- Модели: различные открытые и проприетарные модели Qwen.
Modal
Облачная платформа, где Python-код и ИИ-модели запускаются на серверных GPU по запросу. Подходит разработчикам, которым нужна гибкая инфраструктура без постоянного сервера.
Сайт: https://modal.com/
- После регистрации предоставляется 5 долларов кредитов в месяц.
- После добавления способа оплаты предоставляется 30 долларов кредитов в месяц.
- Можно использовать любую поддерживаемую модель, оплата рассчитывается по времени вычислений.
Inference.net
Облачный API для запуска открытых ИИ-моделей на распределенной вычислительной инфраструктуре. Дает готовый доступ к моделям без самостоятельного развертывания.
Сайт: https://inference.net/
- Пробные кредиты: 1 доллар. Еще 25 долларов можно получить за ответ на опрос, присланный по электронной почте.
- Модели: различные открытые модели.
Hyperbolic
Облачная платформа с API для открытых языковых моделей и арендой GPU. Подходит для тестирования моделей и запуска собственных ИИ-задач.
Модели
- DeepSeek V3 0324
- Llama 3.3 70B Instruct*
- deepseek-ai/deepseek-r1-0528
- qwen/qwen3-coder-480b-a35b-instruct
SambaNova Cloud
Облачный сервис быстрого доступа к крупным открытым моделям на системах SambaNova. Подходит для генерации текста, рассуждений и программирования через API.
- Пробные кредиты: 5 долларов сроком на три месяца.
Модели
- deepseek-v3.1
- deepseek-v3.2
- gemma-4-31b-it
- gpt-oss-120b
- meta-llama-3.3-70b-instruct*
- minimax-m2.7
Scaleway Generative APIs
Европейский облачный API для языковых, embedding, речевых и мультимодальных моделей. Подходит тем, кому нужен готовый ИИ-сервис в инфраструктуре Scaleway.
- Пробные кредиты: 1 000 000 бесплатных токенов.
Модели
- BGE-Multilingual-Gemma2
- Gemma 3 27B Instruct
- Llama 3.3 70B Instruct*
- Pixtral 12B (2409)
- Whisper Large v3
- devstral-2-123b-instruct-2512
- gemma-4-26b-a4b-it
- glm-5.2
- gpt-oss-120b
- holo2-30b-a3b
- mistral-medium-3.5-128b
- mistral-small-3.2-24b-instruct-2506
- qwen3-235b-a22b-instruct-2507
- qwen3-coder-30b-a3b-instruct
- qwen3-embedding-8b
- qwen3.5-397b-a17b
- qwen3.6-35b-a3b
- Voxtral-small-24b-2507
* принадлежит корпорации Meta, которая признана в РФ экстремистской
Другие мои подборки и гайды
- 1000+ нейросетей для создания контента
- 30 примеров, на что способен NotebookLM для телеграм-каналов
- 10 способов как находить востребованные темы для контента с помощью чат-бота
- 13 промтов, которые заставляют ChatGPT писать как человек
- 100 ИИ-агентов, которые будут работать за тебя
- Как за 5 минут превратить NotebookLM в личного наставника
- 100 гайдов по промпт-инжинирингу от OpenAI, Google, Microsoft, Яндекса и др
Спасибо, что дочитали
Присоединяйтесь к 18 000+ подписчиков в телеграм-канале Бегин (или макс-канал), где я выкладываю ИИ-подборки каждую неделю.