Как сократить расходы на API нейросетей на 90-97%: тестируем релей для GPT-6, Gemini 3.8 и Grok 4.7
Разбираемся, как получать токены актуальных флагманских сетей в разы дешевле официальных тарифов OpenAI и Google без зарубежных карт.
С выходом моделей поколений GPT-6, Grok 4.7 и Gemini 3.8 качество кодинга и работы автономных агентов вышло на новый уровень. Но вместе с этим выросли и счета: сложные цепочки промптов в Cursor, плагинах для IDE и внутренних скриптах быстро сжигают баланс.
Для разработчиков из РФ и СНГ проблема удваивается: оплачивать официальные API напрямую в OpenAI или Anthropic - это постоянный квест с зарубежным пластиком, завышенными курсами посредников и риском внезапного бана аккаунта по IP.
Недавно наткнулся на сервис Codex Relay, который решает обе задачи: дает единый доступ ко всем топовым сеткам и отдает токены с огромным дисконтом.
Сравнение цен: официальный прайс против релея
Специально сверил официальные цены за 1M токенов с тарифами внутри платформы. Разница колоссальная:
- Линейка OpenAI GPT (скидки до -97%):
- gpt-6.1-sol: $0.064 (вместо официальных $2.00)
- gpt-6-astra: $0.32 (вместо $10.00)
- gpt-6-luna: $0.0032 (вместо $0.10)
- gpt-5.6-sol: $0.128 (вместо $4.00)
- Google Gemini (скидка -90%):
- gemini-3.8-flash: $0.075 (вместо $0.75)
- gemini-3.1-pro: $0.20 (вместо $2.00)
- xAI Grok (скидка -88%):
- grok-4.7: $0.24 (вместо $2.00)
- Китайские модели (Z.ai):
- glm-5.3 и glm-5.3-flash со скидкой 35%. 🎁 Приятный бонус на старте Отдельный плюс - за привязку своего Telegram-аккаунта в профиле начисляют бонусные $10 на баланс. С учетом низких цен на запросы, этого бонуса вполне достаточно, чтобы не внося свои деньги спокойно потестировать разные модели, проверить скорость ответов и настроить софт.
Как это устроено технически
Платформа работает по стандартному протоколу OpenAI-compatible Relay:
- Вы регистрируетесь и получаете один универсальный API-ключ.
- Поддерживается стандартная библиотека openai в Python / Node.js или любой клиент (Cursor, VS Code Cline, Continue, Chatbox).
- Баланс пополняется в одном месте без танцев с зарубежными картами.
Подключение за пару минут
1. В редакторах кода (Cursor / VS Code)
Если используете Cursor или расширения вроде Cline / Roo Code:
- Перейдите в Settings → Models.
- Выберите провайдера OpenAI Compatible.
- В поле Base URL укажите эндпоинт сервиса: https://codex-relay.codes/v1
- Вставьте сгенерированный ключ и укажите нужную модель (например, gpt-6.1-sol или gemini-3.8-flash).
2. В Python
Для скриптов и ботов код стандартный:
from openai import OpenAI
client = OpenAI(
api_key="ВАШ_КЛЮЧ_ИЗ_CODEX_RELAY",
base_url="https://codex-relay.codes/v1"
)
response = client.chat.completions.create(
model="gpt-6.1-sol",
messages=[
{"role": "user", "content": "Привет! Оптимизируй этот SQL-запрос."}
]
)
print(response.choices[0].message.content)
Резюме
Если у вас крутятся пет-проекты, боты или вы активно кодите с AI-ассистентами - экономия в 10-30 раз на токенах ощущается с первых же дней.
👉 Ссылка на платформу: Codex Relay