Осторожно: 36 часов GPT 5.6 Sol обошлись в $1180
Я только что использовал Codex, чтобы сделать масштабный технический пивот для buddian.com (платформы для ИИ-видео).
За 51 итерацию было использовано 190 млн токенов и сделано 1396 вызовов функций.
Что в итоге?
- Полностью переписанный воркер генерации
- Интеграция Veo 3.1 (с заделом под другие ИИ)
- Неразрушающий монтаж видео
Заодно вшитая защита интеллектуальной собственности через Prampta для лицензированных персонажей. В свое время мне пришлось закрыть свой стартап — сервис радиохостинга MoeRadio — из-за того, что пользователи загружали пиратские треки.
Но я совсем не ожидал, что счёт от Azure составит $1180, включая:
- генерация ответа (выходные токены): $24,50
- обработка контекста (входные токены): $1034
88% затрат ушло просто на то, чтобы модель читала контекст. Это $284 за каждый час реального вычислительного времени.
Если разрабатываете проекты с большими контекстными окнами, следите за расходом токенов. Иначе они сожрут всю юнит-экономику.
Самое ужасное, что деньги сняли с другого человека, которому я помог получить облачный кредит Azure, но что-то пошло не так...