Почему лимиты Codex сгорают быстро: советы по экономии
💬 Разобралась, почему лимиты Codex могут сгорать за час
Все чаще встречала жалобы и сама столкнулась с тем, что выжгла недельный лимит подписки за час работы. Причем причина не всегда в объеме задач, а еще и в нескольких настройках, на которые легко не обратить внимания. Проверила по бенчмаркам Artificial Analysis, цифры сходятся:
🪼 Смысл вот в чем:
• У GPT-6 Astra 5 уровней усилия: low, medium, high, xhigh, max. По замерам Artificial Analysis одна задача стоит от 0,82 доллара на low до 3,26 на max. Разница в 4 раза, а переключаются они в 2 клика.
• Режим Fast (тот самый 2x) ускоряет работу, но у Astra сейчас съедает лимит в 2,5 раза быстрее. Не горит - лучше выключить)
• Ultra это не просто "думать дольше": в ChatGPT Work режим Ultra может сам подключать параллельных субагентов, и каждый расходует токены. Отсюда и счет в итоге 😱 При этом в локальном Codex субагенты запускаются по вашему запросу или инструкции проекта
Раньше можно было не думать: ставишь высокий эффорт и выше и работаешь. С Astra так не выходит, она заметно прожорливее, и выбор уровня впервые стал ежедневным решением.
Сам OpenAI советует так: low для узких, обратимых и легко проверяемых задач, medium как баланс на каждый день, high когда ошибка дорого стоит, xhigh и max только если на high реально видно процент провалов, и когда дополнительное рассуждение реально дает прирост. И их же цитата, которая мне понравилась больше всего: Astra на low может обогнать 5.6 Sol на high - так что ниже усилие не значит глупее.
А самый простой способ беречь лимит теперь - не гонять Astra там, где справятся новые GPT-6 Sol и Luna, я их на днях разбирала.
🪼 Как и всегда, есть свои нюансы:
• Цифры Artificial Analysis это средняя цена задачи на их наборе тестов, на вашей работе выйдет своя
• Менять семейство модели посреди диалога не стоит: кэш слетает, Codex сам предупреждает о просадке. Лучше начать новый чат. Про переключение моделей посреди диалога мы с вами помним еще со Шпаргалки по Claude, кстати, как вам формат, стоит вернуть? 🔥- если да
• Лимиты OpenAI сейчас двигают на ходу, так что детали могут поменяться
Какой вывод из всего этого можно сделать? Особенно учитывая постоянно меняющиеся условия лимитов? Пожалуй, что перестать по привычке ставить высокий эффорт - это самая простая экономия лимита 😅 Ну и вспомнить, что Work и Codex делят один общий лимит, а у обычного чата он отдельный) И если модель уже съела лимит в Work или Codex, обычный Chat продолжит работать - тексты, вопросы и брейншторм можно унести туда. А у вас как дела с лимитами?