Топ-менеджер итальянского стартапа пожаловался, что Codex потратил $79 тысяч на «простую» UX-задачу, а из логов пропали данные о некоторых запусках
В комментариях некоторые предположили, что его API-ключ используют мошенники. Другие посоветовали лучше прописывать инструкции для ИИ-агента.
Источник: Reddit
- Лоренцо Массаро рассказал на Reddit и Hacker News, что уже две недели пытается добиться ответа поддержки OpenAI о том, каким образом Codex в VS Code потратил $79 тысяч (около 6 млн рублей) на «простую» задачу, так и не прислав результат.
- Массаро — технический директор итальянской компании Eternal Tech, которая разрабатывает корпоративную ИИ-инфраструктуру для цифровых двойников.
- По его словам, 10 июля 2026 года он попросил Codex в VS Code провести проверку UX-дизайна одного модуля его продукта. Для работы выбрал GPT-5.5 (Medium).
- Позже в логах он обнаружил, что модель запустила 826 подзадач, поручив их более затратной GPT-5.6 Sol (Ultra). Проверка интерфейса переросла в масштабную работу с серверной инфраструктурой, учётом расходов, безопасностью, аудитами, реализацией и выпуском продукта.
- Модель не запрашивала разрешения пользователя и не сообщила о результатах работы. Всего было потрачено около 2,146 трлн токенов. В восстановленной истории платежей он нашёл 162 оплаченных счёта с корпоративной кредитной карты на сумму $79666.
- Из журналов также пропали некоторые данные о запуске 104 задач, заявляет автор поста. На них ушло 147,9 млрд токенов.
- С середины сентября 2026 года Массаро пытается добиться от OpenAI подтверждения транзакций, но «связаться с человеком-оператором практически невозможно». Он попросил пользователей в комментариях поделиться своим опытом.
- Некоторые предположили, что мошенники украли его API-ключ и использовали его, чтобы перепродать другим пользователям. Другие посоветовали лучше контролировать, какие инструменты использует агент, подробнее прописывать инструкции и следить за всеми этапами работы. Третьи назвали историю выдумкой.
- Массаро обратился в полицию Италии для расследования возможного цифрового мошенничества. Он рассказал, что на стороне банка устанавливал лимит расходов, но один из ИИ-агентов «каким-то образом переключился между картами, когда лимит был достигнут», с помощью навыка управления компьютером.