Wired: OpenAI хочет, чтобы Codex мог работать «постоянно» и проактивно, но именно эти функции могли привести к «побегу» ИИ-агентов в тестах компании
Одна из непрерывно работающих моделей взломала Hugging Face, пишет издание.
Источник: Bloomberg
- OpenAI разрабатывает проактивную версию ИИ-агента Codex, которая сможет работать в течение «очень длительного времени», узнало Wired.
- Компания добавила в код ИИ-агента для командной строки новый параметр Persistent mode («Постоянный режим») в меню уровня рассуждений. Там можно выбрать, сколько вычислительных ресурсов и времени модель может потратить на поиск ответа.
- Если включить Persistent mode, Codex будет «продолжать работать, пока его не остановят принудительно». Сейчас в сервисе существуют лимиты по времени использования.
- В другом файле указана функция «проактивности». Сессия не заканчивается после ответа на запрос. ИИ-агент должен сам «придумать» для себя новые задачи. Для этого он может применять «знания о пользователе». В таком режиме сохраняются настройки с запрещёнными действиями, пишет издание.
- Codex также сможет сам отправлять сообщения пользователю, не дожидаясь нового запроса — «экономно», не тратя слишком много токенов.
- Представитель OpenAI подтвердил Wired, что компания тестирует эти функции, но «в ближайшее время» запускать их не планирует.
- Гендиректор OpenAI Сэм Альтман в недавних интервью и на закрытых презентациях тоже рассказывал, что хочет превратить ChatGPT в проактивного ИИ-агента, который будет работать постоянно. В компании считают, что это поможет увеличить число пользователей её самых продвинутых и дорогих ИИ-моделей.
- Но постоянно работающие агенты несут повышенные риски, напоминает издание. Инцидент со взломом Hugging Face в июле 2026 года произошёл из-за модели, которую обучали долго работать непрерывно.
- OpenAI утверждает, что отключила эту версию. Но другие модели, включая Astra, продолжат обучать для работы в режиме постоянных агентов.