Wired: OpenAI хочет, чтобы Codex мог работать «постоянно» и проактивно, но именно эти функции могли привести к «побегу» ИИ-агентов в тестах компании

Одна из непрерывно работающих моделей взломала Hugging Face, пишет издание.

Источник: Bloomberg
Источник: Bloomberg
  • OpenAI разрабатывает проактивную версию ИИ-агента Codex, которая сможет работать в течение «очень длительного времени», узнало Wired.
  • Компания добавила в код ИИ-агента для командной строки новый параметр Persistent mode («Постоянный режим») в меню уровня рассуждений. Там можно выбрать, сколько вычислительных ресурсов и времени модель может потратить на поиск ответа.
  • Если включить Persistent mode, Codex будет «продолжать работать, пока его не остановят принудительно». Сейчас в сервисе существуют лимиты по времени использования.
  • В другом файле указана функция «проактивности». Сессия не заканчивается после ответа на запрос. ИИ-агент должен сам «придумать» для себя новые задачи. Для этого он может применять «знания о пользователе». В таком режиме сохраняются настройки с запрещёнными действиями, пишет издание.
  • Codex также сможет сам отправлять сообщения пользователю, не дожидаясь нового запроса — «экономно», не тратя слишком много токенов.
  • Представитель OpenAI подтвердил Wired, что компания тестирует эти функции, но «в ближайшее время» запускать их не планирует.
  • Гендиректор OpenAI Сэм Альтман в недавних интервью и на закрытых презентациях тоже рассказывал, что хочет превратить ChatGPT в проактивного ИИ-агента, который будет работать постоянно. В компании считают, что это поможет увеличить число пользователей её самых продвинутых и дорогих ИИ-моделей.
  • Но постоянно работающие агенты несут повышенные риски, напоминает издание. Инцидент со взломом Hugging Face в июле 2026 года произошёл из-за модели, которую обучали долго работать непрерывно.
  • OpenAI утверждает, что отключила эту версию. Но другие модели, включая Astra, продолжат обучать для работы в режиме постоянных агентов.
3
2