«Ни одна из компаний не действует ответственно»: исследователь Anthropic Джейкоб Коксон заявил об уходе из индустрии ИИ из-за опасений, что технология выйдет из-под контроля и «уничтожит человечество»
До этого он работал в OpenAI, но в начале 2026 года перешёл в Anthropic, которая, как он ожидал, уделяет больше внимания безопасности.
Фото WSJ
- Джейкоб Коксон — 27-летний исследователь, специализирующийся на обучении моделей путём обработки больших объёмов данных, пишет WSJ.
- 8 сентября 2026 года он объявил об уходе из Anthropic и всей индустрии ИИ. Своё решение Коксон объяснил тем, что не хочет участвовать в гонке по созданию ИИ, способного к самосовершенствованию, который может «выйти из-под контроля и уничтожить человечество».
- По его словам, многие коллеги в индустрии всё чаще используют слова вроде «crunchtime» (решающий момент) и «endgame» (эндшпиль — финал шахматной партии), описывая траекторию к самосовершенствующимся моделям.
Мы движемся по пути, который, скорее всего, будет самым агрессивным из этих сценариев, и к концу следующего [2027] года ситуация может выйти из-под контроля.
- До Anthropic Коксон работал в OpenAI. В начале 2026 года он сменил работодателя, потому что ожидал, что в Anthropic уделяют больше внимания вопросам безопасности. Он по-прежнему считает стремления Anthropic «искренними», но отмечает, что их недостаточно.
Последние три года я занимался исследованиями предобучения как в OpenAI, так и в Anthropic. Ни одна из компаний не действует ответственно. Они несутся напролом к самоулучшающемуся сверхинтеллекту и играют в рулетку нашими жизнями.
- Исследователь также предостерегает людей от «недооценки» ИИ. «Вскоре» это будут сверхчеловеческие системы, способные взламывать что угодно, совершать прорывы в любой области «за ночь» и обретать реальную власть и ресурсы.
- При этом он выразил «оптимизм» по поводу возможной координации между ведущими компаниями для повышения безопасности их моделей. По его мнению, к взаимодействию их должны подтолкнуть инциденты вроде взлома Hugging Face и другие несанкционированные атаки ИИ-агентов.