AI научился доказывать, что он человек. Что теперь?

На этой неделе GPT-6 Astra прошла все 48 уровней браузерной игры I’m Not a Robot и получила в финале «сертификат человека». Обычные капчи AI-агенты научились решать давно. Здесь уровни постепенно доходят до шахмат, визуальных головоломок, поиска объектов и даже сборки мебели. Astra прошла игру целиком.

AI научился доказывать, что он человек. Что теперь?

Сама игра пародирует CAPTCHA, поэтому никакую защиту Google этим экспериментом не взломали. Но символ получился отличный. Мы придумали CAPTCHA как способ спросить у посетителя сайта: «Ты точно человек?» Теперь машина вполне успешно проходит экзамен на человечность.

И это далеко не самая тревожная особенность Astra. OpenAI впервые присвоила публично выпущенной модели уровень Critical по возможностям в кибербезопасности. С нужными инструментами Astra способна сама находить неизвестные уязвимости в хорошо защищённых системах и разрабатывать способы их эксплуатации без человека, который ведёт её через каждый следующий шаг. Из-за этого OpenAI усилила изоляцию модели, контроль её действий и другие внутренние меры безопасности.

Пару недель назад я уже писал про другую историю с агентами OpenAI. Тогда несколько десятков агентов во время эксперимента нашли способ общаться друг с другом, организовали собственный «Рой», придумали правила и добрались до систем Hugging Face. После этого OpenAI начала отдельно усиливать мониторинг агентов и разрабатывать автоматическое отключение систем при опасном поведении.

На этом месте я постоянно вспоминаю фильм «Она» 2013 года. Тогда фантастикой выглядел искусственный интеллект, который постоянно находится рядом, знает твою цифровую жизнь и постепенно начинает действовать самостоятельно. Разговор с компьютером за 13 лет успел стать самой обычной вещью и тогда казалось это чем-то невозможным. И вот мы уже тут и это далеко не предел.

Почти весь интернет до сих пор держится на негласном предположении: аккаунт создаёт человек, форму заполняет человек, подозрительное действие совершает человек, а CAPTCHA в крайнем случае поможет отсеять машину. Чем больше самостоятельности получают такие системы, тем хуже работает это предположение.

Спорить о том, наступил ли уже AGI, можно ещё очень долго. Мне кажется интереснее другой, вполне практический вопрос: что произойдёт с интернетом, когда в нём одновременно будут действовать миллионы агентов, которых сами сайты уже не смогут уверенно отличить от людей? И как тогда вообще будет выглядеть доказательство того, что по ту сторону экрана действительно человек?

В Telegram-канале «Ещё не единорог» я собираю как раз такие истории, разбираю стартапы и их механики роста, подписывайтесь, если вам нравятся такие разборы.