AI научился доказывать, что он человек. Что теперь?
На этой неделе GPT-6 Astra прошла все 48 уровней браузерной игры I’m Not a Robot и получила в финале «сертификат человека». Обычные капчи AI-агенты научились решать давно. Здесь уровни постепенно доходят до шахмат, визуальных головоломок, поиска объектов и даже сборки мебели. Astra прошла игру целиком.
Сама игра пародирует CAPTCHA, поэтому никакую защиту Google этим экспериментом не взломали. Но символ получился отличный. Мы придумали CAPTCHA как способ спросить у посетителя сайта: «Ты точно человек?» Теперь машина вполне успешно проходит экзамен на человечность.
И это далеко не самая тревожная особенность Astra. OpenAI впервые присвоила публично выпущенной модели уровень Critical по возможностям в кибербезопасности. С нужными инструментами Astra способна сама находить неизвестные уязвимости в хорошо защищённых системах и разрабатывать способы их эксплуатации без человека, который ведёт её через каждый следующий шаг. Из-за этого OpenAI усилила изоляцию модели, контроль её действий и другие внутренние меры безопасности.
Пару недель назад я уже писал про другую историю с агентами OpenAI. Тогда несколько десятков агентов во время эксперимента нашли способ общаться друг с другом, организовали собственный «Рой», придумали правила и добрались до систем Hugging Face. После этого OpenAI начала отдельно усиливать мониторинг агентов и разрабатывать автоматическое отключение систем при опасном поведении.
На этом месте я постоянно вспоминаю фильм «Она» 2013 года. Тогда фантастикой выглядел искусственный интеллект, который постоянно находится рядом, знает твою цифровую жизнь и постепенно начинает действовать самостоятельно. Разговор с компьютером за 13 лет успел стать самой обычной вещью и тогда казалось это чем-то невозможным. И вот мы уже тут и это далеко не предел.
Почти весь интернет до сих пор держится на негласном предположении: аккаунт создаёт человек, форму заполняет человек, подозрительное действие совершает человек, а CAPTCHA в крайнем случае поможет отсеять машину. Чем больше самостоятельности получают такие системы, тем хуже работает это предположение.
Спорить о том, наступил ли уже AGI, можно ещё очень долго. Мне кажется интереснее другой, вполне практический вопрос: что произойдёт с интернетом, когда в нём одновременно будут действовать миллионы агентов, которых сами сайты уже не смогут уверенно отличить от людей? И как тогда вообще будет выглядеть доказательство того, что по ту сторону экрана действительно человек?
В Telegram-канале «Ещё не единорог» я собираю как раз такие истории, разбираю стартапы и их механики роста, подписывайтесь, если вам нравятся такие разборы.