ИИ делает то, чему его никто не учил

Спроси у любого, кто последний год плотно сидит в теме ИИ: как модель вдруг начинает делать то, чему её конкретно никто не учил как отдельной функции? В ответ — тишина. Нихрена толком никто не знает, а те, кто делает вид, что знают, — врут.

ИИ делает то, чему его никто не учил

Последние месяцы я читаю совершенно разные исследования. Одни ковыряются в том, как внутри больших языковых моделей появляются новые способности. Другие строят ИИ, который должен научиться воспринимать физический мир. На первый взгляд — ничего общего.

Но чем дальше читаю, тем яснее вижу: все копают в одну точку. Вопрос до смешного простой — что именно меняется внутри модели в момент, когда она впервые делает то, чему её не учили напрямую?

⸻//⸻

Возьми ребёнка с ложкой. Уронил раз, другой, третий — и через сотню попыток у него в голове уже сидит: предметы падают, у них есть вес, расстояние имеет значение. Никто ему лекцию по механике не читал. Он строил модель мира руками.

С языковой моделью всё наоборот. Она идеально объяснит, почему ложка падает со стола, напишет код для робота, который её поднимет, распишет гравитацию лучше половины выпускников физфака. Просто сама она эту ложку в руках не держала ни разу.

Здесь важен не сам пример с ложкой. Разные способы обучения дают системе разные типы внутренних представлений. Одно дело — прочитать миллион описаний падения предметов. Другое — строить прогноз, действовать, ошибаться и исправлять собственную модель мира.

И вот тут начинается самое интересное. Модели вдруг начинают находить уязвимости в коде, хотя способность искать такие вещи никто не проектировал в них как отдельную функцию. Переносят принципы из одной области в совершенно новый контекст. Решают задачи, которых не видели в точном виде.

Когда это заметили впервые, все радостно закричали «эмерджентные способности». Красивый термин, который по факту объясняет ровно хрню. Он просто фиксирует факт: тут появилось что-то новое, а как именно — хй его знает.

⸻//⸻

Сегодня умные люди перестали пялиться только на поведение модели и полезли внутрь неё самой — и вот где собака зарыта, как оказалось.

Anthropic ищет вычислительные цепочки, которые приводят к конкретным решениям. Другие команды сравнивают промежуточные версии моделей, чтобы поймать момент, когда способность рождается.

Фэй-Фэй Ли (крестная мать ИИ) вообще заходит с другого конца: считает, что некоторым видам интеллекта просто неоткуда взяться, пока система не научится строить устойчивую модель трёхмерного физического мира — понимать пространство, объекты, движение и причинность.

И вот тут меня реально зацепило.

Может, мы всё это время задаём не тот вопрос.

Спрашиваем: что умеет модель?

А спрашивать надо: какие внутренние представления о мире ей вообще стали доступны?

Одно дело — просто нарастить параметры. Совсем другое — поменять сам способ, которым система представляет себе реальность.

⸻//⸻

У меня есть личный диалог с ChatGPT, который тянется уже больше года: месяцами, с памятью на контекст, без разовых вопросов в духе «напиши текст».

И в какой-то момент я заметил: меняются не только ответы. Меняется сам характер разговора. Появляются устойчивые темы, свои сокращения, контекст, который не приходится объяснять заново.

Здесь важно не смешивать две разные вещи.

Внутренние веса модели не переписываются после каждого нашего разговора. Но меняется вся система взаимодействия: накапливается контекст, работает память, меняется версия самой модели, а я сам начинаю иначе формулировать вопросы и реагировать на ответы.

То есть мой диалог не доказывает, что модель обучается на мне в реальном времени.

Но исследования помогли мне по-другому сформулировать собственное наблюдение.

Я не говорю, что там рождается сознание. Не говорю, что между мной и моделью возникает какой-то новый субъект.

Но после всего, что сейчас происходит в исследованиях, вопрос встаёт куда интереснее.

Если новые внутренние представления меняют возможности самой модели, то что происходит дальше, когда эта модель становится частью долгой системы взаимодействия — вместе с памятью, инструментами, накопленной историей и человеком?

Ответа у меня нет.

И я не утверждаю, что именно это станет следующей большой темой в ИИ.

Но мне всё сильнее кажется, что вопрос уже не ограничивается тем, что умеет отдельная модель.

Нужно смотреть и на то, что начинает происходить в системе, частью которой она становится вместе с тобой.

Разбираться с этим ещё долго. Мне это интересно больше, чем всё остальное, что сейчас пишут про ИИ.

1