OpenAI: «вы и ваша мама будут использовать одного AI агента»

Ещё недавно мы с вами говорили: как круто будет, когда у нас появится AI коллега, или даже команда AI агентов, которая заменит весь скучный ручной труд. А мы будем попивать джус и с телефона отправлять задачи этим агентам 😁 Но вот будущее наступило. И оказывается это не все, чего мы хотели. И вообще мы хотели как раз наоборот — никакую не команду AI агентов.

Но обо всем по порядку

Недавно xAI релизнули интересную штуку — Grok Bot. И AI комьюнити сильно возбудилось на этот счёт. Ведь это те самый AI коллеги, как по учебнику.

Идея простая: вы отдаете задачу той самой команде, состоящей из агентов-специалистов, а они решают ее в тесной коллаборации разделяя задачи между собой. Вот главный Chief of Staff, под ним рисерчер, тестировщик, дизайнер, ассистент по разгребанию почты и тд. Каждый агент настраивается. У него свой "компьютер", память и обязанности. И, конечно, они могут общаться между собой!

Ну, сингулярность наступила, подумаете вы. Но штука в том, что сингулярность уже улетела далеко вперед. А Grok Bot теперь выглядит как достаточно простой и чисто инженерный шаг от Grok Build (аналог Claude Code и Codex) — его просто размножили и настроили возможность отправлять сообщения разным сессиям друг другу.

Кстати, исходники Grok Bot утекли в сеть ровно по той же схеме, что и Claude Code. Так что, немного подшаманив, можно запустить даже с OpenRouter потестить эту штуку 🎹

Но где теперь эта ваша сингулярность?

Сформулировался новый магнум опус — единый агент, который самостоятельно адаптируется под абсолютного любого юзера и его задачи. Может показаться, что вышеупомянутые агенты уже это делают. Но речь про совершенно другой UX.

Больше никаких скиллов, геморроя с ручным описанием должностных обязанностей агентов, выбора нужных моделей с правильным эффортом и харнессом. Ведь будем откровенны — это все костыли. И даже Grok Bot на фоне этой концепции — костыль.

Суть в максимальном отказе от ручных настроек и повышении эффективности работы. Вы просто "живете" вместе с этим агентом, а он смотрит, изучет, впитывает ваш образ жизни. И потом придумывает как все это дело автоматизировать да еще и эффективно, параллеля и оптимизируя работу.

Как попасть в это светлое будущее?

Чтобы добиться такого UX понадобятся лучшие из лучших:

  1. Существенно более высокая скорость и низкая стоимость вычислений. Моделям придется пропускать через себя существенно больше информации
  2. Адаптивный UI. В идеале дописываемый агентом. Codex или Claude Code — это каменные рамки. За них нельзя выйти, и толком поменять. В будущем же одному сервису понадобиться уметь подстраиваться налету под нужды любого: программиста, менеджера, врача, художника, юриста, ученого и тд. А им всем нужны свои приколы в UI. Юристу — работа с судебными делами и НПА, а врачу — просмотрщик рентген снимков
  3. Модели поумнее. Казалось бы куда уж еще. Но текущего уровня все еще маловато. Они слишком заточены под бенчмарки, слишком склонны соглашаться и тд. Все эти проблемы все еще достаточно сильно сдерживают нас

И похоже ближе всех к этому уровню подобрались OpenAI

Об этом в интервью рассказал Тибо — батя Codex и продакт лид всей платформы OpenAI. Загибаем пальцы:

  1. Ultrafast режим + их собственные процессоры Jalapeño. Быстрый режим, кстати, рано или поздно станет дефолтным для всех юзеров
  2. Адаптивный UI — их цель по словам самого Тибо. А слияние ChatGPT и Codex — шаг в этом направлении
  3. Model Astra. Та самая модель, которую в закрытом режиме показывают правительству США и все никак не релизнут. Уж не знаю, насколько она мощна, но сами OpenAI в нее сильно верят 📈

На выходе — Тибо пушит платформу OpenAI к такому виду, чтобы и вы и ваша мама или бабушка общались с одним и тем же ботом. Но со временем он будет сильно персонализироваться, сам развивать необходимые скиллы и поддерживать их актуальными, сам управлять армией сабагентов и делать это все супер-эффективно.

Вот так незаметно, как это обычно и бывает, мы подбираемся к реалистично сформулированному AGI.

2