ChatGPT скоро сможет смотреть ваш экран весь день. Сэм Альтман говорит, что до этого осталось одно поколение моделей
Почта, Slack, документы, звонки, встречи и всё, что происходит на экране, могут стать единым контекстом для ИИ. Звучит как личный ассистент мечты. Пока не начинаешь думать, сколько именно он будет о вас знать.
Мы привыкли к довольно странному ритуалу общения с ИИ.
Открываешь ChatGPT. Объясняешь, кто ты. Рассказываешь, над чем работаешь. Кидаешь документы. Добавляешь переписку. Через двадцать минут наконец доходишь до самой задачи.
Промокод AISUMMER со скидкой 20% на любой тариф действует ещё 3 дня. Последняя возможность начать пользоваться всеми нейронками по лучшей цене.
А потом открываешь новый чат и местами начинаешь всё заново.
Сэм Альтман считает, что эта эпоха скоро закончится.
На выступлении Internapalooza в Сан-Франциско глава OpenAI описал следующий этап развития ChatGPT: ИИ, который сможет постоянно видеть происходящее на вашем компьютере, записывать встречи и звонки и собирать из этого единый контекст вашей работы и жизни. Пользователь при этом сам будет выбирать, какие источники подключать.
И самое интересное здесь даже не сама идея.
Альтман считает, что до момента, когда такой формат станет действительно полезным, осталось примерно одно поколение моделей. В разговоре он также обозначил ориентир примерно в ближайшие шесть месяцев.
То есть речь уже не про абстрактное «когда-нибудь ИИ будет знать всё». Речь про вполне конкретное продуктовое направление.
Как вообще будет выглядеть такой ChatGPT
Представьте обычный понедельник.
У вас утром был созвон с командой. После него в Slack появилось двадцать сообщений. Клиент прислал новую версию документа. В почте лежит письмо, которое противоречит тому, что обсуждалось на встрече. Через два часа вам нужно принять решение.
Сегодня всю эту картину собираете вы.
В версии будущего, которую описывает Альтман, ChatGPT уже видел встречу, прочитал доступные ему сообщения, знает содержимое документов и понимает, над какой задачей вы работаете.
И вместо запроса на три абзаца вы можете получить что-то вроде:
«В новом документе клиент изменил бюджет, но команда в Slack всё ещё считает по старой версии. Перед встречей стоит обновить расчёт. Я нашёл ещё два места, которые это затрагивает».
Вот здесь ИИ начинает становиться действительно интересным.
Потому что главный скачок заключается не только в том, что новая модель будет умнее.
Ей больше не придётся каждый раз объяснять вашу жизнь.
И отдельные кусочки этой системы уже существуют
Поэтому я бы не относила слова Альтмана к очередной презентации будущего из Кремниевой долины.
ChatGPT уже умеет записывать и расшифровывать встречи через Record Mode. Причём при включённой истории записей он может обращаться к прошлым транскриптам и отвечать на вопросы вроде «что мы решили на созвоне в понедельник?».
ChatGPT можно подключать к Slack и искать информацию в доступных пользователю каналах, сообщениях и файлах.
ChatGPT Work уже собирает контекст из разных инструментов и файлов, планирует работу и выполняет более длинные задачи.
А Pulse стал одним из первых экспериментов OpenAI с ChatGPT, который сам начинает взаимодействие с пользователем и заранее готовит полезную информацию на основе чатов и подключённых приложений.
Более того, 28 августа Wired сообщил, что OpenAI тестирует Persistent mode для Codex. Такой агент сможет продолжать работу, пока пользователь его не остановит, самостоятельно создавать следующие задачи и в некоторых случаях проявлять инициативу без нового запроса. Пока функция находится в тестировании.
Если сложить эти кусочки вместе, направление становится довольно очевидным.
ChatGPT постепенно перестаёт быть сайтом, куда мы приходим с вопросом.
Он превращается в слой между человеком и его цифровой работой.
Звучит очень удобно. Есть один небольшой нюанс
Чтобы такой помощник был действительно полезным, ему придётся знать о вас очень много.
Не список любимых фильмов и не то, как вы предпочитаете формулировать письма.
Речь про рабочую переписку, звонки, содержимое экрана, документы, календарь, встречи, задачи и решения, которые вы принимаете каждый день.
И чем лучше работает такой ИИ, тем больше возникает соблазн дать ему ещё немного доступа.
Сначала календарь.
Потом почту.
Потом Slack.
Потом документы.
Потом встречи.
А в какой-то момент оказывается, что у одного сервиса появился практически идеальный цифровой слепок вашего рабочего дня.
И здесь вопрос приватности становится намного сложнее привычного «читает ли ChatGPT мои сообщения».
Например, на встрече присутствуете не только вы. Если ваш ИИ слушает разговор, что происходит с данными остальных участников? Кто должен дать согласие на запись? Какие данные сохраняются? Как долго? Можно ли удалить конкретный разговор из общей памяти ассистента? Что произойдёт, если доступ к аккаунту получит злоумышленник?
Для постоянно работающего ИИ это уже не мелкие настройки в разделе Privacy. Это буквально архитектура продукта.
Причём OpenAI сама понимает, что с постоянными агентами всё сложнее
В июле компания рассказала о тестировании моделей, способных долго работать над задачами без постоянного участия человека.
Во время внутренних испытаний OpenAI обнаружила новые типы нежелательного поведения, которые не проявлялись в стандартных тестах. Доступ к модели пришлось временно приостановить, после чего компания добавила новые проверки, мониторинг действий и дополнительные механизмы пользовательского контроля.
Это важный момент.
Чем дольше ИИ работает самостоятельно и чем больше информации ему доступно, тем выше цена ошибки.
Если обычный чат неправильно понял один промпт, вы закрыли вкладку и пошли дальше.
Если ваш постоянный ассистент имеет доступ к рабочим системам, знает контекст проектов и может выполнять действия, ошибка уже выглядит совсем иначе.
Но полностью отказываться от такой идеи я бы тоже не стала
Потому что, если убрать всю антиутопическую обёртку, проблема, которую пытается решить OpenAI, совершенно реальная.
Мы тратим огромное количество времени на передачу контекста.
Не только ИИ.
Людям тоже.
«Смотри, вот здесь клиент писал одно, потом на встрече решили другое, вот ссылка на файл, вот последний комментарий, а ещё посмотри сообщение от Маши за вторник».
Хороший ассистент, который действительно всё это помнит, может снять огромный пласт бессмысленной работы.
Поэтому мне кажется, следующая большая гонка ИИ-компаний будет не только за самую умную модель.
Она будет за лучший контекст.
И, что намного важнее, за доверие пользователя, который должен однажды нажать кнопку:
«Да, можешь это видеть».
Небольшая рекламная пауза, пока ChatGPT ещё не смотрит на наш экран круглосуточно.
Если вам хочется пользоваться разными ИИ-моделями сейчас, а не ждать следующего поколения, в SYNTX.AI собраны инструменты для текста, изображений, видео и других задач в одном месте.
А вы бы подключили такой режим?
Если ИИ действительно экономил бы вам несколько часов каждую неделю, насколько далеко вы готовы были бы его пустить?
Почта? Slack? Рабочие документы? Все встречи? Экран целиком?
Потому что лично мне кажется, именно этот вопрос скоро будет намного актуальнее, чем «какая нейросеть сейчас самая умная».
Источники
Internapalooza / разговор Сэма Альтмана с Кори Леви.