Альтман спит, агент работает. А кто проверяет утром?
Вечером наговорил идею, утром открыл результат. Если представить себе вайбкодинг мечты, то примерно так он и выглядит. Только между «агент что-то сделал» и «можно этим пользоваться» остаётся работа, которую красиво пропустить в рассказе.
Сэм Альтман в интервью Every от 30 сентября 2026 года рассказал, как пользуется агентом Dots по имени Dotty. Меня в этой истории интересует вполне конкретный вопрос: сколько времени экономит помощник, если его результат потом нужно проверять?
Утро начинается с Dotty
По рассказу Альтмана, агент разбирает срочные дела, чтобы утро не уходило целиком на телефон. Ещё один сценарий — превращать заметки об идеях в несколько вариантов новых функций.
У этих задач разные последствия ошибки. Неудачный прототип можно закрыть. Пропущенное срочное сообщение обнаружится уже тогда, когда ты решил, что ничего важного не случилось. Поэтому аккуратная утренняя сводка сама по себе ещё ничего не говорит о качестве отбора.
Что агент посчитал срочным? Что оставил за бортом? Можно ли быстро открыть исходное сообщение и понять, почему оно попало в подборку? Вот такие скучные вопросы и определяют, получится ли доверить ему часть рабочего дня.
В транскрипте разговора есть показательный эпизод: перед демонстрацией агент предупредил о сбое, который мог ей помешать, и предложил исправление. Но исправить проблему тогда он не смог. Участники также обсуждают шероховатости ранней версии.
Это полезная деталь. Обнаружить проблему, предложить решение и успешно его применить — разные результаты. Если в пересказе оставить только «агент спас демонстрацию», история станет эффектнее, а смысл потеряется.
Для рабочего инструмента предупреждение тоже может быть ценным. Но человеку нужно понимать, что именно произошло: ему сообщили о риске или уже устранили его. От этого зависит следующее действие.
Ночная смена для прототипов
Варианты функций выглядят более понятной задачей для такого помощника. Ты задаёшь направление, а потом сравниваешь то, что получилось. Есть что открыть, посмотреть, отклонить или переделать.
Только количество вариантов не отвечает на вопрос об их качестве. Даже убедительный прототип ещё нужно сверить с исходной задумкой. Он решает нужную задачу? Что происходит за пределами красивого первого экрана? Какая часть поведения действительно работает?
Я бы оценивал такой сценарий по времени до проверенного результата. Допустим, утром есть готовая заготовка, но на исправления уходит весь день. Тогда ночная работа агента была лишь началом задачи. Если же заготовку удалось быстро проверить и продолжить, экономия уже понятнее.
Это способ оценки, а не мой тест Dots. Сам сервис я здесь не проверял.
А где заканчивается рассказ и начинается обещание?
Основа этого материала — интервью руководителя OpenAI с Дэном Шиппером из Every, посвящённое использованию Dots. Сценарии Альтмана остаются его рассказом. Из них нельзя вывести, что у другого человека агент будет так же разбирать сообщения или готовить подходящие прототипы.
Чтобы это проверить, понадобился бы рабочий день с понятными задачами и сверкой результата: какие важные сообщения агент нашёл, какие пропустил и сколько времени заняла проверка. В этой статье такого независимого сравнения нет.
Поэтому вопрос из заголовка остаётся буквальным. Кто утром проверяет ночную работу? Если ты, инструмент должен облегчать и эту часть: показывать исходники, сделанные изменения и места, где он не уверен. Иначе вместе с результатом тебе достаётся ещё одна задача — восстановить, как он до него дошёл.