Gemini 3.8 Live: голосовой ИИ продолжает разговор, пока выполняет задачу

Gemini 3.8 Live: голосовой ИИ продолжает разговор, пока выполняет задачу

15 сентября Google выпустила две голосовые модели: Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking. В журнале Gemini API обе уже отмечены как общедоступные для разработчиков. Главное изменение касается задач, на которые нельзя ответить одной репликой: ИИ может обращаться к инструментам в фоне и поддерживать разговор, пока работа продолжается.

Это пригодится, когда вы обсуждаете документ, уточняете детали поездки или объясняете, как должен выглядеть интерфейс. Разберём, что умеют новые модели и где их возможности уже можно использовать.

Чем отличаются две модели

Gemini 3.8 Live рассчитана на быстрый обмен репликами. Она принимает голос, текст, изображения и видео, отвечает голосом и поддерживает вызов внешних инструментов. Среди изменений относительно Gemini 3.1 Flash Live — фоновый вызов функций по умолчанию: приложению больше не обязательно останавливать диалог на время такого обращения. Это указано в документации модели.

Extended Thinking предназначена для более сложных задач: разобраться в нескольких условиях, спланировать действия, дождаться результатов поиска. У неё есть отдельное фоновое рассуждение с настраиваемой интенсивностью. Модель может произнести промежуточный ответ и продолжить обработку запроса — поэтому конец фразы ещё не означает, что задача завершена. Это различие прямо описано в документации Extended Thinking.

Gemini 3.8 Live: голосовой ИИ продолжает разговор, пока выполняет задачу

В Extended Thinking разговор и фоновая работа могут идти параллельно. Промежуточная реплика сообщает о ходе задачи.

Такие обновления и практические сценарии работы с нейросетями разбираю в PromtHubru

Что можно делать голосом

В руководстве Live API Google предлагает обычную Live для языковой практики, голосового поиска и быстрых команд. Extended Thinking — для задач с несколькими шагами: например, сопоставления вариантов поездки или разбора ошибки в коде. В собственном приложении разработчик должен подключить инструменты, через которые агент получит нужные данные и выполнит действия.

Для создания сайтов интересна демонстрация Google: Extended Thinking превращает наброски и голосовые замечания в компоненты React — части веб-интерфейса. Это показ компании; качество на ваших проектах потребует отдельной проверки.

Есть и более повседневный сценарий. В Google Docs на Android можно описать документ голосом, обсудить предложенный план, получить черновик и попросить изменить разделы или оформление. Например, сначала согласовать структуру предложения клиенту, затем добавить условия и сократить вступление. Голосовой ввод здесь позволяет обсуждать правки по ходу работы.

Где доступно и что с Россией

Развёртывание обновления началось 15 сентября. По анонсу Google, обычная 3.8 Live приходит в Search Live, а Extended Thinking — в Gemini Live. Обе модели доступны через Gemini API и Google AI Studio. Появление обновления у конкретного пользователя зависит от сервиса и условий доступа.

У встроенных функций свои требования. Gmail Live пока находится в бете и работает только на английском. Для личного аккаунта нужна подходящая подписка Google AI либо доступ к Workspace Experiments. В мобильном Gmail можно задавать вопросы по письмам и открывать сообщения, на которых основан ответ.

Gemini 3.8 Live: голосовой ИИ продолжает разговор, пока выполняет задачу

Доступность модели в API, обновление Gemini Live и условия функций Workspace проверяются отдельно.

Россия отсутствует в списке поддерживаемых регионов Google AI Studio и Gemini API. Проверенного способа доступа из РФ для этого материала нет. Покупать подписку только ради анонса без проверки нужной функции в своём аккаунте я бы не советовал.

Что это меняет на практике

Польза такого голосового ИИ особенно заметна в задачах с ожиданием: вы сохраняете контакт с помощником, пока он обрабатывает запрос. При этом Google указывает в карточке моделей возможные выдуманные ответы, замедления и тайм-ауты. Для готового документа или выполненного действия по-прежнему нужен проверяемый результат. Уверенная промежуточная реплика его не заменяет.

11