Google представила Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking — две модели для голосовых приложений и диалогов в реальном времени. Базовую версию компания позиционирует как более экономичный вариант для масштабных сценариев, а Extended Thinking — как модель для сложных задач с многошаговым рассуждением. Обе принимают визуальный контекст почти в реальном времени, могут выполнять вызовы инструментов и API в фоне и при этом продолжать разговор.
Модели автоматически распознают переход между 97 поддерживаемыми языками. Google также сообщает, что весь звук, созданный её ИИ-продуктами, получает незаметную маркировку SynthID, которую можно использовать для обнаружения сгенерированного контента.
Для Extended Thinking компания приводит 82,6 балла в Speech-to-Speech Quality Index от Artificial Analysis, 68,6% в тесте tau-Voice, 35,1% в tau-Voice-banking от Sierra и 97,7% в Big Bench Audio. Это показатели из сообщения Google; независимую воспроизводимость результатов TheTimeAI не проверяла. Базовая Gemini 3.8 Live, по данным компании, заняла второе место в Speech Agent Arena.
Развёртывание обеих моделей началось 15 сентября в Gemini API и Google AI Studio. Для компаний они доступны в закрытом предварительном режиме Gemini Enterprise и позднее должны появиться в Customer Experience. Базовая модель также выходит в Search Live. Extended Thinking добавляется в Gemini Live, а в Workspace доступ зависит от продукта и подписки: Google указывает Pro и Ultra для Docs и все подписки Google AI для Gmail и Keep. Поэтому единая общедоступность для всех пользователей пока не заявлена.