Компания Google представила диалоговые модели Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking с поддержкой параллельного рассуждения. Анонсированные решения ориентированы на работу в режиме реального времени и предназначены для повышения эффективности голосовых ассистентов. Версия 3.8 Live разработана для масштабирования с упором на доступность и скорость, комбинируя обработку визуальных данных с диалоговыми возможностями. Вариант Extended Thinking создан для решения сложных задач, требующих многошагового анализа и повышенной точности.
Представленные модели способны обрабатывать визуальные сигналы в реальном времени, придавая разговору дополнительный контекст. Системы поддерживают автоматическое определение и переключение между 97 языками непосредственно в процессе общения. Взаимодействие с внешними API и инструментами происходит в фоновом режиме, позволяя модели поддерживать диалог и озвучивать промежуточные этапы работы без паузы. Версия Extended Thinking может рассуждать и говорить одновременно, используя естественные речевые вводные фразы для подтверждения приема команды.
Разработка внедряется в сервисы Google Workspace и Search, а также доступна разработчикам через Gemini Live API. Для защиты контента весь сгенерированный звук маркируется невидимым цифровым водяным знаком SynthID, интегрированным напрямую в аудиопоток для предотвращения распространения недостоверных сведений. Новые решения уже тестируются партнерами сферы корпоративных платформ и сторонних сервисов.
