ИИ перестал молчать, пока думает: Google показала Gemini 3.8 Live

0

Голосовые ассистенты годами заставляли человека ждать в неловкой тишине: вопрос уже задан, а в ответ — вращающийся значок. Google пытается убрать эту паузу. Gemini 3.8 Live умеет продолжать разговор, пока выполняет команды и вызывает внешние сервисы.

Компания представила две модели. Обычная Gemini 3.8 Live рассчитана на быстрый диалог и массовые приложения. Версия Extended Thinking предназначена для задач, где требуется несколько шагов и более глубокое рассуждение. Она может сказать «сейчас проверю», объяснять ход работы и одновременно продолжать обработку запроса в фоне.

В официальном анонсе Google говорится, что модель поддерживает 97 языков и способна переключаться между ними прямо посреди разговора. Она принимает изображение с камеры почти в реальном времени, понимает, на что смотрит пользователь, и может выполнять вызовы инструментов и API, не обрывая беседу.

Чем это отличается от привычного голосового помощника

Старый ассистент работал как пульт: включи таймер, позвони контакту, скажи погоду. Новая модель должна удерживать контекст и разбираться с неоднозначной просьбой. Ей можно показать сломанное устройство, уточнить симптомы голосом, перебить на полуслове и попросить проверить другой вариант. Разговор становится не набором отдельных команд, а одной длинной задачей.

Extended Thinking особенно интересен там, где системе нужно обратиться сразу к нескольким источникам. Например, подобрать время встречи, сверить календарь, найти письмо и подготовить ответ. Раньше пользователь видел паузу или получал результат только в конце. Теперь модель должна проговаривать промежуточный статус, пока фоновые вызовы продолжаются.

Это улучшает ощущение скорости, но не обязательно сокращает реальное время вычисления. Фраза «я проверяю» не делает сервер быстрее. Зато человек понимает, что запрос принят, может уточнить условие и остановить ошибочное действие до его завершения.

Где уже можно попробовать Gemini 3.8 Live

Обе модели доступны разработчикам через Gemini API и Google AI Studio. Обычная 3.8 Live появляется в Search Live, а Extended Thinking — в Gemini Live и продуктах для подписчиков Google AI. Для бизнеса предусмотрен закрытый предварительный доступ в Gemini Enterprise; в Workspace модель приходит в Docs, Gmail и Keep в зависимости от тарифа.

Распространение идёт поэтапно, поэтому наличие приложения Gemini ещё не гарантирует новую модель в аккаунте. На доступность влияют страна, язык, подписка и конкретный продукт. Российские пользователи также сталкиваются с региональными ограничениями сервисов Google, поэтому универсальной даты включения нет.

Google сообщает, что всё сгенерированное моделями аудио получает невидимую метку SynthID. Она должна помогать отличать искусственный голос от настоящего и расследовать подделки. Это не защита от любого дипфейка: метка работает с аудио, созданным продуктами Google, а после сильной обработки её обнаружение может усложниться.

Главная перемена здесь не в ещё одном рекорде тестов. Голосовой ИИ начинает вести себя как собеседник, который способен слушать, смотреть и параллельно работать. Удобство очевидно, но вместе с ним растёт цена ошибки: если модель не просто отвечает, а бронирует, пишет и нажимает, пользователю нужен прозрачный контроль каждого важного действия.

Digital Report
Share.

About Author

Digital-Report.ru — информационно-аналитический портал, который отслеживает изменения цифровой экономики. Мы описываем все технологические тренды, делаем обзоры устройств и технологических событий, которые влияют на жизнь людей.

Leave A Reply