Google выпустила Gemini 3.8 Live и Live Extended Thinking

Wait 5 sec.

Google представила две новые модели для голосовых взаимодействий — Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking. Они работают в режиме speech-to-speech, поддерживают визуальный контекст и могут вызывать инструменты прямо во время разговора, не прерывая диалог. Модели поддерживают 97+ языков, умеют обрабатывать изображения и видео в реальном времени и выполнять асинхронные вызовы API. Юзер может продолжать говорить, пока модель выполняет задачу в фоне.В версии Live Extended Thinking добавлено параллельное рассуждение: модель может анализировать сложную задачу и одновременно продолжать голосовой диалог, озвучивая промежуточный прогресс. По данным Google, она заняла первое место в Artificial Analysis Speech-to-Speech Quality Index с результатом 82,6 балла.Модели уже доступны через Gemini API и Google AI Studio. Google также начала интеграцию Live-моделей в Search, Gemini и Workspace. Для Live API Google цена вопроса составит $0,005/мин за входящее аудио и $0,018/мин за исходящее. В пересчёте на токены компания приводит ориентир $3 за 1 млн входных и $12 за 1 млн выходных аудиотокенов. Читать далее