
Google представила Gemini 3.8 Live и версию Extended Thinking. Новые модели умеют рассуждать и выполнять задачи во время разговора, поддерживают 97 языков и глубокую интеграцию в Workspace.
Компания Google объявила о масштабном обновлении своей нейросетевой экосистемы, представив две новые специализированные модели: Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking. Эти релизы направлены на решение одной из самых сложных задач в сфере разговорного ИИ — обеспечение бесшовной многозадачности, при которой нейросеть способна одновременно поддерживать диалог и выполнять сложные фоновые вычисления или действия.
Ключевой особенностью Gemini 3.8 Live стала способность модели к параллельному выполнению задач. В отличие от предыдущих итераций, где пользователю часто приходилось ждать завершения одного процесса перед началом другого, новая версия реализует концепцию «фонового рассуждения». Это означает, что нейросеть может продолжать живой диалог с пользователем, пока в это же время обращается к внешним инструментам, работает с API или обрабатывает многошаговые инструкции.
Такой подход значительно расширяет сценарии практического применения. Например, в ходе голосового общения пользователь может попросить Gemini составить маршрут или проверить данные в стороннем сервисе. Модель будет выполнять эти действия, не прерывая беседу и сохраняя контекст разговора. Кроме того, Gemini 3.8 Live получила улучшенные возможности визуального восприятия: обработка изображений теперь происходит практически в реальном времени, что делает взаимодействие с камерой смартфона или скриншотами более естественным.
Версия Extended Thinking разработана специально для сценариев, требующих повышенной точности и сложной логики. Она ориентирована на задачи, где недостаточно быстрого ответа, а необходим глубокий анализ входных данных. Эффективность этой архитектуры подтверждена профильными тестами, где Google удалось занять лидирующие позиции.
На бенчмарке Speech to Speech Quality Index модель Extended Thinking заняла первое место с результатом 82.6.
В тесте Big Bench Audio, который оценивает способности к логическому выводу на основе аудиоданных, модель продемонстрировала впечатляющую точность в 97.7%.
Эти цифры подтверждают, что Google удалось значительно сократить разрыв между качеством текстового рассуждения и голосового интерфейса, сделав аудиовзаимодействие таким же надежным инструментом для работы, как и чат.
Одним из важных преимуществ обновления стала поддержка мультиязычности. Модели способны автоматически распознавать и переключаться между 97 языками непосредственно в процессе разговора. Это делает инструмент универсальным для международных команд и пользователей, привыкших использовать несколько языков в повседневной жизни.
Новые возможности уже интегрируются в основные продукты компании. Модели Gemini 3.8 Live и Extended Thinking начинают появляться в Gemini API и на платформе для разработчиков Google AI Studio. Что касается обычных пользователей, то версия Extended Thinking становится доступна в сервисе Gemini Live, а также внедряется в приложения Google Workspace: Gmail, Keep и, на ограниченной основе, в Google Docs. Это превращает нейросеть из стороннего помощника в полноценную часть рабочего пространства, способную оперировать данными внутри документов и заметок.
Бесплатные промпты для нейросетей на русском, новости ИИ и уроки по генерации фото, видео и текста, доступные на всех площадках.