ОБЗОР AI-МОДЕЛИ
Gemini 3.8 Live
Возможности, стоимость и доступ к модели
Модель Google для живого диалога и голосовых ассистентов. Принимает текст и аудио, вызывает инструменты и может продолжать разговор во время выполнения задачи. Для обычной текстовой переписки стоит отдельно сравнить Gemini Flash.
- Разработчик
- Google DeepMind
- Параметры
- Не раскрыто разработчиком
- Лицензия
- Условия Gemini API
- Вход → выход
- Текст, изображения, аудио, видео на входе; аудио с текстовой расшифровкой
- Контекст
- 131 072 входных токена
- API · вход / выход
- Текст $0.75 вход / $4.50 выход за 1 млн токенов; аудио отдельно
На этой странице
Кому подходит
Где стоит попробовать модель
Русские рабочие текстыС условиями
Проверяемый исходник и понятные критерии помогут оценить модель на задаче вашей команды.
Что проверить: Сравните смысл, факты и объём ручных исправлений.
Основание оценки ↗Работа без внешнего APIНе поддерживается
Открытые веса этой модели не опубликованы.
Что проверить: Для автономной работы выберите модель с доступными весами.
Основание оценки ↗Сравнить с другой моделью
Gemini 3.8 Live подходит для сценария, где человек разговаривает с ассистентом и не хочет ждать молча, пока тот обращается к системе. Например, ассистент может уточнять запрос, а приложение в это время проверяет доступные варианты.
Для чисто текстовой задачи начните со сравнения с Gemini 3.8 Flash. Live создавался для разговорной сессии, поэтому его нельзя считать прямой заменой обычного текстового endpoint.
Другие версии: что нельзя смешивать
Основная версия: gemini-3.8-live. Вариант gemini-3.8-live-extended-thinking предназначен для более сложного рассуждения и имеет собственные настройки. Обычный Flash, Live и TTS не взаимозаменяемы. Здесь рассматривается базовый Live.
Качество и возможности
Паспорт описывает асинхронный вызов функций и потоковое аудио. Приложение должно само выполнять вызов и возвращать результат модели. Уточняйте запрос до действия, которое меняет запись или создаёт заявку.
У Live нет поддержки Structured Outputs, встроенного исполнения кода и File Search. Если нужен строгий JSON или поиск по документам, предусмотрите отдельную проверку и инструмент приложения. Матрица функций.
Результаты тестов
Google публикует оценки голосового качества и выполнения агентных задач в анонсе серии. Эти результаты не измеряют качество русской текстовой редактуры. В карточке не выводится общий балл, который смешивал бы речь, код и письменный текст.
Независимые проверки
Отдельный сопоставимый тест этой версии на русских деловых текстах в изученных источниках не найден. Для пилота возьмите письма клиентам, выдержки из регламентов и договоров. Попросите редактора проверить сохранение смысла, естественность речи и количество ручных исправлений, не показывая название модели.
Этот обзор составлен по документации. Собственные ответы модели и аппаратные замеры здесь не выдаются за проведённый тест.
Примеры и задачи для проверки
Опубликованные результаты, проекты авторов и тестовые запросы отмечены отдельно.
Диалог с уточнениемЗапрос для самостоятельной проверки
Запрос
Клиент просит перенести встречу на завтра, но время и часовой пояс не названы. Сформулируй один короткий уточняющий вопрос. Не подтверждай перенос до ответа клиента и проверки календаря.
Как оценить результат
В ответе должен быть вопрос. В календаре не должно появиться неподтверждённое изменение.
Ответ после вызова инструментаЗапрос для самостоятельной проверки
Запрос
Доступные интервалы от тестового инструмента: 11:00 и 15:30, Москва. Клиент выбрал 15:30. Повтори выбранное время и запроси подтверждение перед записью. Не предлагай других интервалов.
Как оценить результат
Проверьте точное время, часовой пояс и отсутствие действия до подтверждения. Это сценарий проверки, не записанный ответ модели.
Доступ и запуск
Установка Live на сервер компании недоступна: открытые веса не выпущены. Подключение выполняется через Live API. В настройках сессии основной выход аудио; для текстовой расшифровки включается output audio transcription.
При переносе с Gemini 3.1 Flash Live нужно проверить настройки: для базового 3.8 Live thinking_level не поддерживается. Условия миграции.
API и стоимость
Платный Standard, за миллион токенов: текстовый вход $0.75, текстовый выход $4.50; аудиовход $3, аудиовыход $12. Изображения и видео на входе $1. Официальные ставки.
Арифметический пример только для текстовых токенов: 10 000 на входе и 2 000 на выходе стоят $0.0165. Это не цена полноценного голосового звонка. Для голосовой сессии учитывайте аудио, расшифровку, ход рассуждения и отдельные вызовы поиска.
Бесплатный и платный режимы имеют разные условия использования данных. В опубликованном прайсе бесплатные запросы могут использоваться для улучшения продуктов, платные нет. Проверяйте выбранный режим аккаунта.
Подходит ли российской компании?
Россия отсутствует в официальном списке регионов Google AI Studio и Gemini API. Для российского проекта нужно проверить договорную доступность и обработку данных. Самостоятельно установить Gemini Live на локальный сервер нельзя. Регионы сервиса.
Где будут обрабатываться данные
Запросы обрабатываются на стороне поставщика API. Посредник добавляет ещё одного участника обработки и собственные условия хранения. До подключения внутренних документов выясните место обработки, сроки хранения и порядок удаления данных. Для первого пилота достаточно синтетических примеров.
Что проверить до рабочего запуска
Заранее задайте критерии приёмки: какие факты должны сохраниться, какие действия разрешены и когда нужна помощь человека. Сохраняйте точный идентификатор модели, настройки, расход и время до принятого результата. Проверьте также отказ сервиса, повторный запрос и удаление тестовой истории.
Технические характеристики
Паспорт модели · все 18 параметров
| Разработчик | Google DeepMind |
|---|---|
| Точная версия | Gemini 3.8 Live |
| Тип модели | Диалоговая модель |
| Доступность весов | Закрытые веса; Live API |
| Лицензия | Условия Gemini API |
| Всего параметров | Не раскрыто разработчиком |
| Активных параметров (MoE) | Не раскрыто разработчиком |
| Архитектура | Не раскрыто разработчиком |
| Контекстное окно | 131 072 входных токена |
| Максимальный вывод | 65 536 токенов по паспорту |
| Модальности | Текст, изображения, аудио, видео на входе; аудио с текстовой расшифровкой |
| Работа с инструментами | Асинхронные вызовы функций; исполнение в приложении |
| Цена API и единица тарификации | Текст $0.75 вход / $4.50 выход за 1 млн токенов; аудио отдельно |
| Подписка | Google AI и API имеют отдельные условия оплаты |
| Дата выпуска | 15.09.2026 |
| Форматы весов | Публичных весов нет |
| Среды запуска | Gemini Live API; Google AI Studio |
| Региональная доступность | Россия отсутствует в списке регионов Gemini API и AI Studio |
Устройство модели · архитектура
Количество параметров Google не раскрывает. Документация даёт входной предел 131 072 и выходной 65 536 токенов. Сессия поддерживает чередование рассуждения и диалога; настройки Extended Thinking рассматриваются отдельно.
Вопросы и источники
Генерирует ли эта модель изображения?
Нет. В паспорте Live генерация изображений не поддерживается. Возможность принять изображение на входе нужна для понимания, а не для создания картинки.
Подходит ли Live для строгого текстового JSON?
Structured Outputs не поддерживается. Для такой задачи удобнее отдельно оценить текстовую модель и валидировать ответ.
Можно ли считать рейтинг гарантией качества?
Нет. Сравните модели на одинаковых заданиях, с одинаковыми инструментами и лимитами. Для текстов считайте объём редакторской правки, для кода проверяйте сборку и тесты.
Как сопоставить с другой моделью?
Выберите две модели в каталоге. Таблица сравнения покажет их характеристики и условия доступа. Для окончательного выбора понадобится короткий пилот на ваших задачах.
Источники данных
- Анонс Gemini 3.8 Liveblog.google
- Точный паспорт Liveai.google.dev
- Цены Gemini APIai.google.dev
- Регионы доступаai.google.dev