Gemini 3.5 Live Translate

Gemini 3.5 Live Translate переводит непрерывную речь в реальном времени и возвращает перевод голосом и текстом.

Gemini 3.5 Live Translate — аудиомодель Google для перевода разговорной речи с минимальной задержкой. Она принимает поток голоса, переводит его по мере поступления и выдаёт речь на другом языке; вместе с аудио можно получить текстовую расшифровку. В документации Gemini API перечислены более 70 языков. Это специализированный режим перевода, а не универсальный голосовой помощник.

Перевод непрерывной речи

Модель работает как синхронный переводчик

В обычном голосовом диалоге помощник ждёт пауз, определяет намерение и формирует ответ. Live Translate обрабатывает непрерывный аудиопоток и переводит сказанное, не превращая каждую реплику в отдельный запрос к собеседнику. Такой сценарий рассчитан на устный разговор, где важны короткая задержка и естественное продолжение речи.

Вход, выход и идентификатор

API-модель пока имеет статус Preview

В Gemini API используется идентификатор gemini-3.5-live-translate-preview. Модель принимает аудио, а возвращает переведённую речь и текст; заявленные пределы составляют до 131 072 входных и 65 536 выходных токенов. Для запуска соединения применяется Live API и параметр целевого языка. Google указывает статус предварительного доступа, поэтому совместимость и условия могут меняться.

Когда выбирать эту модель

Перевод отличается от расшифровки

Если нужна именно передача смысла разговора на другом языке, подходит Live Translate. Если требуется стенограмма на языке оригинала, сравните его с Gemini 3.5 Transcribe для аудиофайлов и Gemini 3.5 Transcribe Live для потоковой записи. Для голосового агента с рассуждением и действиями Google предлагает отдельное семейство Live, например Gemini 3.8 Live.

Ограничения качества

Акценты, шум и смена языков

Google предупреждает, что распознавание может ошибаться при неродном акценте, похожих языках и быстрой смене языка. Голоса иногда меняются после длинных пауз или при разговоре нескольких участников; фильтрация не исключает весь фоновый шум. Поэтому для важных переговоров результат следует проверять, а задержку и работу с конкретными языками — оценивать на реальных условиях использования.

Связанные модели и разработчик

Страницы каталога и Вики

Gemini 3 5 Transcribe · Gemini 3 5 Transcribe Live · Gemini 3 8 Live · Google DeepMind в Вики Futuretools

Первичные источники

Документация, карточка модели и анонс

В каталог внесена дата официального выпуска или объявления. Если дата анонса отличается от даты выхода в модельном справочнике, различие указано в тексте. Страница модели Gemini API · Руководство по переводу через Live API · Анонс Google от 9 июня 2026 года · Карточка Gemini 3.5 Audio