Gemini 3.8 Flash-Lite TTS

Быстрая модель Google для недорогой озвучки большого объёма текста и голосовых приложений с малой задержкой.

Gemini 3.8 Flash-Lite TTS — модель Google для синтеза речи, представленная 22 сентября 2026 года. Она рассчитана на массовую обработку, озвучивание интерфейсов и голосовые приложения, где важны скорость и стоимость. Модель принимает текст и возвращает аудио.

Основные сценарии

Google рекомендует Flash-Lite для высоконагруженной озвучки, чтения текста вслух, голосовых помощников и повседневной генерации речи одним голосом. Модель поддерживает предустановленные голоса, библиотеку голосов, настройку персонажей и копирование голоса при наличии согласия. API-схема совместима с Gemini 3.8 Flash TTS, поэтому в интеграции можно переключать вариант модели.

Языки и формат работы

В документации Google указана поддержка 101 языка. На вход передаётся текст, на выходе создаётся звук; код модели — gemini-3.8-flash-lite-tts. Это специализированная модель синтеза речи: она не предназначена для вызова функций, поиска или выполнения кода.

Сравнение с Flash TTS

Gemini 3.8 Flash TTS лучше подходит для выразительной подачи, сложного произношения и длинной многоголосой записи. Flash-Lite рассчитана на высокую пропускную способность и более простые запросы.

Замена предыдущей модели

Google указывает Flash-Lite как замену предварительной модели gemini-3.1-flash-tts-preview. Точные лимиты и стоимость следует сверять в текущей документации Gemini API.

Разработчик и первичный источник

Страница разработчика: Google DeepMind в Вики Futuretools.ru.

Официальный источник: материал разработчика.