Gemini 3.8 Flash TTS

Модель Google для выразительного синтеза речи, длинных озвучек, диалогов и работы с региональными произношениями.

Gemini 3.8 Flash TTS — модель Google для преобразования текста в речь, доступная через Gemini API с 22 сентября 2026 года. Google выделяет качество голоса, выразительное чтение, региональные варианты произношения и сохранение тембра на протяжении длинной записи.

Где полезна модель

Flash TTS подходит для озвучивания длинных материалов, аудиокниг, дикторских текстов и диалогов с несколькими участниками. В запросе можно задавать стиль речи и голосовые события вроде смеха или короткой паузы. Для многостороннего диалога каждому ходу нужно явно назначать говорящего.

Голоса и языки

Модель работает с текстовым вводом и аудиовыводом и поддерживает более 130 языков по каталогу Google. Для выбора голоса доступны предустановленные варианты, библиотека голосов и инструменты создания или копирования голоса с проверкой согласия. Указанные возможности зависят от API и интерфейса Google AI Studio.

Чем отличается Flash-Lite TTS

Для массовой и более чувствительной к задержке озвучки Google предлагает Gemini 3.8 Flash-Lite TTS. Flash TTS ориентирована на выразительность и сложные сценарии, Flash-Lite — на высокую пропускную способность и типовые голосовые приложения.

Разработчик и первичный источник

Страница разработчика: Google DeepMind в Вики Futuretools.ru.

Официальный источник: материал разработчика.