Gemini 3.8 Flash TTS
Модель Google для выразительного синтеза речи, длинных озвучек, диалогов и работы с региональными произношениями.
Gemini 3.8 Flash TTS — модель Google для преобразования текста в речь, доступная через Gemini API с 22 сентября 2026 года. Google выделяет качество голоса, выразительное чтение, региональные варианты произношения и сохранение тембра на протяжении длинной записи.
Где полезна модель
Flash TTS подходит для озвучивания длинных материалов, аудиокниг, дикторских текстов и диалогов с несколькими участниками. В запросе можно задавать стиль речи и голосовые события вроде смеха или короткой паузы. Для многостороннего диалога каждому ходу нужно явно назначать говорящего.
Голоса и языки
Модель работает с текстовым вводом и аудиовыводом и поддерживает более 130 языков по каталогу Google. Для выбора голоса доступны предустановленные варианты, библиотека голосов и инструменты создания или копирования голоса с проверкой согласия. Указанные возможности зависят от API и интерфейса Google AI Studio.
Чем отличается Flash-Lite TTS
Для массовой и более чувствительной к задержке озвучки Google предлагает Gemini 3.8 Flash-Lite TTS. Flash TTS ориентирована на выразительность и сложные сценарии, Flash-Lite — на высокую пропускную способность и типовые голосовые приложения.
Разработчик и первичный источник
Страница разработчика: Google DeepMind в Вики Futuretools.ru.
Официальный источник: материал разработчика.