Компактная модель для синтеза речи
KittenTTS — открытая модель преобразования текста в речь размером 25 МБ с 15 миллионами параметров. Она создаёт естественно звучащую речь и работает на устройствах с ограниченными ресурсами, включая старые компьютеры и Raspberry Pi, а также в браузере.
Голоса и работа без подключения
Модель поддерживает несколько реалистичных голосов и синтезирует речь в реальном времени без подключения к интернету и без графического процессора. Она работает на процессоре и распространяется по лицензии Apache 2.0.








