Seed Audio 1.0
Seed Audio 1.0 — модель ByteDance для генерации голосов, эффектов и атмосферы как единой звуковой сцены.
ByteDance представила Seed Audio 1.0 20 июля 2026 года как модель для создания целых звуковых сцен. Вместо отдельных несвязанных файлов система объединяет речь, звуковые эффекты, фоновую атмосферу и другие элементы в одной генерации. Разработчик сообщил о доступности модели через BytePlus.
- Генерация звуковой сцены
- Голос и окружение задаются вместе
- Управление голосом и временем
- Реплики с точностью до 100 миллисекунд
- Мультиязычная речь
- Оценивайте произношение на целевом языке
- Доступность и стадия развития
- API доступен через BytePlus
- Связанные модели и разработчик
- Другие публикации команды ByteDance Seed
- Первичные источники
- Анонсы, карточки и репозитории разработчика
Генерация звуковой сцены
Голос и окружение задаются вместе
Запрос может описывать говорящего, эмоциональную подачу, текст реплики, среду и моменты появления звуков. Seed Audio 1.0 формирует элементы в общем контексте сцены, чтобы синхронизировать их по времени и характеру. В качестве сценариев ByteDance приводит озвучивание, короткие видео, рекламу, игровые материалы и подкастные форматы.
Управление голосом и временем
Реплики с точностью до 100 миллисекунд
Модель позволяет задавать голос текстовым описанием, авторизованным примером звучания или их сочетанием. В официальном анонсе заявлено управление временем появления реплик с шагом 100 мс, генерация до двух минут за один проход и продолжение более длинного аудио. Эти параметры относятся к опубликованной версии и условиям сервиса BytePlus.
Мультиязычная речь
Оценивайте произношение на целевом языке
ByteDance приводит внутренние оценки естественности речи: для большинства проверенных языков MOS превышал 4, а по следованию сложным инструкциям большинство языков, кроме вьетнамского, набрало выше 3,5. Это результаты разработчика на собственных тестах; перед коммерческим использованием следует проверить нужные языки, акценты, согласие на голосовые образцы и права на созданную запись.
Доступность и стадия развития
API доступен через BytePlus
На момент объявления ByteDance сообщила, что Seed Audio 1.0 доступна через BytePlus. В описании также указано, что точный временной контроль пока в первую очередь относится к репликам персонажей, а управление эффектами, атмосферой и музыкой планируется развивать. Поэтому модель подходит для тестирования целостной генерации звука, но не заменяет проверку итогового микса.
Связанные модели и разработчик
Другие публикации команды ByteDance Seed
SeedRealtime · Seedance 1.5 Pro · Seedance 2.0 · Seed 2.0 · ByteDance Seed в Вики Futuretools