SeedRealtime

SeedRealtime — аудиовизуальная модель ByteDance для общения в реальном времени с одновременным восприятием звука, видео и речи.

ByteDance объявила SeedRealtime 5 августа 2026 года как мультимодальную модель с полнодуплексным аудиовизуальным взаимодействием. Она обрабатывает звук, видео и текст в единой архитектуре, чтобы поддерживать непрерывный обмен: смотреть на сцену, слушать речь и отвечать без жёсткого чередования отдельных модулей.

Звук, изображение и время

Модель учитывает контекст непрерывного потока

SeedRealtime объединяет аудио, визуальные данные и временную последовательность событий. Это важно, когда значение фразы зависит от того, что пользователь показывает или на что указывает, а ответ должен учитывать действия и изменения сцены. В опубликованном описании ByteDance также отмечает различение голосов и фонового шума.

Активное взаимодействие

Модель может реагировать на событие без отдельного вопроса

В качестве примеров разработчик приводит напоминание при появлении важного объекта и использование вызова инструмента внутри ответа. Система оценивает, когда уместно вступить в разговор, и старается не перебивать паузы и реплики пользователя. Такая функция требует явного контроля: пользователь должен понимать, какие данные камера и микрофон передают модели и когда она может говорить самостоятельно.

Оценка диалога

Показатель разработчика, а не гарантия задержки

ByteDance сообщила, что в её сквозной оценке модель примерно вдвое сократила проблемы с ритмом аудиовизуального разговора по сравнению с каскадными системами. Это результат конкретной пользовательской проверки, не универсальное измерение скорости для каждой сети, устройства или языка.

Где проходит граница модели

Проверьте доступ и приватность до подключения

Официальная страница описывает SeedRealtime как полностью развёрнутую технологию, но доступ, региональные ограничения и API могут зависеть от платформы. Для продукта в реальном времени дополнительно важны задержка, качество микрофона и камеры, согласие участников, хранение аудио- и видеоданных и поведение системы при ошибочном распознавании сцены.

Связанные модели и разработчик

Другие публикации команды ByteDance Seed

Seed Audio 1.0 · Seedance 1.5 Pro · Seedance 2.0 · Seed 2.0 · ByteDance Seed в Вики Futuretools

Первичные источники

Анонсы, карточки и репозитории разработчика

анонс SeedRealtime · страница SeedRealtime