Gemini Robotics-ER 2
Модель Google для пространственного рассуждения и планирования действий в робототехнике; доступна в предварительной версии.
Gemini Robotics-ER 2 — модель Google для embodied reasoning, то есть анализа физической среды и планирования действий робота. Два варианта API были открыты в предварительном доступе 30 июля 2026 года.
Пространственное рассуждение и действия
Google перечисляет пространственный анализ, выполнение кода, последовательный вызов инструментов, поиск моментов в видео, классификацию прогресса и координацию нескольких роботов. Модель может принимать текст, изображение, видео и аудио. Физическое действие должно выполняться через интеграцию, которая может приостанавливать вызов до подтверждения оператора.
Два варианта API
gemini-robotics-er-2-preview предназначен для обычных запросов, а gemini-robotics-er-2-streaming-preview — для потоковой работы с малой задержкой через Live API. Оба варианта остаются preview и могут измениться до стабильного выпуска.
Безопасность физического управления
Для роботов результат модели не должен напрямую обходить ограничения исполнительных механизмов. Используйте проверку допустимости команд, блокировку опасных движений и контроль оператора. Дата выхода версии 1.6 и её последующего отключения указана Google отдельно; эта страница относится к поколению ER 2.
Разработчик и первичный источник
Страница разработчика: Google DeepMind в Вики Futuretools.ru.
Официальный источник: материал разработчика.