🤖 Xiaomi представила VLA-модель для роботов

Xiaomi-Robotics-0 преобразует изображения и текст в команды для роботов.

Модель использует архитектуру с чанками: пока нейросеть обрабатывает следующий фрагмент, робот продолжает движение по текущему, избегая рывков. Это решает типичную проблему задержек в VLA-системах. На вход подаётся изображение обстановки и текстовая инструкция, на выходе — плавные управляющие команды. Модель обучали на 200 млн таймстемпов траекторий и 80 млн VLM-данных.

Итоговая модель — 4,7 млрд параметров, задержка инференса — 80 мс на RTX 4090. Показывает результаты на уровне Qwen3-VL-4B.

#xiaomi_robotics #vla_model #robot_control #ai #ml #huggingface

🤖 Xiaomi представила VLA-модель для роботов
Xiaomi-Robotics-0 преобразует изображения и текст в команды для роботов | Сетка — социальная сеть от hh.ru