Асинхронный inference сократил задержки VLA-моделей на i.MX 95 — опыт NXP Разделение генерации команд от их выполнения решает главную проблему VLA-моделей на встраиваемых платформах — робот больше не простаивает во время inference. Кто и как исследовал NXP совместно с Hugging Face опубликовали 5 марта 2025 года практическое руководство по развертыванию Vision-Language-Action моделей (ACT и SmolVLA) на процессоре i.MX 95. Материал охватывает полный цикл: от записи робототехнических датасетов до f…