RLHND: Các mô hình nền tảng video như các máy theo dõi tay cơ thể để học robot
RLHND: Video Foundation Models as Physically Grounded Hand Trackers for Robot Learning
Đoạn trích bài viết
Gần đây, các cách tiếp cận sử dụng bộ dữ liệu video của con người cho huấn luyện chính sách robot đã trở nên ngày càng phổ biến. Tuy nhiên, hầu hết các máy theo dõi tay hiện có đều quay lại từ khung cắt có tiền lệ hạn chế về chuyển động tay và tương tác đối tượng, dẫn đến sự không chính xác và không phù hợp về mặt vật lý.
Toàn văn bài viết
Mở bài viết gốc
Đọc bài viết đầy đủ trên huggingface
Mở bài gốc để xem trọn vẹn chi tiết và dẫn chứng.