Vid2Robot: End-to-end Video-conditioned Policy Learning with Cross-Attention Transformers Paper • 2403.12943 • Published Mar 19, 2024 • 15
ABot-M0.5: Unified Mobility-and-Manipulation World Action Model Paper • 2607.00678 • Published 24 days ago • 20