3PoinTr: 3D Point Tracks for Learning Manipulation from Unconstrained Human Videos
Adam Hung,
Bardienus P. Duisterhof,
Jeffrey Ichnowski
arXiv, 2026
[Website]
[Paper]
[Video]
3PoinTr learns manipulation from unconstrained human videos:
videos where the human demonstrator can act freely rather than mimicking target robot kinematics.
3PoinTr first predicts dense 3D point tracks, and then conditions a closed-loop multitask policy on these tracks.