R3M
Reusable visual representations for robot manipulation pretrained on egocentric video.
Value-implicit visual pretraining producing goal-conditioned embeddings for control.
Why: Goal-aware visual embeddings for manipulation
VIP (Value-Implicit Pretraining) is catalogued on Embodied AI Hub as a curated model for embodied AI builders.
Value-implicit visual pretraining producing goal-conditioned embeddings for control.
Why it matters: Goal-aware visual embeddings for manipulation
Use the official repository and docs as the source of truth for install pins, licenses, and hardware requirements.
Researchers, students, and builders comparing open embodied stacks.
Content reviewed 2026-07-28