SOTAVerified

Robot Manipulation

Papers

Showing 1–25 of 430 papers

TitleStatusHype
OpenVLA: An Open-Source Vision-Language-Action ModelCode9
On the Vulnerability of LLM/VLM-Controlled RoboticsCode7
UniVLA: Learning to Act Anywhere with Task-centric Latent ActionsCode5
3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D RepresentationsCode5
Evaluating Real-World Robot Manipulation Policies in SimulationCode5
Magma: A Foundation Model for Multimodal AI AgentsCode5
OpenHelix: A Short Survey, Empirical Analysis, and Open-Source Dual-System VLA Model for Robotic ManipulationCode3
Latent Action Pretraining from VideosCode3
Video Prediction Policy: A Generalist Robot Policy with Predictive Visual RepresentationsCode3
Affordance-based Robot Manipulation with Flow MatchingCode3
3D Diffuser Actor: Policy Diffusion with 3D Scene RepresentationsCode3
LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot LearningCode3
3D Diffuser Actor: Policy Diffusion with 3D Scene RepresentationsCode3
Towards Generalist Robot Policies: What Matters in Building Vision-Language-Action ModelsCode3
SoFar: Language-Grounded Orientation Bridges Spatial Reasoning and Object ManipulationCode3
RLVR-World: Training World Models with Reinforcement LearningCode3
PhysTwin: Physics-Informed Reconstruction and Simulation of Deformable Objects from VideosCode3
RT-1: Robotics Transformer for Real-World Control at ScaleCode3
DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World KnowledgeCode3
RVT-2: Learning Precise Manipulation from Few DemonstrationsCode3
Moto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from VideosCode2
Equivariant Diffusion PolicyCode2
FurnitureBench: Reproducible Real-World Benchmark for Long-Horizon Complex ManipulationCode2
Efficient Diffusion Transformer Policies with Mixture of Expert Denoisers for Multitask LearningCode2
Act3D: 3D Feature Field Transformers for Multi-Task Robotic ManipulationCode2
Show:102550
← PrevPage 1 of 18Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1DreamVLAavg. sequence length (D to D)4.44—Unverified
2VPPavg. sequence length (D to D)4.29—Unverified
3RoboVLMsavg. sequence length (D to D)4.25—Unverified
4Openhelixavg. sequence length (D to D)4.08—Unverified
5UP-VLAavg. sequence length (D to D)4.08—Unverified
6GR-MGavg. sequence length (D to D)4.04—Unverified
7MoDEavg. sequence length (D to D)4.01—Unverified
8RoboUniViewavg. sequence length (D to D)3.86—Unverified
9UniVLAavg. sequence length (D to D)3.8—Unverified
10RoboDualavg. sequence length (D to D)3.66—Unverified
#ModelMetricClaimedVerifiedStatus
1EquActSucc. Rate (18 tasks, 100 demo/task)89.4—Unverified
2SAM2ActSucc. Rate (18 tasks, 100 demo/task)86.8—Unverified
3ARP+Succ. Rate (18 tasks, 100 demo/task)84.9—Unverified
43D-LOTUSSucc. Rate (18 tasks, 100 demo/task)83.1—Unverified
5RVT-2Succ. Rate (18 tasks, 100 demo/task)81.4—Unverified
63D Diffuser ActorSucc. Rate (18 tasks, 100 demo/task)81.3—Unverified
7Mini DiffuserSucc. Rate (18 tasks, 100 demo/task)77.6—Unverified
8SAM-ESucc. Rate (18 tasks, 100 demo/task)70.6—Unverified
9Auto-λSucc. Rate (10 tasks, 100 demos/task)69.3—Unverified
10Act3DSucc. Rate (18 tasks, 100 demo/task)65—Unverified
#ModelMetricClaimedVerifiedStatus
1SoFarVisual Matching0.75—Unverified
2SpatialVLAVisual Matching0.72—Unverified
3Dita-300MVisual Matching0.69—Unverified
4RT-2-XVisual Matching0.61—Unverified
5RoboVLMVisual Matching0.56—Unverified
6RT-1-XVisual Matching0.53—Unverified
7TraceVLAVisual Matching0.46—Unverified
8OpenVLAVisual Matching0.28—Unverified
9Octo-BaseVisual Matching0.17—Unverified
#ModelMetricClaimedVerifiedStatus
1SDPSucc. Rate (12 tasks, 100 demo/task)76—Unverified
2EquiDiff (Voxel)Succ. Rate (12 tasks, 100 demo/task)63.9—Unverified
3EquiDiff (Image)Succ. Rate (12 tasks, 100 demo/task)53.7—Unverified
4DP (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)42—Unverified
5DP3 (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)23.9—Unverified
6BC RNN (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)22.9—Unverified
7ACT (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)21.3—Unverified
#ModelMetricClaimedVerifiedStatus
1SoFarAverage0.58—Unverified
2SpatialVLAAverage0.34—Unverified
3Octo-SmallAverage0.3—Unverified
4Octo-BaseAverage0.16—Unverified
5RoboVLMAverage0.14—Unverified
6RT-1-XAverage0.01—Unverified
7OpenVLAAverage0.01—Unverified