SOTAVerified

Robot Manipulation

Papers

Showing 151–200 of 430 papers

TitleStatusHype
Cross-Embodiment Robot Manipulation Skill Transfer using Latent Space AlignmentCode1
SAM-E: Leveraging Visual Foundation Model with Sequence Imitation for Embodied Manipulation—0
Vision-based Manipulation from Single Human Video with Open-World Object Graphs—0
Learning to Recover from Plan Execution Errors during Robot Manipulation: A Neuro-symbolic Approach—0
Self-Corrected Multimodal Large Language Model for End-to-End Robot Manipulation—0
Octo: An Open-Source Generalist Robot Policy—0
DiffGen: Robot Demonstration Generation via Differentiable Physics Simulation, Differentiable Rendering, and Vision-Language Model—0
Evaluating Real-World Robot Manipulation Policies in SimulationCode5
From LLMs to Actions: Latent Codes as Bridges in Hierarchical Robot Control—0
Diff-IP2D: Diffusion-Based Hand-Object Interaction Prediction on Egocentric VideosCode1
LTLDoG: Satisfying Temporally-Extended Symbolic Constraints for Safe Diffusion-based PlanningCode1
Track2Act: Predicting Point Tracks from Internet Videos enables Generalizable Robot Manipulation—0
DrS: Learning Reusable Dense Rewards for Multi-Stage TasksCode1
Vision-based robot manipulation of transparent liquid containers in a laboratory settingCode1
Closed Loop Interactive Embodied Reasoning for Robot Manipulation—0
Deep SE(3)-Equivariant Geometric Reasoning for Precise Placement TasksCode1
Sketch-Plan-Generalize: Learning and Planning with Neuro-Symbolic Programmatic Representations for Inductive Spatial Concepts—0
Interactive Learning of Physical Object Properties Through Robot Manipulation and Database of Object MeasurementsCode0
A Neuromorphic Approach to Obstacle Avoidance in Robot Manipulation—0
Active Exploration in Bayesian Model-based Reinforcement Learning for Robot Manipulation—0
Accelerating Search-Based Planning for Multi-Robot Manipulation by Leveraging Online-Generated Experiences—0
RiEMann: Near Real-Time SE(3)-Equivariant Robot Manipulation without Point Cloud Segmentation—0
Grounding Language Plans in Demonstrations Through Counterfactual Perturbations—0
RPMArt: Towards Robust Perception and Manipulation for Articulated ObjectsCode1
COBRA-PPM: A Causal Bayesian Reasoning Architecture Using Probabilistic Programming for Robot Manipulation Under Uncertainty—0
ViSaRL: Visual Reinforcement Learning Guided by Human Saliency—0
Diffusion-Reinforcement Learning Hierarchical Motion Planning in Multi-agent Adversarial GamesCode1
NaturalVLM: Leveraging Fine-grained Natural Language for Affordance-Guided Visual Manipulation—0
3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D RepresentationsCode5
Never-Ending Behavior-Cloning Agent for Robotic Manipulation—0
Enhancing Robotic Manipulation with AI Feedback from Multimodal Large Language Models—0
RoboScript: Code Generation for Free-Form Manipulation Tasks across Real and Simulation—0
DINOBot: Robot Manipulation via Retrieval and Alignment with Vision Foundation Models—0
3D Diffuser Actor: Policy Diffusion with 3D Scene RepresentationsCode3
3D Diffuser Actor: Policy Diffusion with 3D Scene RepresentationsCode3
On the Vulnerability of LLM/VLM-Controlled RoboticsCode7
Learning by Watching: A Review of Video-based Learning Approaches for Robot Manipulation—0
Robot Trajectron: Trajectory Prediction-based Shared Control for Robot ManipulationCode2
DiffClone: Enhanced Behaviour Cloning in Robotics with Diffusion-Driven Policy LearningCode0
Learning from Imperfect Demonstrations with Self-Supervision for Robotic Manipulation—0
Efficient Training of Generalizable Visuomotor Policies via Control-Aware Augmentation—0
Multi-task real-robot data with gaze attention for dual-arm fine manipulation—0
Robo-ABC: Affordance Generalization Beyond Categories via Semantic Correspondence for Robot Manipulation—0
MOTO: Offline Pre-training to Online Fine-tuning for Model-based Robot Learning—0
Generate Subgoal Images before Act: Unlocking the Chain-of-Thought Reasoning in Diffusion Model for Robot Manipulation with Multimodal Prompts—0
ManipLLM: Embodied Multimodal Large Language Model for Object-Centric Robotic Manipulation—0
Unleashing Large-Scale Video Generative Pre-training for Visual Robot ManipulationCode2
Improving Environment Robustness of Deep Reinforcement Learning Approaches for Autonomous Racing Using Bayesian Optimization-based Curriculum LearningCode0
Decoupling Meta-Reinforcement Learning with Gaussian Task Contexts and SkillsCode0
On the Role of the Action Space in Robot Manipulation Learning and Sim-to-Real Transfer—0
Show:102550
← PrevPage 4 of 9Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1DreamVLAavg. sequence length (D to D)4.44—Unverified
2VPPavg. sequence length (D to D)4.29—Unverified
3RoboVLMsavg. sequence length (D to D)4.25—Unverified
4Openhelixavg. sequence length (D to D)4.08—Unverified
5UP-VLAavg. sequence length (D to D)4.08—Unverified
6GR-MGavg. sequence length (D to D)4.04—Unverified
7MoDEavg. sequence length (D to D)4.01—Unverified
8RoboUniViewavg. sequence length (D to D)3.86—Unverified
9UniVLAavg. sequence length (D to D)3.8—Unverified
10RoboDualavg. sequence length (D to D)3.66—Unverified
#ModelMetricClaimedVerifiedStatus
1EquActSucc. Rate (18 tasks, 100 demo/task)89.4—Unverified
2SAM2ActSucc. Rate (18 tasks, 100 demo/task)86.8—Unverified
3ARP+Succ. Rate (18 tasks, 100 demo/task)84.9—Unverified
43D-LOTUSSucc. Rate (18 tasks, 100 demo/task)83.1—Unverified
5RVT-2Succ. Rate (18 tasks, 100 demo/task)81.4—Unverified
63D Diffuser ActorSucc. Rate (18 tasks, 100 demo/task)81.3—Unverified
7Mini DiffuserSucc. Rate (18 tasks, 100 demo/task)77.6—Unverified
8SAM-ESucc. Rate (18 tasks, 100 demo/task)70.6—Unverified
9Auto-λSucc. Rate (10 tasks, 100 demos/task)69.3—Unverified
10Act3DSucc. Rate (18 tasks, 100 demo/task)65—Unverified
#ModelMetricClaimedVerifiedStatus
1SoFarVisual Matching0.75—Unverified
2SpatialVLAVisual Matching0.72—Unverified
3Dita-300MVisual Matching0.69—Unverified
4RT-2-XVisual Matching0.61—Unverified
5RoboVLMVisual Matching0.56—Unverified
6RT-1-XVisual Matching0.53—Unverified
7TraceVLAVisual Matching0.46—Unverified
8OpenVLAVisual Matching0.28—Unverified
9Octo-BaseVisual Matching0.17—Unverified
#ModelMetricClaimedVerifiedStatus
1SDPSucc. Rate (12 tasks, 100 demo/task)76—Unverified
2EquiDiff (Voxel)Succ. Rate (12 tasks, 100 demo/task)63.9—Unverified
3EquiDiff (Image)Succ. Rate (12 tasks, 100 demo/task)53.7—Unverified
4DP (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)42—Unverified
5DP3 (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)23.9—Unverified
6BC RNN (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)22.9—Unverified
7ACT (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)21.3—Unverified
#ModelMetricClaimedVerifiedStatus
1SoFarAverage0.58—Unverified
2SpatialVLAAverage0.34—Unverified
3Octo-SmallAverage0.3—Unverified
4Octo-BaseAverage0.16—Unverified
5RoboVLMAverage0.14—Unverified
6RT-1-XAverage0.01—Unverified
7OpenVLAAverage0.01—Unverified