SOTAVerified

Robot Manipulation

Papers

Showing 301–350 of 430 papers

TitleStatusHype
COCOI: Contact-aware Online Context Inference for Generalizable Non-planar Pushing—0
Surfer: Progressive Reasoning with World Models for Robotic Manipulation—0
Robo2VLM: Visual Question Answering from Large-Scale In-the-Wild Robot Manipulation Datasets—0
Robo-ABC: Affordance Generalization Beyond Categories via Semantic Correspondence for Robot Manipulation—0
RoboAgent: Generalization and Efficiency in Robot Manipulation via Semantic Augmentations and Action Chunking—0
Coarse-to-Fine Imitation Learning: Robot Manipulation from a Single Demonstration—0
From Mystery to Mastery: Failure Diagnosis for Improving Manipulation Policies—0
RoboMamba: Efficient Vision-Language-Action Model for Robotic Reasoning and Manipulation—0
RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation—0
RoboScript: Code Generation for Free-Form Manipulation Tasks across Real and Simulation—0
RoboSpatial: Teaching Spatial Understanding to 2D and 3D Vision-Language Models for Robotics—0
RoboTAP: Tracking Arbitrary Points for Few-Shot Visual Imitation—0
Robot Deformable Object Manipulation via NMPC-generated Demonstrations in Deep Reinforcement Learning—0
Robot Fine-Tuning Made Easy: Pre-Training Rewards and Policies for Autonomous Real-World Reinforcement Learning—0
Robot Manipulation in Salient Vision through Referring Image Segmentation and Geometric Constraints—0
Goal-conditioned dual-action imitation learning for dexterous dual-arm robot manipulation—0
Closed Loop Interactive Embodied Reasoning for Robot Manipulation—0
CLAS: Coordinating Multi-Robot Manipulation with Central Latent Action Spaces—0
RoBridge: A Hierarchical Architecture Bridging Cognition and Execution for General Robotic Manipulation—0
Robust Instant Policy: Leveraging Student's t-Regression Model for Robust In-context Imitation Learning of Robot Manipulation—0
Chain of Thought Imitation with Procedure Cloning—0
Category-level Object Detection, Pose Estimation and Reconstruction from Stereo Images—0
CapsDT: Diffusion-Transformer for Capsule Robot Manipulation—0
Can Foundation Models Perform Zero-Shot Task Specification For Robot Manipulation?—0
RT-Affordance: Affordances are Versatile Intermediate Representations for Robot Manipulation—0
BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models—0
Bottom-Up Skill Discovery from Unsegmented Demonstrations for Long-Horizon Robot Manipulation—0
S^2-Diffusion: Generalizing from Instance-level to Category-level Skills in Robot Manipulation—0
SAM-E: Leveraging Visual Foundation Model with Sequence Imitation for Embodied Manipulation—0
WorldEval: World Model as Real-World Robot Policies Evaluator—0
Scaling Robot Supervision to Hundreds of Hours with RoboTurk: Robotic Manipulation Dataset through Human Reasoning and Dexterity—0
Bi-Manual Joint Camera Calibration and Scene Representation—0
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning—0
Bias-reduced Multi-step Hindsight Experience Replay for Efficient Multi-goal Reinforcement Learning—0
Beyond Sight: Finetuning Generalist Robot Policies with Heterogeneous Sensors via Language Grounding—0
SEAL: Semantic Frame Execution And Localization for Perceiving Afforded Robot Actions—0
Select before Act: Spatially Decoupled Action Repetition for Continuous Control—0
Self-Corrected Multimodal Large Language Model for End-to-End Robot Manipulation—0
Self-Supervised Learning of Multi-Object Keypoints for Robotic Manipulation—0
Self-Supervised Learning of State Estimation for Manipulating Deformable Linear Objects—0
Benchmarking Robot Manipulation with the Rubik's Cube—0
Semantically Controllable Augmentations for Generalizable Robot Learning—0
WorldSimBench: Towards Video Generation Models as World Simulators—0
X-Sim: Cross-Embodiment Learning via Real-to-Sim-to-Real—0
SEM: Enhancing Spatial Understanding for Robust Robot Manipulation—0
SENIOR: Efficient Query Selection and Preference-Guided Exploration in Preference-based Reinforcement Learning—0
Should I Run Offline Reinforcement Learning or Behavioral Cloning?—0
A Taxonomy for Evaluating Generalist Robot Policies—0
YOLOPose: Transformer-based Multi-Object 6D Pose Estimation using Keypoint Regression—0
Sim2Real Viewpoint Invariant Visual Servoing by Recurrent Control—0
Show:102550
← PrevPage 7 of 9Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1DreamVLAavg. sequence length (D to D)4.44—Unverified
2VPPavg. sequence length (D to D)4.29—Unverified
3RoboVLMsavg. sequence length (D to D)4.25—Unverified
4Openhelixavg. sequence length (D to D)4.08—Unverified
5UP-VLAavg. sequence length (D to D)4.08—Unverified
6GR-MGavg. sequence length (D to D)4.04—Unverified
7MoDEavg. sequence length (D to D)4.01—Unverified
8RoboUniViewavg. sequence length (D to D)3.86—Unverified
9UniVLAavg. sequence length (D to D)3.8—Unverified
10RoboDualavg. sequence length (D to D)3.66—Unverified
#ModelMetricClaimedVerifiedStatus
1EquActSucc. Rate (18 tasks, 100 demo/task)89.4—Unverified
2SAM2ActSucc. Rate (18 tasks, 100 demo/task)86.8—Unverified
3ARP+Succ. Rate (18 tasks, 100 demo/task)84.9—Unverified
43D-LOTUSSucc. Rate (18 tasks, 100 demo/task)83.1—Unverified
5RVT-2Succ. Rate (18 tasks, 100 demo/task)81.4—Unverified
63D Diffuser ActorSucc. Rate (18 tasks, 100 demo/task)81.3—Unverified
7Mini DiffuserSucc. Rate (18 tasks, 100 demo/task)77.6—Unverified
8SAM-ESucc. Rate (18 tasks, 100 demo/task)70.6—Unverified
9Auto-λSucc. Rate (10 tasks, 100 demos/task)69.3—Unverified
10Act3DSucc. Rate (18 tasks, 100 demo/task)65—Unverified
#ModelMetricClaimedVerifiedStatus
1SoFarVisual Matching0.75—Unverified
2SpatialVLAVisual Matching0.72—Unverified
3Dita-300MVisual Matching0.69—Unverified
4RT-2-XVisual Matching0.61—Unverified
5RoboVLMVisual Matching0.56—Unverified
6RT-1-XVisual Matching0.53—Unverified
7TraceVLAVisual Matching0.46—Unverified
8OpenVLAVisual Matching0.28—Unverified
9Octo-BaseVisual Matching0.17—Unverified
#ModelMetricClaimedVerifiedStatus
1SDPSucc. Rate (12 tasks, 100 demo/task)76—Unverified
2EquiDiff (Voxel)Succ. Rate (12 tasks, 100 demo/task)63.9—Unverified
3EquiDiff (Image)Succ. Rate (12 tasks, 100 demo/task)53.7—Unverified
4DP (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)42—Unverified
5DP3 (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)23.9—Unverified
6BC RNN (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)22.9—Unverified
7ACT (Evaluated in EquiDiff)Succ. Rate (12 tasks, 100 demo/task)21.3—Unverified
#ModelMetricClaimedVerifiedStatus
1SoFarAverage0.58—Unverified
2SpatialVLAAverage0.34—Unverified
3Octo-SmallAverage0.3—Unverified
4Octo-BaseAverage0.16—Unverified
5RoboVLMAverage0.14—Unverified
6RT-1-XAverage0.01—Unverified
7OpenVLAAverage0.01—Unverified