SOTAVerified

Visual Navigation

Visual Navigation is the problem of navigating an agent, e.g. a mobile robot, in an environment using camera input only. The agent is given a target image (an image it will see from the target position), and its goal is to move from its current position to the target by applying a sequence of actions, based on the camera observations only.

Source: Vision-based Navigation Using Deep Reinforcement Learning

Papers

Showing 251–300 of 316 papers

TitleStatusHype
Multimodal Aggregation Approach for Memory Vision-Voice Indoor Navigation with Meta-Learning—0
Exploiting Scene-specific Features for Object Goal Navigation—0
Exploring the Impacts from Datasets to Monocular Depth Estimation (MDE) Models with MineNavi—0
Point Cloud Based Reinforcement Learning for Sim-to-Real and Partial Observability in Visual Navigation—0
Virtual Testbed for Monocular Visual Navigation of Small Unmanned Aircraft Systems—0
Explore then Execute: Adapting without Rewards via Factorized Meta-Reinforcement Learning—0
DeepRelativeFusion: Dense Monocular SLAM using Single-Image Relative Depth Prediction—0
Neural Topological SLAM for Visual Navigation—0
Dynamic Value Estimation for Single-Task Multi-Scene Reinforcement Learning—0
VisualEchoes: Spatial Image Representation Learning through Echolocation—0
Improving Target-driven Visual Navigation with Attention on 3D Spatial Relationships—0
Approximate Inverse Reinforcement Learning from Vision-based Imitation Learning—0
Optimistic Agent: Accurate Graph-Based Value Estimation for More Successful Visual Navigation—0
From Seeing to Moving: A Survey on Learning for Visual Indoor Navigation (VIN)—0
Perception and Navigation in Autonomous Systems in the Era of Learning: A Survey—0
Improving the Generalization of Visual Navigation Policies using Invariance Regularization—0
Generating Robust Supervision for Learning-Based Visual Navigation Using Hamilton-Jacobi Reachability—0
Meta Adaptation using Importance Weighted Demonstrations—0
Unsupervised Reinforcement Learning of Transferable Meta-Skills for Embodied Navigation—0
A Hybrid Compact Neural Architecture for Visual Place RecognitionCode0
Talk2Nav: Long-Range Vision-and-Language Navigation with Dual Attention and Spatial Memory—0
Zero-shot Imitation Learning from Demonstrations for Legged Robot Visual Navigation—0
Learning Your Way Without Map or Compass: Panoramic Target Driven Visual Navigation—0
Bayesian Relational Memory for Semantic Visual NavigationCode0
Help, Anna! Visual Navigation with Natural Multimodal Assistance via Retrospective Curiosity-Encouraging Imitation LearningCode0
Improving Visual Feature Extraction in Glacial Environments—0
Situational Fusion of Visual Representation for Visual Navigation—0
Vision-based Navigation Using Deep Reinforcement LearningCode0
NeoNav: Improving the Generalization of Visual Navigation via Generating Next Expected ObservationsCode0
Universal Successor Features Based Deep Reinforcement Learning for Navigation—0
Adaptive Navigation Scheme for Optimal Deep-Sea Localization Using Multimodal Perception Cues—0
Air Learning: A Deep Reinforcement Learning Gym for Autonomous Aerial Robot Visual NavigationCode0
Shifting the Baseline: Single Modality Performance on Visual Navigation \& QA—0
SplitNet: Sim2Sim and Task2Task Transfer for Embodied Visual NavigationCode0
Graph Attention Memory for Visual Navigation—0
Drone Path-Following in GPS-Denied Environments using Convolutional NetworksCode0
Scaling and Benchmarking Self-Supervised Visual Representation LearningCode0
Cross-Task Knowledge Transfer for Visually-Grounded Navigation—0
Perceptual Attention-based Predictive Control—0
Scene Memory Transformer for Embodied Agents in Long-Horizon Tasks—0
Combining Optimal Control and Learning for Visual Navigation in Novel Environments—0
The Regretful Navigation Agent for Vision-and-Language NavigationCode0
The Regretful Agent: Heuristic-Aided Navigation through Progress EstimationCode0
A Behavioral Approach to Visual Navigation with Graph Localization Networks—0
MRS-VPR: a multi-resolution sampling based global visual place recognition method—0
Embodied Multimodal Multitask Learning—0
Learning On-Road Visual Control for Self-Driving Vehicles with Auxiliary Tasks—0
Target Driven Visual Navigation with Hybrid Asynchronous Universal Successor Representations—0
Reinforced Cross-Modal Matching and Self-Supervised Imitation Learning for Vision-Language Navigation—0
Object-oriented Targets for Visual Navigation using Rich Semantic Representations—0
Show:102550
← PrevPage 6 of 7Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1NaviLLMdist_to_end_reduction7.9—Unverified
2VLN-PETLdist_to_end_reduction6.13—Unverified
3early to beddist_to_end_reduction6.03—Unverified
4HAMTdist_to_end_reduction5.58—Unverified
5s-agent (NDH-Full)dist_to_end_reduction5.27—Unverified
6BabyWalk (r2r-pretrain)dist_to_end_reduction4.46—Unverified
7Environment-agnostic Multitask Learningdist_to_end_reduction3.91—Unverified
8BabyWalkdist_to_end_reduction3.65—Unverified
9Test2-NDHdist_to_end_reduction3.44—Unverified
10SCoAdist_to_end_reduction3.37—Unverified
#ModelMetricClaimedVerifiedStatus
1SUSAspl0.64—Unverified
2Meta-Explorespl0.61—Unverified
3NaviLLMspl0.6—Unverified
4BEV-BERTspl0.6—Unverified
5HOPspl0.59—Unverified
6DUETspl0.58—Unverified
7VLN-PETLspl0.58—Unverified
8VLN-BERTspl0.57—Unverified
9Prevalentspl0.51—Unverified
10RCM+SIL(no early exploration)spl0.38—Unverified
#ModelMetricClaimedVerifiedStatus
1AutoVLNNav-SPL27.83—Unverified
2NaviLLMNav-SPL26.26—Unverified
3Meta-ExploreNav-SPL25.8—Unverified
4SUSANav-SPL25.47—Unverified
5DUETNav-SPL21.42—Unverified
6GBENav-SPL13.3—Unverified
#ModelMetricClaimedVerifiedStatus
1MVV-INSPL (All)17.27—Unverified
2SAVNSPL (All)16.15—Unverified
#ModelMetricClaimedVerifiedStatus
1PopArt-IMPALAMedium Human-Normalized Score72.8—Unverified
#ModelMetricClaimedVerifiedStatus
1Prevalentspl28.72—Unverified