SOTAVerified

Video Saliency Prediction

Papers

Showing 1–29 of 29 papers

TitleStatusHype
Text-Audio-Visual-conditioned Diffusion Model for Video Saliency Prediction—0
DTFSal: Audio-Visual Dynamic Token Fusion for Video Saliency Prediction—0
Minimalistic Video Saliency Prediction via Efficient Decoder & Spatio Temporal Action Cues—0
Relevance-guided Audio Visual Fusion for Video Saliency Prediction—0
AIM 2024 Challenge on Video Saliency Prediction: Methods and ResultsCode1
CaRDiff: Video Salient Object Ranking Chain of Thought Reasoning for Saliency Prediction with Diffusion—0
SalFoM: Dynamic Saliency Prediction with Video Foundation Models—0
Transformer-based Video Saliency Prediction with High Temporal Dimension Decoding—0
UniST: Towards Unifying Saliency Transformer for Video Saliency Prediction and Detection—0
Spherical Vision Transformer for 360-degree Video Saliency PredictionCode1
CASP-Net: Rethinking Video Saliency Prediction from an Audio-VisualConsistency Perceptual Perspective—0
TinyHD: Efficient Video Saliency Prediction with Heterogeneous Decoders using Hierarchical Maps DistillationCode1
CASP-Net: Rethinking Video Saliency Prediction From an Audio-Visual Consistency Perceptual Perspective—0
GASP: Gated Attention For Saliency PredictionCode1
Spatio-Temporal Self-Attention Network for Video Saliency PredictionCode1
Noise-Aware Video Saliency PredictionCode0
ViNet: Pushing the limits of Visual Modality for Audio-Visual Saliency PredictionCode1
Hierarchical Domain-Adapted Feature Learning for Video Saliency PredictionCode1
Video Saliency Prediction Using Enhanced Spatiotemporal Alignment NetworkCode1
Simple vs complex temporal recurrences for video saliency predictionCode0
Learning to Explore Intrinsic Saliency for Stereoscopic Video—0
DAVE: A Deep Audio-Visual Embedding for Dynamic Saliency PredictionCode0
Model-guided Multi-path Knowledge Aggregation for Aerial Saliency Prediction—0
DeepVS: A Deep Learning Based Video Saliency Prediction ApproachCode0
Temporal Saliency Adaptation in Egocentric VideosCode0
Video Saliency Detection by 3D Convolutional Neural Networks—0
Benchmark 3D eye-tracking dataset for visual saliency prediction on stereoscopic 3D video—0
A Learning-Based Visual Saliency Prediction Model for Stereoscopic 3D Video (LBVS-3D)Code0
Predicting Video Saliency with Object-to-Motion CNN and Two-layer Convolutional LSTMCode0
Show:102550

No leaderboard results yet.