SOTAVerified

Open Vocabulary Semantic Segmentation

Papers

Showing 76–100 of 113 papers

TitleStatusHype
SILC: Improving Vision Language Pretraining with Self-Distillation—0
Parameter-efficient Fine-tuning in Hyperspherical Space for Open-vocabulary Semantic Segmentation—0
CUS3D :CLIP-based Unsupervised 3D Segmentation via Object-level Denoise—0
From Open-Vocabulary to Vocabulary-Free Semantic Segmentation—0
Generalizable Semantic Vision Query Generation for Zero-shot Panoptic and Semantic Segmentation—0
Rethinking the Global Knowledge of CLIP in Training-Free Open-Vocabulary Semantic Segmentation—0
Personalized OVSS: Understanding Personal Concept in Open-Vocabulary Semantic Segmentation—0
EAGLE: Efficient Adaptive Geometry-based Learning in Cross-view Understanding—0
Image-to-Image Matching via Foundation Models: A New Perspective for Open-Vocabulary Semantic Segmentation—0
Incorporating Feature Pyramid Tokenization and Open Vocabulary Semantic Segmentation—0
Dual Semantic Guidance for Open Vocabulary Semantic Segmentation—0
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation—0
ClearCLIP: Decomposing CLIP Representations for Dense Vision-Language Inference—0
Class Enhancement Losses with Pseudo Labels for Zero-shot Semantic Segmentation—0
RadZero: Similarity-Based Cross-Attention for Explainable Vision-Language Alignment in Radiology with Zero-Shot Multi-Task Capability—0
Training-Free Open-Vocabulary Segmentation with Offline Diffusion-Augmented Prototype Generation—0
Bridging Generative and Discriminative Models for Unified Visual Perception with Diffusion Priors—0
LMSeg: Unleashing the Power of Large-Scale Models for Open-Vocabulary Semantic Segmentation—0
Understanding Fine-tuning CLIP for Open-vocabulary Semantic Segmentation in Hyperbolic Space—0
DPSeg: Dual-Prompt Cost Volume Learning for Open-Vocabulary Semantic Segmentation—0
3D Vision-Language Gaussian Splatting—0
MROVSeg: Breaking the Resolution Curse of Vision-Language Models in Open-Vocabulary Image Segmentation—0
Multi-Grained Cross-modal Alignment for Learning Open-vocabulary Semantic Segmentation from Text Supervision—0
Multi-robot autonomous 3D reconstruction using Gaussian splatting with Semantic guidance—0
MVP-SEG: Multi-View Prompt Learning for Open-Vocabulary Semantic Segmentation—0
Show:102550
← PrevPage 4 of 5Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1HyperSegmIoU64.6—Unverified
2SILCmIoU63.5—Unverified
3CAT-SegmIoU63.3—Unverified
4MaskCLIP++mIoU62.5—Unverified
5CLIPSelfmIoU62.3—Unverified
6UMG-CLIP-L/14mIoU61—Unverified
7SEDmIoU60.6—Unverified
8Mask-AdaptermIoU60.4—Unverified
9EBSeg-LmIoU60.2—Unverified
10MAFT+mIoU59.4—Unverified
#ModelMetricClaimedVerifiedStatus
1UMG-CLIP-E/14mIoU38.2—Unverified
2MaskCLIP++mIoU38.2—Unverified
3Mask-AdaptermIoU38.2—Unverified
4CAT-SegmIoU37.9—Unverified
5SILCmIoU37.7—Unverified
6UMG-CLIP-L/14mIoU36.1—Unverified
7MAFT+mIoU36.1—Unverified
8OVSeg + OpenDASmIoU35.8—Unverified
9SEDmIoU35.2—Unverified
10CLIPSelfmIoU34.5—Unverified
#ModelMetricClaimedVerifiedStatus
1UMG-CLIP-E/14mIoU17.3—Unverified
2MaskCLIP++mIoU16.8—Unverified
3Mask-AdaptermIoU16.2—Unverified
4CAT-SegmIoU16—Unverified
5UMG-CLIP-L/14mIoU15.4—Unverified
6MAFT+mIoU15.1—Unverified
7SILCmIoU15—Unverified
8PosSAMmIoU14.9—Unverified
9FC-CLIPmIoU14.8—Unverified
10SCANmIoU14—Unverified
#ModelMetricClaimedVerifiedStatus
1UMG-CLIP-L/14mIoU97.9—Unverified
2SILCmIoU97.6—Unverified
3SCANmIoU97.2—Unverified
4CAT-SegmIoU97—Unverified
5MaskCLIP++mIoU96.8—Unverified
6MAFT+mIoU96.5—Unverified
7EBSeg-LmIoU96.4—Unverified
8FC-CLIPmIoU95.4—Unverified
9OVSeg Swin-BmIoU94.5—Unverified
10HyperSegmIoU92.1—Unverified
#ModelMetricClaimedVerifiedStatus
1SILCmIoU25.8—Unverified
2UMG-CLIP-E/14mIoU25.2—Unverified
3MaskCLIP++mIoU23.9—Unverified
4CAT-SegmIoU23.8—Unverified
5UMG-CLIP-L/14mIoU23.2—Unverified
6Mask-AdaptermIoU22.7—Unverified
7SEDmIoU22.6—Unverified
8MAFT+mIoU21.6—Unverified
9EBSeg-LmIoU21—Unverified
10FC-CLIPmIoU18.2—Unverified
#ModelMetricClaimedVerifiedStatus
1POMPHIoU39.1—Unverified
2ZSSegHIoU37.8—Unverified
3ZegFormerHIoU34.8—Unverified
4TTD (TCL)mIoU23.7—Unverified
5LaVGmIoU23.2—Unverified
6CLIP Surgery (original CLIP without any fine-tuning)mIoU21.9—Unverified
7TTD (MaskCLIP)mIoU19.4—Unverified
#ModelMetricClaimedVerifiedStatus
1FC-CLIPmIoU56.2—Unverified
2SimSegmIoU34.5—Unverified
3TTD (TCL)mIoU32—Unverified
4CLIP Surgery (CLIP without any fine-tuning)mIoU31.4—Unverified
5TTD (MaskCLIP)mIoU27—Unverified
#ModelMetricClaimedVerifiedStatus
1UMG-CLIP-E/14mIoU85.4—Unverified
2CAT-SegmIoU82.5—Unverified
3SILCmIoU82.5—Unverified
4FC-CLIPmIoU81.8—Unverified
#ModelMetricClaimedVerifiedStatus
1SkySense-OmIoU-43.9—Unverified
2SegEarth-OVmIoU-21.7—Unverified
#ModelMetricClaimedVerifiedStatus
1PACLmIoU38.8—Unverified
#ModelMetricClaimedVerifiedStatus
1SkySense-OmIoU8.3—Unverified
#ModelMetricClaimedVerifiedStatus
1SkySense-OmIoU54.1—Unverified
#ModelMetricClaimedVerifiedStatus
1SkySense-OmIoU30.89—Unverified
#ModelMetricClaimedVerifiedStatus
1SkySense-OmIoU32.12—Unverified