SOTAVerified

Text Clustering

Grouping a set of texts in such a way that objects in the same group (called a cluster) are more similar (in some sense) to each other than to those in other groups (clusters). (Source: Adapted from Wikipedia)

Papers

Showing 51–75 of 123 papers

TitleStatusHype
Learning Thematic Similarity Metric from Article Sections Using Triplet Networks—0
LITA: An Efficient LLM-assisted Iterative Topic Augmentation Framework—0
LMSim : Computing Domain-specific Semantic Word Similarities Using a Language Modeling Approach—0
Localize, Group, and Select: Boosting Text-VQA by Scene Text Modeling—0
Moving Past Single Metrics: Exploring Short-Text Clustering Across Multiple Resolutions—0
Accounting ngrams and multi-word terms can improve topic models—0
Mutual Clustering on Comparative Texts via Heterogeneous Information Networks—0
Neural Text Classification by Jointly Learning to Cluster and Align—0
Neural Topic Modeling with Deep Mutual Information Estimation—0
News clustering approach based on discourse text structure—0
No Pattern, No Recognition: a Survey about Reproducibility and Distortion Issues of Text Clustering and Topic Modeling—0
Notes on using Determinantal Point Processes for Clustering with Applications to Text Clustering—0
Post-Retrieval Clustering Using Third-Order Similarity Measures—0
QurSim: A corpus for evaluation of relatedness in short texts—0
Representation Learning for Short Text Clustering—0
Robust Multi-Relational Clustering via _1-Norm Symmetric Nonnegative Matrix Factorization—0
Self-supervised Document Clustering Based on BERT with Data Augment—0
Semi-supervised Clustering for Short Text via Deep Representation Learning—0
Semi-Supervised Clustering with Contrastive Learning for Discovering New Intents—0
Sequential Embedding Induced Text Clustering, a Non-parametric Bayesian Approach—0
Short Text Clustering with Transformers—0
Subgroup Detection in Ideological Discussions—0
Text Classification and Clustering with Annealing Soft Nearest Neighbor Loss—0
Text Classification for Azerbaijani Language Using Machine Learning and Embedding—0
Text clustering applied to data augmentation in legal contexts—0
Show:102550
← PrevPage 3 of 5Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1ST5-XXLV-Measure43.71—Unverified
2MPNetV-Measure43.69—Unverified
3GTR-XXLV-Measure42.42—Unverified
4MiniLM-L6V-Measure42.35—Unverified
5ST5-XLV-Measure42.34—Unverified
6MiniLM-L12V-Measure41.81—Unverified
7ST5-LargeV-Measure41.65—Unverified
8GTR-LargeV-Measure41.6—Unverified
9GTR-XLV-Measure41.51—Unverified
10ContrieverV-Measure41.1—Unverified
#ModelMetricClaimedVerifiedStatus
1G-BATAccuracy41.25—Unverified
2BATAccuracy35.66—Unverified
#ModelMetricClaimedVerifiedStatus
1Vector Space ModelRelated Headlines85—Unverified