SOTAVerified

Document Classification

Document Classification is a procedure of assigning one or more labels to a document from a predetermined set of labels.

Source: Long-length Legal Document Classification

Papers

Showing 51–100 of 641 papers

TitleStatusHype
Improving Document Classification with Multi-Sense EmbeddingsCode1
Text Classification Using Label Names Only: A Language Model Self-Training ApproachCode1
Pre-training technique to localize medical BERT and enhance biomedical BERTCode1
Bridge Correlational Neural Networks for Multilingual Multimodal Representation LearningCode1
Are Large Language Models Ready for Healthcare? A Comparative Study on Clinical Language UnderstandingCode1
A Comparative Study of Pretrained Language Models for Long Clinical TextCode1
GeoGalactica: A Scientific Large Language Model in GeoscienceCode1
ANLS* -- A Universal Document Processing Metric for Generative Large Language ModelsCode1
Hierarchical Metadata-Aware Document Categorization under Weak SupervisionCode1
German's Next Language ModelCode1
A Sentence-level Hierarchical BERT Model for Document Classification with Limited Labelled DataCode1
Graph Attention NetworksCode1
Bioformer: an efficient transformer language model for biomedical text miningCode1
Aspect-based Document Similarity for Research PapersCode1
Three-level Hierarchical Transformer Networks for Long-sequence and Multiple Clinical Documents ClassificationCode1
Classification Benchmarks for Under-resourced Bengali Language based on Multichannel Convolutional-LSTM NetworkCode1
Can a Fruit Fly Learn Word Embeddings?Code1
Hierarchical Transformers for Long Document ClassificationCode1
HPI-DHC at TREC 2018 Precision Medicine TrackCode1
ChordMixer: A Scalable Neural Attention Model for Sequences with Different LengthsCode1
ContraDoc: Understanding Self-Contradictions in Documents with Large Language ModelsCode1
Clinical-Longformer and Clinical-BigBird: Transformers for long clinical sequencesCode1
L3Cube-IndicNews: News-based Short Text and Long Document Classification Datasets in Indic LanguagesCode1
Benchmarking large language models for biomedical natural language processing applications and recommendationsCode1
Data Programming by Demonstration: A Framework for Interactively Learning Labeling FunctionsCode1
Improving Language Understanding by Generative Pre-TrainingCode1
MAGNET: Multi-Label Text Classification using Attention-based Graph Neural NetworkCode1
Massively Multilingual Sentence Embeddings for Zero-Shot Cross-Lingual Transfer and BeyondCode1
MultiEURLEX - A multi-lingual and multi-label legal document classification dataset for zero-shot cross-lingual transferCode1
MultiFiT: Efficient Multi-lingual Language Model Fine-tuningCode1
Multilingual and cross-lingual document classification: A meta-learning approachCode1
Multilingual Twitter Corpus and Baselines for Evaluating Demographic Bias in Hate Speech RecognitionCode1
TagRuler: Interactive Tool for Span-Level Data Programming by DemonstrationCode1
DocXClassifier: High Performance Explainable Deep Network for Document Image ClassificationCode1
SPECTER: Document-level Representation Learning using Citation-informed TransformersCode1
Glyce: Glyph-vectors for Chinese Character RepresentationsCode0
GloVe: Global Vectors for Word RepresentationCode0
GVdoc: Graph-based Visual Document ClassificationCode0
A Confidence-Calibrated MOBA Game Winner PredictorCode0
A Robust Hybrid Approach for Textual Document ClassificationCode0
Generative Topic Embedding: a Continuous Representation of Documents (Extended Version with Proofs)Code0
Geometric deep learning on graphs and manifolds using mixture model CNNsCode0
AraDIC: Arabic Document Classification using Image-Based Character Embeddings and Class-Balanced LossCode0
Exploring Topic Coherence over Many Models and Many TopicsCode0
Corpus-level and Concept-based Explanations for Interpretable Document ClassificationCode0
FLAG: Financial Long Document Classification via AMR-based GNNCode0
Generalized Sobolev Transport for Probability Measures on a GraphCode0
A La Carte Embedding: Cheap but Effective Induction of Semantic Feature VectorsCode0
BilBOWA: Fast Bilingual Distributed Representations without Word AlignmentsCode0
Anytime Active LearningCode0
Show:102550
← PrevPage 2 of 13Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1ApproxRepSetAccuracy97.17—Unverified
2REL-RWMD k-NNAccuracy95.61—Unverified
3Orthogonalized Soft VSMAccuracy92.65—Unverified
4MAGNETF189.9—Unverified
5VLAWEF189.3—Unverified
6KD-LSTMregF188.9—Unverified
7LSTM-reg (single model)F187—Unverified
8SCDV-MSF182.71—Unverified
#ModelMetricClaimedVerifiedStatus
1ACNetAccuracy83.5—Unverified
2LGCNAccuracy83.3—Unverified
3GATAccuracy83—Unverified
4MoNetAccuracy81.7—Unverified
5DeepWalkAccuracy67.2—Unverified
#ModelMetricClaimedVerifiedStatus
1BioLinkBERT (large)F188.1—Unverified
2NCBI_BERT(large) (P)F187.3—Unverified
3SciFive-largeF186.08—Unverified
4BioGPTMicro F185.12—Unverified
5PubMedBERT uncasedMicro F182.32—Unverified
#ModelMetricClaimedVerifiedStatus
1MPAD-pathAccuracy99.59—Unverified
2Orthogonalized Soft VSMAccuracy97.73—Unverified
3ApproxRepSetAccuracy95.73—Unverified
4REL-RWMD k-NNAccuracy95.18—Unverified
#ModelMetricClaimedVerifiedStatus
1ApproxRepSetAccuracy94.31—Unverified
2Orthogonalized Soft VSMAccuracy93.42—Unverified
3REL-RWMD k-NNAccuracy93.03—Unverified
#ModelMetricClaimedVerifiedStatus
1ApproxRepSetAccuracy72.6—Unverified
2REL-RWMD k-NNAccuracy71.05—Unverified
3Orthogonalized Soft VSMAccuracy69.21—Unverified
#ModelMetricClaimedVerifiedStatus
1KD-LSTMregF172.9—Unverified
2MAGNETF169.6—Unverified
#ModelMetricClaimedVerifiedStatus
1REL-RWMD k-NNAccuracy96.85—Unverified
2ApproxRepSetAccuracy96.24—Unverified
#ModelMetricClaimedVerifiedStatus
1Document Classification Using Importance of SentencesAccuracy54.8—Unverified
2LSTM-reg (single model)Accuracy52.8—Unverified
#ModelMetricClaimedVerifiedStatus
1ApproxRepSetAccuracy59.06—Unverified
2REL-RWMD k-NNAccuracy56.8—Unverified
#ModelMetricClaimedVerifiedStatus
1SPECTERF1 (micro)82—Unverified
2SciNCLF1 (micro)81.4—Unverified
#ModelMetricClaimedVerifiedStatus
1SciNCLF1 (micro)88.7—Unverified
2SPECTERF1 (micro)86.4—Unverified
#ModelMetricClaimedVerifiedStatus
1ConvTextTMAccuracy91.28—Unverified
2HDLTexAccuracy90.93—Unverified
#ModelMetricClaimedVerifiedStatus
1ChuLoAccuracy95.38—Unverified
#ModelMetricClaimedVerifiedStatus
1ChuLoAccuracy64.4—Unverified
#ModelMetricClaimedVerifiedStatus
1MPAD-pathAccuracy89.81—Unverified
#ModelMetricClaimedVerifiedStatus
1BilBOWAAccuracy75—Unverified
#ModelMetricClaimedVerifiedStatus
1BilBOWAAccuracy86.5—Unverified
#ModelMetricClaimedVerifiedStatus
1HDLTexAccuracy86.07—Unverified
#ModelMetricClaimedVerifiedStatus
1HDLTexAccuracy76.58—Unverified
#ModelMetricClaimedVerifiedStatus
1KD-LSTMregAccuracy69.4—Unverified