SOTAVerified

Document Classification

Document Classification is a procedure of assigning one or more labels to a document from a predetermined set of labels.

Source: Long-length Legal Document Classification

Papers

Showing 151–200 of 641 papers

TitleStatusHype
Specialized Document Embeddings for Aspect-based Similarity of Research PapersCode1
Efficient Classification of Long Documents Using Transformers—0
DocXClassifier: High Performance Explainable Deep Network for Document Image ClassificationCode1
A Survey of Historical Document Image Datasets—0
Improved Multi-label Classification under Temporal Concept Drift: Rethinking Group-Robust Algorithms in a Label-Wise SettingCode0
Semi-supervised Nonnegative Matrix Factorization for Document Classification—0
Sobolev Transport: A Scalable Metric for Probability Measures with Graph MetricsCode0
One Configuration to Rule Them All? Towards Hyperparameter Transfer in Topic Models using Multi-Objective Bayesian OptimizationCode2
Neighborhood Contrastive Learning for Scientific Document Representations with Citation EmbeddingsCode1
Moving Other Way: Exploring Word Mover Distance Extensions—0
Clinical-Longformer and Clinical-BigBird: Transformers for long clinical sequencesCode1
Importance of Textlines in Historical Document Classification—0
Recurrent Neural Networks with Mixed Hierarchical Structures and EM Algorithm for Natural Language Processing—0
Automation of Citation Screening for Systematic Literature Reviews using Neural Networks: A Replicability StudyCode0
Hierarchical Neural Network Approaches for Long Document Classification—0
ERNIE-Layout: Layout-Knowledge Enhanced Multi-modal Pre-training for Document UnderstandingCode0
Document Classification with Word Sense Knowledge—0
Intelligent Document Processing -- Methods and Tools in the real world—0
Sublinear Time Approximation of Text Similarity MatricesCode0
An Empirical Study on Transfer Learning for Privilege Review—0
Sparse Structure Learning via Graph Neural Networks for Inductive Document ClassificationCode1
Revisiting Transformer-based Models for Long Document Classification—0
Temporal Language Modeling for Short Text Document Classification with Transformers—0
Improved Multi-label Classification under Temporal Concept Drift: Rethinking Group-Robust Algorithms in a Label-Wise Setting—0
MNet-Sim: A Multi-layered Semantic Similarity Network to Evaluate Sentence Similarity—0
Feature Selective Likelihood Ratio Estimator for Low- and Zero-frequency N-grams—0
Augmentations in Graph Contrastive Learning: Current Methodological Flaws & Towards Better Practices—0
Softmax Tree: An Accurate, Fast Classifier When the Number of Classes Is Large—0
MultiEURLEX - A multi-lingual and multi-label legal document classification dataset for zero-shot cross-lingual transferCode1
Effective Convolutional Attention Network for Multi-label Clinical Document Classification—0
Beyond Text: Incorporating Metadata and Label Structure for Multi-Label Document Classification using Heterogeneous Graphs—0
Legal Terminology Extraction with the Termolator—0
Effectively Leveraging BERT for Legal Document Classification—0
Domain-adaptation of spherical embeddings—0
Comparative Study of Long Document Classification—0
Domain Agnostic Few-Shot Learning For Document Intelligence—0
Contrastive Document Representation Learning with Graph Attention Networks—0
Enhance Long Text Understanding via Distilled Gist Detector from Abstractive Summarization—0
Weakly Supervised Concept Map Generation through Task-Guided Graph TranslationCode0
JOINTLY LEARNING TOPIC SPECIFIC WORD AND DOCUMENT EMBEDDING—0
Towards Comprehensive Patent Approval Predictions:Beyond Traditional Document Classification—0
Balancing Methods for Multi-label Text Classification with Long-Tailed Class DistributionCode1
MultiEURLEX -- A multi-lingual and multi-label legal document classification dataset for zero-shot cross-lingual transferCode1
Towards Explaining STEM Document Classification using Mathematical Entity LinkingCode0
Application of Mix-Up Method in Document Classification Task Using BERT—0
Domain-Specific Japanese ELECTRA Model Using a Small Corpus—0
Improving Neural Language Processing with Named Entities—0
Exploring Out-of-Distribution Generalization in Text Classifiers Trained on Tobacco-3482 and RVL-CDIP—0
PyEuroVoc: A Tool for Multilingual Legal Document Classification with EuroVoc DescriptorsCode1
Multilingual Protest News Detection - Shared Task 1, CASE 2021—0
Show:102550
← PrevPage 4 of 13Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1ApproxRepSetAccuracy97.17—Unverified
2REL-RWMD k-NNAccuracy95.61—Unverified
3Orthogonalized Soft VSMAccuracy92.65—Unverified
4MAGNETF189.9—Unverified
5VLAWEF189.3—Unverified
6KD-LSTMregF188.9—Unverified
7LSTM-reg (single model)F187—Unverified
8SCDV-MSF182.71—Unverified
#ModelMetricClaimedVerifiedStatus
1ACNetAccuracy83.5—Unverified
2LGCNAccuracy83.3—Unverified
3GATAccuracy83—Unverified
4MoNetAccuracy81.7—Unverified
5DeepWalkAccuracy67.2—Unverified
#ModelMetricClaimedVerifiedStatus
1BioLinkBERT (large)F188.1—Unverified
2NCBI_BERT(large) (P)F187.3—Unverified
3SciFive-largeF186.08—Unverified
4BioGPTMicro F185.12—Unverified
5PubMedBERT uncasedMicro F182.32—Unverified
#ModelMetricClaimedVerifiedStatus
1MPAD-pathAccuracy99.59—Unverified
2Orthogonalized Soft VSMAccuracy97.73—Unverified
3ApproxRepSetAccuracy95.73—Unverified
4REL-RWMD k-NNAccuracy95.18—Unverified
#ModelMetricClaimedVerifiedStatus
1ApproxRepSetAccuracy94.31—Unverified
2Orthogonalized Soft VSMAccuracy93.42—Unverified
3REL-RWMD k-NNAccuracy93.03—Unverified
#ModelMetricClaimedVerifiedStatus
1ApproxRepSetAccuracy72.6—Unverified
2REL-RWMD k-NNAccuracy71.05—Unverified
3Orthogonalized Soft VSMAccuracy69.21—Unverified
#ModelMetricClaimedVerifiedStatus
1KD-LSTMregF172.9—Unverified
2MAGNETF169.6—Unverified
#ModelMetricClaimedVerifiedStatus
1REL-RWMD k-NNAccuracy96.85—Unverified
2ApproxRepSetAccuracy96.24—Unverified
#ModelMetricClaimedVerifiedStatus
1Document Classification Using Importance of SentencesAccuracy54.8—Unverified
2LSTM-reg (single model)Accuracy52.8—Unverified
#ModelMetricClaimedVerifiedStatus
1ApproxRepSetAccuracy59.06—Unverified
2REL-RWMD k-NNAccuracy56.8—Unverified
#ModelMetricClaimedVerifiedStatus
1SPECTERF1 (micro)82—Unverified
2SciNCLF1 (micro)81.4—Unverified
#ModelMetricClaimedVerifiedStatus
1SciNCLF1 (micro)88.7—Unverified
2SPECTERF1 (micro)86.4—Unverified
#ModelMetricClaimedVerifiedStatus
1ConvTextTMAccuracy91.28—Unverified
2HDLTexAccuracy90.93—Unverified
#ModelMetricClaimedVerifiedStatus
1ChuLoAccuracy95.38—Unverified
#ModelMetricClaimedVerifiedStatus
1ChuLoAccuracy64.4—Unverified
#ModelMetricClaimedVerifiedStatus
1MPAD-pathAccuracy89.81—Unverified
#ModelMetricClaimedVerifiedStatus
1BilBOWAAccuracy75—Unverified
#ModelMetricClaimedVerifiedStatus
1BilBOWAAccuracy86.5—Unverified
#ModelMetricClaimedVerifiedStatus
1HDLTexAccuracy86.07—Unverified
#ModelMetricClaimedVerifiedStatus
1HDLTexAccuracy76.58—Unverified
#ModelMetricClaimedVerifiedStatus
1KD-LSTMregAccuracy69.4—Unverified