SOTAVerified

Language Identification

Language identification is the task of determining the language of a text.

Papers

Showing 201–250 of 794 papers

TitleStatusHype
DeepAnalyzer at SemEval-2019 Task 6: A deep learning-based ensemble method for identifying offensive tweets—0
Deep learning-based end-to-end spoken language identification system for domain-mismatched scenario—0
Automatic Identification of Closely-related Indian Languages: Resources and Experiments—0
DELab@IIITSM at ICON-2021 Shared Task: Identification of Aggression and Biasness Using Decision Tree—0
cs@DravidianLangTech-EACL2021: Offensive Language Identification Based On Multilingual BERT Model—0
Detecting Code-Switching in a Multilingual Alpine Heritage Corpus—0
Cross-Linguistic Offensive Language Detection: BERT-Based Analysis of Bengali, Assamese, & Bodo Conversational Hateful Content from Social Media—0
Detection of Similar Languages and Dialects Using Deep Supervised Autoencoder—0
Detect Language of Transliterated Texts—0
Developing Language-tagged Corpora for Code-switching Tweets—0
Automatic discovery of Latin syntactic changes—0
Development of Text and Speech database for Hindi and Indian English specific to Mobile Communication environment—0
Dialect Diversity in Text Summarization on Twitter—0
Dialects Identification of Armenian Language—0
Anglicized Words and Misspelled Cognates in Native Language Identification—0
Discriminating between Indo-Aryan Languages Using SVM Ensembles—0
Discriminating between Mandarin Chinese and Swiss-German varieties using adaptive language models—0
Discriminating between Similar Languages Using PPM—0
A Federated Learning Approach to Privacy Preserving Offensive Language Identification—0
Discriminating between Similar Languages and Arabic Dialect Identification: A Report on the Third DSL Shared Task—0
Discriminating between Similar Languages on Imbalanced Conversational Texts—0
Discriminating between Similar Languages with Word-level Convolutional Neural Networks—0
A Dataset and Classifier for Recognizing Social Media English—0
Discriminating Non-Native English with 350 Words—0
Discriminating Similar Languages with Linear SVMs and Neural Networks—0
Discriminating Similar Languages with Token-Based Backoff—0
Accurate Pinyin-English Codeswitched Language Identification—0
Cross-lingual Inductive Transfer to Detect Offensive Language—0
Distinguishing Literal and Non-Literal Usage of German Particle Verbs—0
Distributed Representations of Words and Documents for Discriminating Similar Languages—0
Distributional Interaction of Concreteness and Abstractness in Verb--Noun Subcategorisation—0
DKPro TC: A Java-based Framework for Supervised Learning Experiments on Textual Data—0
DLRG@DravidianLangTech-EACL2021: Transformer based approachfor Offensive Language Identification on Code-Mixed Tamil—0
Do Characters Abuse More Than Words?—0
Cross-domain Feature Selection for Language Identification—0
Automatic Detection of Sentence Fragments—0
An Exploratory Analysis of the Relation Between Offensive Language and Mental Health—0
Cross-corpus Native Language Identification via Statistical Embedding—0
Cross-Corpora Spoken Language Identification with Domain Diversification and Generalization—0
Duluth at SemEval-2020 Task 12: Offensive Tweet Identification in English with Logistic Regression—0
Dyn-ASR: Compact, Multilingual Speech Recognition via Spoken Language and Accent Identification—0
Efficient Discrimination Between Closely Related Languages—0
Efficiently Identifying Low-Quality Language Subsets in Multilingual Datasets: A Case Study on a Large-Scale Multilingual Audio Dataset—0
Emad at SemEval-2019 Task 6: Offensive Language Identification using Traditional Machine Learning and Deep Learning approaches—0
Automatic Detection of Intra-Word Code-Switching—0
Cross-Corpora Language Recognition: A Preliminary Investigation with Indian Languages—0
Automatic Detection of Code-switching Style from Acoustics—0
A Neural Model for Language Identification in Code-Switched Tweets—0
Enhancing Code-Switching ASR Leveraging Non-Peaky CTC Loss and Deep Language Posterior Injection—0
A Fast, Compact, Accurate Model for Language Identification of Codemixed Text—0
Show:102550
← PrevPage 5 of 16Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1wav2vec 2.0 LV-60KError rate7.2—Unverified
2XLS-RError rate5.7—Unverified
#ModelMetricClaimedVerifiedStatus
1GlotLIDMacro F10.98—Unverified
#ModelMetricClaimedVerifiedStatus
1FastTextAccuracy0.97—Unverified
#ModelMetricClaimedVerifiedStatus
1Apple bi-LSTMAccuracy91.37—Unverified
#ModelMetricClaimedVerifiedStatus
1Apple bi-LSTMAccuracy86.93—Unverified
#ModelMetricClaimedVerifiedStatus
1ConformerG-PAccuracy99.8—Unverified