SOTAVerified

Language Identification

Language identification is the task of determining the language of a text.

Papers

Showing 201–250 of 794 papers

TitleStatusHype
DeepAnalyzer at SemEval-2019 Task 6: A deep learning-based ensemble method for identifying offensive tweets—0
Deep learning-based end-to-end spoken language identification system for domain-mismatched scenario—0
Deep Models for Arabic Dialect Identification on Benchmarked Data—0
DELab@IIITSM at ICON-2021 Shared Task: Identification of Aggression and Biasness Using Decision Tree—0
Demographic Dialectal Variation in Social Media: A Case Study of African-American English—0
Detecting Code-Switching in a Multilingual Alpine Heritage Corpus—0
Ensemble Methods for Native Language Identification—0
Detection of Similar Languages and Dialects Using Deep Supervised Autoencoder—0
Detect Language of Transliterated Texts—0
Developing Language-tagged Corpora for Code-switching Tweets—0
Challenges of Computational Processing of Code-Switching—0
Development of Text and Speech database for Hindi and Indian English specific to Mobile Communication environment—0
Dialect Diversity in Text Summarization on Twitter—0
Dialects Identification of Armenian Language—0
Discovering Parallel Language Resources for Training MT Engines—0
Discriminating between Indo-Aryan Languages Using SVM Ensembles—0
Discriminating between Mandarin Chinese and Swiss-German varieties using adaptive language models—0
Discriminating between Similar Languages Using PPM—0
Babler - Data Collection from the Web to Support Speech Recognition and Keyword Search—0
Discriminating between Similar Languages and Arabic Dialect Identification: A Report on the Third DSL Shared Task—0
Discriminating between Similar Languages on Imbalanced Conversational Texts—0
Discriminating between Similar Languages with Word-level Convolutional Neural Networks—0
BERT-based Multi-Task Model for Country and Province Level Modern Standard Arabic and Dialectal Arabic Identification—0
Discriminating Non-Native English with 350 Words—0
Discriminating Similar Languages with Linear SVMs and Neural Networks—0
Discriminating Similar Languages with Token-Based Backoff—0
Challenges in Neural Language Identification: NRC at VarDial 2020—0
Discrimination between Similar Languages, Varieties and Dialects using CNN- and LSTM-based Deep Neural Networks—0
Distinguishing Literal and Non-Literal Usage of German Particle Verbs—0
Distributed Representations of Words and Documents for Discriminating Similar Languages—0
Distributional Interaction of Concreteness and Abstractness in Verb--Noun Subcategorisation—0
DKPro TC: A Java-based Framework for Supervised Learning Experiments on Textual Data—0
DLRG@DravidianLangTech-EACL2021: Transformer based approachfor Offensive Language Identification on Code-Mixed Tamil—0
Do Characters Abuse More Than Words?—0
A Report on the VarDial Evaluation Campaign 2020—0
Does the Phonology of L1 Show Up in L2 Texts?—0
Domain Attentive Fusion for End-to-end Dialect Identification with Unknown Target Domain—0
BigSSL: Exploring the Frontier of Large-Scale Semi-Supervised Learning for Automatic Speech Recognition—0
Ceasing hate withMoH: Hate Speech Detection in Hindi-English Code-Switched Language—0
Duluth at SemEval-2020 Task 12: Offensive Tweet Identification in English with Logistic Regression—0
Dyn-ASR: Compact, Multilingual Speech Recognition via Spoken Language and Accent Identification—0
Efficient Discrimination Between Closely Related Languages—0
Efficiently Identifying Low-Quality Language Subsets in Multilingual Datasets: A Case Study on a Large-Scale Multilingual Audio Dataset—0
Emad at SemEval-2019 Task 6: Offensive Language Identification using Traditional Machine Learning and Deep Learning approaches—0
BRUMS at SemEval-2020 Task 12 : Transformer based Multilingual Offensive Language Identification in Social Media—0
Arabic Dialect Identification in the Context of Bivalency and Code-Switching—0
BRUMS at SemEval-2020 Task 12: Transformer Based Multilingual Offensive Language Identification in Social Media—0
Arabic Language WEKA-Based Dialect Classifier for Arabic Automatic Speech Recognition Transcripts—0
Enhancing Code-Switching ASR Leveraging Non-Peaky CTC Loss and Deep Language Posterior Injection—0
Categorization of Turkish News Documents with Morphological Analysis—0
Show:102550
← PrevPage 5 of 16Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1wav2vec 2.0 LV-60KError rate7.2—Unverified
2XLS-RError rate5.7—Unverified
#ModelMetricClaimedVerifiedStatus
1GlotLIDMacro F10.98—Unverified
#ModelMetricClaimedVerifiedStatus
1FastTextAccuracy0.97—Unverified
#ModelMetricClaimedVerifiedStatus
1Apple bi-LSTMAccuracy91.37—Unverified
#ModelMetricClaimedVerifiedStatus
1Apple bi-LSTMAccuracy86.93—Unverified
#ModelMetricClaimedVerifiedStatus
1ConformerG-PAccuracy99.8—Unverified