| Recoding latent sentence representations -- Dynamic gradient-based activation modification in RNNs | Jan 3, 2021 | Language ModelingLanguage Modelling | CodeCode Available | 0 |
| Modeling Disclosive Transparency in NLP Application Descriptions | Jan 2, 2021 | FairnessLanguage Modeling | CodeCode Available | 0 |
| The Highs and Lows of Simple Lexical Domain Adaptation Approaches for Neural Machine Translation | Jan 2, 2021 | DecoderDomain Adaptation | —Unverified | 0 |
| Bayesian Neural Networks with Variance Propagation for Uncertainty Evaluation | Jan 1, 2021 | Bayesian InferenceComputational Efficiency | —Unverified | 0 |
| Learning Chess Blindfolded | Jan 1, 2021 | Domain ProbingGame of Chess | —Unverified | 0 |
| BROS: A Pre-trained Language Model for Understanding Texts in Document | Jan 1, 2021 | DecoderDiversity | —Unverified | 0 |
| Contextual Knowledge Distillation for Transformer Compression | Jan 1, 2021 | Knowledge DistillationLanguage Modeling | —Unverified | 0 |
| Context-Aware Temperature for Language Modeling | Jan 1, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 |
| Adding Recurrence to Pretrained Transformers | Jan 1, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 |
| Domain-slot Relationship Modeling using a Pre-trained Language Encoder for Multi-Domain Dialogue State Tracking | Jan 1, 2021 | Dialogue State TrackingLanguage Modeling | —Unverified | 0 |
| Cross-lingual Transfer Learning for Pre-trained Contextualized Language Models | Jan 1, 2021 | Cross-Lingual TransferLanguage Modeling | —Unverified | 0 |
| Block Skim Transformer for Efficient Question Answering | Jan 1, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 |
| Universal Sentence Representations Learning with Conditional Masked Language Model | Jan 1, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 |
| Representation and Bias in Multilingual NLP: Insights from Controlled Experiments on Conditional Language Modeling | Jan 1, 2021 | FairnessLanguage Modeling | —Unverified | 0 |
| Pretrain Knowledge-Aware Language Models | Jan 1, 2021 | Knowledge ProbingLanguage Modeling | —Unverified | 0 |
| Towards Practical Second Order Optimization for Deep Learning | Jan 1, 2021 | Click-Through Rate PredictionCPU | —Unverified | 0 |
| Refine and Imitate: Reducing Repetition and Inconsistency in Dialogue Generation via Reinforcement Learning and Human Demonstration | Jan 1, 2021 | Dialogue GenerationLanguage Modeling | —Unverified | 0 |
| Synthesizer: Rethinking Self-Attention for Transformer Models | Jan 1, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 |
| ROMUL: Scale Adaptative Population Based Training | Jan 1, 2021 | Data Augmentationimage-classification | —Unverified | 0 |
| Sensei: Self-Supervised Sensor Name Segmentation | Jan 1, 2021 | Language ModelingLanguage Modelling | CodeCode Available | 0 |
| MONGOOSE: A Learnable LSH Framework for Efficient Neural Network Training | Jan 1, 2021 | Efficient Neural NetworkLanguage Modeling | —Unverified | 0 |
| On the use of linguistic similarities to improve Neural Machine Translation for African Languages | Jan 1, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 |
| Transformer-QL: A Step Towards Making Transformer Network Quadratically Large | Jan 1, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 |
| TaskSet: A Dataset of Optimization Tasks | Jan 1, 2021 | Diversityimage-classification | CodeCode Available | 0 |
| Non-iterative Parallel Text Generation via Glancing Transformer | Jan 1, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 |