| The Mysterious Case of Neuron 1512: Injectable Realignment Architectures Reveal Internal Characteristics of Meta's Llama 2 Model | Jul 4, 2024 | Language ModelingLanguage Modelling | CodeCode Available | 0 |
| Improving Self Consistency in LLMs through Probabilistic Tokenization | Jul 4, 2024 | Language ModelingLanguage Modelling | —Unverified | 0 |
| Uncertainty-Guided Optimization on Large Language Model Search Trees | Jul 4, 2024 | Bayesian OptimizationEfficient Exploration | CodeCode Available | 0 |
| Chain-of-Thought Augmentation with Logit Contrast for Enhanced Reasoning in Language Models | Jul 4, 2024 | Language ModelingLanguage Modelling | —Unverified | 0 |
| ConText at WASSA 2024 Empathy and Personality Shared Task: History-Dependent Embedding Utterance Representations for Empathy and Emotion Prediction in Conversations | Jul 4, 2024 | Language ModelingLanguage Modelling | —Unverified | 0 |
| On the Effectiveness of Acoustic BPE in Decoder-Only TTS | Jul 4, 2024 | DecoderDiversity | —Unverified | 0 |
| MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization | Jul 4, 2024 | Language ModelingLanguage Modelling | —Unverified | 0 |
| Mixture of A Million Experts | Jul 4, 2024 | Computational EfficiencyLanguage Modeling | CodeCode Available | 2 |
| Narrow Transformer: StarCoder-Based Java-LM For Desktop | Jul 4, 2024 | Language ModelingLanguage Modelling | —Unverified | 0 |
| Unlocking the Potential of Model Merging for Low-Resource Languages | Jul 4, 2024 | Language ModelingLanguage Modelling | —Unverified | 0 |