Foundations of Large Language Model Compression -- Part 1: Weight Quantization Sep 3, 2024 Language Modeling Language Modelling
Code Code Available 05 Generalizing Teacher Networks for Effective Knowledge Distillation Across Student Architectures Jul 22, 2024 Knowledge Distillation Model Compression
Code Code Available 05 Robust and Large-Payload DNN Watermarking via Fixed, Distribution-Optimized, Weights Aug 23, 2022 Model Compression Transfer Learning
Code Code Available 05 Robust Knowledge Distillation Based on Feature Variance Against Backdoored Teacher Model Jun 1, 2024 Knowledge Distillation Model Compression
Code Code Available 05 Robustness and Diversity Seeking Data-Free Knowledge Distillation Nov 7, 2020 Data-free Knowledge Distillation Diversity
Code Code Available 05 Rotation Invariant Quantization for Model Compression Mar 3, 2023 model Model Compression
Code Code Available 05 Few Shot Network Compression via Cross Distillation Nov 21, 2019 Knowledge Distillation Model Compression
Code Code Available 05 Adversarial Robustness vs. Model Compression, or Both? Oct 1, 2019 Adversarial Robustness model
Code Code Available 05 Lottery Aware Sparsity Hunting: Enabling Federated Learning on Resource-Limited Edge Aug 27, 2022 Federated Learning Model Compression
Code Code Available 05 What Do Compressed Deep Neural Networks Forget? Nov 13, 2019 Fairness Interpretability Techniques for Deep Learning
Code Code Available 05 Finding Deviated Behaviors of the Compressed DNN Models for Image Classifications Dec 6, 2021 image-classification Image Classification
Code Code Available 05 Faithful Label-free Knowledge Distillation Nov 22, 2024 Inductive Bias Knowledge Distillation
Code Code Available 05 Model Compression with Adversarial Robustness: A Unified Optimization Framework Feb 10, 2019 Adversarial Robustness Model Compression
Code Code Available 05 Semi-Online Knowledge Distillation Nov 23, 2021 Knowledge Distillation Model Compression
Code Code Available 05 Compression-aware Continual Learning using Singular Value Decomposition Sep 3, 2020 Continual Learning Model Compression
Code Code Available 05 Explicit-NeRF-QA: A Quality Assessment Database for Explicit NeRF Model Compression Jul 11, 2024 Model Compression NeRF
Code Code Available 05 Exact Backpropagation in Binary Weighted Networks with Group Weight Transformations Jul 3, 2021 Binarization Classification with Binary Weight Network
Code Code Available 05 Exploiting Kernel Sparsity and Entropy for Interpretable CNN Compression Dec 11, 2018 Clustering Model Compression
Code Code Available 05 Compressing Vision Transformers for Low-Resource Visual Learning Sep 5, 2023 Autonomous Navigation image-classification
Code Code Available 05 Is Smaller Always Faster? Tradeoffs in Compressing Self-Supervised Speech Transformers Nov 17, 2022 Knowledge Distillation Model Compression
Code Code Available 05 Enhancing In-Context Learning Performance with just SVD-Based Weight Pruning: A Theoretical Perspective Jun 6, 2024 Generalization Bounds In-Context Learning
Code Code Available 05 Adversarial Fine-tuning of Compressed Neural Networks for Joint Improvement of Robustness and Efficiency Mar 14, 2024 Adversarial Robustness Model Compression
Code Code Available 05 Enhancing Knowledge Distillation of Large Language Models through Efficient Multi-Modal Distribution Alignment Sep 19, 2024 Knowledge Distillation Model Compression
Code Code Available 05 Exploring Gradient Flow Based Saliency for DNN Model Compression Oct 24, 2021 Denoising image-classification
Code Code Available 05 EAQuant: Enhancing Post-Training Quantization for MoE Models via Expert-Aware Optimization Jun 16, 2025 Mixture-of-Experts Model Compression
Code Code Available 05 Empirical Evaluation of Deep Learning Model Compression Techniques on the WaveNet Vocoder Nov 20, 2020 Model Compression Quantization
Code Code Available 05 ELSA: Exploiting Layer-wise N:M Sparsity for Vision Transformer Acceleration Sep 15, 2024 Model Compression
Code Code Available 05 An exploration of the effect of quantisation on energy consumption and inference time of StarCoder2 Nov 15, 2024 Model Compression Quantization
Code Code Available 05 Causal Explanation of Convolutional Neural Networks Sep 13, 2021 counterfactual Counterfactual Explanation
Code Code Available 05 StrassenNets: Deep Learning with a Multiplication Budget Dec 11, 2017 Deep Learning image-classification
Code Code Available 05 Einconv: Exploring Unexplored Tensor Network Decompositions for Convolutional Neural Networks Aug 13, 2019 Model Compression Neural Architecture Search
Code Code Available 05 Improved Knowledge Distillation via Full Kernel Matrix Transfer Sep 30, 2020 Knowledge Distillation Model Compression
Code Code Available 05 Compressing Convolutional Neural Networks via Factorized Convolutional Filters Jun 1, 2019 Model Compression
Code Code Available 05 Efficient model compression with Random Operation Access Specific Tile (ROAST) hashing Jul 21, 2022 Model Compression
Code Code Available 05 Efficient Speech Translation through Model Compression and Knowledge Distillation May 26, 2025 Knowledge Distillation Model Compression
Code Code Available 05 Systematic Outliers in Large Language Models Feb 10, 2025 Model Compression
Code Code Available 05 Exploring Unexplored Tensor Network Decompositions for Convolutional Neural Networks Dec 1, 2019 Model Compression Neural Architecture Search
Code Code Available 05 Tensorized Embedding Layers for Efficient Model Compression Jan 30, 2019 Language Modelling Machine Translation
Code Code Available 05 Learning Accurate Performance Predictors for Ultrafast Automated Model Compression Apr 13, 2023 image-classification Image Classification
Code Code Available 05 On Model Compression for Neural Networks: Framework, Algorithm, and Convergence Guarantee Mar 13, 2023 Image Classification Model Compression
Code Code Available 05 Compressed models are NOT miniature versions of large models Jul 18, 2024 Adversarial Attack Model Compression
— Unverified 00 Artemis: HE-Aware Training for Efficient Privacy-Preserving Machine Learning Oct 2, 2023 Model Compression Privacy Preserving
— Unverified 00 Comprehensive Survey of Model Compression and Speed up for Vision Transformers Apr 16, 2024 Computational Efficiency Edge-computing
— Unverified 00 Are We There Yet? A Measurement Study of Efficiency for LLM Applications on Mobile Devices Mar 10, 2025 CPU GPU
— Unverified 00 Comprehensive Study on Performance Evaluation and Optimization of Model Compression: Bridging Traditional Deep Learning and Large Language Models Jul 22, 2024 Deep Learning image-classification
— Unverified 00 Compositionality Unlocks Deep Interpretable Models Apr 3, 2025 Model Compression Tensor Networks
— Unverified 00 A Comprehensive Review and a Taxonomy of Edge Machine Learning: Requirements, Paradigms, and Techniques Feb 16, 2023 Edge-computing Model Compression
— Unverified 00 Accelerating Very Deep Convolutional Networks for Classification and Detection May 26, 2015 Classification General Classification
— Unverified 00 CompMarkGS: Robust Watermarking for Compressed 3D Gaussian Splatting Mar 17, 2025 3DGS 3D Reconstruction
— Unverified 00 Complexity-Driven CNN Compression for Resource-constrained Edge AI Aug 26, 2022 Computational Efficiency Model Compression
— Unverified 00