Learning Efficient Vision Transformers via Fine-Grained Manifold Distillation Jul 3, 2021 Knowledge Distillation Model Compression
Code Code Available 1Search for Efficient Large Language Models Sep 25, 2024 GPU Model Compression
Code Code Available 1Skip-Convolutions for Efficient Video Processing Apr 23, 2021 Model Compression
Code Code Available 1SLiM: One-shot Quantization and Sparsity with Low-rank Approximation for LLM Weight Compression Oct 12, 2024 Model Compression Natural Language Understanding
Code Code Available 1An Empirical Study of CLIP for Text-based Person Search Aug 19, 2023 Cross-Modal Retrieval Data Augmentation
Code Code Available 1SPDY: Accurate Pruning with Speedup Guarantees Jan 31, 2022 GPU Model Compression
Code Code Available 1Improving Neural Network Efficiency via Post-Training Quantization With Adaptive Floating-Point Jan 1, 2021 Model Compression Quantization
Code Code Available 1Consistent Quantity-Quality Control across Scenes for Deployment-Aware Gaussian Splatting May 15, 2025 3DGS Model Compression
Code Code Available 1PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning Feb 20, 2024 Instruction Following Knowledge Distillation
Code Code Available 1Artemis: HE-Aware Training for Efficient Privacy-Preserving Machine Learning Oct 2, 2023 Model Compression Privacy Preserving
— Unverified 0Are We There Yet? A Measurement Study of Efficiency for LLM Applications on Mobile Devices Mar 10, 2025 CPU GPU
— Unverified 0Accelerating Very Deep Convolutional Networks for Classification and Detection May 26, 2015 Classification General Classification
— Unverified 0A Comprehensive Review and a Taxonomy of Edge Machine Learning: Requirements, Paradigms, and Techniques Feb 16, 2023 Edge-computing Model Compression
— Unverified 0Accelerating Machine Learning Primitives on Commodity Hardware Oct 8, 2023 CPU Model Compression
— Unverified 0Compositionality Unlocks Deep Interpretable Models Apr 3, 2025 Model Compression Tensor Networks
— Unverified 0CompMarkGS: Robust Watermarking for Compressed 3D Gaussian Splatting Mar 17, 2025 3DGS 3D Reconstruction
— Unverified 0Complexity-Driven CNN Compression for Resource-constrained Edge AI Aug 26, 2022 Computational Efficiency Model Compression
— Unverified 0Architecture Compression Feb 8, 2019 Decoder Model Compression
— Unverified 0A Progressive Sub-Network Searching Framework for Dynamic Inference Sep 11, 2020 Model Compression
— Unverified 0Compact CNN Structure Learning by Knowledge Distillation Apr 19, 2021 Knowledge Distillation Model Compression
— Unverified 0A Deep Cascade Network for Unaligned Face Attribute Classification Sep 12, 2017 Attribute Classification
— Unverified 0Continuous Approximations for Improving Quantization Aware Training of LLMs Oct 6, 2024 MMLU Model Compression
— Unverified 0Convolutional Neural Network Compression Based on Low-Rank Decomposition Aug 29, 2024 Model Compression Neural Network Compression
— Unverified 0Accelerating Linear Recurrent Neural Networks for the Edge with Unstructured Sparsity Feb 3, 2025 Audio Denoising Denoising
— Unverified 0A Privacy-Preserving-Oriented DNN Pruning and Mobile Acceleration Framework Mar 13, 2020 Model Compression Privacy Preserving
— Unverified 02-bit Conformer quantization for automatic speech recognition May 26, 2023 Automatic Speech Recognition Automatic Speech Recognition (ASR)
— Unverified 0Approximability and Generalisation Mar 15, 2022 Learning Theory Model Compression
— Unverified 0CoLLD: Contrastive Layer-to-layer Distillation for Compressing Multilingual Pre-trained Speech Encoders Sep 14, 2023 Contrastive Learning Knowledge Distillation
— Unverified 0Apprentice: Using Knowledge Distillation Techniques To Improve Low-Precision Network Accuracy Nov 15, 2017 image-classification Image Classification
— Unverified 0Additive Tree-Structured Covariance Function for Conditional Parameter Spaces in Bayesian Optimization Jun 21, 2020 Bayesian Optimization global-optimization
— Unverified 0Collaborative Teacher-Student Learning via Multiple Knowledge Transfer Jan 21, 2021 Knowledge Distillation Model Compression
— Unverified 0ADC/DAC-Free Analog Acceleration of Deep Neural Networks with Frequency Transformation Sep 4, 2023 Computational Efficiency Model Compression
— Unverified 0Towards Feature Distribution Alignment and Diversity Enhancement for Data-Free Quantization Apr 30, 2022 Data Free Quantization Diversity
— Unverified 0Applications of Knowledge Distillation in Remote Sensing: A Survey Sep 18, 2024 Computational Efficiency Instance Segmentation
— Unverified 0Communication-Efficient Distributed Online Learning with Kernels Nov 28, 2019 Model Compression
— Unverified 0Accelerating Inference and Language Model Fusion of Recurrent Neural Network Transducers via End-to-End 4-bit Quantization Jun 16, 2022 Language Modeling Language Modelling
— Unverified 0Communication-Efficient Federated Learning with Adaptive Compression under Dynamic Bandwidth May 6, 2024 Federated Learning Model Compression
— Unverified 0ClusComp: A Simple Paradigm for Model Compression and Efficient Finetuning Mar 17, 2025 GPU Model Compression
— Unverified 0A Partial Regularization Method for Network Compression Sep 3, 2020 Model Compression
— Unverified 0Closed-Loop Neural Interfaces with Embedded Machine Learning Oct 15, 2020 BIG-bench Machine Learning General Classification
— Unverified 0CompactifAI: Extreme Compression of Large Language Models using Quantum-Inspired Tensor Networks Jan 25, 2024 Model Compression Quantization
— Unverified 0Compacting Deep Neural Networks for Internet of Things: Methods and Applications Mar 20, 2021 Diversity Knowledge Distillation
— Unverified 0Classification-based Quality Estimation: Small and Efficient Models for Real-world Applications Sep 17, 2021 Machine Translation Model Compression
— Unverified 0An Overview of Neural Network Compression Jun 5, 2020 Knowledge Distillation Model Compression
— Unverified 0AdaSpring: Context-adaptive and Runtime-evolutionary Deep Model Compression for Mobile Applications Jan 28, 2021 Model Compression
— Unverified 010K is Enough: An Ultra-Lightweight Binarized Network for Infrared Small-Target Detection Mar 4, 2025 Binarization Model Compression
— Unverified 0Context-aware deep model compression for edge cloud computing Nov 29, 2020 Cloud Computing Image Classification
— Unverified 0Convolutional Neural Network Compression via Dynamic Parameter Rank Pruning Jan 15, 2024 Model Compression Neural Network Compression
— Unverified 0A Novel Architecture Slimming Method for Network Pruning and Knowledge Distillation Feb 21, 2022 Knowledge Distillation Model Compression
— Unverified 0Adaptive Learning of Tensor Network Structures Aug 12, 2020 BIG-bench Machine Learning Model Compression
— Unverified 0