Model Compression

Model Compression is an actively pursued area of research over the last few years with the goal of deploying state-of-the-art deep networks in low-power and resource limited devices without significant drop in accuracy. Parameter pruning, low-rank factorization and weight quantization are some of the proposed methods to compress the size of deep networks.

Source: KD-MRI: A knowledge distillation framework for image reconstruction and image restoration in MRI workflow

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 501–525 of 1356 papers

Title	Date	Tasks	Status
Explainability-Driven Leaf Disease Classification Using Adversarial Training and Knowledge Distillation	Dec 30, 2023	Adversarial AttackClassification	—Unverified
Explaining Sequence-Level Knowledge Distillation as Data-Augmentation for Neural Machine Translation	Dec 6, 2019	Data AugmentationKnowledge Distillation	—Unverified
FFSplit: Split Feed-Forward Network For Optimizing Accuracy-Efficiency Trade-off in Language Model Inference	Jan 8, 2024	GPULanguage Modeling	—Unverified
FLOPs as a Direct Optimization Objective for Learning Sparse Neural Networks	Nov 7, 2018	GPUimage-classification	—Unverified
Are We There Yet? A Measurement Study of Efficiency for LLM Applications on Mobile Devices	Mar 10, 2025	CPUGPU	—Unverified
Exploiting Non-Linear Redundancy for Neural Model Compression	May 28, 2020	modelModel Compression	—Unverified
Exploiting random projections and sparsity with random forests and gradient boosting methods -- Application to multi-label and multi-output learning, random forest model compression and leveraging input sparsity	Apr 26, 2017	Model Compression	—Unverified
Exploration and Estimation for Model Compression	Jan 1, 2021	modelModel Compression	—Unverified
Exploring compressibility of transformer based text-to-music (TTM) models	Jun 24, 2024	DecoderFAD	—Unverified
Artemis: HE-Aware Training for Efficient Privacy-Preserving Machine Learning	Oct 2, 2023	Model CompressionPrivacy Preserving	—Unverified
From Algorithm to Hardware: A Survey on Efficient and Safe Deployment of Deep Neural Networks	May 9, 2024	Knowledge DistillationModel Compression	—Unverified
Data-Driven Compression of Convolutional Neural Networks	Nov 28, 2019	Knowledge DistillationModel Compression	—Unverified
A Unified Knowledge Distillation Framework for Deep Directed Graphical Models	Sep 29, 2021	Continual LearningFederated Learning	—Unverified
DarkRank: Accelerating Deep Metric Learning via Cross Sample Similarities Transfer	Jul 5, 2017	ClusteringImage Clustering	—Unverified
DARC: Differentiable ARchitecture Compression	May 20, 2019	image-classificationImage Classification	—Unverified
A Unified Framework of DNN Weight Pruning and Weight Clustering/Quantization Using ADMM	Nov 5, 2018	ClusteringModel Compression	—Unverified
Aligned Weight Regularizers for Pruning Pretrained Neural Networks	Apr 4, 2022	Language ModellingModel Compression	—Unverified
DARB: A Density-Aware Regular-Block Pruning for Deep Neural Networks	Nov 19, 2019	Model CompressionNetwork Pruning	—Unverified
D^2MoE: Dual Routing and Dynamic Scheduling for Efficient On-Device MoE-based LLM Serving	Apr 17, 2025	Mixture-of-ExpertsModel Compression	—Unverified
A Unified Approximation Framework for Compressing and Accelerating Deep Neural Networks	Jul 26, 2018	General Classificationimage-classification	—Unverified
CURing Large Models: Compression via CUR Decomposition	Jan 8, 2025	Model Compression	—Unverified
CSTAR: Towards Compact and STructured Deep Neural Networks with Adversarial Robustness	Dec 4, 2022	Adversarial RobustnessModel Compression	—Unverified
Augmenting Knowledge Distillation With Peer-To-Peer Mutual Learning For Model Compression	Oct 21, 2021	Knowledge DistillationModel Compression	—Unverified
Artificial Neural Networks for Photonic Applications: From Algorithms to Implementation	Aug 2, 2024	Model Compression	—Unverified
CrossQuant: A Post-Training Quantization Method with Smaller Quantization Kernel for Precise Large Language Model Compression	Oct 10, 2024	Language ModelingLanguage Modelling	—Unverified

Show:10 25 50

← PrevPage 21 of 55Next →

All datasets ImageNet QNLI

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	ADLIK-MO-ResNet50+W4A4	Top-1	77.88	—	Unverified
2	ADLIK-MO-ResNet50+W3A4	Top-1	77.34	—	Unverified
3	ResNet-18 + 4bit-1dim model compression using DKM	Top-1	70.52	—	Unverified
4	MobileNet-v1 + 4bit-1dim model compression using DKM	Top-1	69.63	—	Unverified
5	ResNet-18 + 2bit-1dim model compression using DKM	Top-1	68.63	—	Unverified
6	MobileNet-v1 + 2bit-1dim model compression using DKM	Top-1	67.62	—	Unverified
7	ResNet-18 + 4bit-4dim model compression using DKM	Top-1	66.1	—	Unverified
8	ResNet-18 + 2bit-2dim model compression using DKM	Top-1	64.7	—	Unverified
9	MobileNet-v1 + 4bit-4dim model compression using DKM	Top-1	61.4	—	Unverified
10	ResNet-18 + 1bit-1dim model compression using DKM	Top-1	59.7	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MobileBERT + 2bit-1dim model compression using DKM	Accuracy	82.13	—	Unverified
2	MobileBERT + 1bit-1dim model compression using DKM	Accuracy	63.17	—	Unverified