Model Compression

Model Compression is an actively pursued area of research over the last few years with the goal of deploying state-of-the-art deep networks in low-power and resource limited devices without significant drop in accuracy. Parameter pruning, low-rank factorization and weight quantization are some of the proposed methods to compress the size of deep networks.

Source: KD-MRI: A knowledge distillation framework for image reconstruction and image restoration in MRI workflow

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 826–850 of 1356 papers

Title	Date	Tasks	Status
High-fidelity 3D Model Compression based on Key Spheres	Jan 19, 2022	Model CompressionObject	CodeCode Available
PCEE-BERT: Accelerating BERT Inference via Patient and Confident Early Exiting	Jan 16, 2022	Model Compression	—Unverified
UDC: Unified DNAS for Compressible TinyML Models	Jan 15, 2022	Model CompressionNeural Architecture Search	—Unverified
DeepSpeed-MoE: Advancing Mixture-of-Experts Inference and Training to Power Next-Generation AI Scale	Jan 14, 2022	DecoderMixture-of-Experts	CodeCode Available
ThreshNet: An Efficient DenseNet Using Threshold Mechanism to Reduce Connections	Jan 9, 2022	image-classificationImage Classification	CodeCode Available
Two-Pass End-to-End ASR Model Compression	Jan 8, 2022	DecoderKnowledge Distillation	—Unverified
The Effect of Model Compression on Fairness in Facial Expression Recognition	Jan 5, 2022	Facial Expression RecognitionFacial Expression Recognition (FER)	—Unverified
HODEC: Towards Efficient High-Order DEcomposed Convolutional Neural Networks	Jan 1, 2022	Model CompressionVocal Bursts Intensity Prediction	—Unverified
Dreaming To Prune Image Deraining Networks	Jan 1, 2022	Model CompressionRain Removal	—Unverified
Multi-Dimensional Model Compression of Vision Transformer	Dec 31, 2021	modelModel Compression	CodeCode Available
Conditional Generative Data-free Knowledge Distillation	Dec 31, 2021	Conditional Image GenerationData-free Knowledge Distillation	—Unverified
Croesus: Multi-Stage Processing and Transactions for Video-Analytics in Edge-Cloud Systems	Dec 31, 2021	Model Compressionobject-detection	—Unverified
Data-Free Knowledge Transfer: A Survey	Dec 31, 2021	Data-free Knowledge DistillationDomain Adaptation	—Unverified
Automatic Mixed-Precision Quantization Search of BERT	Dec 30, 2021	Knowledge DistillationModel Compression	—Unverified
LegoDNN: Block-grained Scaling of Deep Neural Networks for Mobile Vision	Dec 18, 2021	Knowledge DistillationModel Compression	—Unverified
From Dense to Sparse: Contrastive Pruning for Better Pre-trained Language Model Compression	Dec 14, 2021	Contrastive LearningLanguage Modeling	CodeCode Available
Knowledge Distillation for Object Detection via Rank Mimicking and Prediction-guided Feature Imitation	Dec 9, 2021	image-classificationImage Classification	—Unverified
Low-rank Tensor Decomposition for Compression of Convolutional Neural Networks Using Funnel Regularization	Dec 7, 2021	global-optimizationModel Compression	—Unverified
Finding Deviated Behaviors of the Compressed DNN Models for Image Classifications	Dec 6, 2021	image-classificationImage Classification	CodeCode Available
Toward Real-World Voice Disorder Classification	Dec 5, 2021	ClassificationModel Compression	—Unverified
Shapeshifter: a Parameter-efficient Transformer using Factorized Reshaped Matrices	Dec 1, 2021	Knowledge DistillationModel Compression	CodeCode Available
Formalizing Generalization and Adversarial Robustness of Neural Networks to Weight Perturbations	Dec 1, 2021	Adversarial RobustnessModel Compression	—Unverified
FedHM: Efficient Federated Learning for Heterogeneous Models via Low-rank Factorization	Nov 29, 2021	Distributed ComputingFederated Learning	—Unverified
Exploring Low-Cost Transformer Model Compression for Large-Scale Commercial Reply Suggestions	Nov 27, 2021	Model Compression	—Unverified
Accelerating Deep Learning with Dynamic Data Pruning	Nov 24, 2021	AttributeDeep Learning	—Unverified

Show:10 25 50

← PrevPage 34 of 55Next →

All datasets ImageNet QNLI

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	ADLIK-MO-ResNet50+W4A4	Top-1	77.88	—	Unverified
2	ADLIK-MO-ResNet50+W3A4	Top-1	77.34	—	Unverified
3	ResNet-18 + 4bit-1dim model compression using DKM	Top-1	70.52	—	Unverified
4	MobileNet-v1 + 4bit-1dim model compression using DKM	Top-1	69.63	—	Unverified
5	ResNet-18 + 2bit-1dim model compression using DKM	Top-1	68.63	—	Unverified
6	MobileNet-v1 + 2bit-1dim model compression using DKM	Top-1	67.62	—	Unverified
7	ResNet-18 + 4bit-4dim model compression using DKM	Top-1	66.1	—	Unverified
8	ResNet-18 + 2bit-2dim model compression using DKM	Top-1	64.7	—	Unverified
9	MobileNet-v1 + 4bit-4dim model compression using DKM	Top-1	61.4	—	Unverified
10	ResNet-18 + 1bit-1dim model compression using DKM	Top-1	59.7	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MobileBERT + 2bit-1dim model compression using DKM	Accuracy	82.13	—	Unverified
2	MobileBERT + 1bit-1dim model compression using DKM	Accuracy	63.17	—	Unverified