Model Compression

Model Compression is an actively pursued area of research over the last few years with the goal of deploying state-of-the-art deep networks in low-power and resource limited devices without significant drop in accuracy. Parameter pruning, low-rank factorization and weight quantization are some of the proposed methods to compress the size of deep networks.

Source: KD-MRI: A knowledge distillation framework for image reconstruction and image restoration in MRI workflow

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 631–640 of 1356 papers

Title	Date	Tasks	Status
Robust and Large-Payload DNN Watermarking via Fixed, Distribution-Optimized, Weights	Aug 23, 2022	Model CompressionTransfer Learning	CodeCode Available
Design Automation for Fast, Lightweight, and Effective Deep Learning Models: A Survey	Aug 22, 2022	Deep LearningEdge-computing	—Unverified
Enhancing Targeted Attack Transferability via Diversified Weight Pruning	Aug 18, 2022	DiversityModel Compression	—Unverified
An Algorithm-Hardware Co-Optimized Framework for Accelerating N:M Sparse Transformers	Aug 12, 2022	Computational EfficiencyModel Compression	—Unverified
Safety and Performance, Why not Both? Bi-Objective Optimized Model Compression toward AI Software Deployment	Aug 11, 2022	Inference AttackMembership Inference Attack	CodeCode Available
Triple Sparsification of Graph Convolutional Networks without Sacrificing the Accuracy	Aug 6, 2022	Graph LearningModel Compression	—Unverified
Model Blending for Text Classification	Aug 5, 2022	ClassificationMachine Translation	—Unverified
Quiver neural networks	Jul 26, 2022	Model Compression	—Unverified
Efficient model compression with Random Operation Access Specific Tile (ROAST) hashing	Jul 21, 2022	Model Compression	CodeCode Available
Model Compression for Resource-Constrained Mobile Robots	Jul 20, 2022	Knowledge Distillationmodel	—Unverified

Show:10 25 50

← PrevPage 64 of 136Next →

All datasets ImageNet QNLI

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	ADLIK-MO-ResNet50+W4A4	Top-1	77.88	—	Unverified
2	ADLIK-MO-ResNet50+W3A4	Top-1	77.34	—	Unverified
3	ResNet-18 + 4bit-1dim model compression using DKM	Top-1	70.52	—	Unverified
4	MobileNet-v1 + 4bit-1dim model compression using DKM	Top-1	69.63	—	Unverified
5	ResNet-18 + 2bit-1dim model compression using DKM	Top-1	68.63	—	Unverified
6	MobileNet-v1 + 2bit-1dim model compression using DKM	Top-1	67.62	—	Unverified
7	ResNet-18 + 4bit-4dim model compression using DKM	Top-1	66.1	—	Unverified
8	ResNet-18 + 2bit-2dim model compression using DKM	Top-1	64.7	—	Unverified
9	MobileNet-v1 + 4bit-4dim model compression using DKM	Top-1	61.4	—	Unverified
10	ResNet-18 + 1bit-1dim model compression using DKM	Top-1	59.7	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MobileBERT + 2bit-1dim model compression using DKM	Accuracy	82.13	—	Unverified
2	MobileBERT + 1bit-1dim model compression using DKM	Accuracy	63.17	—	Unverified