ADC/DAC-Free Analog Acceleration of Deep Neural Networks with Frequency Transformation Sep 4, 2023 Computational Efficiency Model Compression
— Unverified 00 Explaining Sequence-Level Knowledge Distillation as Data-Augmentation for Neural Machine Translation Dec 6, 2019 Data Augmentation Knowledge Distillation
— Unverified 00 Efficient Model Compression for Hierarchical Federated Learning May 27, 2024 Edge-computing Federated Learning
— Unverified 00 Efficient Model Compression for Bayesian Neural Networks Nov 1, 2024 Deep Learning feature selection
— Unverified 00 Efficient Memory Management for GPU-based Deep Learning Systems Feb 19, 2019 CPU Deep Learning
— Unverified 00 ClusComp: A Simple Paradigm for Model Compression and Efficient Finetuning Mar 17, 2025 GPU Model Compression
— Unverified 00 Exploiting random projections and sparsity with random forests and gradient boosting methods -- Application to multi-label and multi-output learning, random forest model compression and leveraging input sparsity Apr 26, 2017 Model Compression
— Unverified 00 Exploration and Estimation for Model Compression Jan 1, 2021 model Model Compression
— Unverified 00 A Partial Regularization Method for Network Compression Sep 3, 2020 Model Compression
— Unverified 00 Efficient Hybrid Language Model Compression through Group-Aware SSM Pruning Apr 15, 2025 Knowledge Distillation Language Modeling
— Unverified 00 Efficient DNN-Powered Software with Fair Sparse Models Jul 3, 2024 Fairness Model Compression
— Unverified 00 Closed-Loop Neural Interfaces with Embedded Machine Learning Oct 15, 2020 BIG-bench Machine Learning General Classification
— Unverified 00 Efficient Computation of Quantized Neural Networks by −1, +1 Encoding Decomposition Oct 8, 2018 image-classification Image Classification
— Unverified 00 Classification-based Quality Estimation: Small and Efficient Models for Real-world Applications Sep 17, 2021 Machine Translation Model Compression
— Unverified 00 An Overview of Neural Network Compression Jun 5, 2020 Knowledge Distillation Model Compression
— Unverified 00 AdaSpring: Context-adaptive and Runtime-evolutionary Deep Model Compression for Mobile Applications Jan 28, 2021 Model Compression
— Unverified 00 Accelerating Inference and Language Model Fusion of Recurrent Neural Network Transducers via End-to-End 4-bit Quantization Jun 16, 2022 Language Modeling Language Modelling
— Unverified 00 2-bit Conformer quantization for automatic speech recognition May 26, 2023 Automatic Speech Recognition Automatic Speech Recognition (ASR)
— Unverified 00 Efficient classification using parallel and scalable compressed model and Its application on intrusion detection May 14, 2014 Attribute Classification
— Unverified 00 Efficient automated U-Net based tree crown delineation using UAV multi-spectral imagery on embedded devices Jul 16, 2021 Denoising Image Denoising
— Unverified 00 Efficient Apple Maturity and Damage Assessment: A Lightweight Detection Model with GAN and Attention Mechanism Oct 13, 2023 Decision Making Model Compression
— Unverified 00 Efficient and Workload-Aware LLM Serving via Runtime Layer Swapping and KV Cache Resizing May 24, 2025 Model Compression Quantization
— Unverified 00 A Novel Architecture Slimming Method for Network Pruning and Knowledge Distillation Feb 21, 2022 Knowledge Distillation Model Compression
— Unverified 00 Efficient AI in Practice: Training and Deployment of Efficient LLMs for Industry Applications Feb 20, 2025 Knowledge Distillation Model Compression
— Unverified 00 Efficiency optimization of large-scale language models based on deep learning in natural language processing tasks May 20, 2024 Inference Optimization Knowledge Distillation
— Unverified 00 Effective Multi-Stage Training Model For Edge Computing Devices In Intrusion Detection Jan 31, 2024 Edge-computing Intrusion Detection
— Unverified 00 Characterizing the Accuracy -- Efficiency Trade-off of Low-rank Decomposition in Language Models May 10, 2024 AI Agent Model Compression
— Unverified 00 Adaptive Learning of Tensor Network Structures Aug 12, 2020 BIG-bench Machine Learning Model Compression
— Unverified 00 Effective Interplay between Sparsity and Quantization: From Theory to Practice May 31, 2024 Computational Efficiency Model Compression
— Unverified 00 Effective and Efficient One-pass Compression of Speech Foundation Models Using Sparsity-aware Self-pinching Gates May 28, 2025 Model Compression
— Unverified 00 Effective and Efficient Mixed Precision Quantization of Speech Foundation Models Jan 7, 2025 Model Compression parameter estimation
— Unverified 00 Education distillation:getting student models to learn in shcools Nov 23, 2023 Incremental Learning Knowledge Distillation
— Unverified 00 Channel Compression: Rethinking Information Redundancy among Channels in CNN Architecture Jul 2, 2020 Acoustic Scene Classification Event Detection
— Unverified 00 Edge-Optimized Deep Learning & Pattern Recognition Techniques for Non-Intrusive Load Monitoring of Energy Time Series May 7, 2025 Model Compression Non-Intrusive Load Monitoring
— Unverified 00 Edge-MultiAI: Multi-Tenancy of Latency-Sensitive Deep Learning Applications on Edge Nov 14, 2022 Management Model Compression
— Unverified 00 Edge-First Language Model Inference: Models, Metrics, and Tradeoffs May 22, 2025 Benchmarking Language Modeling
— Unverified 00 Edge Deep Learning for Neural Implants Dec 1, 2020 Deep Learning EEG
— Unverified 00 Order of Compression: A Systematic and Optimal Sequence to Combinationally Compress CNN Mar 26, 2024 Knowledge Distillation Model Compression
— Unverified 00 An Improving Framework of regularization for Network Compression Dec 11, 2019 Model Compression object-detection
— Unverified 00 Adaptive Quantization of Neural Networks Jan 1, 2018 Edge-computing Model Compression
— Unverified 00 Accelerating Framework of Transformer by Hardware Design and Model Compression Co-Optimization Oct 19, 2021 CPU GPU
— Unverified 00 Edge-AI for Agriculture: Lightweight Vision Models for Disease Detection in Resource-Limited Settings Dec 23, 2024 Computational Efficiency Federated Learning
— Unverified 00 Edge AI: Evaluation of Model Compression Techniques for Convolutional Neural Networks Sep 2, 2024 Edge-computing image-classification
— Unverified 00 EDCompress: Energy-Aware Model Compression for Dataflows Jun 8, 2020 Diversity model
— Unverified 00 ECoFLaP: Efficient Coarse-to-Fine Layer-Wise Pruning for Vision-Language Models Oct 4, 2023 Model Compression
— Unverified 00 Cascaded channel pruning using hierarchical self-distillation Aug 16, 2020 Knowledge Distillation Model Compression
— Unverified 00 DynaQuant: Compressing Deep Learning Training Checkpoints via Dynamic Quantization Jun 20, 2023 Deep Learning Model Compression
— Unverified 00 Dynamic Sparse Learning: A Novel Paradigm for Efficient Recommendation Feb 5, 2024 Model Compression Recommendation Systems
— Unverified 00 Can We Find Strong Lottery Tickets in Generative Models? Dec 16, 2022 Model Compression Network Pruning
— Unverified 00 A New Clustering-Based Technique for the Acceleration of Deep Convolutional Networks Jul 19, 2021 Clustering image-classification
— Unverified 00