Machine Learning · Computer Science
SigmaQuant: Hardware-Aware Heterogeneous Quantization Method for Edge DNN Inference
Qunyou Liu, Pengbo Yu, Marina Zapater, David Atienza
2026-03-04
Machine Learning · Computer Science
EmBench: Quantifying Performance Variations of Deep Neural Networks across Modern Commodity Devices
Mario Almeida, Stefanos Laskaridis, Ilias Leontiadis, Stylianos I. Venieris +1
2019-05-20
Distributed, Parallel, and Cluster Computing · Computer Science
SlimEdge: Performance and Device Aware Distributed DNN Deployment on Resource-Constrained Edge Hardware
Mahadev Sunil Kumar, Arnab Raha, Debayan Das, Gopakumar G +2
2026-02-17
Computer Vision and Pattern Recognition · Computer Science
Optimising Resource Management for Embedded Machine Learning
Lei Xun, Long Tran-Thanh, Bashir M Al-Hashimi, Geoff V. Merrett
2021-05-11
Hardware Architecture · Computer Science
HybridDNN: A Framework for High-Performance Hybrid DNN Accelerator Design and Implementation
Hanchen Ye, Xiaofan Zhang, Zhize Huang, Gengsheng Chen +1
2020-04-09
Hardware Architecture · Computer Science
Dynamic DNNs Meet Runtime Resource Management on Mobile and Embedded Platforms
Lei Xun, Bashir M. Al-Hashimi, Jonathon Hare, Geoff V. Merrett
2022-06-08
Machine Learning · Computer Science
Compilation and Optimizations for Efficient Machine Learning on Embedded Systems
Xiaofan Zhang, Yao Chen, Cong Hao, Sitao Huang +2
2022-08-29
Distributed, Parallel, and Cluster Computing · Computer Science
Accelerating Distributed Deep Learning using Lossless Homomorphic Compression
Haoyu Li, Yuchen Xu, Jiayi Chen, Rohit Dwivedula +4
2024-02-13
Machine Learning · Computer Science
Hardware-Aware DNN Compression for Homogeneous Edge Devices
Kunlong Zhang, Guiying Li, Ning Lu, Peng Yang +1
2025-12-23
Machine Learning · Computer Science
2-in-1 Accelerator: Enabling Random Precision Switch for Winning Both Adversarial Robustness and Efficiency
Yonggan Fu, Yang Zhao, Qixuan Yu, Chaojian Li +1
2025-01-07
Machine Learning · Computer Science
Hardware-Aware DNN Compression via Diverse Pruning and Mixed-Precision Quantization
Konstantinos Balaskas, Andreas Karatzas, Christos Sad, Kostas Siozios +3
2023-12-27
Emerging Technologies · Computer Science
Deep Learning with Coherent VCSEL Neural Networks
Zaijun Chen, Alexander Sludds, Ronald Davis, Ian Christen +7
2023-07-19
Machine Learning · Computer Science
Towards Ultra-High Performance and Energy Efficiency of Deep Learning Systems: An Algorithm-Hardware Co-Optimization Framework
Yanzhi Wang, Caiwen Ding, Zhe Li, Geng Yuan +7
2018-02-20
Hardware Architecture · Computer Science
Hardware-Aware DNN Compression for Homogeneous Edge Devices
Kunlong Zhang, Guiying Li, Ning Lu, Peng Yang +1
2025-12-16
Machine Learning · Computer Science
All-in-One: A Highly Representative DNN Pruning Framework for Edge Devices with Dynamic Power Management
Yifan Gong, Zheng Zhan, Pu Zhao, Yushu Wu +5
2022-12-13
Distributed, Parallel, and Cluster Computing · Computer Science
An efficient and flexible inference system for serving heterogeneous ensembles of deep neural networks
Pierrick Pochelu, Serge G. Petiton, Bruno Conche
2022-08-31
Distributed, Parallel, and Cluster Computing · Computer Science
Throughput Maximization of DNN Inference: Batching or Multi-Tenancy?
Seyed Morteza Nabavinejad, Masoumeh Ebrahimi, Sherief Reda
2023-08-29
Machine Learning · Computer Science
Efficient Deep Learning Infrastructures for Embedded Computing Systems: A Comprehensive Survey and Future Envision
Xiangzhong Luo, Di Liu, Hao Kong, Shuo Huai +3
2025-12-23
Hardware Architecture · Computer Science
Exploration of Systolic-Vector Architecture with Resource Scheduling for Dynamic ML Workloads
Jung-Hoon Kim, Sungyeob Yoo, Seungjae Moon, Joo-Young Kim
2022-06-08
Performance · Computer Science
MMBench: Benchmarking End-to-End Multi-modal DNNs and Understanding Their Hardware-Software Implications
Cheng Xu, Xiaofeng Hou, Jiacheng Liu, Chao Li +8
2023-08-30
Distributed, Parallel, and Cluster Computing · Computer Science
Hyperdrive: A Multi-Chip Systolically Scalable Binary-Weight CNN Inference Engine
Renzo Andri, Lukas Cavigelli, Davide Rossi, Luca Benini
2019-03-15
Hardware Architecture · Computer Science
MetaML-Pro: Cross-Stage Design Flow Automation for Efficient Deep Learning Acceleration
Zhiqiang Que, Jose G. F. Coutinho, Ce Guo, Hongxiang Fan +1
2026-02-11