publications
publications by categories in reversed chronological order. * denotes equal author contribution.
2026
-
MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLMarXiv preprint arXiv:2602.20191, 2026 -
Efficient Multi-bit Quantization Network Training via Weight Bias Correction and Bit-wise Coreset SamplingAdvances in Neural Information Processing Systems, 2026
2025
-
Row-Column Hybrid Grouping for Fault-Resilient Multi-Bit Weight Representation on IMC ArraysarXiv preprint arXiv:2508.15685, 2025 -
MSQ: Memory-Efficient Bit Sparsification QuantizationIn Proceedings of the IEEE/CVF International Conference on Computer Vision, 2025 -
TruncQuant: Truncation-Ready Quantization for DNNs with Flexible Weight Bit PrecisionIn 2025 IEEE/ACM International Symposium on Low Power Electronics and Design (ISLPED), 2025 -
MEMHD: Memory-Efficient Multi-Centroid Hyperdimensional Computing for Fully-Utilized In-Memory Computing ArchitecturesIn 2025 Design, Automation & Test in Europe Conference (DATE), 2025