260924_news

MoBiQuant is accepted at NeurIPS 2026. MoBiQuant is a novel any-precision Mixture-of-Bits quantization framework that adjusts weight precision for flexible LLM inference based on token sensitivity!