๐Ÿ“ TwinQuant: Learnable Subspace Decomposition for 4-Bit LLM Quantization - ICML'26

June 1, 2026

๐Ÿ“ DartQuant: Efficient Rotational Distribution Calibration for LLM Quantization - NeurIPS'25

November 9, 2025

๐Ÿ“ SPINQUANT: LLM QUANTIZATION WITH LEARNED ROTATIONS - ICLR'25

November 6, 2025

๐Ÿ“ QSVD: Efficient Low-rank Approximation for Unified Query-Key-Value Weight Compression in Low-Precision Vision-Language Models - NeurIPS'25 Spotlight

October 30, 2025