LLM quantization
LRQ: Optimizing Post-Training Quantization for Large Language Models by Learning Low-Rank Weight-Scaling Matrices
Present, but with little supersession signal in the knowledge base
0 papers critique it · 0 beat it on benchmarks