LLM quantization

LRQ

LRQ: Optimizing Post-Training Quantization for Large Language Models by Learning Low-Rank Weight-Scaling Matrices

Trackedfirst seen Jul 16, 2024

Present, but with little supersession signal in the knowledge base

0 papers critique it · 0 beat it on benchmarks