Open-weight & owned stack · Quantization efficiency
SliderQuant Targets Accurate Post-Training LLM Quantization
The SliderQuant paper presents a method for improving accuracy during post-training quantization of large language models.
Read the original at awesomepapers.ioOpens the publisher's site in a new tab