Activation-Weighted Low-Rank Compression

Research paper proposing an activation-weighted fitting method that reduces perplexity degradation by 5-7x vs plain SVD across GPT-2, Gemma-3, and Qwen2.5.

PythonPyTorchTransformersResearch
Activation-Weighted Low-Rank Compression cover