نسخة أولية وصول مفتوح
Capability Scaling-Down Laws for LLM Compression
LLM compression reduces inference costs and memory requirements, but selecting a method and configuration remains largely empirical because comparable resource reductions can produce different capability losses. We systematically investigate capability scaling-down laws for LLM compression across pruning, quantization, …