June 4, 2026 Sparsity Induction for Accurate Post-Training Pruning of Large Language Models 通过稀疏性诱导提升 LLM 后训练剪枝精度 weight-pruning model-compression attention-mechanism llm-training architecture