model-pruning
from Orchestra-Research/AI-research-SKILLs
Reduce LLM size and accelerate inference using pruning techniques like Wanda and SparseGPT. Use when compressing models without retraining, achieving 50% sparsity with minimal accuracy loss, or enabli
v1.0.0MIT
496
Lines
1,518
Words
16
Code Blocks
Languages
bashpython
19-emerging-techniques/model-pruning/SKILL.md