Skip to content

model-pruning

from Orchestra-Research/AI-research-SKILLs

Reduce LLM size and accelerate inference using pruning techniques like Wanda and SparseGPT. Use when compressing models without retraining, achieving 50% sparsity with minimal accuracy loss, or enabli

v1.0.0MIT
496
Lines
1,518
Words
16
Code Blocks

Languages

bashpython
19-emerging-techniques/model-pruning/SKILL.md