-
ShortGPT: Layers in Large Language Models are More Redundant Than You Expect
Paper • 2403.03853 • Published • 66 -
SparseGPT: Massive Language Models Can Be Accurately Pruned in One-Shot
Paper • 2301.00774 • Published • 4 -
The LLM Surgeon
Paper • 2312.17244 • Published • 9 -
SliceGPT: Compress Large Language Models by Deleting Rows and Columns
Paper • 2401.15024 • Published • 73
Bui Van Hop
hllj
AI & ML interests
Computer Vision, Deep Learning, NLP
Recent Activity
liked a model about 7 hours ago
Lego-X/SWE-Lego-Qwen3-8B new activity about 7 hours ago
AxiaoDBL/qwen3.5-4b-swebench-sft:What teacher model and issue pool were used for the model training? liked a model about 1 year ago
Qwen/Qwen3-30B-A3B-GPTQ-Int4