1
Return

PP-LLMs: A progressive pruning approach with medium-granularity for large language models

delete2026-07-31
delete0
PRE
AI
K
Kangning Du
Y
Yinkai Wang
B
Benkui Zhang *
J
Jinxiao Wang
F
Fan Zhang
L
Lin Cao
Y
Yanan Guo
DOI:10.1016/j.eswa.2026.133770delete
deleteOriginal
deleteOriginal request for help
deleteShare
deleteSave
Abstract

Abstract

En 中文
• We propose a dual-metric two-stage pipeline tailored to each layer’s function. • We introduce a method quantifying layer importance for performance-aware pruning. • We design a low-cost pruning method, PP-LLMs, for effective model deployment.
Keywords:
Large language models
Model compression
Structure pruning
Layer importance metric

Journal

Expert Systems with Applications cover
Expert Systems with Applications
IF:
7.5
Papers:
2.9W
Citations:
10.2W

Organization

B
beijing information science and technology university
Scholars:
369
Papers: 153
Citations: 0
Cited Papers

Cited Papers

Citing Papers

Citing Papers