arrow
返回

Embeddings hidden layers learning for neural network compression

delete2025-07-01
delete0
delete
OA
AI
J
Jia Cheng Hu
R
Roberto Cavicchioli
A
Alessandro Capotondi
DOI:10.1016/j.neunet.2025.107794delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
• 嵌入可以学习隐藏层,而不会损害标记和学习的质量。 • EPS和VEPS能够实现极小模型的构建。 • ShareBERT在参数量减少21.9倍的情况下,达到了BERT的95.5%的精度。 • 为资源受限设备引入了轻量级ShareBERT变体。 • 在不同任务上均有效,并且与现有的压缩方法正交。
Keyword:
Parameter-sharing
Parameter reduction
Compression
Embeddings
BERT

期刊

Neural Networks 封面图
Neural Networks
IF:
6.3
论文数:
8.2K
被引数:
3.0W

机构

暂无机构信息
引用论文

引用论文

Right-truncatable Neural Word Embeddings
err
IF0
err2016-01-01
err0
PREAI
errJun Suzuki; Masaaki Nagata
err分享
err收藏
Long Short-Term Memory长短期记忆
err1997-11-01
err0
PREAI
errSepp Hochreiter; Jürgen Schmidhuber
err分享
err收藏
Self-Critical Sequence Training for Image Captioning
err2017-07-01
err0
errOAAI
errSteven J. Rennie; Etienne Marcheret; Youssef Mroueh; Jerret Ross; Vaibhava Goel
err分享
err收藏
LAD: Layer-Wise Adaptive Distillation for BERT Model Compression
errSENSORS
IF3.5
err2023-01-28
err6
errOAAI
errLin, Ying-Jia; Chen, Kuan-Yu; Kao, Hung-Yu
err分享
err收藏
Placing search in context
err2001-04-01
err0
PREAI
errLev Finkelstein; Evgeniy Gabrilovich; Yossi Matias; Ehud Rivlin; Zach Solan; Gadi Wolfman; Eytan Ruppin
err分享
err收藏
Uncertainty-Driven Knowledge Distillation for Language Model Compression
err2023-01-01
err3
PREAI
errHuang, Tianyu; Dong, Weisheng; Wu, Fangfang; Li, Xin; Shi, Guangming
err分享
err收藏
学者 查看更多内容