arrow
返回

Word embedding factor based multi-head attention

delete2025-01-30
delete0
delete
OA
AI
Z
Zhengren Li
Z
Zhao, Yumeng
X
Xiaohang Zhang *
H
Huawei Han
C
Cui Fen Huang
DOI:10.1007/s10462-025-11115-ydelete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
自然语言处理(NLP)领域通过使用基于多头注意力机制(如Transformer和BERT)的深度学习模型取得了显著进展。然而,这种方法存在两大主要局限性:首先,注意力头的数量通常基于经验手动设定;其次,其在语义理解和解释方面不够清晰。本研究提出了一种新颖的注意力机制,称为基于因子分析的多头(FAM)注意力,该机制结合了探索性因子分析理论和词嵌入。实验结果表明,与传统方法相比,FAM注意力在实现更好性能的同时所需参数更少,并且在词元级别具有更强的语义理解和可解释性。这对当前的大语言模型(LLMs)具有重要意义,特别是在有效减少参数数量和提升性能方面。
Keyword:
Multi-head attention
Word embedding
Factor analysis
BERT

期刊

Artificial Intelligence Review 封面图
Artificial Intelligence Review
IF:
13.9
论文数:
6.1K
被引数:
1.9W

机构

B
Beijing Univ Posts and Telecommun
学者数:
719
论文数: 311
被引数: 55
引用论文

引用论文

Annotating Columns with Pre-trained Language Models
err2022-06-11
err0
errOAAI
errYoshihiko Suhara; Jinfeng Li; Yuliang Li; Dan Zhang; Çağatay Demiralp; Chen Chen; Wang-Chiew Tan
err分享
err收藏
err分享
err收藏
Video Swin Transformer视频Swin变压器
err2022-06-01
err0
PREAI
errZe Liu; Jia Ning; Yue Cao; Yixuan Wei; Zheng Zhang; Stephen Lin; Han Hu
err分享
err收藏
On the diversity of multi-head attention论多头注意力的多样性
err2021-09-01
err53
PREAI
errLi, Jian; Wang, Xing; Tu, Zhaopeng; Lyu, Michael R.
err分享
err收藏
err分享
err收藏
学者 查看更多内容