arrow
返回

Circuit explained: How does a transformer perform compositional generalization

delete2026-02-04
delete0
PRE
AI
C
Cheng Tang
B
Brenden Lake
M
Mehrdad Jazayeri *
DOI:10.1371/journal.pone.0340088delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
结构化泛化——将已知组件系统地组合成新颖结构的能力——是人类灵活认知的基础,然而在神经网络中实现这一能力的机制在机器学习和认知科学中仍不为人所知。[1]的研究表明,一个紧凑的编码器-解码器转换器可以在序列算术任务中实现简单的结构化泛化。在本工作中,我们识别并从机制上解释了此类模型中负责此行为的电路。通过因果消融,我们隔离了该电路,并表明这种理解能够通过精确的激活编辑来可预测地引导模型的输出。我们发现,该电路在不编码任何特定函数的特定语义的情况下执行函数组合——相反,它利用标记位置和标识的解耦表示来在整个函数族中应用通用的标记重新映射规则。尽管该电路机制是在有限数量的合成任务的小规模模型中识别出来的,但它为符号结构化如何在转换器中涌现提供了见解,并为大规模模型中的类似机制提供了可检验的假设。模型和分析的代码已公开可用。
Keyword:
compositional generalization
transformer models
causal ablation
function composition
disentangled representation

期刊

PLoS One 封面图
PLoS One
IF:
2.6
论文数:
2.6W
被引数:
81.6W

机构

M
massachusetts institute of technology (mit)
学者数:
1.4K
论文数: 622
被引数: 0
P
princeton university
学者数:
3.2K
论文数: 1.6K
被引数: 0
引用论文

引用论文

Mental Leaps
err
IF0
err1994-12-07
err0
PREAI
errKeith J. Holyoak; Paul Thagard
err分享
err收藏
err
IF0
err
err0
PREAI
err
err分享
err收藏
Rule learning by seven-month-old infants
errSCIENCE
IF45.8
err1999-01-01
err880
PREAI
errMarcus, GF; Vijayan, S; Rao, SB; Vishton, PM
err分享
err收藏
err
IF0
err
err0
PREAI
err
err分享
err收藏
Task representations in neural networks trained to perform many cognitive tasks
err2019-01-14
err0
PREAI
errGuangyu Robert Yang; Madhura R. Joglekar; H. Francis Song; William T. Newsome; Xiao-Jing Wang
err分享
err收藏
没有更多内容