AI星际引擎
AI STARSHIP
首页
动态
博客
播客
论文
学习
关于
墨
纸
2026.09.24 星期四
第
49
期
主题 · 大语言模型机理
大语言模型机理
1 条
01
削弱型神经元:Transformer中具有过度影响力的输入-输出功能单元
发现GLU型神经元中存在‘削弱型’机制——输入/输出权重负相关,主动抑制残差流中特定方向,揭示新解释性现象。
arxiv.org
·
arXiv
·
09/16
Transformer可解释性
神经元分析
大语言模型机理