arXiv cs.LG· Raneem Mahajne, Toviah Moldwin·· 6 小时前AI 评分22
完全可解释的极简 Transformer:从几何到算法
Fully Interpretable Minimal Transformers: From Geometry to Algorithm
AI 导读
研究者提出一套构建与解读极简 Transformer 的框架,将嵌入维度和注意力头大小都限制为 2,从而在二维平面上完整可视化其内部表示。模型在“遇到 '+' 时输出最近出现的偶数”任务上训练后,嵌入、Q/K/V 变换、注意力矩阵、残差流与决策边界均可直接观察,作者据此把学到的几何结构读成一步步算法流程。
来源:arXiv cs.LG · arxiv.org