先手 SENTE · 周报阅读清单 · 速读 · arXiv 2609.29845

Transformer 能同时想两件事:大模型里的线性叠加现象

Your Transformer Can Hold Two Thoughts at Once: Evidence of Linear Superposition in LLMs
Pavel Tikhonov,Anton Korznikov,Matvey Mikhalchuk,Nikita Dragunov 等 9 位作者 · 2026-09-24

两段输入叠加进去,输出就是两个分布的叠加

打开交互式解读 →

三个要点

2× 理论推理吞吐提升(一次前向生成两段续写)

适合谁读:做推理优化、服务成本的基础设施团队;可解释性研究者。

arXiv 摘要页 · PDF

AI 解读 · 基于原文:本页由 AI 根据论文原文整理,所有数字均可在原文中找到出处;引用前请核对原文。