跳到正文
原文
arXiv:可解释性· arXiv:2609.09556· Enrico Vompa·· 23 天前

特征叠加中线性可达性的高概率保证:IHT-SAE 突破线性可达上限

High-probability guarantees for linear accessibility in feature superposition

AI 导读

研究者将线性可达性建模为压缩感知问题,在次高斯噪声下为固定支撑导出高概率界,证明所需维度随 $d=O_{\varepsilon}(k \log m)$ 线性增长,而非此前最坏情况下的二次上限。工作刻画了活跃与非活跃特征干扰的不对称性,以及干扰预算与观测噪声预算之间的权衡,并通过高斯尾部近似在系统参数上验证了这些界。作者还提出 IHT-SAE,用学习式迭代精修提升特征恢复能力,突破线性可达性限制,为评估稀疏自编码器、组合泛化与神经网络可解释性提供框架。

阅读原文arxiv.org