跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 7 条 · 共 7 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 2
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源502新闻与研究603细分与主体7来源:论文追踪论文追踪1 条材料来源:arXiv:可解释性arXiv:可解释性1 条材料来源:arXiv:越狱、提示注入、投毒与防御arXiv:越狱、提示注入、投毒与防御2 条材料来源:Hugging Face Daily PapersHugging FaceDaily Papers1 条材料来源:IEEE S&PIEEE S&P1 条材料论文:Persistent SAE:为语言模型特征学习特定时间尺度论文2026-07-19Persistent SAE:为语言模型特征学习特定时间尺度论文:Influence Score 与 Transformer 可解释性:推理时注意力头有效影响的度量论文2026-09-04Influence Score 与 Transformer 可解释性:推理时注意力头有效影响的度量论文:Deep Noir:用架构时序自动发现 Transformer 激活引导参数论文2026-09-17Deep Noir:用架构时序自动发现Transformer 激活引导参数动态:研究:自然语言自编码器中如何挑选最具信息量的 token 位置动态2026-09-28研究:自然语言自编码器中如何挑选最具信息量的 token 位置论文:研究:自然语言自动编码器中哪些 token 最值得审计论文2026-09-29研究:自然语言自动编码器中哪些 token 最值得审计会议论文:EnchTable:微调大语言模型中的统一安全对齐迁移会议论文2026EnchTable:微调大语言模型中的统一安全对齐迁移方向:可解释性可解释性5方向:提示注入提示注入6方向:Agent 安全Agent 安全2方向:思维链监控思维链监控2方向:其他方向其他方向1方向:对齐对齐1方向:后门与投毒后门与投毒1
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。6 个较少出现的方向归入「其他方向」,点选可查看。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 7 条