跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 10 条 · 共 10 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 2
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源602新闻与研究603细分与主体7来源:论文追踪论文追踪1 条材料来源:LessWrongLessWrong1 条材料来源:arXiv:可解释性arXiv:可解释性1 条材料来源:Redwood ResearchRedwood Research1 条材料来源:Transformer CircuitsTransformerCircuits1 条材料来源:CAISCAIS1 条材料论文:论文提出按风险类别测量的对齐缩放定律框架论文2026-10-06论文提出按风险类别测量的对齐缩放定律框架动态:减少合成标记会让部分 SDF 虚假事实更难检测动态2026-10-04减少合成标记会让部分 SDF 虚假事实更难检测论文:LLM Forensics:用稀疏自编码器定位并控制后门触发机制论文2026-09-07LLM Forensics:用稀疏自编码器定位并控制后门触发机制动态:Redwood Research 给出构建抗训练模型生物的建议动态2026-05-28Redwood Research 给出构建抗训练模型生物的建议动态:Anthropic 提出分阶段模型差分方法,用字典学习分离微调中的模型与数据影响动态2024-12-11Anthropic 提出分阶段模型差分方法,用字典学习分离微调中的模型与数据影响动态:教皇利奥十四世通谕《Magnifica Humanitas》谈 AI 伦理与人类关系动态2026-06-03教皇利奥十四世通谕《MagnificaHumanitas》谈 AI 伦理与人类关系方向:对齐对齐4方向:后门与投毒后门与投毒6方向:其他方向其他方向3方向:可解释性可解释性2方向:AI 控制AI 控制2方向:AnthropicAnthropic2方向:Google DeepMindGoogleDeepMind1
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。8 个较少出现的方向归入「其他方向」,点选可查看。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 10 条