跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 7 条 · 共 79 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 2
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源502新闻与研究603细分与主体7来源:Miles BrundageMiles Brundage1 条材料来源:Goodfire ResearchGoodfireResearch2 条材料来源:MITRE ATLAS 数据发布MITRE ATLAS 数据发布1 条材料来源:The EU AI Act NewsletterThe EU AI ActNewsletter1 条材料来源:Schneier on SecuritySchneier onSecurity1 条材料动态:DeepSeek R1 的真正启示:规模加人才即可逼近超人类 AI动态2025-02-02DeepSeek R1 的真正启示:规模加人才即可逼近超人类 AI动态:Goodfire 开源 DeepSeek R1 的稀疏自编码器并披露两个引导现象动态2025-11-28Goodfire 开源 DeepSeek R1 的稀疏自编码器并披露两个引导现象动态:Goodfire 研究思维链表演性:探针揭示模型内部答案早于推理文本动态2026-04-10Goodfire 研究思维链表演性:探针揭示模型内部答案早于推理文本动态:MITRE ATLAS 发布 v2026.08:新增自主攻击与 AI 智能体相关技术与缓解措施动态2026-09-01MITRE ATLAS 发布 v2026.08:新增自主攻击与 AI 智能体相关技术与缓解措施动态:EU AI Act Newsletter #106:呼吁强制执行通用人工智能模型规则动态2026-07-13EU AI Act Newsletter #106:呼吁强制执行通用人工智能模型规则动态:研究揭示推理语言模型的自我越狱现象动态2026-09-23研究揭示推理语言模型的自我越狱现象方向:前沿安全框架前沿安全框架2方向:OpenAIOpenAI4方向:DeepSeekDeepSeek6方向:思维链监控思维链监控3方向:开源模型安全开源模型安全3方向:其他方向其他方向6方向:AnthropicAnthropic2
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。13 个较少出现的方向归入「其他方向」,点选可查看。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 7 条