分析与理论arXiv 2609.25366
研究:思维链对答案的约束随模型相对任务难度而变化
用续写扰动衡量思维链对答案的因果约束如何随任务难度变化
- arXiv
- 2609.25366
- 发表
- 层
- 模型层
- 场景
- 模型与 API
- 测试
- Gemma-2-9B-IT、Llama-3.1-8B-Instruct、DeepSeek-R1-Distill-Qwen-7B 等 4 个
- 组件推理链
摘要在所测续写干预与模型中,思维链对答案的约束随任务和后训练条件而变。
用续写扰动衡量思维链对答案的因果约束如何随任务难度变化
摘要在所测续写干预与模型中,思维链对答案的约束随任务和后训练条件而变。
提出 ARIA,在冻结权重上用 SAE 做推理时遗忘门控
提出 FUSE 框架,评测大语言模型的化生危险能力