分析与理论arXiv 2609.34572
论文提出 Nudgeability:推理模型会跟随置信信号却不追踪自身能力
测量固定推理轨迹中信心信号对工具委派的敏感性与对准性
- arXiv
- 2609.34572
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 被测模型
- Qwen3-4B、Qwen3-8B、Qwen3-14B 等 11 个
- 组件推理链
测量固定推理轨迹中信心信号对工具委派的敏感性与对准性
分析外部记忆对智能体处理不可回答问题的影响
这份研究在同一智能体框架里检查外部记忆会不会让不可回答问题的处理更稳,以及稳来自哪一种存储内容。