分析与理论arXiv 2610.06851·10月5日研究发现基础模型仅靠固定开头 token 即可达到 RL 级推理表现证明短开头词可唤醒基模型推理,且效应来自训练数据arXiv2610.06851发表10月5日层训练与数据层场景模型与 API测试Olmo-3-7B、Olmo-3-32B、Qwen3-4B 等 10 个组件推理链深度解读完整解读
分析与理论arXiv 2609.34572·9月28日论文提出 Nudgeability:推理模型会跟随置信信号却不追踪自身能力提出 Nudgeability,测量推理模型跟随信心信号调整工具委派的对准程度arXiv2609.34572发表9月28日层应用层场景AI Agent测试Qwen3-4B、Qwen3-8B、Qwen3-14B 等 11 个组件推理链深度解读完整解读