分析与理论arXiv:2610.06851 · 10月5日研究发现基础模型仅靠固定开头 token 即可达到 RL 级推理表现证明短开头词可唤醒基模型推理,且效应来自训练数据模型与 API·测试Olmo-3-7B、Olmo-3-32B、Qwen3-4B 等 10 个·训练与数据层推理链完整解读