研究发现类型化决策模型主要按选项标签而非定义作答
揭示类型化决策模型按选项标签而非定义规则作答
完整解读
揭示类型化决策模型按选项标签而非定义规则作答
证明短开头词可唤醒基模型推理,且效应来自训练数据
完整解读分析良性知识蒸馏中提示模板对学生拒答保留的影响
完整解读提出预训练缩放律,估计野生 AI 网页文本相当于多少人类 token
作者测量未标注的 wild AI 网页文本对预训练的影响,并提出一个能让 AI token 价值变号的缩放律。
测绘去安全开源模型的生产、重分发与下游应用留存机制