跳到正文
10月9日 · 周五

全部论文

找到 4 篇
筛选3
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 519 篇还没打标签,不在筛选结果里。

另有 519 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 分析与理论arXiv 2610.01535

    论文:安全路由评测在分布偏移下失效,基线选取偏差被低估

    揭示安全路由评测在分布偏移下的虚假下限与选择偏差

    发表
    被测模型
    claude-3-5-sonnet、claude-3-opus、claude-sonnet-4-6 等 9 个

    摘要论文揭示安全路由评估在分布偏移下的虚假下限,指出防御重心应转向外部动作级强制。

    深度解读完整解读
  2. 分析与理论arXiv 2609.31857

    LLM Judge 验证在稀疏重叠下的问题:从推理到设计

    分析稀疏重叠下 LLM judge 与人类一致性的验证误差并规划重叠分配

    发表
    被测模型
    Gemini Flash、Gemini Pro、GPT-4o-mini 等 10 个
    摘要稀疏重叠主导 judge 验证的错误决策。

    这篇工作研究标注重叠很稀时,怎样验证 LLM judge 是否足以替代人类,并规划重叠该留多少、怎么分配。。部署前的标准做法是在校准集上比较 judge 与人类的一致性。

    深度解读完整解读
  3. 分析与理论arXiv 2609.30467

    研究提出医疗答案事实核查失败分类法,指出检索后验证范式的固有局限

    归纳开放式医学长答案检索核验的失败分类

    发表
    被测模型
    GPT-5.4、Mistral Small 3 (24B-Instruct-2501)、Mistral Small 4 (119B-2603) 等 8 个
    摘要作者把开放式低召回归为证据是否在库、能否被定位,以及与声明是否对齐。

    这篇工作诊断开放式医学事实核验的 retrieve-then-verify 管线断在哪里,而不是提出新的核验器。

    深度解读完整解读
  4. 分析与理论arXiv 2608.27924

    智能体记忆如何可靠处理不可回答问题:一项系统研究

    分析外部记忆对智能体处理不可回答问题的影响

    发表
    场景
    AI Agent
    被测模型
    DeepSeek-V3.2、Qwen3-235B-A22B-Instruct-2507、GPT-5.5
    摘要记忆能选择性提高 UAQ 的可接受回应,但跨数据集不稳定,且更依赖可迁移的行为指导。

    这份研究在同一智能体框架里检查外部记忆会不会让不可回答问题的处理更稳,以及稳来自哪一种存储内容。

    深度解读完整解读
已经到底了