跳到正文
10月9日 · 周五

全部论文

找到 2 篇
筛选4
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 433 篇还没打标签,不在筛选结果里。

另有 433 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 评测与基准arXiv 2608.11727

    Harness-IF:评估编码 Agent 跨指令面的指令遵循能力

    提出 Harness-IF,按交付面评测编程 Agent 的指令遵循

    发表
    测试
    Seed-2.0-Pro、Claude-Opus-4.7、GPT-5.5 等 12 个
    摘要规则级基准显示总分开高估反先验遵循,交付面优先序也不按提示词深度。

    Harness-IF 用执行证据给编程智能体的单条操作规则打分,并单独报告反对未提示默认的那一部分。。

    深度解读完整解读
  2. 风险行为arXiv 2609.35928

    论文发现暴露模型身份标签会削弱多智能体 LLM 合作

    测量公开模型家族标签引发的多智能体派系化与合作下降

    发表
    测试
    Seed-OSS (Seed-OSS-36B-Instruct)、Gemma (gemma-4-26B-A4B-it)、GPT-OSS (gpt-oss-20b) 等 6 个
    摘要可见身份标签让异构 LLM 群体按标签结派,共识更慢、更贵,去掉标签后该行为消失。

    Del Giudice 等人研究异构多智能体 LLM 系统里一个配置细节:把模型家族身份告诉智能体,会不会改变合作。他们把由此出现的、按身份结组的倾向称为 factionalism。任务是无利害的共同决策,没有人设,也没有偏向同家族同伴的奖励。

    深度解读完整解读
已经到底了