跳到正文
10月10日 · 周六

全部论文

找到 52 篇

另有 350 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 其他arXiv 2610.08364

    Transect:为长程 LLM Agent 评测保留可观测性的开源工具

    提出 Transect,将长程 Agent 评测转录对齐到可回查的共享时间线

    发表
    场景
    AI Agent
    被测模型
    Claude-Opus-4.7
    摘要Transect 把长转录收成可回查报告,案例中文稿与自审占主要 token。

    Transect 是基于 Inspect Scout 的转录分析包,用来在长程智能体评估里保住可回查的过程账户。

    深度解读完整解读
  2. 其他arXiv 2610.07386

    NetAgent:面向多任务网络流量分析的智能体框架

    提出 NetAgent,编排工具完成多任务网络流量分析

    发表
    场景
    AI Agent
    摘要NetAgent 编排工具做多任务流量分析。

    NetAgent 是一个多任务网络流量分析智能体框架。作者要让分析员用自然语言把分类、隧道检测和主机研判串成可重规划的工作流,而不为每个任务单独训练一个模型。

    深度解读完整解读
  3. 其他arXiv 2610.06563

    HERA 提出 harness 与环境协同演化

    提出 HERA,协同演化 harness 与环境以提升 Agent 拒答准确性

    发表
    场景
    AI Agent
    被测模型
    GPT-5.6-Luna、GPT-5.6-Terra、GPT-5.6-Sol 等 20 个
    摘要HERA 用失败协同演化 harness 与环境,并在迁移评测中提高 Abstain。

    HERA 在模型权重固定时,让 harness 与可执行环境按失败协同演化,以改进 agentic abstention。

    深度解读完整解读
  4. 其他arXiv 2610.02662

    论文发现语言驱动机器人安全监控的细化缺口:安全高层计划可能产生不安全执行

    审计机器人安全监控的细化缺口,比较表面计划与图细化轨迹的裁决

    发表
    摘要表面轨迹可漏掉图诱导的禁区进入。

    作者审计 RoboGuard 的一个假设:对高层动作轨迹的安全裁决,在补上语义图诱导的导航和已记录隐式效应之后是否仍然成立。做法是不改验证器,并固定同一条 LTL。

    深度解读完整解读
  5. 其他arXiv 2610.01195

    Federated Agent Optimization:面向隐私约束下分布式智能体协同优化的联邦智能体优化框架

    提出 FAO 框架,形式化隐私约束下的分布式智能体协同优化

    发表
    场景
    AI Agent
    摘要FAO 把智能体协作写成效用、隐私和通信的多目标问题,并给出组件分类与迁移框架。

    Federated Agent Optimization(FAO) 是一篇框架论文:多个处在私有环境中的 LLM 智能体,如何在原始数据、完整轨迹和本地知识不离开客户端的前提下协作改进。

    深度解读完整解读
  6. 其他arXiv 2610.01045

    论文提出空承诺概念,衡量智能体承诺超出运行时能力的问题

    定义空承诺并给出单回合测量协议,按配置判定智能体承诺可否执行

    发表
    场景
    AI Agent
    摘要空承诺由配置决定、说话当下可判。

    作者定义空承诺:智能体承诺回合结束后的行动,但在其工具与运行时下没有任何执行路径。空洞只由配置决定,不依赖后续轨迹。

    深度解读完整解读
  7. 其他arXiv 2609.39982

    Mid-Harness:在模型与 Harness 之间扩展终端智能体的动作采样

    提出 Mid-Harness,在执行前验证并筛选终端智能体的候选动作

    发表
    被测模型
    TMAX-9B、TMAX-4B、TMAX-27B 等 6 个
    摘要Mid-Harness 在执行前选择候选动作。

    Mid-Harness 在不改生成器和执行 harness 的前提下,于二者之间做动作级测试时计算,用来研究终端智能体里“多采样、再验证”何时提高轨迹成功。

    深度解读完整解读
  8. 其他arXiv 2609.38807

    PatchHolmes:基于列表式选择的智能体补丁检索系统

    提出 PatchHolmes,用混合检索和列表式智能体选出 CVE 修复提交

    发表
    被测模型
    Qwen3-235B、Qwen3-Coder-30B、gpt-oss-120B 等 4 个
    摘要PatchHolmes 用混合检索和列表式四工具智能体做补丁检索,增益主要来自联合阅读候选而非更换骨干。

    PatchHolmes 是面向补丁检索的两阶段系统:在本地 Git 仓库上用冻结开源权重模型,为一个已知 CVE 找出修复提交,不做按仓库微调,也不使用付费外部搜索 API。

    深度解读完整解读
  9. 其他arXiv 2609.38143

    为测试时 AI4AI 的智能体执行环境设计学习元技能

    从执行反馈学习 meta-skill,为未见任务搭建 Agent harness

    发表
    场景
    AI Agent
    被测模型
    Gemini-3.6-Flash、Qwen3.8-Flash、GPT-OSS-120B 等 4 个
    摘要冻结的 meta-skill 库指导 Builder 为未见任务搭建 harness,权重保持固定。

    作者研究 test-time AI4AI:Builder 与 Target 权重都固定时,Builder 学习如何为 Target 构造更好的执行环境。

    深度解读完整解读
  10. 其他arXiv 2609.35266

    面向软件交付决策门禁的智能体安全审计器持续保障机制

    提出 TAIP 持续保障,在策略或证据变化后重算仓库审计交付门裁决

    发表
    摘要TAIP 把策略、证据和执行分开,在保留的 RepoAudit 证据上于 5s 预算内重算合并门姿态。

    TAIP 是放在未修改 RepoAudit 之外的保证层,用来在软件交付门上重算智能体安全控制的当前姿态。

    深度解读完整解读
  11. 其他arXiv 2609.31562

    面向自主科学发现的智能体经济基础设施

    勾勒科学智能体经济以协调验证、信用与安全

    发表
    摘要作者主张以智能体经济管理自主科学发现的验证资源、信用、问责与安全,而非只提升推理。

    作者把高自主 AI scientist 的规模化协调写成经济与制度问题:假设生成变便宜之后,要分配的是稀缺验证资源,并处理信用、问责和恶意使用。

    深度解读完整解读
  12. 其他arXiv 2609.26457

    Weco AI 提出 AIDE2:AI 研究智能体递归自我改进 8 天获七次提升

    提出双层系统 AIDE2,使研究智能体自改进 Harness 并对比人类研发基线

    发表
    被测模型
    gemini 3 flash、gpt-5.6-sol、fable 5

    摘要提出双层递归自改进系统 AIDE2,在固定预算下演化 Harness 代码,多项留出基准超越人类基线并降低奖励黑客。

    深度解读完整解读