跳到正文
10月9日 · 周五

全部论文

找到 37 篇

另有 669 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 其他arXiv 2610.00093

    自我演化智能体的安全性综述:SAVER 过渡中心框架

    提出 SAVER 框架综述自演化智能体的安全状态转移

    发表
    场景
    AI Agent
    摘要SAVER 用状态转移追踪自演化安全:合法状态可经复用变不安全,后代修复证据仍少。

    SAVER 是一篇关于自演化智能体安全的转移中心综述:安全对象从单次回答或单次授权动作,转到可复用状态在多次转移中的谱系。

    深度解读完整解读
  2. 其他arXiv 2610.01195

    Federated Agent Optimization:面向隐私约束下分布式智能体协同优化的联邦智能体优化框架

    提出 FAO 框架,形式化隐私约束下的智能体协同优化

    发表
    场景
    AI Agent
    摘要FAO 把智能体协作写成效用、隐私和通信的多目标问题,并给出组件分类与迁移框架。

    Federated Agent Optimization(FAO) 是一篇框架论文:多个处在私有环境中的 LLM 智能体,如何在原始数据、完整轨迹和本地知识不离开客户端的前提下协作改进。

    深度解读完整解读
  3. 其他arXiv 2609.10144

    AIOS 的内核管理共享内存:面向系统级个性化的新抽象

    AI 导读研究提出"内核管理共享内存",由智能体系统内核而非单个智能体统一负责记忆检索、隐私执行与提示注入。

    发表
    测试
    GPT-4o、Llama-3.1:8B、Qwen-2.5:7B
    摘要作者称内核集中管理记忆,能拿到无约束上下文的大部分个性化收益,并降低延迟。

    kernel-managed shared memory 把多智能体的检索、隐私和注入收进 agent-system kernel,并在 AIOS 上与三种替代方案比较。

    深度解读完整解读
  4. 其他arXiv 2609.12413

    SoK 综述:智能体 AI 时代的越狱攻击、防御与实践考量

    综述智能体执行链路中的越狱攻击、防御与实践权衡

    发表
    场景
    AI Agent
    测试
    Qwen3.5-4B、Llama-3.1-8B-Instruct
    摘要SoK 将越狱重放到智能体流水线,并用两种模型检验回复层防御的边际与代价。

    Mia 等人把越狱安全从单轮回复扩展到智能体的规划、记忆、工具和智能体间通信,并问既有结论在更强原生对齐下是否还成立。

    深度解读完整解读
  5. 其他arXiv 2609.15906

    综述提出面向工具调用 AI 智能体的授权架构

    提出面向工具调用智能体的授权主体层级与结构要求

    发表
    场景
    AI Agent
    摘要叙事综述用主体层级把工具调用授权收成七项要求,并标出强制与聚合两处缺口。

    这是一篇关于工具调用型智能体授权架构的结构化叙事综述,分析单位是每一次使模型之外系统产生效果的调用。

    深度解读完整解读
  6. 其他arXiv 2609.19399

    RWPS:面向网络安全博弈的高效纳什均衡计算

    提出 RWPS,在固定仿真预算下估计安全博弈收益并求均衡

    发表
    摘要RWPS 用历史代理和均衡加权采样估计安全博弈收益,并给出按支撑加权的遗憾界。

    Lanier、Farmer 与 Vorobeychik 研究仿真型网络安全博弈中,如何在远小于全矩阵的仿真预算下计算可利用性较低的均衡。。收益没有闭式,PSRO 扩大攻防策略池时必须估计每一对的收益,仿真次数随池二次增长。

    深度解读完整解读
  7. 其他arXiv 2609.12039

    现实才是最终验证者:智能体软件工程的两大关键缺口

    提出双缺口框架统一智能体软件工程的奖励投机与幻觉

    发表
    摘要双缺口解释内环为何会放行部署后不可接受的实现,外环用现实证据持续修订 R、M 与 E。

    Reality Is the Final Verifier 用 two-gap framework 解释智能体软件工程的主要失败,并主张用外层保证环持续收窄缺口,而不是试图在部署前证明缺口已关闭。

    深度解读完整解读
  8. 其他arXiv 2609.12067

    面向压缩与隐私的可扩展离散到连续信道模拟

    提出置换方案,精确模拟离散到连续信道并用于变速率压缩与差分隐私估计

    发表
    摘要置换加指数竞赛用固定样本模拟离散到连续信道,polar-MLC 将其用到 VQ-VAE 压缩和高斯 CDP 均值估计。

    Rowan、Phan 与 Khisti 研究离散输入、连续输出信道的模拟:共享随机样本数固定,长块长用 polar 码与多层编码降到 O(n log n)。。信道模拟要让解码器的 Y 服从 P_{Y|X},同时把消息长度压向 I(X。

    深度解读完整解读
  9. 其他arXiv 2609.21858

    基于泊松过程的可水印多草稿推测采样

    提出多草稿水印投机采样 MPFR,同时保持无偏水印与采样效率

    发表
    测试
    Qwen2.5-7B-Instruct、Qwen2.5-0.5B-Instruct、Qwen2.5-1.5B-Instruct 等 4 个
    摘要MPFR 用上下文索引的泊松过程做可水印多草稿投机采样,并保持停止时间草稿不变性。

    MPFR 是一种基于泊松过程的多草稿投机采样,用来同时提高解码效率并嵌入无偏水印。

    深度解读完整解读
  10. 其他arXiv 2609.26457

    Weco AI 提出 AIDE2:AI 研究智能体递归自我改进 8 天获七次提升

    提出双层自改进系统 AIDE2,让外层智能体重写内层 Harness 代码

    发表
    测试
    claude opus 4.7、gemini 3 flash、gemini 3.1 pro 等 6 个

    摘要提出双层递归自改进系统 AIDE2,在固定预算下演化 Harness 代码,多项留出基准超越人类基线并降低奖励黑客。

    深度解读完整解读
  11. 其他arXiv 2609.39982

    Mid-Harness:在模型与 Harness 之间扩展终端智能体的动作采样

    提出 Mid-Harness,在执行前验证并选择终端智能体的候选动作

    发表
    测试
    TMAX-9B、TMAX-4B、TMAX-27B 等 8 个
    摘要Mid-Harness 在执行前选择候选动作。

    Mid-Harness 在不改生成器和执行 harness 的前提下,于二者之间做动作级测试时计算,用来研究终端智能体里“多采样、再验证”何时提高轨迹成功。

    深度解读完整解读