论文提出反集群准则:以协调事件为单元遏制智能体协同入侵
提出以协调情节为操作单位的跨执行准则,规定如何发现未授权智能体协同并在重启后遏制
- arXiv
- 2609.06140
- 发表
- 层
- 应用层
- 场景
- 多智能体
- 风险欺骗与谋划
摘要立场是跨执行保留关系并约束共享状态。
提出以协调情节为操作单位的跨执行准则,规定如何发现未授权智能体协同并在重启后遏制
摘要立场是跨执行保留关系并约束共享状态。
提出 AgentRewind,用对齐检查点回退长程 Agent 的上下文与工作区
提出 TAIP,把策略与证据分离,在配置或策略变化后重算仓库审计门禁裁决
TAIP 是放在未修改 RepoAudit 之外的保证层,用来在软件交付门上重算智能体安全控制的当前姿态。
研究提出"内核管理共享内存",由智能体系统内核而非单个智能体统一负责记忆检索、隐私执行与提示注入。
kernel-managed shared memory 把多智能体的检索、隐私和注入收进 agent-system kernel,并在 AIOS 上与三种替代方案比较。
Lanier、Farmer 与 Vorobeychik 研究仿真型网络安全博弈中,如何在远小于全矩阵的仿真预算下计算可利用性较低的均衡。。收益没有闭式,PSRO 扩大攻防策略池时必须估计每一对的收益,仿真次数随池二次增长。
提出双缺口框架统一智能体软件工程的奖励投机与幻觉
Reality Is the Final Verifier 用 two-gap framework 解释智能体软件工程的主要失败,并主张用外层保证环持续收窄缺口,而不是试图在部署前证明缺口已关闭。
提出双层自改进系统 AIDE2,让外层智能体重写内层 Harness 代码
摘要提出双层递归自改进系统 AIDE2,在固定预算下演化 Harness 代码,多项留出基准超越人类基线并降低奖励黑客。
提出 Mid-Harness,在执行前验证并选择终端智能体的候选动作
Mid-Harness 在不改生成器和执行 harness 的前提下,于二者之间做动作级测试时计算,用来研究终端智能体里“多采样、再验证”何时提高轨迹成功。
提出列表式智能体补丁检索系统,在仓库中定位 CVE 修复提交
PatchHolmes 是面向补丁检索的两阶段系统:在本地 Git 仓库上用冻结开源权重模型,为一个已知 CVE 找出修复提交,不做按仓库微调,也不使用付费外部搜索 API。
提出固定权重下学习 meta-skill 以为未见任务搭建智能体 harness 的方法
作者研究 test-time AI4AI:Builder 与 Target 权重都固定时,Builder 学习如何为 Target 构造更好的执行环境。
提出评估合同,检验合规监测数据能否支持部署系统的比较主张
作者给出的是评测效度立场:部署后的运行数据要支持比较主张,必须先写明测量与主张如何对齐。
提出 Djinnlang,以无歧义规格约束 LLM 的实现并由 Dafny 核验
Djinnlang 让程序员只写规格,把 LLM 放进编译器,并用 Dafny 验证器加上无歧义约束钉住语义。
提出 DriveMCP 框架,将感知、交规检索与 RSS 仲裁接成可审计驾驶辅助
DriveMCP 是面向高级驾驶辅助的模块化智能体框架,把感知、合规、车辆状态和安全仲裁拆开并留下审计轨迹。