现实才是最终验证者:智能体软件工程的两大关键缺口
提出双缺口框架统一智能体软件工程的奖励投机与幻觉
- arXiv
- 2609.12039
- 发表
- 层
- 应用层
- 场景
- 编程 Agent
- 风险奖励作弊
摘要双缺口解释内环为何会放行部署后不可接受的实现,外环用现实证据持续修订 R、M 与 E。
Reality Is the Final Verifier 用 two-gap framework 解释智能体软件工程的主要失败,并主张用外层保证环持续收窄缺口,而不是试图在部署前证明缺口已关闭。
提出双缺口框架统一智能体软件工程的奖励投机与幻觉
Reality Is the Final Verifier 用 two-gap framework 解释智能体软件工程的主要失败,并主张用外层保证环持续收窄缺口,而不是试图在部署前证明缺口已关闭。
构建基于论证方案与大模型的结构化欺骗分析网页工具
占位。
提出双层自改进系统 AIDE2,让外层智能体重写内层 Harness 代码
摘要提出双层递归自改进系统 AIDE2,在固定预算下演化 Harness 代码,多项留出基准超越人类基线并降低奖励黑客。
提出 Mid-Harness,在执行前验证并选择终端智能体的候选动作
Mid-Harness 在不改生成器和执行 harness 的前提下,于二者之间做动作级测试时计算,用来研究终端智能体里“多采样、再验证”何时提高轨迹成功。
提出列表式智能体补丁检索系统,在仓库中定位 CVE 修复提交
PatchHolmes 是面向补丁检索的两阶段系统:在本地 Git 仓库上用冻结开源权重模型,为一个已知 CVE 找出修复提交,不做按仓库微调,也不使用付费外部搜索 API。
检验元认知反馈能否减少向 LLM 助手的答案卸载
这是一项关于学习界面如何减少把完整答案交给 LLM、从而降低去技能风险的预注册 HCI 实验。
提出 Djinnlang,以无歧义规格约束 LLM 的实现并由 Dafny 核验
Djinnlang 让程序员只写规格,把 LLM 放进编译器,并用 Dafny 验证器加上无歧义约束钉住语义。
提出成本感知的 MCP 编排框架,用确定性利用图与免费层模型做自动化渗透测试
PentestChain 是一个十阶段、经 MCP 暴露的自动渗透框架,用确定性利用图把 7B 本地模型挡在利用关键路径之外,并把每次交战的美元成本当作实测指标。。