Hugging Face Daily Papers · 收录 12:08 · 原文 9月30日论文关注度1515PatchHolmes:基于列表式选择的智能体补丁检索系统PatchHolmes 提出让 AI 智能体一次性读取前 100 个候选提交并通过四个预算受限的工具逐一打开提交来定位漏洞修复补丁的方法,将 Recall@1 从逐点系统的 34.61% 提升至 59.95%。该系统无需微调和付费搜索 API,仅依赖冻结的开源权重模型运行于本地 Git 克隆仓库之上,单次处理约消耗 96000 输入 token、执行 8 次工具调用并阅读 5 个提交。工具#Agent 安全#供应链安全#真实事件#工具与开源#arXiv
arXiv · 收录 06:20 · 原文 9月21日论文关注度2424SyzHarness:用 LLM 合成模糊测试 harness 复现 Linux 内核补丁漏洞SyzHarness 结合 LLM 推理与覆盖率引导模糊测试,从补丁出发复现 Linux 内核漏洞:LLM 智能体借助代码导航工具合成参数化 fuzzing harness,固定前置设置逻辑,只把不确定的 bug 关键输入参数交给 Syzkaller 变异,再通过分层可达性反馈迭代优化。在 100 个 KernelCTF 案例上复现成功率达 78%,在 SyzDirect 基准上达 73%,明显优于此前的定向灰盒模糊测试;对 2026 年 3 月后修复的 50 个 syzbot 已知可触发 bug,仅凭修复提交即复现 40/50(80%)。工具#危险能力#AI 与网络攻防#红队#真实事件#工具与开源