评测与基准arXiv 2607.19262
BioSecBench-Surveillance:面向病原体基因组监测 AI 智能体的可验证基准
提出 BioSecBench-Surveillance,评测 Agent 的病原监测分析
- arXiv
- 2607.19262
- 发表
- 层
- 应用层
- 场景
- 编程 Agent
- 测试
- Gemini 3.5 Flash、Gemini 3.1 Pro、Opus 4.8 等 10 个
提出 BioSecBench-Surveillance,评测 Agent 的病原监测分析
用演化算法构造思维病毒并测量其在多智能体中的传播
提出 AuraForge,从漏洞修复合成安全测试并监督训练编码智能体
AuraForge 把真实仓库的历史漏洞修复变成可执行训练任务,用来监督编程智能体同时满足功能请求和隐含的安全要求。
提出 Box2-Bench,评测模型能否选择性依赖外部工作流
Box2-Bench 固定任务与模型,只改变工作流可靠性,用来衡量模型能否选择性依赖可能出错的外部指导。
提出推断期后门攻击 AKRASIA,用代码触发器与伪装推理篡改代码输出
摘要论文针对推理代码大模型提出了隐蔽推断期后门攻击 AKRASIA,揭示了模型思维链可被利用进行欺骗性伪装的安全隐患。