评测与基准arXiv 2608.12851
研究者提出 SkillMisevo-Bench,量化自改进 Agent 的技能误演化风险
提出 SkillMisevo-Bench,量化自改进 Agent 的技能误演化
- arXiv
- 2608.12851
- 发表
- 层
- 应用层
- 被测模型
- Claude Code、Codex、Hermes 等 4 个
提出 SkillMisevo-Bench,量化自改进 Agent 的技能误演化
提出 SYNCHAIN,诱导计算机使用 Agent 自建跨任务持久攻击链
摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。
提出 ARE 框架与图像文本攻击,评测多模态网页 Agent 的对抗鲁棒性
摘要系统评估多模态网页智能体的脆弱性,指出推理时计算组件被攻破会加剧系统风险。