评测与基准arXiv 2610.07639·10月6日HarnessSecurity-Bench 横向评测六款编码智能体框架的安全机制提出 HARNESSSECURITY-BENCH 评测编码智能体框架的安全机制arXiv2610.07639发表10月6日层应用层场景编程 Agent攻击提示注入组件权限与沙箱+1+1深度解读完整解读
防御arXiv 2609.22949·9月19日多智能体系统提示注入威胁模型与防御架构:14 类攻击向量与四类防御提出多智能体提示注入威胁模型与四层架构防御arXiv2609.22949发表9月19日层应用层场景多智能体被测模型GPT-4o (2024-08-06)、Claude 3.5 Sonnet、Llama 3 70B-Instruct防御指令与数据隔离攻击提示注入组件权限与沙箱+2+2深度解读完整解读