用时序逻辑监控工具 Agent:MonPoly 标出 71.8% STAC 攻击链,但溯源检查被一行注入骗过 94%–99%
提出基于MonPoly的时序逻辑监控,离线检出工具智能体危险动作链
这篇论文对工具调用大语言模型智能体的安全监控进行了形式化时序验证研究。
提出基于MonPoly的时序逻辑监控,离线检出工具智能体危险动作链
这篇论文对工具调用大语言模型智能体的安全监控进行了形式化时序验证研究。
提出PAA路径对齐归因,审计编程智能体边界动作前的分段提示注入
本研究针对长流程智能体在执行任务时面临的分阶段间接提示注入威胁,提出了在动作生效前进行拦截的边界动作审计框架与路径对齐归因方法。
提出HACKTRACE用生成状态检测并抑制代码奖励作弊
提出DART,用去噪表征转移检测并干预多轮智能体攻击
论文提出了一种针对大语言模型智能体多轮安全风险的轻量级运行时防御框架DART。
红队评估编码智能体的阻断监视器,并提出Auto Mode++加固