APort Vault 发布:用 4,371 条人工攻击评测 AI Agent 支付授权
提出 APort Vault,评测支付智能体授权层对越权转账的拦截
完整解读另有 383 篇论文还没打上分类标签,暂不在筛选结果里。
提出 APort Vault,评测支付智能体授权层对越权转账的拦截
完整解读提出 nmult 指标,测量智能体动作门禁堆叠的错误相关性与等效层数
论文是一项针对智能体动作拦截防御堆叠故障关联性与实际组合价值的实证测量研究。
提出 HarnessSecurity-Bench,横向评测编码智能体框架的安全机制
完整解读构建 AGENTDOXX 评测联网搜索智能体对匿名访谈的再识别能力
提出 STAR-Guard 双层防御缓解长程智能体遗忘安全约束
在模拟环境中复现级联失准行为并降低审计诱导开销
提出 MisKnow-Agent,评测深度研究智能体是否采纳误导性检索知识
构建知识逆转基准,评测陈旧检索证据如何推翻模型原本正确的回答
这篇论文是对检索增强生成(RAG)中“陈旧文档中毒”现象的实证与机理评估研究。
提出卡点评测框架,以实参级谓词审计间接提示注入评测的测量偏差