摘要论文揭示并测量了 LLM 路由决策在无文本日志中的敏感话题泄露,验证了按类别公平性防御的有效性与边界。
全部论文
另有 429 篇论文还没打上分类标签,暂不在筛选结果里。
- 评测与基准arXiv 2610.04378
COPEX:面向 MCP 智能体的受控攻击评测基准发布
提出 COPEX 基准,固定协议栈评测 MCP 智能体的攻击抵抗力
- arXiv
- 2610.04378
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 攻击arXiv 2610.05089
研究者披露 LiteLLM 网关跨租户干扰攻击 Cooldown Landmines
提出利用共享冷却的跨租户干扰攻击,并设计租户隔离机制
- arXiv
- 2610.05089
- 发表
- 场景
- LLM 应用
摘要揭示网关共享冷却漏洞,提出来源检查与租户隔离防御。
- 防御arXiv 2609.01931
Agent Flight Recorder:为长时程工具调用智能体提供链上锚定的防篡改审计追踪
提出 Agent Flight Recorder,为长时程工具智能体提供链上锚定的防篡改审计
- arXiv
- 2609.01931
- 发表
- 层
- 应用层
- 场景
- AI Agent
摘要语义事件加哈希链、Merkle 与链上锚定,用来在争议中核验长程智能体的动作序列。
Agent Flight Recorder 把长程工具智能体的动作收成可被第三方独立核验的审计记录,面向运营方本身可能改写历史的争议。
已经到底了