分析与理论arXiv 2609.29757·9月24日OllamaDrama:用蜜罐测量暴露 LLM 基础设施遭受的攻击部署蜜罐测量针对暴露 LLM 基础设施的攻击arXiv2609.29757发表9月24日层基础设施层场景模型与 API深度解读完整解读
防御arXiv 2609.35659·9月29日Tracekit:面向自主编码 Agent 的防篡改意图-推理-动作审计系统提出 Tracekit,对编码 Agent 做防篡改的意图-推理-动作审计arXiv2609.35659发表9月29日层应用层场景编程 Agent测试Claude Code (claude -p, version 2.1)、独立评审(同一 CLI,无工具)防御监控与审计攻击提示注入风险Agent 危险操作组件监控器+3+3摘要Tracekit 把意图、自述和动作写入可锚定的哈希链。Tracekit 是无第三方依赖的编码智能体审计层:把人类请求、模型自述和已执行动作并排写入可外部锚定的哈希链,执行前用正则门,事后用规则和独立模型互查。深度解读完整解读