评测与基准arXiv 2610.03585
宾州州立大学提出 TPRS,量化 Agent 安全基准中工具命名对 ASR 的影响
提出 TPRS,量化 Agent 安全基准对工具命名的表征敏感性
- arXiv
- 2610.03585
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 被测模型
- GPT-5-mini、Claude Haiku 4.5、GPT-4o-mini
- 组件MCP 与技能
提出 TPRS,量化 Agent 安全基准对工具命名的表征敏感性
测试编程智能体被诱导或自主篡改自身执行轨迹的行为
这是一项针对本地大模型智能体执行轨迹完整性与安全防篡改边界的实证研究。