风险行为arXiv 2609.32915
AgentTell:浏览器 Agent 的行为侧信道泄漏基准
构建 AGENTTELL 基准,测量浏览器 Agent 的行为侧信道隐私泄露
- arXiv
- 2609.32915
- 发表
- 层
- 应用层
- 被测模型
- Claude Sonnet 5、Gemini 3.7 Flash、GPT-5.6 Luna 等 6 个
摘要论文评估了浏览器智能体的行为侧信道泄露风险,并基于近万次会话提供了评测数据。
构建 AGENTTELL 基准,测量浏览器 Agent 的行为侧信道隐私泄露
摘要论文评估了浏览器智能体的行为侧信道泄露风险,并基于近万次会话提供了评测数据。
提出 CAVEAT 基准,评测激励失配市场中计算机使用 Agent 的购买决策退化
摘要提出 CAVEAT 基准揭示智能体在商业偏好下的决策退化,诊断出三类失效并给出缓解方案。
测量任务无关说服对 Agent 编码与网页研究行为的影响
这篇工作测量一件事:与任务无关的说服进入对话之后,AI 智能体执行后面的编码或网页研究时,轨迹是否系统性不同,以及“更容易被说服”能否预测差有多大。