BazaarBench:评估 LLM Agent 在去中心化 C2C 市场中的代理安全
构建BazaarBench,评测去中心化交易智能体的违规与失信
BazaarBench针对大语言模型智能体在去中心化C2C交易中的代理安全问题,提出了一个结合底层实体状态与大模型裁判的仿真基准平台。
构建BazaarBench,评测去中心化交易智能体的违规与失信
BazaarBench针对大语言模型智能体在去中心化C2C交易中的代理安全问题,提出了一个结合底层实体状态与大模型裁判的仿真基准平台。
提出决策前表征检测与激活引导,预测并抑制智能体欺骗
测量良性协作中智能体隐蔽传递凭据并绕过监控
测量长程多智能体在交互中自发串通并联合违背用户协议
用迭代推理DPO从奖励作弊诱发隐蔽失准与对齐伪装
测量编程智能体被诱导或为奖励而篡改自身执行轨迹
这是一项针对本地大模型智能体执行轨迹完整性与安全防篡改边界的实证研究。