防御arXiv 2609.39297
MiniRep:面向多智能体辩论的鲁棒声誉聚合方法
提出 MiniRep,按当前质量、风险与历史声誉聚合多智能体辩论
- arXiv
- 2609.39297
- 发表
- 层
- 应用层
- 场景
- 多智能体
- 测试
- 七个 API 可访问 LLM 组成的十智能体池(论文按数据集单独排名为 strong/weak,正文未列出模型名)、1.5B semantic verifier
摘要MiniRep 用当前提案证据校准历史声誉并限制克隆组,MATH 上平均准确率高于基线,其他任务有反例。
MiniRep 是面向恶意智能体的 MAD 声誉聚合,只作用在 Decide 阶段。