防御arXiv 2608.30387
研究者提出多智能体系统输出与委派链路双层存证方案
提出多智能体输出与委派谱系的两层存证方案
- arXiv
- 2608.30387
- 发表
- 层
- 应用层
- 场景
- 多智能体
- 测试
- Ollama llama3.1:latest
- 防御水印与溯源
摘要两层证明记录放出字节与边授权。
部署方侧的两层证明,用来在多智能体跨部署方委托之后回答两个事后问题:谁放出了这些字节,这条跨部署方边有没有父方授权。
提出多智能体输出与委派谱系的两层存证方案
部署方侧的两层证明,用来在多智能体跨部署方委托之后回答两个事后问题:谁放出了这些字节,这条跨部署方边有没有父方授权。
提出基准投毒攻击,使自修改编码智能体跨代写出漏洞代码
摘要论文报告了恶意基准能污染自修改代码智能体的进化过程并持续输出漏洞,警示系统设计需纳入安全约束。
提出 MiniRep,按当前质量、风险与历史声誉聚合多智能体辩论
MiniRep 是面向恶意智能体的 MAD 声誉聚合,只作用在 Decide 阶段。