评测与基准arXiv 2607.20891
MisKnow-Agent 评测
用 MisKnow-Agent 评测深度研究智能体是否采纳误导文档结论
- arXiv
- 2607.20891
- 发表
- 层
- 应用层
- 被测模型
- DeerFlow、WebThinker、Gemini Deep Research 等 6 个
摘要论文通过 MisKnow-Agent 框架评估发现长程研究智能体易采纳误导性知识,且现有防御难以完全消除该现象。
用 MisKnow-Agent 评测深度研究智能体是否采纳误导文档结论
摘要论文通过 MisKnow-Agent 框架评估发现长程研究智能体易采纳误导性知识,且现有防御难以完全消除该现象。