分析与理论arXiv 2608.27924·8月28日智能体记忆如何可靠处理不可回答问题:一项系统研究分析外部记忆对智能体可靠处理不可回答问题的作用arXiv2608.27924发表8月28日层应用层场景AI Agent风险幻觉与编造组件记忆摘要记忆能选择性提高 UAQ 的可接受回应,但跨数据集不稳定,且更依赖可迁移的行为指导。这份研究在同一智能体框架里检查外部记忆会不会让不可回答问题的处理更稳,以及稳来自哪一种存储内容。深度解读完整解读
评测与基准arXiv 2609.36130·9月28日论文提出 DerivAudit:审计长期 Agent 记忆是否真由交互历史支持提出 DERIVAUDIT,审计长期 Agent 记忆是否由交互历史支持arXiv2609.36130发表9月28日层应用层场景AI Agent风险幻觉与编造组件记忆摘要DERIVAUDIT 表明扩历史能补出处,但组合准入与过细检查仍两侧出错。DERIVAUDIT 审计长期智能体的持久记忆是否由写入时可获得的交互历史支持,而不是只看以后能否被召回。深度解读完整解读