跳到正文
10月10日 · 周六

Agent 安全 · 论文

找到 2 篇
筛选6
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。
  1. 评测与基准arXiv 2609.35408

    研究揭示 LLM 交付物修订痕迹导致的无意泄露,并提出 RevLeakBench 基准

    用 RevLeakBench 测量 LLM 交付物修订痕迹的无意泄露

    发表
    场景
    AI Agent
    被测模型
    GPT-5.6、GPT-5.5、DeepSeek-V4-Pro 等 6 个
    摘要修订痕迹让撤回项重新进入交付物。

    修订痕迹指模型按要求删掉或换掉一项后,又在交代这次修改时把它写进给第三方的交付物。

    深度解读完整解读
  2. 其他arXiv 2609.22978

    DeepSeek Elastic Compute(DSec):面向大规模智能体训练的高效沙箱基础设施

    提出弹性沙箱基础设施 DSec,支撑大规模智能体训练

    发表
    场景
    AI Agent
    摘要DSec 是面向大规模智能体 RL 的多后端生产沙箱,用分层、按需镜像和训练协同维持高密度。

    DSec 是 DeepSeek-AI 的生产沙箱平台,用来支撑从 DeepSeek V3.2 到 V4.1 的智能体 RL 与评测,而不是报告某个模型的任务准确率。

    深度解读完整解读
已经到底了