跳到正文
10月9日 · 周五

全部论文

找到 6 篇

另有 432 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 防御arXiv 2605.19847

    论文揭示多租户 RAG 账号合谋使隐私泄露随账号数线性增长

    提出零知识审计协议,核验多租户 RAG 的合谋差分隐私

    发表
    测试
    BAAI/bge-small-en-v1.5、MultiTenantRAGService、FAISS 等 4 个
    摘要揭示多租户 RAG 合谋泄露按根号 k 放大,提出带零知识证明的无泄露审计协议。

    论文针对多租户 RAG 服务在多账户协同攻击下隐私边界失效的问题展开研究。

    深度解读完整解读
  2. 评测与基准arXiv 2609.38822

    SkillSeek:Agent 技能检索在 Marketplace 规模下的再审视

    提出 SkillSeek,用确定性检索替代智能体技能选择循环

    发表
    场景
    AI Agent
    测试
    BGE-base、bge-reranker-v2-m3、Qwen3.5-397B-A17B 等 11 个
    摘要SkillSeek 用免训练两阶段 IR 选技能,在所测网格上与 LLM 检索循环的 pass rate 接近且花费更低。

    SkillSeek 把智能体技能选择做成标准信息检索:BGE-base 双编码器取 top-20,小型交叉编码器重排后经 MCP 返回 top-5,检索循环内不再调用 LLM。公开技能聚合已到数十万条,Liu et al. (2026b) 让智能体自己改写查询并精炼候选,每任务都付 token。作者要问的是,这种合成优势在 SkillsBench 上是否经常出现,以及确定性检索能否在 pass rate 上接近它。

    深度解读完整解读
  3. 防御arXiv 2609.22724

    MATE:面向移动 Agent 的策略感知安全审计方法

    提出策略条件轨迹审计器 MATE,判断移动 Agent 是否违反可编辑安全策略

    发表
    攻击者
    黑盒
    测试
    bge-m3、MATE-0.5B、MATE-1.5B 等 8 个
    摘要MATE 用合成轨迹微调轻量审计器,在可编辑策略下判断移动智能体轨迹是否违规并给出解释。

    MATE 是面向移动 GUI 智能体的轻量策略条件轨迹审计器,在给定自然语言安全策略时判断轨迹是否违规并解释原因。

    深度解读完整解读
已经到底了