跳到正文
10月10日 · 周六

全部论文

找到 10 篇

另有 201 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 评测与基准arXiv 2610.07939

    CCDF 数据集:Grok Imagine、Veo 3.1、Sora 2 伪造监控录像,十个深伪检测器基本认不出

    提出监控深伪基准 CCDF,在统一编码后评测检测器对伪造犯罪事故录像的识别

    发表
    被测模型
    C2P-CLIP、ForgeLens、D3-Im 等 10 个

    摘要提出消除格式捷径的监控深度伪造基准 CCDF,揭示现有检测器难以识别商用生成视频。

    深度解读完整解读
  2. 评测与基准arXiv 2610.06339

    BabelFake:面向多语言音视频 DeepFake 检测的基准数据集

    构建多语言音视频 DeepFake 基准 BabelFake 并评测检测器

    发表
    被测模型
    SpeechForensics、AVH-Align、(B)RAVEn
    摘要BabelFake 为五语同意采集基准。

    BabelFake 是经同意与 IRB 批准采集的多语音视频 DeepFake 检测基准,用来把视觉操纵和语音合成拆开比较。

    深度解读完整解读
  3. 评测与基准arXiv 2610.00392

    A2A-TIBA:针对 A2A 协议 LLM 智能体的间接提示注入攻击与三层同构攻防模型

    提出 A2A-TIBA,经 A2A 对等任务间接注入并植入常驻回调

    发表
    被测模型
    MiniMax-M3、deepseek-v4-pro、glm-5.3 等 8 个
    摘要A2A-TIBA 一次植入后绕过智能体,GDA 用四类结果定位防线,ELA-ITL 把信封标注列为第三层。

    A2A-TIBA 把间接提示注入和绕过放进 A2A:gray-box 攻击者已能投递任务,诱导目标部署常驻回调程序后,下令和外传不再经过智能体。

    深度解读完整解读
  4. 评测与基准arXiv 2609.35557

    论文:容器、权限规则与沙箱都无法区分读取研究代码的是编译器还是编码 Agent

    评测容器、权限规则与沙箱能否区分编译器与编码 Agent 的文件读取

    发表
    摘要此 harness 表达不了编译器可读而智能体不可读,五条路径两边都不覆盖。

    作者在物理流求解器上检查一套编码智能体配置:编译器必须读本组材料与反应模型,这些字节又不得进入模型上下文或离开本机的记录。

    深度解读完整解读
  5. 评测与基准arXiv 2608.18607

    VA-Judger:面向联合视频-音频生成的人类偏好反馈奖励建模

    提出 VA-Judger,用人类偏好训练联合音视频奖励模型

    发表
    被测模型
    VA-Judger、LTX-2 + VA-Judger
    摘要VA-Judger 用易到难的人类偏好学习做联合音视频奖励,并用于 LTX-2 后训练。

    VA-Judger 是面向联合音视频生成的思维链全模态奖励模型,用来替代由分维度专家指标拼成的强化学习奖励。

    深度解读完整解读
  6. MasDrift:跨多智能体架构的授权保持基准

    提出 MasDrift,评测多智能体在良性任务中的授权保持

    发表
    被测模型
    DeepSeek V4 Flash、Qwen3.7 Plus、GPT-5.4 Nano 等 6 个
    摘要授权保持可被测量:层级用未授权动作换完成率,重锚定比沿链携带更稳。

    MasDrift 把多智能体设计中的授权保持做成可测量性质,对象是没有攻击者的普通委托。

    深度解读完整解读
  7. 评测与基准arXiv 2605.18984

    Artifact-Bench:评估 MLLM 检测与诊断 AI 生成视频伪影

    提出 Artifact-Bench,评测 MLLM 检测并诊断 AI 生成视频伪影

    发表
    被测模型
    Gemini 3.1 Pro、Gemini 3 Flash、Qwen3-VL 8B-Instruct 等 19 个
    摘要Artifact-Bench 以三项任务评 MLLM 的 AIGC 伪影感知。

    Artifact-Bench 用来看 MLLM 能否发现 AI 生成视频中的伪影,并说明视频为何不真实。

    深度解读完整解读
  8. 评测与基准arXiv 2605.14859

    论文提出 AuthBench 基准,评测编码 Agent 能否推断最小权限边界

    提出 AuthBench 评测编码 Agent 最小权限,并验证充足性-紧缩性分解

    发表
    被测模型
    GPT-5、GPT-5.3-Codex、GPT-5.4 等 9 个
    摘要论文提出权限边界推断基准与两阶段分解方法,有效降低安全暴露。

    本文研究代码智能体在执行终端任务前自主推断最小文件权限边界的能力。

    深度解读完整解读
已经到底了