跳到正文
10月10日 · 周六

全部论文

找到 22 篇
筛选3
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 392 篇还没打标签,不在筛选结果里。

另有 392 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 评测与基准arXiv 2610.04366

    CrashSim 用真实事故先验生成碰撞场景并构建 nuCrash 数据集

    提出 CrashSim 用真实事故先验引导扩散仿真并构建 nuCrash 评测自动驾驶规划器

    发表
    被测模型
    Lane-graph planner、PDM-closed planner、IL planner 等 5 个
    摘要CrashSim 迁入真实事故先验生成场景。

    CrashSim 用检索到的真实事故先验引导扩散式多车仿真,为自动驾驶安全评测生成碰撞与近碰撞场景。。

    深度解读完整解读
  2. 评测与基准arXiv 2610.02874

    SceneFactory-3D:将 2D 交通场景提升为 3D 物理反事实以做安全评测

    提出 SceneFactory-3D,用路况反事实评测驾驶策略的闭环安全性

    发表
    被测模型
    Frozen L0、L0-T、L1 等 5 个
    摘要SceneFactory-3D 固定场景只改路况。

    SceneFactory-3D 是 GPU 批处理的多智能体驾驶仿真器,用来在场景和控制器固定时只改路面物理,并比较闭环结果。

    深度解读完整解读
  3. 其他arXiv 2610.02662

    论文发现语言驱动机器人安全监控的细化缺口:安全高层计划可能产生不安全执行

    审计机器人安全监控的细化缺口,比较表面计划与图细化轨迹的裁决

    发表
    摘要表面轨迹可漏掉图诱导的禁区进入。

    作者审计 RoboGuard 的一个假设:对高层动作轨迹的安全裁决,在补上语义图诱导的导航和已记录隐式效应之后是否仍然成立。做法是不改验证器,并固定同一条 LTL。

    深度解读完整解读
  4. 防御arXiv 2610.03089

    COBRA:为计算机使用 Agent 防御分支引导攻击的双 LLM 架构

    提出 COBRA 双 LLM 架构,防御计算机使用 Agent 的分支转向攻击

    发表
    被测模型
    gpt-5、UI-TARS-1.5-7B、claude-sonnet-5 等 6 个

    摘要提出分支转向防御架构 COBRA,通过事前能力约束与边界代理消除分支转向攻击并兼顾效用。

    深度解读完整解读
  5. 评测与基准arXiv 2610.06898

    DIBench:面向移动 GUI 智能体多候选选择决策完整性的安全基准

    用 DIBench 评测移动 GUI 智能体被 UI 注入后的决策完整性

    发表
    被测模型
    Qwen2.5-VL(32B)、Qwen3-VL(32B)、GUI-Owl(32B) 等 7 个

    摘要论文提出移动智能体决策完整性基准 DIBench,发现欺诈 UI 注入诱导目标选择并推高完成率,通用防御收益不稳定。

    深度解读完整解读
  6. 评测与基准arXiv 2609.26618

    NavSafe-∞:在真实感环境中评测闭环驾驶安全

    提出 NAVSAFE-∞ 写真闭环基准,评测端到端驾驶策略的闭环安全

    发表
    被测模型
    LTF、DiffusionDrive、DrivoR 等 13 个
    摘要写真事件级闭环基准显示开环高分不能稳定变成闭环安全。

    NAVSAFE-∞ 用写真、事件级闭环仿真检查端到端驾驶策略的安全,而不是只看开环轨迹分数。

    深度解读完整解读
  7. 评测与基准arXiv 2609.24890

    OSWorld-Pro 发布:面向 Computer-Use Agent 的过程式评测基准

    提出 OSWorld-Pro,用顺序子目标过程评测计算机使用智能体

    发表
    被测模型
    Claude Opus 5 Max、Claude Opus 4.8 Max、Claude Opus 4.7 Max 等 14 个
    摘要OSWorld-Pro 用顺序子目标评测 CUA,并标出点击失误与无关动作。

    OSWorld-Pro 是一套计算机使用智能体的过程评测,用来补充只核对最终交付物的 OSWorld。

    深度解读完整解读
  8. 防御arXiv 2609.22724

    MATE:面向移动 Agent 的策略感知安全审计方法

    提出移动 Agent 轨迹审计器 MATE,判断轨迹是否违反可编辑安全策略

    发表
    攻击者
    黑盒
    被测模型
    MATE-0.5B、MATE-1.5B、MATE-3B
    摘要MATE 用合成轨迹微调轻量审计器,在可编辑策略下判断移动智能体轨迹是否违规并给出解释。

    MATE 是面向移动 GUI 智能体的轻量策略条件轨迹审计器,在给定自然语言安全策略时判断轨迹是否违规并解释原因。

    深度解读完整解读
  9. 其他arXiv 2609.17247

    DriveMCP:面向高级驾驶辅助系统的智能体 AI 框架

    提出 DriveMCP 框架,将感知、交规检索与车辆遥测接成可审计驾驶辅助层

    发表
    摘要DriveMCP 用可审计专家工具和 RSS/TTC 仲裁做驾驶辅助,作者称违章与超速低于三个 VLM 基线。

    DriveMCP 是面向高级驾驶辅助的模块化智能体框架,把感知、合规、车辆状态和安全仲裁拆开并留下审计轨迹。

    深度解读完整解读
  10. 防御arXiv 2609.03438

    CONFLICTGUI 基准与 CONFLICTGUARD 框架:让多模态 GUI Agent 学会在冲突指令下终止执行

    提出 ConflictGuard,引导 GUI Agent 在冲突指令下终止执行

    发表
    被测模型
    UI-Venus-1.5-8B、UI-TARS-1.5-7B、OS-Atlas-Base-7B 等 10 个
    摘要ConflictGUI 暴露 GUI 智能体的执行偏向过度服从,ConflictGuard 用条件转向提高冲突终止率。

    ConflictGuard用推理时的可行性核验和条件激活转向,让 GUI 智能体在指令不可行时终止,而不是盲执行。

    深度解读完整解读
  11. 攻击arXiv 2608.06862

    SynChain:诱导计算机使用 Agent 自建攻击链并跨任务持久化

    提出 SYNCHAIN,诱导计算机使用 Agent 自建跨任务持久攻击链

    发表
    被测模型
    Qwen3.5-9B、Llama-3.1-8B、Ministral-3-8B

    摘要论文揭示了 CUA 自合成工件带来的内部供应链威胁,验证了潜伏载荷的跨任务传播能力与防御局限。

    深度解读完整解读