跳到正文
10月10日 · 周六

全部论文

找到 10 篇

另有 194 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 其他arXiv 2610.08917

    CARE:为视觉-语言-动作模型推理加速提供认证式选择

    提出 CARE,离线认证 VLA 加速配置的回合级失败风险并选出最快合格候选

    发表
    被测模型
    OpenVLA-OFT、π0.5、π0 等 5 个
    摘要CARE 以配对回合认证加速诱发失败,在预算内选最快候选,不足则保留参考。

    CARE 在部署前从加速配置中选出最快、且加速诱发失败风险能被有限样本认证为低于用户预算的候选。证据不足就保留全计算参考策略。

    深度解读完整解读
  2. 其他arXiv 2610.05689

    研究者提出用可逆神经网络为 AI 控制系统寻找可证明的前向不变集

    提出用可逆网络为给定 AI 控制器寻找可证明前向不变集

    发表
    被测模型
    Pendulum AI-controller、Cart pole AI-controller、PVTOL AI-controller
    摘要用潜空间超矩形加解析验证,为事先给定的 AI 控制器寻找 FIS。

    本文处理的是认证场景:AI 控制器事先给定,不能为了构造 Lyapunov 函数去改控制器,却仍要给出可解析核验的安全依据。

    深度解读完整解读
  3. 其他arXiv 2610.02662

    论文发现语言驱动机器人安全监控的细化缺口:安全高层计划可能产生不安全执行

    审计机器人安全监控的细化缺口,比较表面计划与图细化轨迹的裁决

    发表
    摘要表面轨迹可漏掉图诱导的禁区进入。

    作者审计 RoboGuard 的一个假设:对高层动作轨迹的安全裁决,在补上语义图诱导的导航和已记录隐式效应之后是否仍然成立。做法是不改验证器,并固定同一条 LTL。

    深度解读完整解读
  4. 其他arXiv 2609.31562

    面向自主科学发现的智能体经济基础设施

    勾勒科学智能体经济以协调验证、信用与安全

    发表
    摘要作者主张以智能体经济管理自主科学发现的验证资源、信用、问责与安全,而非只提升推理。

    作者把高自主 AI scientist 的规模化协调写成经济与制度问题:假设生成变便宜之后,要分配的是稀缺验证资源,并处理信用、问责和恶意使用。

    深度解读完整解读
  5. 其他arXiv 2609.26457

    Weco AI 提出 AIDE2:AI 研究智能体递归自我改进 8 天获七次提升

    提出双层系统 AIDE2,使研究智能体自改进 Harness 并对比人类研发基线

    发表
    被测模型
    gemini 3 flash、gpt-5.6-sol、fable 5

    摘要提出双层递归自改进系统 AIDE2,在固定预算下演化 Harness 代码,多项留出基准超越人类基线并降低奖励黑客。

    深度解读完整解读
  6. 其他arXiv 2609.17247

    DriveMCP:面向高级驾驶辅助系统的智能体 AI 框架

    提出 DriveMCP 框架,将感知、交规检索与车辆遥测接成可审计驾驶辅助层

    发表
    摘要DriveMCP 用可审计专家工具和 RSS/TTC 仲裁做驾驶辅助,作者称违章与超速低于三个 VLM 基线。

    DriveMCP 是面向高级驾驶辅助的模块化智能体框架,把感知、合规、车辆状态和安全仲裁拆开并留下审计轨迹。

    深度解读完整解读
  7. 其他arXiv 2402.04247

    论文探讨 AI 科学家的风险:应优先保障安全而非自主性

    梳理 AI 科学家的风险并主张三元防护框架

    发表
    摘要作者主张防护优先于自主性,用三元框架把输出安全扩展到行为与环境反馈。

    这是一篇关于 LLM 驱动 AI scientists 的 perspective:自主科研能力增强时,误用和意外后果缺少科学情境下的系统防护。

    深度解读完整解读
已经到底了