跳到正文
10月10日 · 周六

全部论文

找到 8 篇
筛选3
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 194 篇还没打标签,不在筛选结果里。

另有 194 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 其他arXiv 2610.02662

    论文发现语言驱动机器人安全监控的细化缺口:安全高层计划可能产生不安全执行

    审计机器人安全监控的细化缺口,比较表面计划与图细化轨迹的裁决

    发表
    摘要表面轨迹可漏掉图诱导的禁区进入。

    作者审计 RoboGuard 的一个假设:对高层动作轨迹的安全裁决,在补上语义图诱导的导航和已记录隐式效应之后是否仍然成立。做法是不改验证器,并固定同一条 LTL。

    深度解读完整解读
  2. 其他arXiv 2609.25413

    论文提议前沿 AI 开发者开展嵌入式评估

    提议前沿开发者托管嵌入式评估,审查内部智能体监控、权限与对齐

    发表
    场景
    AI Agent
    摘要论文建议前沿开发者现在就以接近员工的现场访问,持续审查内部监控、权限与对齐。

    嵌入式评估是一种第三方评估:独立评估者在前沿 AI 开发者现场获得接近员工的系统、人员与文档访问,用来审查依赖内部系统与实践的风险。

    深度解读完整解读
  3. 其他arXiv 2609.18120

    PentestChain:面向免费层 LLM 的成本感知 MCP 编排自动化渗透测试框架

    提出成本感知的 MCP 编排框架,用确定性利用图与免费层模型做自动化渗透测试

    发表
    摘要确定性利用图加免费层级联在十次自建运行上测得付费成本为零。

    PentestChain 是一个十阶段、经 MCP 暴露的自动渗透框架,用确定性利用图把 7B 本地模型挡在利用关键路径之外,并把每次交战的美元成本当作实测指标。。

    深度解读完整解读
  4. 其他arXiv 2609.16694

    面向安全 AI 渗透测试智能体:安全威胁、护栏与架构视角

    综述自主渗透智能体的继承攻击、架构攻击及护栏缺口

    发表
    场景
    AI Agent
    摘要用双轴分类连接渗透智能体的架构、攻击与护栏,并认为现有防御仍按组件分开。

    这是一篇关于自主 AI 渗透测试智能体的安全综述:用架构和生命周期两轴整理威胁与护栏,不做新的攻击实验。

    深度解读完整解读
  5. 其他arXiv 2609.10630

    论文提出 AI 安全设计保障架构:结合 Scientist AI 模型级监督与系统级控制

    提出结合 Scientist AI 监督与系统级控制的智能体保障架构

    发表
    场景
    AI Agent
    摘要作者梳理事件中的多层失效,主张监督模型、系统控制与证据治理并用。

    Lu 与 Bengio 给出的是一套可逐层上移的保障架构和一组事件归类,不是已测量的防御系统。

    深度解读完整解读
  6. 其他arXiv 2610.00093

    自我演化智能体的安全性综述:SAVER 过渡中心框架

    用 SAVER 框架综述自演化智能体的状态复用安全

    发表
    场景
    AI Agent
    摘要SAVER 用状态转移追踪自演化安全:合法状态可经复用变不安全,后代修复证据仍少。

    SAVER 是一篇关于自演化智能体安全的转移中心综述:安全对象从单次回答或单次授权动作,转到可复用状态在多次转移中的谱系。

    深度解读完整解读
已经到底了