跳到正文
10月8日 · 周四

提示注入 · 论文

找到 5 篇
筛选
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 75 篇还没打标签,不在筛选结果里。

另有 50 篇还没有研究类型,暂不在这些分类里。

  1. 分析/可解释性arXiv:2609.38723 ·

    面向智能体的高效 HPC 系统:挑战与机遇

    AI 导读编码智能体已成为 HPC 系统的真实用户,但现有 HPC 抽象、接口与策略仍为人类工作流设计。

    摘要FASRC 测量说明编码智能体改变 HPC 使用方式,作者据此提出四层协同设计议程。

    这是一篇对生产 HPC 上编码智能体的测量与系统议程论文,不是攻击实现或防御评测。。

    完整解读
  2. 分析/可解释性arXiv:2609.37737 ·

    研究用因果激活修补定位模型服从提示注入指令的决策层

    AI 导读研究者在 4B 至 32B 的五个模型上做逐层因果激活修补,发现攻击信息从第一层起就可线性解码,但直到网络后三分之一的晚层瓶颈才对行为产生明显因果影响。

    测试Qwen3-4B、Qwen3-14B、Qwen3-32B 等 7 个
    摘要合规的因果杠杆集中在网络后三分之一的低秩子空间,该层也是混淆下检测最好的位置。

    这篇工作用逐层激活修补定位提示注入合规发生在网络何处,并把该位置用于检测验证。。

    完整解读
已经到底了