跳到正文
10月9日 · 周五

全部论文

论文 1414 篇
筛选
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 455 篇还没打标签,不在筛选结果里。
  1. arXiv 2610.11634收录

    LTBD:用可学习信任边界分隔符防御提示注入

    AI 导读论文提出可学习信任边界分隔符(LTBD),一种在输入中显式编码信任边界、不改变 LLM 参数的轻量防御方法,用少量可学习分隔符区分可信用户指令与不可信外部数据,使模型更好遵循预期的信任层级。

    收录