跳到正文
AI Safety HOT
10月10日 · 周六
全部论文
找到
0
篇
搜索标题、摘要与正文
/
已整理优先
最新发表
全部
0
全部
0
筛选
5
攻击类型
越狱
12
提示注入
100
投毒与后门
15
模型篡改
0
检测规避
3
恶意使用
3
系统形态
AI Agent
0
coding agent
0
攻击面/入口
网页与界面
0
工具返回
0
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。
另有
241
篇还没打标签,不在筛选结果里。
攻击
越狱
12
提示注入
100
投毒与后门
15
提取与窃取
防御
检测与过滤
隔离与权限
监控与审计
模型加固
模型自身风险
欺骗与谋划
奖励作弊
拒答失当
危险能力
agent 场景
AI Agent
coding agent
science agent
web agent
系统组件
MCP 与技能
RAG 系统
微调与开源权重
多模态
攻击类型:模型篡改
系统形态:AI Agent
系统形态:coding agent
攻击面/入口:网页与界面
攻击面/入口:工具返回
清除全部
另有
241
篇论文还没打上分类标签,暂不在筛选结果里。
没有同时符合这些条件的论文
同一类里可以多选(任一即可),不同类之间要同时满足;去掉一两个条件再看。另有 241 篇还没打上分类标签,暂时筛不到。
去掉全部筛选
总览
热点榜
新闻
论文
更多