全部动态
从来源,看到研究的联系
图中 6 条 · 本页 14 条 · 共 590 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 3
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。
点选节点,展开一条线索
本页材料
完整标题与摘要 · 14 条- 会议论文USENIX Security 2026
捉迷藏的艺术:让基于 Pickle 的模型供应链投毒重新变得隐蔽
系统梳理 pickle 模型投毒攻击面,发现 22 条加载路径中 19 条被现有扫描器漏检,并找到 133 个可利用 gadget,绕过率接近 100%。
- 会议论文USENIX Security 2026
野外恶意Agent技能的检测与理解
分析98,380个Agent技能,确认157个恶意技能及632项漏洞,并揭示凭证窃取和指令操纵两类主要攻击策略。
- 会议论文USENIX Security 2026
通过微调轨迹中一致的知识演化证明模型谱系
结合模型编辑与知识向量化,验证微调带来的参数修改与知识演化是否一致;可在分类器、扩散模型和 LLM 上稳健验证谱系,应对未授权再分发。
- 会议论文ACL 2025
LLM 供应链中通过排列触发器劫持系统提示
提出 SHIP 攻击:供应方植入需按精确顺序出现才激活的排列触发器,绕过部署方系统提示,在八个模型上 ASR 最高达 100% 且能抵御六种防御。
- 会议论文ACL 2025
ESF:面向 LLM 黑盒篡改检测的高效敏感指纹
提出首个面向 LLM 黑盒篡改检测的指纹方法,仅用 5 个指纹样本即可以超过 99.2% 的检出率发现微调、压缩与后门注入。
- 会议论文ACM CCS 2025
PickleBall:基于 Pickle 的机器学习模型安全反序列化
- 会议论文ACM CCS 2025
潜伏何物?大规模共享扩散模型的概念审计
- 会议论文ACM CCS 2025
Sentry:即时认证机器学习制品
- 会议论文ACM CCS 2025
ImportSnare:检索增强代码生成中的定向“代码手册”劫持
- 会议论文ICML 2025
Mind the Gap:针对 GGUF 量化的实用攻击
利用量化误差提供的自由度,构造在全精度下看似正常、量化后表现恶意的模型;在三个模型、九种 GGUF 类型上实现不安全代码生成、内容注入和拒答等攻击。
- 会议论文ICML 2025
硬件与软件平台推断
仅凭黑盒 LLM 的输入输出数值模式推断底层 GPU 与软件栈,白盒下区分 GPU 准确率 83.9%–100%,可用于验证服务商是否以廉价硬件或模型冒充。
- 会议论文NeurIPS 2025
CoreGuard:在边缘部署中保护 LLM 核心能力免遭模型窃取
提出计算与通信开销都很低的保护方法,防止边缘部署的专有 LLM 被提取权重或被微调利用,实验显示安全保护达到上界且开销可忽略。
- 会议论文IEEE S&P 2025
BAIT:通过反演攻击目标扫描大语言模型后门
- 会议论文USENIX Security 2025
我们有个包给你!代码生成 LLM 的包幻觉全面分析
评估 16 个 LLM 生成的 57.6 万代码样本,商业模型幻觉包率至少 5.2%、开源模型 21.7%,并验证了缓解策略。