全部动态
从来源,看到研究的联系
点击节点查看内容
本页材料
24 条- 会议论文NDSS 2025
BitShield:防御针对 DNN 可执行文件的比特翻转攻击
首个针对 DNN 可执行文件的 BFA 防御,基于语义完整性检查检测数据段与代码段翻转,平均缓解率 97.51%,开销约 2.47%。
- 会议论文NDSS 2025
针对微调扩散模型的黑盒成员推断攻击
提出首个面向扩散模型的基于分数的黑盒成员推断攻击框架,覆盖四种攻击场景,AUC 可达 0.95。
- 会议论文NDSS 2025
BumbleBee:大型 Transformer 的安全两方推理框架
优化矩阵乘法与非线性激活的两方私有推理协议,通信量降低 80%~95%,可用 CPU 约 8 分钟生成 LLaMA-7B 一个 token。
- 会议论文NDSS 2025
CENSOR:基于正交子空间贝叶斯采样防御梯度反演
在联邦学习中将梯度扰动限制在与原梯度正交的子空间,防御梯度反演攻击恢复私有数据,同时保持模型效用。
- 会议论文NDSS 2025
人工耳蜗使用者面对音频深度伪造的影响研究
对 35 名人工耳蜗用户和 87 名听力正常者的实验显示,前者识别语音转换伪造仅约 67% 正确,并评估了 CI 模拟音频训练的检测器能否作为代理。
- 会议论文NDSS 2025
CLIBE:检测 Transformer NLP 模型中的动态后门
首个动态后门检测框架,通过注意力层的少样本权重扰动判断后门,并在 Hugging Face 的 49 个模型中发现一个疑似后门模型。
- 会议论文NDSS 2025
编译模型自带漏洞:揭示 DNN 可执行文件中普遍存在的比特翻转攻击面
首次系统研究 DNN 可执行文件的 BFA,发现仅需已知模型结构即可攻击,平均约 1.4 次翻转就能使精度降至随机水平。
- 会议论文NDSS 2025
防御针对迭代剪枝深度神经网络的成员推断攻击
发现迭代剪枝会加剧模型记忆,提出 WeMem 针对数据复用与固有可记忆性削弱记忆,在十种自适应 MIA 下优于五种现有防御。
- 会议论文NDSS 2025
密度提升一切:同时改进恶意软件检测器性能、鲁棒性与可持续性
指出特征稀疏是投毒、规避与概念漂移的共同根源,用压缩技术和密度提升训练缓解稀疏,增强检测器对攻击的抵抗力。
- 会议论文NDSS 2025
Diffence:用扩散模型保护成员隐私
推理前用生成模型重新生成输入以消除成员与非成员差异,不改变预测标签,平均降低 MIA 攻击准确率 15.8%,可与其他防御叠加。
- 会议论文NDSS 2025
DLBox:保护训练数据的新型模型训练框架
借助机密计算并强制执行 DGM-Rules,限制不可信开发者只能进行良性训练,阻止数据编码、梯度反演等泄露途径,开销很小。
- 会议论文NDSS 2025
我们真的需要设计新的拜占庭鲁棒聚合规则吗?
提出 FoundationFL,服务器生成合成更新并与客户端更新一起用 Trimmed-mean 或 Median 聚合,以防御联邦学习投毒攻击并给出收敛性分析。
- 会议论文NDSS 2025
DShield:通过差异学习防御图神经网络后门攻击
利用语义漂移与属性过度强调两个现象,对比自监督模型与后门模型过滤中毒节点,在 21 种攻击下大幅降低攻击成功率。
- 会议论文NDSS 2025
解释即水印:通过特征归因水印实现无害的多比特模型所有权验证
提出 EaaW,把多比特水印嵌入触发样本的特征归因解释而非预测,避免后门水印的有害性与歧义性,并能抵抗潜在攻击。
- 会议论文NDSS 2025
从 Large 到 Mammoth:大语言模型漏洞检测能力的对比评估
评估多个 LLM 在 Java 及 C/C++ 上的漏洞检测,发现部分模型表现不佳,上下文窗口有稳定增益,量化等因素收益有限。
- 会议论文NDSS 2025
GAP-Diff:保护 JPEG 压缩图像免受扩散模型人脸定制滥用
提出 GAP-Diff,通过可反向传播的预处理模拟生成对 JPEG 压缩鲁棒的对抗扰动,干扰扩散模型微调,保护人像隐私。
- 会议论文NDSS 2025
用 LLM 生成 API 参数安全规则以检测 API 误用
提出 GPTAid,用 LLM 与执行反馈过滤生成 API 参数安全规则,精度 92.3%,在 47 个应用中发现 210 个未知安全漏洞。
- 会议论文NDSS 2025
我知道你问了什么:多租户 LLM 服务中经 KV 缓存共享泄露提示词
首次研究多租户 LLM 服务的安全风险,提出 PROMPTPEEK,利用 KV 缓存共享的侧信道在不同先验条件下还原其他用户提示。
- 会议论文NDSS 2025
I know what you MEME!:用多模态大模型理解与检测有害 Meme
分析视觉艺术与宣传技巧如何削弱现有有害 Meme 检测,提出基于自适应提示与 CoT 的 HMGUARD,准确率达 0.92。
- 会议论文NDSS 2025
IsolateGPT:面向 LLM Agent 系统的执行隔离架构
针对第三方 LLM 应用缺乏隔离的安全隐私风险,提出执行隔离架构,可抵御多种攻击且功能无损,多数查询开销低于 30%。
- 会议论文NDSS 2025
L-HAWK:针对远距离目标的可控物理对抗补丁
提出由激光触发的物理对抗补丁攻击自动驾驶视觉感知,50 米处平均攻击成功率 91.9%,明显优于 TPatch。
- 会议论文NDSS 2025
LADDER:基于进化算法的多目标后门攻击
以多目标进化算法在双域优化黑盒后门触发器,攻击成功率不低于 99%,鲁棒性与隐蔽性均优于现有隐蔽攻击。
- 会议论文NDSS 2025
LLMPirate:用 LLM 实施黑盒硬件 IP 盗版
提出首个用 LLM 重写电路设计以规避盗版检测的技术,在四种检测工具上对所有测试电路均成功规避。
- 会议论文NDSS 2025
Magmaw:针对机器学习无线通信系统的模态无关对抗攻击
提出可对任意多模态无线信号生成通用对抗扰动的攻击,在软件无线电平台实测,即使有强防御仍显著降低性能。