顶会安全论文
共 38 篇
- 超越越狱:LLM应用能力边界模糊带来的风险
- 近红外域中的定向物理逃逸攻击
- ThinkTrap:利用无限思考攻击黑盒LLM服务Yunzhe Li, Jianan Wang, Hongzi Zhu 等会议页面
- 面向文本到图像扩散模型的有效提示窃取攻击Shiqian Zhao, Chong Wang, Yiming Li 等会议页面
提示注入
2- 利用注意力防御大语言模型间接提示注入攻击Yinan Zhong, Qianhao Miao, Yanjiao Chen 等会议页面
- 当缓存投毒遇上LLM系统:语义缓存投毒及其对策
- AI角色平台安全风险的基准评测与分析Yiluo Wei, Peixian Zhang, Gareth Tyson会议页面
- 失血通道:隐藏状态判别力消失如何助推越狱攻击Yingjie Zhang, Tong Liu, Zhe Zhao 等会议页面
- 字符级扰动可破坏大语言模型水印Zhaoxi Zhang, Xiaomei Zhang, Yanjun Zhang 等会议页面
- 大语言模型内容审核的全球分析
- VeriLoRA:利用零知识证明实现可验证安全微调Guofu Liao, Taotao Wang, Shengli Zhang 等会议页面
- ViGText:结合视觉语言解释与图网络的深伪检测
- ZKSL:基于异步零知识证明的可验证高效分割联邦学习Yixiao Zheng, Changzheng Wei, Xiaodong Qi 等会议页面
可解释性
1- 通过恶意载荷定位实现可解释的深度学习网页攻击检测Peiyang Li, Fukun Mei, Ye Wang 等会议页面
- CatBack:通过类别编码对表格数据实施通用后门攻击Behrad Tajalli, Stefanos Koffas, Stjepan Picek会议页面
- 因果引导的开放权重LoRA模型后门攻击Linzhi Chen, Yang Sun, Hongru Wei 等会议页面
- 面向大域分类与键值数据的增强型洗牌差分隐私协议
- 级联式与代理式成员推断攻击Yuntao Du, Jiacheng Li, Yuetian Chen 等会议页面
- CELLSHIFT:面向真实网站指纹识别的RTT感知轨迹转换
- 揭示并缓解LLM推理中KV缓存的隐私风险
- STIP:生产环境大模型的三方隐私保护无损推理Mu Yuan, Lan Zhang, Yihang Cheng 等会议页面
- SVDefense:基于奇异值分解防御梯度反演攻击
- 是否打乱:审计带打乱的DP-SGD
- 我的数据被用于训练了吗?基于神经激活的开源LLM成员推断Xue Tan, Hao Luan, Mingyu Luo 等会议页面
- WhiteCloak:追责安全聚合中的匿名恶意客户端Zhi Lu, Yongquan Cui, Songfeng Lu会议页面
- 缓存陷阱:LLM服务框架中的缓存安全威胁XiangFan Wu, Lingyun Ying, Guoqiang Chen 等会议页面
AI 与网络攻防
12- 基于LLM的PLC逻辑指令漏洞模糊测试框架
- 利用LLM自动标注代码以划定TEE边界
- 自动化汽车全生命周期函数级TARA分析
- 超越原始字节:迈向大型恶意软件语言模型
- 超越RTT的对抗鲁棒住宅代理检测方法Temoor Ali, Shehel Yoosuf, Mouna Rabhi 等会议页面
- BSFuzzer:面向BLE逻辑缺陷的上下文感知语义模糊测试Ting Yang, Yue Qin, Lan Zhang 等会议页面
- CHAMELEOSCAN:利用LLM界面探索检测iOS变色龙应用
- Chimera:利用多智能体LLM自动模拟内部威胁Jiongchi Yu, Xiaofei Xie, Qiang Hu 等会议页面
- 重流量监测中的博弈与零样本攻击
- TIPSO-GAN:基于优化生成对抗网络的恶意流量检测Ernest Akpaku, Jinfu Chen, Joshua Ofoeda会议页面
- 利用偏差劫持LLM静态分析
- 它们修复了什么?LLM辅助分类关键内存漏洞补丁