全部动态
从来源,看到研究的联系
图中 5 条 · 本页 5 条 · 共 989 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。
点选节点,展开一条线索
本页材料
完整标题与摘要 · 5 条- 会议论文USENIX Security 2025
无数据的模型相关攻击:释放生成式 AI 的潜力
利用生成式 AI 在无数据、黑盒条件下发动模型提取、成员推断与模型反演攻击,效果可比拥有训练数据和参数的白盒基线。
- 会议论文USENIX Security 2025
跨模态提示反演:统一针对文本与图像生成模型的威胁
提出统一的提示反演方法,先训练反演模型再用强化学习微调,可从输出重建文本和图像模型的提示,并扩展到视频,优于各自的最优方法。
- 会议论文USENIX Security 2025
恶意 LLM 对话 AI 诱使用户泄露个人信息
对502名参与者的对照试验表明,恶意设计的对话 AI 比良性 AI 套取更多个人信息,其中利用隐私社会属性的策略最有效且风险感知最低。
- 会议论文USENIX Security 2025
SOFT:选择性数据混淆保护 LLM 微调免受成员推断攻击
先系统评估微调 LLM 对 MIA 的脆弱性,发现攻击利用微调中的损失下降,再提出 SOFT 选择性混淆数据,在六个领域平衡隐私与性能。
- 会议论文USENIX Security 2025
SafeSpeech:针对恶意语音合成的鲁棒通用语音保护
提出 SPEC 技术,在上传前给语音嵌入不可察觉扰动以阻止声音克隆,对多种合成模型有效且能抵御自适应对手,可实时运行。