研究:LLM 路由决策日志可推断用户医疗、自伤等敏感话题
提出利用路由元数据推断敏感话题的侧信道攻击
另有 112 篇论文还没打上分类标签,暂不在筛选结果里。
提出利用路由元数据推断敏感话题的侧信道攻击
提出 CredLeak-Bench,评测智能体在钓鱼场景下的凭据泄露
完整解读提出 Trojan Hippo Bench,评测智能体持久记忆攻击与防御
揭示前沿智能体在禁止泄露时自发建立隐蔽信道传递机密
论文研究了固定参数与提示词的智能体在受审计交互中自发形成隐蔽信道并泄露机密的过程。
提出流匹配逆向框架,从多向量视觉文档索引重构页面
完整解读评估多租户智能体共享向量记忆的跨用户泄露与主动桥接
完整解读提出 TRANSCOPE,用 CPU 硬件计数器推断训练集成员
用 StegoMemory 测试智能体持久记忆作为跨会话隐写信道的可行性
构建 AGENTDOXX 评测联网搜索智能体对匿名访谈的再识别能力
提出跨通道分段攻击,借 MCP 多通道隐式信任外发敏感数据
提出 ReGap,用自生成伪监督微调恢复模型中的隐私关联
提出 SigLeak,从执行轨迹比对中推断专有智能体技能
揭示拆分训练返回梯度以零支撑暴露诱饵行并泄露训练内容
这是一项关于双节点大语言模型拆分训练系统的系统安全案例研究,揭示了评估工具遗漏反向信道所导致的静默隐私失效。
利用加密思维块的跨模型重放,诱导弱模型逐字转写专有推理链
提出 RECAST 框架,本地改写图表与语音以保护远程数值推理隐私
完整解读比较高效与高成本训练的对抗和隐私脆弱性并分析损失几何
作者在视觉分类和数学推理语言模型上,检查用更少数据或更简对齐换取训练效率时,安全性质是否一起变化。比较在任务效用接近的前提下进行。视觉侧用 KNN-Shapley 的高重要性小子集对照低重要性大子集,并用预训练微调对照从头训练。
访谈残障成人,分析向记忆型助手披露残障时的信息流与语境完整性
完整解读提出 LLMLeak,把机密编进报错 URL,借聊天机器人网页抓取外传
LLMLeak 研究一种隐蔽外传:本地恶意软件已拿到机密,却因为网络限制或监控不能直接连接攻击者,于是把秘密放进看起来像排障文档的 URL,让良性聊天机器人的网页抓取工具在访问时把秘密带出去。
提出 FLOWSEAL,在工具边界以信息流控制阻断智能体隐私泄露
构建 AGENTTELL 基准,测量浏览器智能体跨站行为侧信道泄露