防御arXiv 2609.21363·9月18日用扩散模型隐空间扰动防御视觉语言模型的地理位置隐私泄露提出扩散潜空间地理扰动防御,抑制视觉语言模型泄露精确地理位置arXiv2609.21363发表9月18日层提示层场景模型与 API攻击者黑盒攻击恶意使用组件视觉深度解读完整解读
评测与基准arXiv 2609.35028·9月28日VEX-Bench:评测 LLM 生成虚假信息的核验复杂度提出 VEX-Bench 评测 LLM 生成虚假信息的核查复杂度arXiv2609.35028发表9月28日层提示层场景模型与 API攻击恶意使用摘要VEX-Bench 用筛查时的五维复杂度衡量虚假信息对核查容量的占用,并报告生成与核查的成本差。VEX-Bench 把 LLM 虚假信息的风险从“能否生成”改成“筛查时会占用多少核查容量”。深度解读完整解读