评测与基准arXiv:2609.02316 · 9月2日Counter-GEO-Bench:现有护栏难挡 GEO 虚假信息构建 COUNTER-GEO-BENCH,评测生成式搜索对信息扭曲 GEO 的防御LLM 应用·测试Gemma-4-31B-IT、Qwen-3.5-35B-A3B、Llama-4-Scout-17B-16E 等 11 个·应用层检测与过滤投毒与后门RAG+1+1摘要论文构建了针对 GEO 虚假信息的首个防御基准,揭示通用护栏的失效与反作用,并提出了有效的轻量对比检测基线。完整解读
评测与基准arXiv:2608.28411 · 8月28日LongPIBench:面向长上下文提示注入的评测基准提出 LongPIBench,评测长文档场景下的提示注入攻击与防御LLM 应用·测试Llama-3.1-8B-Instruct、Llama-3.2-3B-Instruct、Apertus-8B-Instruct 等 11 个·应用层提示注入摘要论文构建长文本提示注入基准 LongPIBench,揭示启发式与优化攻击在长文档中的高有效性及现有防御的大幅失效。完整解读