arXiv· arXiv:2609.35028· Hanxun Huang·2026-09-28 20:26· 4 天前VEX-Bench:评测 LLM 生成虚假信息的核验复杂度VEX-Bench: Benchmarking Verification Complexity of LLM-Generated MisinformationAI 导读研究者提出 VEX-Bench,用于评估 LLM 生成虚假信息在筛查阶段呈现的核验复杂度,覆盖可核查性、潜在危害、信源可信度信号、冒充合法性和预期核验成本等维度。阅读原文arxiv.org#安全评测#真实事件#红队#多模态