跳到正文
原文
论文追踪· arXiv:2609.04859· Changming Xiao, Zhenliang Ni, Jinhui He, Han Shu, Jie Hu·本站收录 · 原文发表

MM-IFEval-Pro:面向视觉语言模型的多语言抗攻击指令遵循基准

MM-IFEval-Pro: A Multilingual and Attack-Resistant Benchmark for Instruction-Following in Vision-Language Models

AI 导读

研究者提出 MM-IFEval-Pro,一个覆盖中英文任务和多种指令劫持场景的多模态指令遵循基准,包含 4 大任务类别、24 个子类及 8 个指令类别、52 个子类,每个样本平均含 3.0 个约束。团队还构建了富含中文与对抗指令的强化学习训练集,显著提升模型在该基准上的表现,并有效迁移到其他主流多模态基准,展现出跨任务与跨语言的泛化能力。

阅读原文arxiv.org