arXiv:危险能力与安全评测· arXiv:2609.29349· Firoj Alam·2026-09-24 18:22· 8 天前ArGuard 共享任务:阿拉伯语模因与 LLM 提示词中的有害内容检测ArGuard Shared Task: Harmful Content Detection in Arabic Memes and LLM PromptsAI 导读ArGuard 共享任务评估阿拉伯语模因与 LLM 提示词中的有害内容检测,分设阿拉伯语模因多模态仇恨检测(Track A)与面向阿拉伯语 LLM 安全评估的有害提示词检测(Track B)两条赛道。阅读原文arxiv.org#安全评测#多模态#红队#arXiv