评测与基准arXiv 2606.06037
SpeechJBB:语码转换语音下大型音频语言模型的越狱基准
提出 SpeechJBB,评测语码转换语音下音频语言模型的越狱稳健性
- arXiv
- 2606.06037
- 发表
- 层
- 提示层
- 场景
- 模型与 API
- 被测模型
- Qwen2.5-Omni-7B、Qwen3-Omni-30B-A3B-Instruct、Voxtral-Small-24B 等 9 个
摘要SpeechJBB 用五语语码转换语音和伪词探针评测九个 LALM,作者将越狱归为对齐失败而非听不懂。
SpeechJBB 用合成语音测量 LALM 在五语、语码转换和局部伪词混淆下的安全对齐,并另设口语理解对照。