评测与基准arXiv 2610.02303
PowerBench 评测 24 个模型在权力转移请求上的偏见
提出 PowerBench,测量模型对权力转移请求的拒答偏见
- arXiv
- 2610.02303
- 发表
- 层
- 模型层
- 场景
- 模型与 API
- 被测模型
- grok-4.3、haiku-4.5、nova-2-lite 等 18 个
- 风险偏见与歧视
摘要作者报告拒答随 SE/DE/PG 变化,并存在针对美国失权、智能体和语言的差。
提出 PowerBench,测量模型对权力转移请求的拒答偏见
摘要作者报告拒答随 SE/DE/PG 变化,并存在针对美国失权、智能体和语言的差。
测量剪枝对语音 LLM 群体转写公平性的影响
摘要剪枝后的 Speech-LLM 不能只看总体 WER:Fair-Speech 上族群差扩大,作者建议看最差组。