跳到正文
原文
论文追踪· arXiv:2609.40034· Ayoub Ajarra, Debabrota Basu·本站收录 · 原文发表

ALeBi:用 bias probe 主动审计多群体公平性

Efficient Active Auditing of Multi-Group Fairness with Bias Probes

AI 导读

研究者提出 bias probe 框架与主动审计器 ALeBi,通过定向自适应查询估计多群体公平性指标,无需重建黑盒模型即可揭示偏差结构。该工作给出由属性特定复杂度度量控制的样本复杂度保证,并扩展到模型所有者刻意隐藏偏差的对抗场景,揭示模型保密性与可靠审计之间的根本权衡。实验验证了理论结果,并表明该方法能准确估计偏差、可解释地识别高偏差与低偏差区域。

阅读原文arxiv.org