跳到正文
10月8日 · 周四

全部论文

找到 5 篇

另有 1065 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 评测与基准arXiv:2609.05843 ·

    SinoGlyphBench:中文字形混淆下语言模型审核的诊断基准

    提出 SinoGlyphBench,用配对字形混淆诊断中文审核稳定性

    模型与 API测试GPT-5.4 mini、GPT-5.5、DeepSeek V4 Flash 等 12 个提示层
    摘要SinoGlyphBench 显示中文字形混淆会同时增加有害漏报和误报,全文扰动最重。

    SinoGlyphBench是一个配对诊断基准,用来看内容审核在可还原的中文字形混淆下是否还保持原决定。

    完整解读
已经到底了