跳到正文
10月9日 · 周五

全部论文

找到 4 篇

另有 445 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 摘要论文指出恶意微调防御在持续训练下均会衰减,表明基于有限攻击者假设的防御无法为开源模型提供持久保护。

    深度解读完整解读
已经到底了