跳到正文
10月8日 · 周四

可解释性 · 论文

找到 2 篇
筛选

论文正在打标签,标好的论文会出现在这里。

同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 176 篇还没打标签,不在筛选结果里。

另有 104 篇还没有研究类型,暂不在这些分类里。

  1. 其他arXiv:2609.09054 ·

    Training-Free Task Vectors:无需微调的 LLM 行为控制方法

    AI 导读研究者提出 Training-Free Task Vectors(TFTVs),无需微调即可计算类任务向量方向,仅用前向传播统计将激活引导向量映射为秩一权重空间编辑,并支持加法学习、减法遗忘与多编辑组合。

    测试Llama-3.1-8B-Instruct、Qwen-2.5-7B-Instruct、gemma-4-E2B-it 等 4 个

    摘要TFTV 用前向统计把转向方向写成可加减的秩一权重编辑,并在行为控制上比较效用。

    完整解读
已经到底了