跳到正文
原文
arXiv:可解释性· arXiv:2609.13556· Darin Keng·· 20 天前

Llama-3.1 医学微调模型在专业术语理解上为何不如通用版:一项机制可解释性对比分析

Domain-Specific Jargon in Large Language Models: A Comparative Analysis between General-Purpose and Specialist Models

AI 导读

研究构建两个医学术语评测基准,对比通用版 Llama-3.1 与医学数据微调变体,发现通用模型在两项任务上均优于医学微调模型。机制可解释性分析显示,微调模型未重组参数知识,而是过度依赖少数与术语偏好预测相关的组件,造成系统性校准偏差;对这些组件重新加权可抑制其影响并追平通用基线。部分术语敏感组件还能迁移至材料科学术语任务,提示其编码了部分领域无关的专业术语概念。

阅读原文arxiv.org