本文使用上下文无关规则重用量化方法,研究指令微调大语言模型在对话中局部句法趋同现象,发现所有模型均高于随机基线,且指令微调模型在局部重用上超过人类,但相对预训练模型的变化表明并非简单的更强复制。
机构:牛津
来源:arXiv 2607.26015 | AI4Papers 论文推荐平台