本文使用上下文无关规则重用量化方法,研究指令微调大语言模型在对话中局部句法趋同现象,发现所有模型均高于随机基线,且指令微调模型在局部重用上超过人类,但相对预训练模型的变化表明并非简单的更强复制。
机构:牛津
来源:arXiv 2607.26015 | AI4Papers 论文推荐平台
AI4Papers 是一个以每日 arXiv 论文发现为入口的 AI 科研工作流平台,帮助研究者用最短时间掌握最新 AI/ML 前沿动态。
核心功能完全免费。高级 AI 功能(对比分析、深度研究、灵感工作台)支持自带兼容 API Key(如 OpenAI、通义千问)无限使用。
免费注册 | 使用教程