We find that language models can transfer capabilities through task-unrelated text. Post-training typically improves language models using task-specific data…
机构:北大
来源:arXiv 2609.29233 | AI4Papers 论文推荐平台