Large reasoning models can produce correct yet unnecessarily long reasoning traces. Existing methods improve reasoning efficiency with trajectory-level objec…
机构:Amazon
来源:arXiv 2609.27156 | AI4Papers 论文推荐平台