GPU kernels generated by large language model (LLM) agents can remain less efficient than expert implementations, but runtime alone does not reveal how the g…
机构:阿里
来源:arXiv 2610.03226 | AI4Papers 论文推荐平台