Biomedical large language model (LLM) evaluation requires auditable assessment of narrow, evolving, source-grounded subspecialty knowledge. Multiple sclerosi…
机构:NYU Abu Dhabi
来源:arXiv 2610.06170 | AI4Papers 论文推荐平台