Large audio-language models (LALMs) exploit multimodal evidence, yet task-irrelevant audio can alter text-reasoning decisions when listening is unnecessary. …
机构:国防科技大学
来源:arXiv 2610.11196 | AI4Papers 论文推荐平台