Ensuring the safety of reasoning large language models (LLMs) across languages is essential for their reliable deployment. However, when exposed to jailbreak…
机构:NUS
来源:arXiv 2609.37054 | AI4Papers 论文推荐平台