聊天机器人默认采用哪些制度框架?多语言大型语言模型的管辖权默认审计
本文研究多语言大型语言模型(LLMs)在回答涉及税务、劳动保护、医疗、教育、养老金及行政程序等问题时,是否以输入语言作为默认的司法管辖信号。通过对7个美国或中国开发的LLMs使用60个未明确指定地区的法律行政问题进行测评,发现中文输入通常导致中国特定的答案,英文输入则倾向美国或通用答案,存在制度框架误选风险。作者建议,LLM界面不应仅依据输入语言推断制度背景,而应主动询问或明确所适用的司法范围。
这条 研究论文 信号说明,来自 arXiv cs.CL 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。