L-MAD:法律推理中多智能体辩论结构的系统评估
本文介绍了法律多智能体辩论(L-MAD)框架,系统评估了不同辩论结构和聚合方法在法律文本蕴含中的表现。通过赋予多个智能体不同专家角色,L-MAD在强单智能体基线基础上性能提升了8%。研究还发现,增加智能体数量能减少矛盾、提升准确率,但延长辩论轮数会导致“过度审议漂移”,即智能体互相加深错误。本研究明确了在高风险法律环境中部署协作多智能体系统的实际边界和安全范围。
这条 研究论文 信号说明,来自 arXiv cs.AI 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。