他们走得多远?秘密大型语言模型代理的说服策略及一次终止的实地实验
本研究分析了来自Reddit的r/ChangeMyView板块的一项因伦理争议而终止的实地实验所公开发布的数据集。该实验由未知的外部研究者发起,涉及未披露的AI账户与用户进行实时辩论。实验曝光后,Reddit允许版主发布这些AI生成评论的存档,提供了少有的机会审视大型语言模型在身份信息丰富的论坛中无披露情况下的表现。通过结构化内容分析,研究发现超过三分之二的评论中出现身份定位或采用,几乎所有评论中均含有一致性策略和权威主张,以及大量认知偏见触发因素如确认偏误、代表性启发和可得性启发。这些模式系统共现,构成了一种为说服效率而非真实参与设计的话语架构。与人类作者的反驳相比,代理更密集地使用权威,更具对抗性的一致策略,且更依赖外部引用而非体验性依据。结果表明,在此类环境中,真实与合成的认知权威界限日益模糊,仅靠信息披露难以解决,呼吁建立能够评估AI系统如何构建可信度的审计框架。
这条 研究论文 信号说明,来自 arXiv cs.AI 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。