BridgeAlign:连接人文与社会科学的偏好一致性方法
当前大型语言模型的数据合成主要集中在具有可验证答案的领域,忽视了重视细微质量判断的人文与社会科学领域。BridgeAlign提出了一种针对广泛人文社会科学的偏好一致性管线,包含三个阶段:种子文档筛选、基于角色的偏好数据合成及偏好优化。通过合成超过21万条偏好样本,BridgeAlign使Qwen3-8B在17个基准测试中表现优异,同时在人类偏好和知识能力上实现双重领先,无需权衡。
这条 研究论文 信号说明,来自 arXiv cs.CL 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。