UP-NRPA:基于用户画像的嵌套展开策略自适应,用于目标导向对话系统中的大型语言模型规划
本文提出了UP-NRPA,一种基于用户画像的嵌套展开策略自适应在线框架,利用大型语言模型动态调整目标导向对话系统中的对话策略。该方法通过实时用户反馈和用户个性、偏好及目标的映射,实现无需离线强化学习即可适配多样化用户特征。UP-NRPA在协作与非协作对话基准测试中表现优异,多任务成功率达100%,谈判任务中售出率提升56.41%。
这条 研究论文 信号说明,来自 arXiv cs.AI 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。