返回今日信号
图片
研究论文2026年7月13日 04:00

GATS:结合分层世界模型的图增强树搜索实现高效智能体规划

大型语言模型(LLM)智能体在多步骤规划任务中表现出潜力,但现有方法如LATS和ReAct在规划过程中高度依赖LLM推理,导致计算成本高且行为具有随机性。本文提出GATS(图增强树搜索),结合基于UCB1的系统搜索和分层世界模型,消除推理期间的LLM调用,同时实现更优规划性能。分层世界模型包括精确符号动作匹配、执行日志学习统计和基于LLM的未知动作预测。在合成规划任务和12个挑战场景中,GATS均实现100%成功率,显著优于LATS和ReAct,且零LLM调用、规划结果确定无方差。结果表明系统搜索结合学习世界模型,在智能体规划中大幅优于LLM引导探索。

AI Signal Takeaway

这条 研究论文 信号说明,来自 arXiv cs.AI 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。

发生了什么

arXiv cs.AI 发布了这条关于 研究论文 的更新:大型语言模型(LLM)智能体在多步骤规划任务中表现出潜力,但现有方法如LATS和ReAct在规划过程中高度依赖LLM推理,导致计算成本高且行为具有随机性。本文提出GATS(图增强树搜索),结合基于UCB1的系统搜索和分层世界模型,消除推理期间的LLM调用,同时实现更优规划性能。分层世界模型包括精确符号动作匹配、执行日志学习统计和基于LLM的未知动作预测。在合成规划任务和12个挑战场景中,GATS均实现100%成功率,显著优于LATS和ReAct,且零LLM调用、规划结果确定无方差。结果表明系统搜索结合学习世界模型,在智能体规划中大幅优于LLM引导探索。

为什么重要

GATS通过引入分层世界模型,有效减少了对昂贵且不稳定的LLM推理的依赖,实现在规划时零次LLM调用,同时利用系统性树搜索提升了规划成功率和确定性,极大提升了智能体的效率与表现。

谁应该关注

研究员、模型团队和技术战略负责人 应该重点关注这条信号,尤其是正在跟踪 research、papers、agents 的团队。

下一步看什么

接下来观察这条信号是否出现开发者采用、竞品回应、研究复现、企业部署或政策/平台层面的后续动作。

相关信号

[ 2026年7月13日 ]
研究论文
arXiv cs.CV/2026年7月13日

StereoSplat+:结合扩散辅助渐进推理的前馈立体高斯散点法

三维高斯散点法(3DGS)的最新进展实现了高质量的场景表示,用于新视角合成。但现有方法多依赖多视角观测或未来帧信息,这在机器人和增强现实等仅有单一立体相机的场景中难以实现。本文提出了StereoSplat+,一种扩散增强的前馈框架,可从单对立体图像因果重建高质量3DGS场景。方法包括输入不变的StereoSplat网络,通过成本体积分支和三平面三维体积分支融合几何信息,并利用连续位姿编码适配不同视角和相机配置;以及一种称为StereoSplat+的单次扩散渐进推理策略,通过从单一立体对预测3DGS,渲染新视图,使用一步扩散增强器细化,再反馈更新3DGS。KITTI-360数据集实验表明,本方法在遮挡区域和视角外推时,显著提升了新视角渲染质量和几何准确性,优于现有前馈3DGS方法。

研究论文
arXiv cs.CV/2026年7月13日

探针混合:通过探针学习多模态大语言模型中的特权模态

多模态大语言模型(MLLMs)通常假设训练和推理时均可获得所有模态数据,但现实中常常只有训练阶段可获得辅助模态。本文提出了探针混合(MoP)框架,通过结构化探针机制区分模态特异和模态通用信号,保留模态依赖结构的同时实现跨模态迁移表达。结合探针解耦损失的MoP跨模态训练策略(MoP-X),在八个任务和四种模态的综合评测中,MoP在推理阶段仅用单一模态输入时,较强基线最高提升65%,显示辅助模态即使不可用于推理也可显著提升模型性能。代码、模型和评测协议将开源。

研究论文
arXiv cs.CV/2026年7月13日

安全伪装:医疗图像保密建模的图像伪装系统评估

云端深度学习推动了大规模医疗图像分析,但将敏感患者图像外包进行模型开发带来了重大隐私问题。图像伪装作为一种新兴的隐私增强技术,通过将图像转换为视觉上难以理解的形式,同时保留用于后续学习的信息。我们建立了统一框架,评估了代表性方法DisguisedNets和NeuraCrypt,在涉及分类和语义分割的四个数据集上,分析它们的预测效用、效率和对重建攻击的鲁棒性。结果显示,图像伪装对不同任务的表现差异显著:对医疗图像分类保持良好效用,但对密集语义分割产生较大性能下降。随机多维变换(RMT)在性能和安全性间提供最佳平衡,而基于AES的伪装严重影响效用。此外,基于回归的重建攻击在自然图像上的有效性,在真实医疗图像上则较低。此研究系统评估了隐私增强技术在医疗AI保密应用中的适用性。