Axolotl3D:统一的忠实三维形状补全框架
最新的三维生成模型利用大规模先验和扩散架构,从单张图像生成高质量几何形状,但通常假设视野完整且仅用单视角输入,限制了在多视角、遮挡或编辑等场景的应用。Axolotl3D提出了一种多模态且具备遮挡感知的三维生成模型,联合条件输入包括图像、可见性掩码、相机参数和部分点云。部分点云作为几何锚点促进准确的形状补全,而相机参数确保多视角在共享三维坐标系下的一致对齐。该模型通过统一训练策略,从大规模三维数据合成多样化条件,实现了跨模态稳健推理。在Toys4K和OmniObject3D数据集上,Axolotl3D在干净和遮挡条件下均取得了最先进的表现,并在实际重建与几何一致编辑中表现出色。
这条 研究论文 信号说明,来自 arXiv cs.CV 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。