论文研究普通
VGGT-Diff:融合视觉几何与扩散模型的稀疏视角新视角合成
原始标题:VGGT-Diff: Visual Geometry Meets Diffusion for Sparse-View Novel View Synthesis
内容摘要
VGGT-Diff 将 VGGT-Ω 的视觉几何 latent 路由进预训练视频扩散模型,用于稀疏视角新视角合成。每个视觉 token 关联 3D 点和置信度,经置信度感知的 Visual Geometry Router(VGR)转为查询对齐的 latent 条件,Point-Track Residual Consistency(PTRC)沿可靠 3D 轨迹正则化预测残差。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-3f4ca6a6aa8d01fe9b179af7