HuggingFace Daily Papers(社区热门论文)·· 3 天前AI 评分38
VGGT-Diff:融合视觉几何与扩散模型的稀疏视角新视角合成
VGGT-Diff: Visual Geometry Meets Diffusion for Sparse-View Novel View Synthesis
AI 导读
VGGT-Diff 将 VGGT-Ω 的视觉几何 latent 路由进预训练视频扩散模型,用于稀疏视角新视角合成。每个视觉 token 关联 3D 点和置信度,经置信度感知的 Visual Geometry Router(VGR)转为查询对齐的 latent 条件,Point-Track Residual Consistency(PTRC)沿可靠 3D 轨迹正则化预测残差。
来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org