论文研究普通
GeoNeXt:将视频生成模型用作几何学习器
原始标题:Video Generative Models as Geometry Learner
内容摘要
GeoNeXt将预训练视频生成模型改造为统一的几何估计框架,把深度与表面法线估计重构为下一帧预测任务,无需分别训练任务专属模型或大规模微调图像扩散骨干。该方法在零样本单目深度和表面法线估计上超越此前任务专属及统一生成式方案,且训练数据需求大幅降低,性能可与基于超100倍数据训练的有判别力SOTA方法比肩。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-cae7c97b5b2fa83b2f52f9fc