MVDrag3D：灵活强大的拖拽式多视图3D编辑技术

文摘 2024-11-13 07:30 上海

作者 | ADFeed

点击下方卡片，关注“3D视觉之心”公众号

第一时间获取3D视觉干货

>>点击进入→3D视觉之心技术交流群

MvDrag3D: Drag-based Creative 3D Editing via Multi-view Generation-Reconstruction Priors

介绍：
https://chenhonghua.github.io/MyProjects/MvDrag3D/
论文：
https://arxiv.org/abs/2410.16272v1

MVDrag3D 是一种创新的3D编辑框架，它通过结合多视图生成和重建先验来实现灵活且富有创造性的拖拽编辑。

该方法的核心在于使用多视图扩散模型作为强大的生成先验，以确保在多个渲染视图之间进行一致的拖拽编辑。随后，通过一个重建模型来重建编辑对象的3D高斯表示，进一步通过视图特定的变形网络调整高斯的位置，以实现不同视图间的精准对齐。

MVDrag3D展现了在处理重大拓扑变化和跨多个对象类别生成新纹理方面的卓越能力。它不仅支持各种对象类别和3D表示，如3D高斯和网格，还通过多视图分数函数增强了视图一致性和视觉质量。此外，MVDrag3D在实验中表现出了精确、生成性和灵活性，使其成为3D编辑领域的一种多功能解决方案。

技术解读

MVDrag3D 的思路是利用多视图生成和重建先验来实现3D对象的拖拽编辑。它通过多视图扩散模型作为生成先验，确保在多个渲染视图中进行一致的拖拽操作，然后通过重建模型生成编辑对象的3D高斯表示，并使用特定的变形网络来调整高斯的位置以实现视图间的对齐，最终通过多视图分数函数来增强视图一致性和视觉质量。

MVDrag3D 的处理过程大致如下：

首先将3D对象渲染成四个正交视图，并将拖拽点投影到相应的视图上。
接着，通过扩展基于分数的梯度引导机制到多视图扩散模型中，实现跨所有视图的一致编辑。
编辑后的视图被用来重建3D高斯表示，但初始的3D高斯可能会在不同视图间存在对齐问题。为了解决这一问题，MVDrag3D采用了一个轻量级的变形网络来预测每个高斯的位移，以纠正3D对齐问题。
此外，MVDrag3D还提出了一个图像条件的多视图分数函数，用于从多个视图中提取生成先验，以确保在所有视图中保持高保真度的外观和细节。

其技术特点包括精确的拖拽能力、生成新内容的能力以及对不同输入对象类别和3D表示的兼容性。MVDrag3D 为3D编辑领域提供了一种新的解决方案，能够处理重大的拓扑变化和跨多个对象类别生成新纹理，这在以往的3D编辑方法中是难以实现的。这种方法不仅提高了编辑的灵活性和创造性，还通过多视图一致性增强了最终编辑结果的视觉质量，这使得MVDrag3D在3D内容创作和计算机图形学领域具有重要的应用潜力。

论文解读

这篇论文是关于3D编辑技术的研究，主要内容概括如下：

摘要：介绍了基于拖拽的编辑技术在2D内容创作中的流行，以及将其扩展到3D领域的挑战。提出了MVDrag3D框架，利用多视图生成和重建先验实现更灵活和有创意的3D拖拽编辑。
引言：讨论了3D形状拖拽编辑的传统方法，以及它们在处理拓扑变化和生成新纹理方面的局限性。介绍了3D高斯喷涂技术，并指出了现有方法的不足。
相关工作：

回顾了基于拖拽的2D图像编辑技术。
探讨了基于拖拽的3D编辑方法，包括传统的网格变形技术和基于3D潜在空间的生成3D拖拽方法。
讨论了多视图图像生成和前馈多视图3D重建的最新研究进展。

方法：

介绍了基于分数的图像编辑梯度引导机制。
详细阐述了MVDrag3D的整体流程，包括3D到2D渲染和投影、多视图梯度引导拖拽、3D高斯重建和细化。
讨论了DDIM反演过程中引入随机噪声的影响。

实验：

描述了实验设置，包括实现细节、数据集和评估指标。
提供了与现有方法的定性和定量比较，展示了MVDrag3D在不同3D表示上的应用效果。
讨论了实验结果，包括对不同文本提示的敏感性分析和方法的局限性。

结论：总结了MVDrag3D作为一种新型3D编辑范式的贡献，强调了其精确性、生成能力和灵活性，并提出了未来的研究方向。

【3D视觉之心】技术交流群

3D视觉之心是面向3D视觉感知方向相关的交流社区，由业内顶尖的3D视觉团队创办！聚焦三维重建、Nerf、点云处理、视觉SLAM、激光SLAM、多传感器标定、多传感器融合、深度估计、摄影几何、求职交流等方向。扫码添加小助理微信邀请入群，备注：学校/公司+方向+昵称（快速入群方式）

扫码添加小助理进群

【3D视觉之心】知识星球

3D视觉之心知识星球主打3D感知全技术栈学习，星球内部形成了视觉/激光/多传感器融合SLAM、传感器标定、点云处理与重建、视觉三维重建、NeRF与Gaussian Splatting、结构光、工业视觉、高精地图等近15个全栈学习路线，每天分享干货、代码与论文，星球内嘉宾日常答疑解惑，交流工作与职场问题。

http://mp.weixin.qq.com/s?__biz=MzkyMDY0OTc1NA==&mid=2247516136&idx=2&sn=436db27d55f0c1db631e4e7c05ed7917

3D视觉之心

3D视觉与SLAM、点云相关内容分享

专为自动驾驶而生！DeSiRe-GS：彻底摒弃3D框，动静态重建完美解耦（UC Berkeley最新）

具身智能训练数据集哪里找？几大开源数据集帮你汇总好了！

章国锋团队开启SfM新篇章！DATAP-SfM：动态感知跟踪一切！

字节&清华&北京交通大学发布V2X-Radar: 一个用于协同感知的4D雷达多模态数据集

文本、图像、点云任意模态输入，AI能够一键生成高质量CAD模型了

3DLS全新尝试：线性高斯核在高频区域实现更清晰、更精确的结果，帧率提高30%！

闭环仿真杀器！DrivingSphere：理想提出直接构建高保真4D世界

真实雨景/图像去雨/自动驾驶/图像检索相关方向开源数据集资源

美国教授痛心：UC伯克利GPA 4.0计算机本科生，毕业即失业？ML博士直呼太卷后悔转行

高速动态低成本重建救星？SCIGS：首个从单个压缩图像重建3D显式动态场景的方法

论文分享 | 全景场景补全

动态SLAM全新数据集！InCrowd-VI：不同人群密度、遮挡、复杂光照的视觉惯性SLAM数据集！

机器人训练数据不缺了！英伟达团队推出DexMG：数据增强200倍

盘点！那些从自动驾驶“跳槽”进具身智能的大佬们

清华大学发布使用CARLA生成V2V与V2I的增强自动驾驶协作的多智能体调度数据集WHALES

GarVerseLOD：实现单张图像高保真度服装重建的3D重建框架

如何创立一家惯性导航公司

融合神经辐射场和视觉同时定位与地图构建的混合场景表示方法

宝可梦GO「偷家」李飞飞空间智能？全球最强3D地图诞生，150万亿参数解锁现实边界

克服LiDAR固定分辨率的限制！LiV-GS：首个大规模室外场景对齐离散点云与高斯地图的方法

MVSplat360：从稀疏视图到360°全景合成的前馈方法

Siggraph Asia 2024 | Adobe发布MagicClay：可通过文字引导对3D模型特定部分进行雕刻！

谷歌2024博士奖学金名单公布

首个基于高斯点云建图的动态SLAM框架！DGS-SLAM：解决动态物体引起的光度和几何不一致

无需视频流实现全景分割与深度估计MGNiceNet：统一的单目几何场景理解

ECCV 2024 | PARE-Net：用于鲁棒点云配准的位置感知旋转等变网络

NeurIPS 2024高中赛道开卷！人大附中、北师大实验中学等摘得3篇Spotlight

加州大学 | 基于视觉语言模型的端到端导航：零样本，无需数据训练！

港大DEIO：首个学习与传统非线性图优化结合的单目事件惯性里程计

基于语义似然与高精度地图匹配的智能车辆同时定位与检测

钻石冷却的GPU即将问世：温度能降20度，超频空间增加25%

超越现有3DGS网格重建方法！DyGASR：速度提高25%、内存使用量减少30%

复旦&蔚来开源DG-SLAM：第一个动态环境下的鲁棒GS SLAM！

身处相机内外参之间（EG3D/NeRF/3D Gaussian Splatting）

NeurIPS 2024 | 无需训练，一个框架搞定开放式目标检测、实例分割

突破多场景训练方法限制！ETH开源SplatFormer：首个专门设计用于在3DGS上运行的点变换器模型

【清华大学】RINO：基于非迭代估计的精确、鲁棒雷达惯性里程计

论文分享｜无监督点云语义分割

传说中Ilya Sutskever精选论文清单：AI领域40大论文完整版「破解」完成

丰田研究院综述「机器人领域中的神经场」

顶刊TGRS | 使用端到端深度神经网络从高分辨率遥感图像和数字表面模型中提取3D建筑实例

让纸片人动起来! DrawingSpinUp：从单个绘图生成高质量3D动画

浙大西湖大学开源MBA-SLAM！解决NeRF、3DGS中的运动模糊问题！

这三家国内机构合作成果，斩获EMNLP 2024最佳论文奖，主办方：明年苏州见！

ICP还能玩出什么花样？RA-L'24全新GenZ-ICP：根据环境几何特性自适应，解决依赖单一误差度量

英伟达最新！SCube：仅用三张图，就能实现即时大规模三维场景重建

更高轨迹精度、建图质量！基于NeRF轨迹平滑约束的SLAM优化

分类

时事

民生

政务

教育

文化

科技

财富

体娱

健康

情感

旅行

百科

职场

楼市

企业

乐活

学术

汽车

时尚

创业

美食

幽默

美体

文摘

原创标签

时事社会财经军事教育体育科技汽车科学房产搞笑综艺明星音乐动漫游戏时尚健康旅游美食生活摄影宠物职场育儿情感小说曲艺文化历史三农文学娱乐电影视频图片新闻宗教电视剧纪录片广告创意壁纸头像心灵鸡汤星座命理教育培训艺术文化金融财经健康医疗美妆时尚餐饮美食母婴育儿社会新闻工业农业时事政治星座占卜幽默笑话独立短篇连载作品文化历史科技互联网

发布位置

广东北京山东江苏河南浙江山西福建河北上海四川陕西湖南安徽湖北内蒙古江西云南广西甘肃辽宁黑龙江贵州新疆重庆吉林天津海南青海宁夏西藏香港澳门台湾美国加拿大澳大利亚日本新加坡英国西班牙新西兰韩国泰国法国德国意大利缅甸菲律宾马来西亚越南荷兰柬埔寨俄罗斯巴西智利卢森堡芬兰瑞典比利时瑞士土耳其斐济挪威朝鲜尼日利亚阿根廷匈牙利爱尔兰印度老挝葡萄牙乌克兰印度尼西亚哈萨克斯坦塔吉克斯坦希腊南非蒙古奥地利肯尼亚加纳丹麦津巴布韦埃及坦桑尼亚捷克阿联酋安哥拉