我要投稿

ObjectMover – 港大联合 Adobe 推出的新型图像编辑模型

AI老司机 AI行业动态

2025-03-31 0 221

ObjectMover是什么

ObjectMover 是香港大学和 Adobe Research 联合提出的新型图像编辑模型，解决图像中物体移动、插入和移除时出现的光照、阴影不协调以及物体失真等问题。将物体移动视为两帧视频的特殊案例，利用预训练视频生成模型的跨帧一致性学习能力，通过微调模型将其迁移到图像编辑任务。模型采用序列到序列建模，输入包括原始图像、目标物体图像和指令图，输出为物体移动后的合成图像。

ObjectMover的主要功能

物体移动：可将图像中的物体移动到指定位置，自动调整相关的物理效果，如光照、阴影、反射等，同时保持物体的身份特征。
物体删除：能真实地填充被移除物体的背景，非生成不相干的新物体，准确地移除与物体相关的光影。
物体插入：能精准保持被插入物体的身份特征，自动生成与环境一致的光影效果。

ObjectMover的技术原理

视频先验迁移：ObjectMover将物体移动任务视为两帧视频的特殊案例，利用预训练视频生成模型（如扩散模型）对跨帧一致性的学习能力。通过微调模型，将其从视频生成任务迁移到图像编辑任务。能充分利用视频模型预训练时习得的物理规律及物体对应关系，在图像编辑任务中实现精确的光影同步与身份特征保持。
序列到序列建模：模型将物体移动任务重构为序列预测问题。输入包括原始图像、目标物体图像、指令图（标注移动位置与方向），输出为物体移动后的合成图像。使模型能更好地理解和处理物体在不同位置下的光影变化和遮挡关系。
合成数据集构建：由于缺乏大规模物体移动的真实数据，研究团队使用现代游戏引擎（如虚幻引擎）生成高质量合成数据对。数据涵盖了复杂光照、材质和遮挡场景，增强了模型训练的多样性和泛化能力。
多任务学习策略：ObjectMover结合了物体移动、移除、插入及视频数据插入四个子任务，通过统一框架在合成数据与真实视频数据上进行训练。提升了模型对真实场景的泛化能力，使模型在处理不同图像编辑任务时表现出更高的适应性和鲁棒性。

ObjectMover的项目地址

项目官网：https://xinyu-andy.github.io/ObjMover/
arXiv技术论文：https://arxiv.org/pdf/2503.08037

ObjectMover的应用场景

特效制作：对于一些复杂的特效场景，如物体的消失或出现，ObjectMover可以实现物体的删除和插入，保持场景的真实感。
虚拟场景编辑：在虚拟现实和游戏开发中，需要对虚拟场景中的物体进行灵活的调整。ObjectMover可以用来移动场景中的物体，如将一个道具从一个位置移动到另一个位置，同时保持物体的光照和阴影与环境一致。
游戏关卡设计：开发者可以用ObjectMover快速调整关卡中的物体布局，提高关卡设计的效率。
产品展示：对于产品广告，可以用ObjectMover将产品放置在不同的场景中，展示产品的不同使用场景。
空间规划：在建筑和室内设计中，可以用ObjectMover将家具或装饰品移动到不同的位置，评估不同的设计方案。

收藏点赞 (0)

若非本站原创的文章，特别作如下声明：
本文刊载所有内容仅供提供信息交流和业务探讨而非提供法律建议目的使用，不代表任何监管机构的立场和观点。
不承担任何由于内容的合法性及真实性所引起的争议和法律责任。
凡注明为其他媒体来源的信息，均为转载，版权归版权所有人所有。
如有未注明作者及出处的文章和资料等素材，请版权所有者联系我们，我们将及时补上或者删除，共同建设自媒体信息平台，感谢你的支持！

AI老司机 AI行业动态 ObjectMover – 港大联合 Adobe 推出的新型图像编辑模型 https://www.ailsj.cn/1200.html