arrow
返回

Geometry-Aware Joint Attention for Efficient Native 3D Editing

delete2026-06-19
delete0
PRE
AI
蔡
蔡伟伟 (Weiwei Cai)
S
Shuangkang Fang
W
Weicai Ye
X
Xuanyang Zhang
Y
Yan‐Pei Cao
G
Gang Yu
陈涛 封面图
陈涛 (Tao Chen)
DOI:10.1109/lsp.2026.3705718delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
指令引导的3D编辑旨在根据文本指令修改3D对象,同时保持其整体几何结构。然而,现有方法要么依赖基于优化的管线,在推理时速度较慢,要么执行逐视图2D编辑后进行重建,往往导致几何不一致。为解决这些局限性,我们提出UniEdit3D,一种本地的前馈3D编辑模型,直接在扩散变换器中对结构化3D潜在表示进行操作。为使有效的前馈编辑成为可能,我们引入了“几何感知结构化注意力编辑”,这是一种统一的注意力机制,能够对统一的源和目标潜在标记进行联合自注意力推理,明确建模保留几何与编辑结构之间的空间交叉相关性。此外,为解决训练数据不足的问题,我们开发了一个自动化数据构建管线,以生成大规模的指令驱动编辑数据对。实验结果表明,与最先进的基线相比,我们的方法将FID降低了27.2%,同时能够在几秒钟内生成编辑后的3D资产。
Keyword:
3D signal processing
instruction-guided 3D editing
geometric consistency
diffusion transformer

期刊

I
IEEE Signal Processing Letters
IF:
3.9
论文数:
784
被引数:
0

机构

S
stepfun inc.
学者数:
4
论文数: 1
被引数: 0
F
fudan university
学者数:
11.8W
论文数: 7.7W
被引数: 121
V
vast
学者数:
35
论文数: 18
被引数: 1
Z
zhejiang university
学者数:
17.7W
论文数: 12.1W
被引数: 152
学者 查看更多机构
引用论文

引用论文

Enhancing No-Reference Audio-Visual Quality Assessment via Joint Cross-Attention Fusion
err2025-01-01
err0
PREAI
errWan, Zhaolin; Hao, Xiguang; Fan, Xiaopeng; Zuo, Wangmeng; Zhao, Debin
err分享
err收藏
Vox-E: Text-guided Voxel Editing of 3D Objects
err2023-10-01
err0
errOAAI
errEtai Sella; Gal Fiebelman; Peter Hedman; Hadar Averbuch-Elor
err分享
err收藏
Chat-Edit-3D: Interactive 3D Scene Editing via Text PromptsChat-Edit-3D:基于文本提示的交互式3D场景编辑
err2025-01-01
err0
PREAI
errFang,Shuangkang; Wang,Yufeng; Tsai,Yi-Hsuan; Yang,Yi; Ding,Wenrui; Zhou,Shuchang; Yang,Ming-Hsuan
err分享
err收藏
Magic3D: High-Resolution Text-to-3D Content Creation
err2023-06-01
err0
errOAAI
errChen-Hsuan Lin; Jun Gao; Luming Tang; Towaki Takikawa; Xiaohui Zeng; Xun Huang; Karsten Kreis; Sanja Fidler; Ming-Yu Liu; Tsung-Yi Lin
err分享
err收藏
err分享
err收藏
Robust Cross-Drone Multi-Target Association Using 3D Spatial Consistency
err2024-01-01
err3
PREAI
errPan, Tingwei; Dong, Hongbin; Deng, Baosong; Gui, Jianjun; Zhao, Bingxu
err分享
err收藏
MFECLIP: CLIP With Mapping-Fusion Embedding for Text-Guided Image Editing
err2024-01-01
err4
PREAI
errWu, Fei; Ma, Yongheng; Jin, Hao; Jing, Xiao-Yuan; Jiang, Guo-Ping
err分享
err收藏
Objaverse-XL: A Universe of 10M+ 3D ObjectsObjaverse-xl:一个包含1000万+ 3D对象的宇宙
err2023-01-01
err0
PREAI
errDeitke,Matt; Ehsani,Kiana; Fan,Alan; Farhadi,Ali; Gadre,Samir Yitzhak; Gkioxari,Georgia; Kembhavi,Aniruddha; Kusupati,Aditya; Laforte,Christian; Liu,Ruoshi; Michel,Oscar; Ngo,Huong; Schmidt,Ludwig; Vanderbilt,Eli; Voleti,Vikram; Vondrick,Carl; Wallingford,Matthew
err分享
err收藏
学者 查看更多内容