arrow
返回

MST: Adaptive Multi-Scale Tokens Guided Interactive Segmentation

delete2025-08-01
delete0
PRE
AI
L
Long Xu
Y
Yongquan Chen
S
Shanghong Li
J
Jun Luo
DOI:10.1109/TCSVT.2025.3546634delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
交互式分割因其应用于人机交互和数据标注而获得了广泛关注。为解决交互式分割中目标尺度变化的问题,我们提出了一种新颖的多尺度token融合算法。该算法选择性地融合最重要的token,使模型能更好地捕捉重要区域的多尺度特征。为进一步增强多尺度token选择的鲁棒性,我们引入了一种基于对比损失的token学习算法。该算法充分利用目标与背景多尺度token间的判别信息,有效提升了所选拓展token的质量。广泛的基准测试表明,我们的方法在解决多尺度问题上具有有效性。代码和数据已在https://github.com/hahamyt/mst上公开。
Keyword:
Interactive segmentation
human-computer interaction
multi-scale token fusion
contrastive loss

期刊

IEEE Transactions on Circuits and Systems for Video Technology 封面图
IEEE Transactions on Circuits and Systems for Video Technology
IF:
11.1
论文数:
846
被引数:
3.1W

机构

T
The Chinese University of Hong Kong
学者数:
3.8K
论文数: 1.9K
被引数: 3
N
Northeastern University
学者数:
2.5W
论文数: 1.6W
被引数: 3.0W
引用论文

引用论文

Rethinking Interactive Image Segmentation with Low Latency, High Quality, and Diverse Prompts
err
IF0
err2024-06-16
err0
PREAI
errQin Liu; Jaemin Cho; Mohit Bansal; Marc Niethammer
err分享
err收藏
Differentiable Patch Selection for Image Recognition
err2021-06-01
err0
errOAAI
errJean-Baptiste Cordonnier; Aravindh Mahendran; Alexey Dosovitskiy; Dirk Weissenborn; Jakob Uszkoreit; Thomas Unterthiner
err分享
err收藏
EdgeFlow: Achieving Practical Interactive Segmentation with Edge-Guided Flow
err2021-10-01
err0
errOAAI
errYuying Hao; Yi Liu; Zewu Wu; Lin Han; Yizhou Chen; Guowei Chen; Lutao Chu; Shiyu Tang; Zhiliang Yu; Zeyu Chen; Baohua Lai
err分享
err收藏
A fully convolutional two-stream fusion network for interactive image segmentation
err2019-01-01
err75
errOAAI
errHu, Yang; Soltoggio, Andrea; Lock, Russell; Carter, Steve
err分享
err收藏
Multidimensional Exploration of Segment Anything Model for Weakly Supervised Video Salient Object Detection
err
IF0
err2024-01-01
err0
PREAI
errBinwei Xu; Qiuping Jiang; Xing Zhao; Chenyang Lu; Haoran Liang; Ronghua Liang
err分享
err收藏
FlexiViT: One Model for All Patch Sizes
err2023-06-01
err0
errOAAI
errLucas Beyer; Pavel Izmailov; Alexander Kolesnikov; Mathilde Caron; Simon Kornblith; Xiaohua Zhai; Matthias Minderer; Michael Tschannen; Ibrahim Alabdulmohsin; Filip Pavetic
err分享
err收藏
Deep High-Resolution Representation Learning for Visual Recognition面向视觉识别的深度高分辨率表示学习
err2021-10-01
err0
errOAAI
errJingdong Wang; Ke Sun; Tianheng Cheng; Borui Jiang; Chaorui Deng; Yang Zhao; Dong Liu; Yadong Mu; Mingkui Tan; Xinggang Wang; Wenyu Liu; Bin Xiao
err分享
err收藏
学者 查看更多内容