返回
Panoptic-VSNet: Visual-semantic prior knowledge-driven multimodal 3D panoptic segmentation
DOI:10.1016/j.patcog.2026.113239.png)
摘要
En 中文
• 通过CLIP驱动的激活将点映射到语义区域,以减少语义差距。
• 融合图像全景掩码和文本嵌入,以实现精确的实例边界。
• 采用动态核和多尺度融合进行上下文捕捉和细节增强。
Keyword:
Panoptic segmentation
Visual-semantic prior
CLIP-driven activation
Multi-scale fusion
Dynamic kernels
期刊
IF:
7.6
论文数:
1.3W
被引数:
4.5W
机构
引用论文
VPA-Net: A visual perception assistance network for 3d lidar semantic segmentationVpa-net: 用于3d lidar语义分割的视觉感知辅助网络
PATTERN RECOGNITION
IF7.6
Panoptic-FusionNet: Camera-LiDAR fusion-based point cloud panoptic segmentation for autonomous drivingPanopte-fusionnet: 基于相机-激光雷达融合的自动驾驶点云全景分割
Class-imbalanced semi-supervised learning for large-scale point cloud semantic segmentation via decoupling optimization基于类不平衡半监督学习的大规模点云语义分割解耦优化
PATTERN RECOGNITION
IF7.6
TCFAP-Net: Transformer-based Cross-feature Fusion and Adaptive Perception Network for large-scale point cloud semantic segmentationTcfap-net: 基于Transformer的交叉特征融合和自适应感知网络的大规模点云语义分割
PATTERN RECOGNITION
IF7.6

