AMLRIS: Alignment-aware Masked Learning for Referring Image Segmentation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Tongfei, Yang, Shuo, Yang, Yuguang, Yang, Linlin, Guo, Runtang, Li, Changbai, Long, He, Xie, Chunyu, Leng, Dawei, Zhang, Baochang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Prompt as Knowledge Bank: Boost Vision-language model via Structural Representation for zero-shot medical detection
von: Yang, Yuguang, et al.
Veröffentlicht: (2025)
von: Yang, Yuguang, et al.
Veröffentlicht: (2025)
DecomCAM: Advancing Beyond Saliency Maps through Decomposition and Integration
von: Yang, Yuguang, et al.
Veröffentlicht: (2024)
von: Yang, Yuguang, et al.
Veröffentlicht: (2024)
UrbanGS: A Scalable and Efficient Architecture for Geometrically Accurate Large-Scene Reconstruction
von: Li, Changbai, et al.
Veröffentlicht: (2026)
von: Li, Changbai, et al.
Veröffentlicht: (2026)
Decom--CAM: Tell Me What You See, In Details! Feature-Level Interpretation via Decomposition Class Activation Map
von: Yang, Yuguang, et al.
Veröffentlicht: (2023)
von: Yang, Yuguang, et al.
Veröffentlicht: (2023)
HRGS: Hierarchical Gaussian Splatting for Memory-Efficient High-Resolution 3D Reconstruction
von: Li, Changbai, et al.
Veröffentlicht: (2025)
von: Li, Changbai, et al.
Veröffentlicht: (2025)
Causally Guided Gaussian Perturbations for Out-Of-Distribution Generalization in Medical Imaging
von: Pei, Haoran, et al.
Veröffentlicht: (2025)
von: Pei, Haoran, et al.
Veröffentlicht: (2025)
WaveMamba: Wavelet-Driven Mamba Fusion for RGB-Infrared Object Detection
von: Zhu, Haodong, et al.
Veröffentlicht: (2025)
von: Zhu, Haodong, et al.
Veröffentlicht: (2025)
MaskRIS: Semantic Distortion-aware Data Augmentation for Referring Image Segmentation
von: Lee, Minhyun, et al.
Veröffentlicht: (2024)
von: Lee, Minhyun, et al.
Veröffentlicht: (2024)
TALENT: Target-aware Efficient Tuning for Referring Image Segmentation
von: Jin, Shuo, et al.
Veröffentlicht: (2026)
von: Jin, Shuo, et al.
Veröffentlicht: (2026)
Adaptive Texture-aware Masking for Self-Supervised Learning in 3D Dental CBCT Analysis
von: Yang, Xinquan, et al.
Veröffentlicht: (2026)
von: Yang, Xinquan, et al.
Veröffentlicht: (2026)
FG-CLIP: Fine-Grained Visual and Textual Alignment
von: Xie, Chunyu, et al.
Veröffentlicht: (2025)
von: Xie, Chunyu, et al.
Veröffentlicht: (2025)
Learning domain-invariant features through channel-level sparsification for Out-Of Distribution Generalization
von: Pei, Haoran, et al.
Veröffentlicht: (2026)
von: Pei, Haoran, et al.
Veröffentlicht: (2026)
Mask Grounding for Referring Image Segmentation
von: Chng, Yong Xien, et al.
Veröffentlicht: (2023)
von: Chng, Yong Xien, et al.
Veröffentlicht: (2023)
Scale-wise Bidirectional Alignment Network for Referring Remote Sensing Image Segmentation
von: Li, Kun, et al.
Veröffentlicht: (2025)
von: Li, Kun, et al.
Veröffentlicht: (2025)
RzenEmbed: Towards Comprehensive Multimodal Retrieval
von: Jian, Weijian, et al.
Veröffentlicht: (2025)
von: Jian, Weijian, et al.
Veröffentlicht: (2025)
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
LMM-Det: Make Large Multimodal Models Excel in Object Detection
von: Li, Jincheng, et al.
Veröffentlicht: (2025)
von: Li, Jincheng, et al.
Veröffentlicht: (2025)
FG-CLIP 2: A Bilingual Fine-grained Vision-Language Alignment Model
von: Xie, Chunyu, et al.
Veröffentlicht: (2025)
von: Xie, Chunyu, et al.
Veröffentlicht: (2025)
Granular Ball Guided Masking: Structure-aware Data Augmentation
von: Xia, Shuyin, et al.
Veröffentlicht: (2025)
von: Xia, Shuyin, et al.
Veröffentlicht: (2025)
Towards Motion-aware Referring Image Segmentation
von: Kim, Chaeyun, et al.
Veröffentlicht: (2026)
von: Kim, Chaeyun, et al.
Veröffentlicht: (2026)
Uncertainty-Aware Gradient Stabilization for Small Object Detection
von: Sun, Huixin, et al.
Veröffentlicht: (2023)
von: Sun, Huixin, et al.
Veröffentlicht: (2023)
Deforming Videos to Masks: Flow Matching for Referring Video Segmentation
von: Wang, Zanyi, et al.
Veröffentlicht: (2025)
von: Wang, Zanyi, et al.
Veröffentlicht: (2025)
Mask-aware Text-to-Image Retrieval: Referring Expression Segmentation Meets Cross-modal Retrieval
von: Shen, Li-Cheng, et al.
Veröffentlicht: (2025)
von: Shen, Li-Cheng, et al.
Veröffentlicht: (2025)
MaskMed: Decoupled Mask and Class Prediction for Medical Image Segmentation
von: Xie, Bin, et al.
Veröffentlicht: (2025)
von: Xie, Bin, et al.
Veröffentlicht: (2025)
Curriculum Point Prompting for Weakly-Supervised Referring Image Segmentation
von: Dai, Qiyuan, et al.
Veröffentlicht: (2024)
von: Dai, Qiyuan, et al.
Veröffentlicht: (2024)
Co-Learning Semantic-aware Unsupervised Segmentation for Pathological Image Registration
von: Liu, Yang, et al.
Veröffentlicht: (2023)
von: Liu, Yang, et al.
Veröffentlicht: (2023)
Channel Attention-Guided Cross-Modal Knowledge Distillation for Referring Image Segmentation
von: Yang, Chen
Veröffentlicht: (2026)
von: Yang, Chen
Veröffentlicht: (2026)
Extending CLIP's Image-Text Alignment to Referring Image Segmentation
von: Kim, Seoyeon, et al.
Veröffentlicht: (2023)
von: Kim, Seoyeon, et al.
Veröffentlicht: (2023)
OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling
von: Xiao, Linhui, et al.
Veröffentlicht: (2024)
von: Xiao, Linhui, et al.
Veröffentlicht: (2024)
Medical Referring Image Segmentation via Next-Token Mask Prediction
von: Chen, Xinyu, et al.
Veröffentlicht: (2025)
von: Chen, Xinyu, et al.
Veröffentlicht: (2025)
LLM-enhanced Action-aware Multi-modal Prompt Tuning for Image-Text Matching
von: Tian, Mengxiao, et al.
Veröffentlicht: (2025)
von: Tian, Mengxiao, et al.
Veröffentlicht: (2025)
PathFL: Multi-Alignment Federated Learning for Pathology Image Segmentation
von: Zhang, Yuan, et al.
Veröffentlicht: (2025)
von: Zhang, Yuan, et al.
Veröffentlicht: (2025)
DiffAtlas: GenAI-fying Atlas Segmentation via Image-Mask Diffusion
von: Zhang, Hantao, et al.
Veröffentlicht: (2025)
von: Zhang, Hantao, et al.
Veröffentlicht: (2025)
Normalizing Batch Normalization for Long-Tailed Recognition
von: Bao, Yuxiang, et al.
Veröffentlicht: (2025)
von: Bao, Yuxiang, et al.
Veröffentlicht: (2025)
Sparse Anatomical Prompt Semi-Supervised Learning with Masked Image Modeling for CBCT Tooth Segmentation
von: Dai, Pengyu, et al.
Veröffentlicht: (2024)
von: Dai, Pengyu, et al.
Veröffentlicht: (2024)
Information Entropy Guided Height-aware Histogram for Quantization-friendly Pillar Feature Encoder
von: Zhou, Sifan, et al.
Veröffentlicht: (2024)
von: Zhou, Sifan, et al.
Veröffentlicht: (2024)
Perception- and Fidelity-aware Reduced-Reference Super-Resolution Image Quality Assessment
von: Lin, Xinying, et al.
Veröffentlicht: (2024)
von: Lin, Xinying, et al.
Veröffentlicht: (2024)
Caries DETR: Tooth Structure-aware Prior and Lesion-aware Dynamic Loss Refinement for DETR Based Caries Detection
von: Liu, Xuefen, et al.
Veröffentlicht: (2026)
von: Liu, Xuefen, et al.
Veröffentlicht: (2026)
LlamaSeg: Image Segmentation via Autoregressive Mask Generation
von: Deng, Jiru, et al.
Veröffentlicht: (2025)
von: Deng, Jiru, et al.
Veröffentlicht: (2025)
TFANet: Three-Stage Image-Text Feature Alignment Network for Robust Referring Image Segmentation
von: Lu, Qianqi, et al.
Veröffentlicht: (2025)
von: Lu, Qianqi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Prompt as Knowledge Bank: Boost Vision-language model via Structural Representation for zero-shot medical detection
von: Yang, Yuguang, et al.
Veröffentlicht: (2025) -
DecomCAM: Advancing Beyond Saliency Maps through Decomposition and Integration
von: Yang, Yuguang, et al.
Veröffentlicht: (2024) -
UrbanGS: A Scalable and Efficient Architecture for Geometrically Accurate Large-Scene Reconstruction
von: Li, Changbai, et al.
Veröffentlicht: (2026) -
Decom--CAM: Tell Me What You See, In Details! Feature-Level Interpretation via Decomposition Class Activation Map
von: Yang, Yuguang, et al.
Veröffentlicht: (2023) -
HRGS: Hierarchical Gaussian Splatting for Memory-Efficient High-Resolution 3D Reconstruction
von: Li, Changbai, et al.
Veröffentlicht: (2025)