DeRIS: Decoupling Perception and Cognition for Enhanced Referring Image Segmentation through Loopback Synergy
Fuente:
arXiv
Salvato in:
| Autori principali: | Dai, Ming, Cheng, Wenxuan, Liu, Jiang-jiang, Yang, Sen, Cai, Wenxiao, Sun, Yanpeng, Yang, Wankou |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Object-level Geometric Structure Preserving for Natural Image Stitching
di: Cai, Wenxiao, et al.
Pubblicazione: (2024)
di: Cai, Wenxiao, et al.
Pubblicazione: (2024)
Precise GPS-Denied UAV Self-Positioning via Context-Enhanced Cross-View Geo-Localization
di: Xu, Yuanze, et al.
Pubblicazione: (2025)
di: Xu, Yuanze, et al.
Pubblicazione: (2025)
PropVG: End-to-End Proposal-Driven Visual Grounding with Multi-Granularity Discrimination
di: Dai, Ming, et al.
Pubblicazione: (2025)
di: Dai, Ming, et al.
Pubblicazione: (2025)
MomentSeg: Moment-Centric Sampling for Enhanced Video Pixel Understanding
di: Dai, Ming, et al.
Pubblicazione: (2025)
di: Dai, Ming, et al.
Pubblicazione: (2025)
VDD: Varied Drone Dataset for Semantic Segmentation
di: Cai, Wenxiao, et al.
Pubblicazione: (2023)
di: Cai, Wenxiao, et al.
Pubblicazione: (2023)
SimVG: A Simple Framework for Visual Grounding with Decoupled Multi-modal Fusion
di: Dai, Ming, et al.
Pubblicazione: (2024)
di: Dai, Ming, et al.
Pubblicazione: (2024)
Improving Generalized Visual Grounding with Instance-aware Joint Learning
di: Dai, Ming, et al.
Pubblicazione: (2025)
di: Dai, Ming, et al.
Pubblicazione: (2025)
Vision Remember: Recovering Visual Information in Efficient LVLM with Vision Feature Resampling
di: Feng, Ze, et al.
Pubblicazione: (2025)
di: Feng, Ze, et al.
Pubblicazione: (2025)
PTQ4RIS: Post-Training Quantization for Referring Image Segmentation
di: Jiang, Xiaoyan, et al.
Pubblicazione: (2024)
di: Jiang, Xiaoyan, et al.
Pubblicazione: (2024)
Drone Referring Localization: An Efficient Heterogeneous Spatial Feature Interaction Method For UAV Self-Localization
di: Dai, Ming, et al.
Pubblicazione: (2022)
di: Dai, Ming, et al.
Pubblicazione: (2022)
Probabilistic Modeling of Disparity Uncertainty for Robust and Efficient Stereo Matching
di: Cai, Wenxiao, et al.
Pubblicazione: (2024)
di: Cai, Wenxiao, et al.
Pubblicazione: (2024)
SpatialBot: Precise Spatial Understanding with Vision Language Models
di: Cai, Wenxiao, et al.
Pubblicazione: (2024)
di: Cai, Wenxiao, et al.
Pubblicazione: (2024)
Decoupling Static and Hierarchical Motion Perception for Referring Video Segmentation
di: He, Shuting, et al.
Pubblicazione: (2024)
di: He, Shuting, et al.
Pubblicazione: (2024)
Image-Conditioned Instance Prompt Network for Referring Remote Sensing Image Segmentation
di: Ren, Biaoyu, et al.
Pubblicazione: (2026)
di: Ren, Biaoyu, et al.
Pubblicazione: (2026)
Curriculum Point Prompting for Weakly-Supervised Referring Image Segmentation
di: Dai, Qiyuan, et al.
Pubblicazione: (2024)
di: Dai, Qiyuan, et al.
Pubblicazione: (2024)
RIS-LAD: A Benchmark and Model for Referring Low-Altitude Drone Image Segmentation
di: Ye, Kai, et al.
Pubblicazione: (2025)
di: Ye, Kai, et al.
Pubblicazione: (2025)
Multi-task Visual Grounding with Coarse-to-Fine Consistency Constraints
di: Dai, Ming, et al.
Pubblicazione: (2025)
di: Dai, Ming, et al.
Pubblicazione: (2025)
EM-KD: Distilling Efficient Multimodal Large Language Model with Unbalanced Vision Tokens
di: Feng, Ze, et al.
Pubblicazione: (2025)
di: Feng, Ze, et al.
Pubblicazione: (2025)
DiffRIS: Enhancing Referring Remote Sensing Image Segmentation with Pre-trained Text-to-Image Diffusion Models
di: Dong, Zhe, et al.
Pubblicazione: (2025)
di: Dong, Zhe, et al.
Pubblicazione: (2025)
RIS-Enhanced Information-Decoupled Symbiotic Radio Over Broadcasting Signals
di: Cai, Shu, et al.
Pubblicazione: (2026)
di: Cai, Shu, et al.
Pubblicazione: (2026)
Topology-Guaranteed Image Segmentation: Enforcing Connectivity, Genus, and Width Constraints
di: Li, Wenxiao, et al.
Pubblicazione: (2026)
di: Li, Wenxiao, et al.
Pubblicazione: (2026)
Pseudo-RIS: Distinctive Pseudo-supervision Generation for Referring Image Segmentation
di: Yu, Seonghoon, et al.
Pubblicazione: (2024)
di: Yu, Seonghoon, et al.
Pubblicazione: (2024)
RIS-FUSION: Rethinking Text-Driven Infrared and Visible Image Fusion from the Perspective of Referring Image Segmentation
di: Ma, Siju, et al.
Pubblicazione: (2025)
di: Ma, Siju, et al.
Pubblicazione: (2025)
Learning Multiple Probabilistic Decisions from Latent World Model in Autonomous Driving
di: Xiao, Lingyu, et al.
Pubblicazione: (2024)
di: Xiao, Lingyu, et al.
Pubblicazione: (2024)
Anti-Jamming Optimization for EM-Compliant Active RIS via Decoupling Architecture
di: Cao, Yang, et al.
Pubblicazione: (2026)
di: Cao, Yang, et al.
Pubblicazione: (2026)
MaskRIS: Semantic Distortion-aware Data Augmentation for Referring Image Segmentation
di: Lee, Minhyun, et al.
Pubblicazione: (2024)
di: Lee, Minhyun, et al.
Pubblicazione: (2024)
Improving underwater semantic segmentation with underwater image quality attention and muti-scale aggregation attention
di: Zuo, Xin, et al.
Pubblicazione: (2025)
di: Zuo, Xin, et al.
Pubblicazione: (2025)
EAVL: Explicitly Align Vision and Language for Referring Image Segmentation
di: Yan, Yichen, et al.
Pubblicazione: (2023)
di: Yan, Yichen, et al.
Pubblicazione: (2023)
TopoSD: Topology-Enhanced Lane Segment Perception with SDMap Prior
di: Yang, Sen, et al.
Pubblicazione: (2024)
di: Yang, Sen, et al.
Pubblicazione: (2024)
P‐5.4: Ghost Removal HDR Fusion Algorithm Based on Enhanced Reference Image
di: Wenxuan Nie, et al.
Pubblicazione: (2024)
di: Wenxuan Nie, et al.
Pubblicazione: (2024)
DeSAM: Decoupled Segment Anything Model for Generalizable Medical Image Segmentation
di: Gao, Yifan, et al.
Pubblicazione: (2023)
di: Gao, Yifan, et al.
Pubblicazione: (2023)
SSP-SAM: SAM with Semantic-Spatial Prompt for Referring Expression Segmentation
di: Tang, Wei, et al.
Pubblicazione: (2026)
di: Tang, Wei, et al.
Pubblicazione: (2026)
Decoupling the Image Perception and Multimodal Reasoning for Reasoning Segmentation with Digital Twin Representations
di: Li, Yizhen, et al.
Pubblicazione: (2025)
di: Li, Yizhen, et al.
Pubblicazione: (2025)
Robot Manipulation in Salient Vision through Referring Image Segmentation and Geometric Constraints
di: Jiang, Chen, et al.
Pubblicazione: (2024)
di: Jiang, Chen, et al.
Pubblicazione: (2024)
CycSim 1.0.4
di: hu, jiang
Pubblicazione: (2025)
di: hu, jiang
Pubblicazione: (2025)
RSRefSeg 2: Decoupling Referring Remote Sensing Image Segmentation with Foundation Models
di: Chen, Keyan, et al.
Pubblicazione: (2025)
di: Chen, Keyan, et al.
Pubblicazione: (2025)
Enhancing Lane Segment Perception and Topology Reasoning with Crowdsourcing Trajectory Priors
di: Jia, Peijin, et al.
Pubblicazione: (2024)
di: Jia, Peijin, et al.
Pubblicazione: (2024)
DGL-RSIS: Decoupling Global Spatial Context and Local Class Semantics for Training-Free Remote Sensing Image Segmentation
di: Li, Boyi, et al.
Pubblicazione: (2025)
di: Li, Boyi, et al.
Pubblicazione: (2025)
EasyChauffeur: A Baseline Advancing Simplicity and Efficiency on Waymax
di: Xiao, Lingyu, et al.
Pubblicazione: (2024)
di: Xiao, Lingyu, et al.
Pubblicazione: (2024)
PanopticPartFormer++: A Unified and Decoupled View for Panoptic Part Segmentation
di: Li, Xiangtai, et al.
Pubblicazione: (2023)
di: Li, Xiangtai, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Object-level Geometric Structure Preserving for Natural Image Stitching
di: Cai, Wenxiao, et al.
Pubblicazione: (2024) -
Precise GPS-Denied UAV Self-Positioning via Context-Enhanced Cross-View Geo-Localization
di: Xu, Yuanze, et al.
Pubblicazione: (2025) -
PropVG: End-to-End Proposal-Driven Visual Grounding with Multi-Granularity Discrimination
di: Dai, Ming, et al.
Pubblicazione: (2025) -
MomentSeg: Moment-Centric Sampling for Enhanced Video Pixel Understanding
di: Dai, Ming, et al.
Pubblicazione: (2025) -
VDD: Varied Drone Dataset for Semantic Segmentation
di: Cai, Wenxiao, et al.
Pubblicazione: (2023)