Gespeichert in:
| Hauptverfasser: | Ye, Kai, Luan, YingShi, Chen, Zhudi, Meng, Guangyue, Dai, Pingyang, Cao, Liujuan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2507.20920 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Understanding What Is Not Said:Referring Remote Sensing Image Segmentation with Scarce Expressions
von: Ye, Kai, et al.
Veröffentlicht: (2025)
von: Ye, Kai, et al.
Veröffentlicht: (2025)
Evolving, Not Training: Zero-Shot Reasoning Segmentation via Evolutionary Prompting
von: Ye, Kai, et al.
Veröffentlicht: (2025)
von: Ye, Kai, et al.
Veröffentlicht: (2025)
DPM++: Dynamic Masked Metric Learning for Occluded Person Re-identification
von: Tan, Lei, et al.
Veröffentlicht: (2026)
von: Tan, Lei, et al.
Veröffentlicht: (2026)
More Clear, More Flexible, More Precise: A Comprehensive Oriented Object Detection benchmark for UAV
von: Ye, Kai, et al.
Veröffentlicht: (2025)
von: Ye, Kai, et al.
Veröffentlicht: (2025)
Can Unified Generation and Understanding Models Maintain Semantic Equivalence Across Different Output Modalities?
von: Jiang, Hongbo, et al.
Veröffentlicht: (2026)
von: Jiang, Hongbo, et al.
Veröffentlicht: (2026)
Attention Disturbance and Dual-Path Constraint Network for Occluded Person Re-identification
von: Xia, Jiaer, et al.
Veröffentlicht: (2023)
von: Xia, Jiaer, et al.
Veröffentlicht: (2023)
Knowing Where to Focus: Attention-Guided Alignment for Text-based Person Search
von: Tan, Lei, et al.
Veröffentlicht: (2024)
von: Tan, Lei, et al.
Veröffentlicht: (2024)
PartFormer: Awakening Latent Diverse Representation from Vision Transformer for Object Re-Identification
von: Tan, Lei, et al.
Veröffentlicht: (2024)
von: Tan, Lei, et al.
Veröffentlicht: (2024)
Unleashing MLLMs on the Edge: A Unified Framework for Cross-Modal ReID via Adaptive SVD Distillation
von: Jiang, Hongbo, et al.
Veröffentlicht: (2026)
von: Jiang, Hongbo, et al.
Veröffentlicht: (2026)
Referring Industrial Anomaly Segmentation
von: Yue, Pengfei, et al.
Veröffentlicht: (2026)
von: Yue, Pengfei, et al.
Veröffentlicht: (2026)
FlexiReID: Adaptive Mixture of Expert for Multi-Modal Person Re-Identification
von: Sun, Zhen, et al.
Veröffentlicht: (2025)
von: Sun, Zhen, et al.
Veröffentlicht: (2025)
3D-DRES: Detailed 3D Referring Expression Segmentation
von: Chen, Qi, et al.
Veröffentlicht: (2026)
von: Chen, Qi, et al.
Veröffentlicht: (2026)
Active-SAOOD: Active Sparsely Annotated Oriented Object Detection in Remote Sensing Images
von: Lin, Yu, et al.
Veröffentlicht: (2026)
von: Lin, Yu, et al.
Veröffentlicht: (2026)
WildSeg3D: Segment Any 3D Objects in the Wild from 2D Images
von: Guo, Yansong, et al.
Veröffentlicht: (2025)
von: Guo, Yansong, et al.
Veröffentlicht: (2025)
MMLA: Multi-Environment, Multi-Species, Low-Altitude Drone Dataset
von: Kline, Jenna, et al.
Veröffentlicht: (2025)
von: Kline, Jenna, et al.
Veröffentlicht: (2025)
Discover, Segment, and Select: A Progressive Mechanism for Zero-shot Camouflaged Object Segmentation
von: Yang, Yilong, et al.
Veröffentlicht: (2026)
von: Yang, Yilong, et al.
Veröffentlicht: (2026)
DeTrack: A Benchmark and Altitude-Aware Dual World Model for Drone-embodied Tracking
von: Hu, Guyue, et al.
Veröffentlicht: (2026)
von: Hu, Guyue, et al.
Veröffentlicht: (2026)
DeRIS: Decoupling Perception and Cognition for Enhanced Referring Image Segmentation through Loopback Synergy
von: Dai, Ming, et al.
Veröffentlicht: (2025)
von: Dai, Ming, et al.
Veröffentlicht: (2025)
Collaborative Position Reasoning Network for Referring Image Segmentation
von: Cao, Jianjian, et al.
Veröffentlicht: (2024)
von: Cao, Jianjian, et al.
Veröffentlicht: (2024)
PTQ4RIS: Post-Training Quantization for Referring Image Segmentation
von: Jiang, Xiaoyan, et al.
Veröffentlicht: (2024)
von: Jiang, Xiaoyan, et al.
Veröffentlicht: (2024)
Prompt Decoupling for Text-to-Image Person Re-identification
von: Li, Weihao, et al.
Veröffentlicht: (2024)
von: Li, Weihao, et al.
Veröffentlicht: (2024)
UAV-Borne Mapping Algorithms for Low-Altitude and High-Speed Drone Applications
von: Zhang, Jincheng, et al.
Veröffentlicht: (2024)
von: Zhang, Jincheng, et al.
Veröffentlicht: (2024)
RefDrone: A Challenging Benchmark for Referring Expression Comprehension in Drone Scenes
von: Sun, Zhichao, et al.
Veröffentlicht: (2025)
von: Sun, Zhichao, et al.
Veröffentlicht: (2025)
MVGGT: Multimodal Visual Geometry Grounded Transformer for Multiview 3D Referring Expression Segmentation
von: Wu, Changli, et al.
Veröffentlicht: (2026)
von: Wu, Changli, et al.
Veröffentlicht: (2026)
HRSAM: Efficient Interactive Segmentation in High-Resolution Images
von: Huang, You, et al.
Veröffentlicht: (2024)
von: Huang, You, et al.
Veröffentlicht: (2024)
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
von: Peng, Yun, et al.
Veröffentlicht: (2024)
von: Peng, Yun, et al.
Veröffentlicht: (2024)
MIHBench: Benchmarking and Mitigating Multi-Image Hallucinations in Multimodal Large Language Models
von: Li, Jiale, et al.
Veröffentlicht: (2025)
von: Li, Jiale, et al.
Veröffentlicht: (2025)
MaskRIS: Semantic Distortion-aware Data Augmentation for Referring Image Segmentation
von: Lee, Minhyun, et al.
Veröffentlicht: (2024)
von: Lee, Minhyun, et al.
Veröffentlicht: (2024)
Pseudo-RIS: Distinctive Pseudo-supervision Generation for Referring Image Segmentation
von: Yu, Seonghoon, et al.
Veröffentlicht: (2024)
von: Yu, Seonghoon, et al.
Veröffentlicht: (2024)
Prototype-Based Low Altitude UAV Semantic Segmentation
von: Zhang, Da, et al.
Veröffentlicht: (2026)
von: Zhang, Da, et al.
Veröffentlicht: (2026)
An Efficient and Mixed Heterogeneous Model for Image Restoration
von: Gu, Yubin, et al.
Veröffentlicht: (2025)
von: Gu, Yubin, et al.
Veröffentlicht: (2025)
DiffRIS: Enhancing Referring Remote Sensing Image Segmentation with Pre-trained Text-to-Image Diffusion Models
von: Dong, Zhe, et al.
Veröffentlicht: (2025)
von: Dong, Zhe, et al.
Veröffentlicht: (2025)
Test-Time Computing for Referring Multimodal Large Language Models
von: Wu, Mingrui, et al.
Veröffentlicht: (2026)
von: Wu, Mingrui, et al.
Veröffentlicht: (2026)
What You Perceive Is What You Conceive: A Cognition-Inspired Framework for Open Vocabulary Image Segmentation
von: Lin, Jianghang, et al.
Veröffentlicht: (2025)
von: Lin, Jianghang, et al.
Veröffentlicht: (2025)
Curriculum Point Prompting for Weakly-Supervised Referring Image Segmentation
von: Dai, Qiyuan, et al.
Veröffentlicht: (2024)
von: Dai, Qiyuan, et al.
Veröffentlicht: (2024)
Depth-Guided Semi-Supervised Instance Segmentation
von: Chen, Xin, et al.
Veröffentlicht: (2024)
von: Chen, Xin, et al.
Veröffentlicht: (2024)
RIS-FUSION: Rethinking Text-Driven Infrared and Visible Image Fusion from the Perspective of Referring Image Segmentation
von: Ma, Siju, et al.
Veröffentlicht: (2025)
von: Ma, Siju, et al.
Veröffentlicht: (2025)
Adaptive Feature Selection for No-Reference Image Quality Assessment by Mitigating Semantic Noise Sensitivity
von: Li, Xudong, et al.
Veröffentlicht: (2023)
von: Li, Xudong, et al.
Veröffentlicht: (2023)
PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation
von: Ke, Shuyan, et al.
Veröffentlicht: (2026)
von: Ke, Shuyan, et al.
Veröffentlicht: (2026)
DeOcc-1-to-3: 3D De-Occlusion from a Single Image via Self-Supervised Multi-View Diffusion
von: Qu, Yansong, et al.
Veröffentlicht: (2025)
von: Qu, Yansong, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Understanding What Is Not Said:Referring Remote Sensing Image Segmentation with Scarce Expressions
von: Ye, Kai, et al.
Veröffentlicht: (2025) -
Evolving, Not Training: Zero-Shot Reasoning Segmentation via Evolutionary Prompting
von: Ye, Kai, et al.
Veröffentlicht: (2025) -
DPM++: Dynamic Masked Metric Learning for Occluded Person Re-identification
von: Tan, Lei, et al.
Veröffentlicht: (2026) -
More Clear, More Flexible, More Precise: A Comprehensive Oriented Object Detection benchmark for UAV
von: Ye, Kai, et al.
Veröffentlicht: (2025) -
Can Unified Generation and Understanding Models Maintain Semantic Equivalence Across Different Output Modalities?
von: Jiang, Hongbo, et al.
Veröffentlicht: (2026)