Breaking the Box: Enhancing Remote Sensing Image Segmentation with Freehand Sketches
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zang, Ying, Gao, Yuncan, Zhang, Jiangi, Hu, Yuangi, Cao, Runlong, Zhu, Lanyun, Zhu, Qi, Ji, Deyi, Xu, Renjun, Chen, Tianrun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Let Human Sketches Help: Empowering Challenging Image Segmentation Task with Freehand Sketches
von: Zang, Ying, et al.
Veröffentlicht: (2025)
von: Zang, Ying, et al.
Veröffentlicht: (2025)
SAM3-Adapter: Efficient Adaptation of Segment Anything 3 for Camouflage Object Segmentation, Shadow Detection, and Medical Image Segmentation
von: Chen, Tianrun, et al.
Veröffentlicht: (2025)
von: Chen, Tianrun, et al.
Veröffentlicht: (2025)
RESMatch: Referring Expression Segmentation in a Semi-Supervised Manner
von: Zang, Ying, et al.
Veröffentlicht: (2024)
von: Zang, Ying, et al.
Veröffentlicht: (2024)
LLaFS: When Large Language Models Meet Few-Shot Segmentation
von: Zhu, Lanyun, et al.
Veröffentlicht: (2023)
von: Zhu, Lanyun, et al.
Veröffentlicht: (2023)
xLSTM-UNet can be an Effective 2D & 3D Medical Image Segmentation Backbone with Vision-LSTM (ViL) better than its Mamba Counterpart
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)
From Air to Wear: Personalized 3D Digital Fashion with AR/VR Immersive 3D Sketching
von: Zang, Ying, et al.
Veröffentlicht: (2025)
von: Zang, Ying, et al.
Veröffentlicht: (2025)
SAM2-Adapter: Evaluating & Adapting Segment Anything 2 in Downstream Tasks: Camouflage, Shadow, Medical Image Segmentation, and More
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)
Retrv-R1: A Reasoning-Driven MLLM Framework for Universal and Efficient Multimodal Retrieval
von: Zhu, Lanyun, et al.
Veröffentlicht: (2025)
von: Zhu, Lanyun, et al.
Veröffentlicht: (2025)
Not Every Patch is Needed: Towards a More Efficient and Effective Backbone for Video-based Person Re-identification
von: Zhu, Lanyun, et al.
Veröffentlicht: (2025)
von: Zhu, Lanyun, et al.
Veröffentlicht: (2025)
IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding
von: Zhu, Lanyun, et al.
Veröffentlicht: (2024)
von: Zhu, Lanyun, et al.
Veröffentlicht: (2024)
RAVEN: Robust Advertisement Video Violation Temporal Grounding via Reinforcement Reasoning
von: Ji, Deyi, et al.
Veröffentlicht: (2025)
von: Ji, Deyi, et al.
Veröffentlicht: (2025)
Robust 4D Visual Geometry Transformer with Uncertainty-Aware Priors
von: Zang, Ying, et al.
Veröffentlicht: (2026)
von: Zang, Ying, et al.
Veröffentlicht: (2026)
Reasoning3D -- Grounding and Reasoning in 3D: Fine-Grained Zero-Shot Open-Vocabulary 3D Reasoning Part Segmentation via Large Vision-Language Models
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)
Img2CAD: Conditioned 3D CAD Model Generation from Single Image with Structured Visual Geometry
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)
POPEN: Preference-Based Optimization and Ensemble for LVLM-Based Reasoning Segmentation
von: Zhu, Lanyun, et al.
Veröffentlicht: (2025)
von: Zhu, Lanyun, et al.
Veröffentlicht: (2025)
4DVGGT-D: 4D Visual Geometry Transformer with Improved Dynamic Depth Estimation
von: Zang, Ying, et al.
Veröffentlicht: (2026)
von: Zang, Ying, et al.
Veröffentlicht: (2026)
Syllables to Scenes: Literary-Guided Free-Viewpoint 3D Scene Synthesis from Japanese Haiku
von: Yu, Chunan, et al.
Veröffentlicht: (2025)
von: Yu, Chunan, et al.
Veröffentlicht: (2025)
SketchYourSeg: Mask-Free Subjective Image Segmentation via Freehand Sketches
von: Koley, Subhadeep, et al.
Veröffentlicht: (2025)
von: Koley, Subhadeep, et al.
Veröffentlicht: (2025)
StreamCacheVGGT: Streaming Visual Geometry Transformers with Robust Scoring and Hybrid Cache Compression
von: Liu, Xuanyi, et al.
Veröffentlicht: (2026)
von: Liu, Xuanyi, et al.
Veröffentlicht: (2026)
SketchingReality: From Freehand Scene Sketches To Photorealistic Images
von: Bourouis, Ahmed, et al.
Veröffentlicht: (2026)
von: Bourouis, Ahmed, et al.
Veröffentlicht: (2026)
Learning to Label: A Reinforced Self-Evolving Framework for Semi-supervised Referring Expression Segmentation
von: Cao, Runlong, et al.
Veröffentlicht: (2026)
von: Cao, Runlong, et al.
Veröffentlicht: (2026)
Discrete Latent Perspective Learning for Segmentation and Detection
von: Ji, Deyi, et al.
Veröffentlicht: (2024)
von: Ji, Deyi, et al.
Veröffentlicht: (2024)
Self-signals Driven Multi-LLM Debate for Efficient and Accurate Reasoning
von: Chen, Xuhang, et al.
Veröffentlicht: (2025)
von: Chen, Xuhang, et al.
Veröffentlicht: (2025)
StreamSense: Streaming Social Task Detection with Selective Vision-Language Model Routing
von: Wang, Han, et al.
Veröffentlicht: (2026)
von: Wang, Han, et al.
Veröffentlicht: (2026)
HD-VGGT: High-Resolution Visual Geometry Transformer
von: Chen, Tianrun, et al.
Veröffentlicht: (2026)
von: Chen, Tianrun, et al.
Veröffentlicht: (2026)
Tree-of-Table: Unleashing the Power of LLMs for Enhanced Large-Scale Table Understanding
von: Ji, Deyi, et al.
Veröffentlicht: (2024)
von: Ji, Deyi, et al.
Veröffentlicht: (2024)
Magic3DSketch: Create Colorful 3D Models From Sketch-Based 3D Modeling Guided by Text and Language-Image Pre-Training
von: Zang, Ying, et al.
Veröffentlicht: (2024)
von: Zang, Ying, et al.
Veröffentlicht: (2024)
Freehand Sketch Generation from Mechanical Components
von: Liao, Zhichao, et al.
Veröffentlicht: (2024)
von: Liao, Zhichao, et al.
Veröffentlicht: (2024)
SMFS‐GAN: Style‐Guided Multi‐class Freehand Sketch‐to‐Image Synthesis
von: Zhenwei Cheng, et al.
Veröffentlicht: (2024)
von: Zhenwei Cheng, et al.
Veröffentlicht: (2024)
RAVEN++: Pinpointing Fine-Grained Violations in Advertisement Videos with Active Reinforcement Reasoning
von: Ji, Deyi, et al.
Veröffentlicht: (2025)
von: Ji, Deyi, et al.
Veröffentlicht: (2025)
RRSIS: Referring Remote Sensing Image Segmentation
von: Yuan, Zhenghang, et al.
Veröffentlicht: (2023)
von: Yuan, Zhenghang, et al.
Veröffentlicht: (2023)
Adaptive Frequency Enhancement Network for Remote Sensing Image Semantic Segmentation
von: Gao, Feng, et al.
Veröffentlicht: (2025)
von: Gao, Feng, et al.
Veröffentlicht: (2025)
Geometrically Consistent Multi-View Scene Generation from Freehand Sketches
von: Bourouis, Ahmed, et al.
Veröffentlicht: (2026)
von: Bourouis, Ahmed, et al.
Veröffentlicht: (2026)
Claw AI Lab: An Autonomous Multi-Agent Research Team
von: Wu, Fan, et al.
Veröffentlicht: (2026)
von: Wu, Fan, et al.
Veröffentlicht: (2026)
Open-Vocabulary Remote Sensing Image Semantic Segmentation
von: Cao, Qinglong, et al.
Veröffentlicht: (2024)
von: Cao, Qinglong, et al.
Veröffentlicht: (2024)
Video-Zero: Self-Evolution Video Understanding
von: Zhang, Ruixu, et al.
Veröffentlicht: (2026)
von: Zhang, Ruixu, et al.
Veröffentlicht: (2026)
Understanding What Is Not Said:Referring Remote Sensing Image Segmentation with Scarce Expressions
von: Ye, Kai, et al.
Veröffentlicht: (2025)
von: Ye, Kai, et al.
Veröffentlicht: (2025)
Seg-LSTM: Performance of xLSTM for Semantic Segmentation of Remotely Sensed Images
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024)
von: Zhu, Qinfeng, et al.
Veröffentlicht: (2024)
Task Specific Pretraining with Noisy Labels for Remote Sensing Image Segmentation
von: Liu, Chenying, et al.
Veröffentlicht: (2024)
von: Liu, Chenying, et al.
Veröffentlicht: (2024)
GeoSeg: Training-Free Reasoning-Driven Segmentation in Remote Sensing Imagery
von: Jiang, Lifan, et al.
Veröffentlicht: (2026)
von: Jiang, Lifan, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Let Human Sketches Help: Empowering Challenging Image Segmentation Task with Freehand Sketches
von: Zang, Ying, et al.
Veröffentlicht: (2025) -
SAM3-Adapter: Efficient Adaptation of Segment Anything 3 for Camouflage Object Segmentation, Shadow Detection, and Medical Image Segmentation
von: Chen, Tianrun, et al.
Veröffentlicht: (2025) -
RESMatch: Referring Expression Segmentation in a Semi-Supervised Manner
von: Zang, Ying, et al.
Veröffentlicht: (2024) -
LLaFS: When Large Language Models Meet Few-Shot Segmentation
von: Zhu, Lanyun, et al.
Veröffentlicht: (2023) -
xLSTM-UNet can be an Effective 2D & 3D Medical Image Segmentation Backbone with Vision-LSTM (ViL) better than its Mamba Counterpart
von: Chen, Tianrun, et al.
Veröffentlicht: (2024)