Let Human Sketches Help: Empowering Challenging Image Segmentation Task with Freehand Sketches
Fuente:
arXiv
Saved in:
| Main Authors: | Zang, Ying, Cao, Runlong, Zhang, Jianqi, Han, Yidong, Cao, Ziyue, Hu, Wenjun, Zhu, Didi, Zhu, Lanyun, Li, Zejian, Ji, Deyi, Chen, Tianrun |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Breaking the Box: Enhancing Remote Sensing Image Segmentation with Freehand Sketches
by: Zang, Ying, et al.
Published: (2025)
by: Zang, Ying, et al.
Published: (2025)
RESMatch: Referring Expression Segmentation in a Semi-Supervised Manner
by: Zang, Ying, et al.
Published: (2024)
by: Zang, Ying, et al.
Published: (2024)
Magic3DSketch: Create Colorful 3D Models From Sketch-Based 3D Modeling Guided by Text and Language-Image Pre-Training
by: Zang, Ying, et al.
Published: (2024)
by: Zang, Ying, et al.
Published: (2024)
SAM3-Adapter: Efficient Adaptation of Segment Anything 3 for Camouflage Object Segmentation, Shadow Detection, and Medical Image Segmentation
by: Chen, Tianrun, et al.
Published: (2025)
by: Chen, Tianrun, et al.
Published: (2025)
SAM2-Adapter: Evaluating & Adapting Segment Anything 2 in Downstream Tasks: Camouflage, Shadow, Medical Image Segmentation, and More
by: Chen, Tianrun, et al.
Published: (2024)
by: Chen, Tianrun, et al.
Published: (2024)
xLSTM-UNet can be an Effective 2D & 3D Medical Image Segmentation Backbone with Vision-LSTM (ViL) better than its Mamba Counterpart
by: Chen, Tianrun, et al.
Published: (2024)
by: Chen, Tianrun, et al.
Published: (2024)
Reasoning3D -- Grounding and Reasoning in 3D: Fine-Grained Zero-Shot Open-Vocabulary 3D Reasoning Part Segmentation via Large Vision-Language Models
by: Chen, Tianrun, et al.
Published: (2024)
by: Chen, Tianrun, et al.
Published: (2024)
From Air to Wear: Personalized 3D Digital Fashion with AR/VR Immersive 3D Sketching
by: Zang, Ying, et al.
Published: (2025)
by: Zang, Ying, et al.
Published: (2025)
SketchYourSeg: Mask-Free Subjective Image Segmentation via Freehand Sketches
by: Koley, Subhadeep, et al.
Published: (2025)
by: Koley, Subhadeep, et al.
Published: (2025)
SketchingReality: From Freehand Scene Sketches To Photorealistic Images
by: Bourouis, Ahmed, et al.
Published: (2026)
by: Bourouis, Ahmed, et al.
Published: (2026)
LLaFS: When Large Language Models Meet Few-Shot Segmentation
by: Zhu, Lanyun, et al.
Published: (2023)
by: Zhu, Lanyun, et al.
Published: (2023)
Img2CAD: Conditioned 3D CAD Model Generation from Single Image with Structured Visual Geometry
by: Chen, Tianrun, et al.
Published: (2024)
by: Chen, Tianrun, et al.
Published: (2024)
Retrv-R1: A Reasoning-Driven MLLM Framework for Universal and Efficient Multimodal Retrieval
by: Zhu, Lanyun, et al.
Published: (2025)
by: Zhu, Lanyun, et al.
Published: (2025)
Not Every Patch is Needed: Towards a More Efficient and Effective Backbone for Video-based Person Re-identification
by: Zhu, Lanyun, et al.
Published: (2025)
by: Zhu, Lanyun, et al.
Published: (2025)
Syllables to Scenes: Literary-Guided Free-Viewpoint 3D Scene Synthesis from Japanese Haiku
by: Yu, Chunan, et al.
Published: (2025)
by: Yu, Chunan, et al.
Published: (2025)
IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding
by: Zhu, Lanyun, et al.
Published: (2024)
by: Zhu, Lanyun, et al.
Published: (2024)
Freehand Sketch Generation from Mechanical Components
by: Liao, Zhichao, et al.
Published: (2024)
by: Liao, Zhichao, et al.
Published: (2024)
Robust 4D Visual Geometry Transformer with Uncertainty-Aware Priors
by: Zang, Ying, et al.
Published: (2026)
by: Zang, Ying, et al.
Published: (2026)
RAVEN: Robust Advertisement Video Violation Temporal Grounding via Reinforcement Reasoning
by: Ji, Deyi, et al.
Published: (2025)
by: Ji, Deyi, et al.
Published: (2025)
SMFS‐GAN: Style‐Guided Multi‐class Freehand Sketch‐to‐Image Synthesis
by: Zhenwei Cheng, et al.
Published: (2024)
by: Zhenwei Cheng, et al.
Published: (2024)
4DVGGT-D: 4D Visual Geometry Transformer with Improved Dynamic Depth Estimation
by: Zang, Ying, et al.
Published: (2026)
by: Zang, Ying, et al.
Published: (2026)
Sketch2PoseNet: Efficient and Generalized Sketch to 3D Human Pose Prediction
by: Wang, Li, et al.
Published: (2025)
by: Wang, Li, et al.
Published: (2025)
Learning to Label: A Reinforced Self-Evolving Framework for Semi-supervised Referring Expression Segmentation
by: Cao, Runlong, et al.
Published: (2026)
by: Cao, Runlong, et al.
Published: (2026)
POPEN: Preference-Based Optimization and Ensemble for LVLM-Based Reasoning Segmentation
by: Zhu, Lanyun, et al.
Published: (2025)
by: Zhu, Lanyun, et al.
Published: (2025)
Geometrically Consistent Multi-View Scene Generation from Freehand Sketches
by: Bourouis, Ahmed, et al.
Published: (2026)
by: Bourouis, Ahmed, et al.
Published: (2026)
SketchRef: a Multi-Task Evaluation Benchmark for Sketch Synthesis
by: Lin, Xingyue, et al.
Published: (2024)
by: Lin, Xingyue, et al.
Published: (2024)
Equipping Sketch Patches with Context-Aware Positional Encoding for Graphic Sketch Representation
by: Zang, Sicong, et al.
Published: (2024)
by: Zang, Sicong, et al.
Published: (2024)
HD-VGGT: High-Resolution Visual Geometry Transformer
by: Chen, Tianrun, et al.
Published: (2026)
by: Chen, Tianrun, et al.
Published: (2026)
Discrete Latent Perspective Learning for Segmentation and Detection
by: Ji, Deyi, et al.
Published: (2024)
by: Ji, Deyi, et al.
Published: (2024)
Histogramless Time-Domain Sketched Fluorescence Lifetime Imaging
by: Zang, Zhenya, et al.
Published: (2026)
by: Zang, Zhenya, et al.
Published: (2026)
StreamSense: Streaming Social Task Detection with Selective Vision-Language Model Routing
by: Wang, Han, et al.
Published: (2026)
by: Wang, Han, et al.
Published: (2026)
Doodle Your 3D: From Abstract Freehand Sketches to Precise 3D Shapes
by: Bandyopadhyay, Hmrishav, et al.
Published: (2023)
by: Bandyopadhyay, Hmrishav, et al.
Published: (2023)
StreamCacheVGGT: Streaming Visual Geometry Transformers with Robust Scoring and Hybrid Cache Compression
by: Liu, Xuanyi, et al.
Published: (2026)
by: Liu, Xuanyi, et al.
Published: (2026)
CustomSketching: Sketch Concept Extraction for Sketch-based Image Synthesis and Editing
by: Xiao, Chufeng, et al.
Published: (2024)
by: Xiao, Chufeng, et al.
Published: (2024)
CustomSketching: Sketch Concept Extraction for Sketch‐based Image Synthesis and Editing
by: Chufeng Xiao, et al.
Published: (2024)
by: Chufeng Xiao, et al.
Published: (2024)
Sketch-and-Verify: Structured Inference-Time Scaling via Program Sketching
by: Jiang, Shan, et al.
Published: (2026)
by: Jiang, Shan, et al.
Published: (2026)
Generating Sketches in a Hierarchical Auto-Regressive Process for Flexible Sketch Drawing Manipulation at Stroke-Level
by: Zang, Sicong, et al.
Published: (2025)
by: Zang, Sicong, et al.
Published: (2025)
Lego Sketch: A Scalable Memory-augmented Neural Network for Sketching Data Streams
by: Feng, Yuan, et al.
Published: (2025)
by: Feng, Yuan, et al.
Published: (2025)
Sketch Down the FLOPs: Towards Efficient Networks for Human Sketch
by: Sain, Aneeshan, et al.
Published: (2025)
by: Sain, Aneeshan, et al.
Published: (2025)
Self-signals Driven Multi-LLM Debate for Efficient and Accurate Reasoning
by: Chen, Xuhang, et al.
Published: (2025)
by: Chen, Xuhang, et al.
Published: (2025)
Similar Items
-
Breaking the Box: Enhancing Remote Sensing Image Segmentation with Freehand Sketches
by: Zang, Ying, et al.
Published: (2025) -
RESMatch: Referring Expression Segmentation in a Semi-Supervised Manner
by: Zang, Ying, et al.
Published: (2024) -
Magic3DSketch: Create Colorful 3D Models From Sketch-Based 3D Modeling Guided by Text and Language-Image Pre-Training
by: Zang, Ying, et al.
Published: (2024) -
SAM3-Adapter: Efficient Adaptation of Segment Anything 3 for Camouflage Object Segmentation, Shadow Detection, and Medical Image Segmentation
by: Chen, Tianrun, et al.
Published: (2025) -
SAM2-Adapter: Evaluating & Adapting Segment Anything 2 in Downstream Tasks: Camouflage, Shadow, Medical Image Segmentation, and More
by: Chen, Tianrun, et al.
Published: (2024)