A Simple Image Segmentation Framework via In-Context Examples
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yang, Jing, Chenchen, Li, Hengtao, Zhu, Muzhi, Chen, Hao, Wang, Xinlong, Shen, Chunhua |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Matcher: Segment Anything with One Shot Using All-Purpose Feature Matching
par: Liu, Yang, et autres
Publié: (2023)
par: Liu, Yang, et autres
Publié: (2023)
Unleashing the Potential of the Diffusion Model in Few-shot Semantic Segmentation
par: Zhu, Muzhi, et autres
Publié: (2024)
par: Zhu, Muzhi, et autres
Publié: (2024)
Unified Open-World Segmentation with Multi-Modal Prompts
par: Liu, Yang, et autres
Publié: (2025)
par: Liu, Yang, et autres
Publié: (2025)
Generative Active Learning for Long-tailed Instance Segmentation
par: Zhu, Muzhi, et autres
Publié: (2024)
par: Zhu, Muzhi, et autres
Publié: (2024)
DiverGen: Improving Instance Segmentation by Learning Wider Data Distribution with More Diverse Generative Data
par: Fan, Chengxiang, et autres
Publié: (2024)
par: Fan, Chengxiang, et autres
Publié: (2024)
Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality
par: Luo, Zekai, et autres
Publié: (2025)
par: Luo, Zekai, et autres
Publié: (2025)
Omni-R1: Reinforcement Learning for Omnimodal Reasoning via Two-System Collaboration
par: Zhong, Hao, et autres
Publié: (2025)
par: Zhong, Hao, et autres
Publié: (2025)
SegAgent: Exploring Pixel Understanding Capabilities in MLLMs by Imitating Human Annotator Trajectories
par: Zhu, Muzhi, et autres
Publié: (2025)
par: Zhu, Muzhi, et autres
Publié: (2025)
OmniJigsaw: Enhancing Omni-Modal Reasoning via Modality-Orchestrated Reordering
par: Jia, Yiduo, et autres
Publié: (2026)
par: Jia, Yiduo, et autres
Publié: (2026)
Where to Look: Can Foundation Models Reach a Target Viewpoint Through Active Exploration?
par: Li, Liyang, et autres
Publié: (2026)
par: Li, Liyang, et autres
Publié: (2026)
Zero-Shot Video Editing Using Off-The-Shelf Image Diffusion Models
par: Wang, Wen, et autres
Publié: (2023)
par: Wang, Wen, et autres
Publié: (2023)
HieraTok: Multi-Scale Visual Tokenizer Improves Image Reconstruction and Generation
par: Chen, Cong, et autres
Publié: (2025)
par: Chen, Cong, et autres
Publié: (2025)
GEM: Boost Simple Network for Glass Surface Segmentation via Vision Foundation Models
par: Hao, Jing, et autres
Publié: (2023)
par: Hao, Jing, et autres
Publié: (2023)
GEM: Boost Simple Network for Glass Surface Segmentation via Segment Anything Model and Data Synthesis
par: Hao, Jing, et autres
Publié: (2024)
par: Hao, Jing, et autres
Publié: (2024)
DICEPTION: A Generalist Diffusion Model for Visual Perceptual Tasks
par: Zhao, Canyu, et autres
Publié: (2025)
par: Zhao, Canyu, et autres
Publié: (2025)
Active-O3: Empowering Multimodal Large Language Models with Active Perception via GRPO
par: Zhu, Muzhi, et autres
Publié: (2025)
par: Zhu, Muzhi, et autres
Publié: (2025)
Exploring Spatial Intelligence from a Generative Perspective
par: Zhu, Muzhi, et autres
Publié: (2026)
par: Zhu, Muzhi, et autres
Publié: (2026)
Towards Explicit Geometry-Reflectance Collaboration for Generalized LiDAR Segmentation in Adverse Weather
par: Yang, Longyu, et autres
Publié: (2025)
par: Yang, Longyu, et autres
Publié: (2025)
Show and Segment: Universal Medical Image Segmentation via In-Context Learning
par: Gao, Yunhe, et autres
Publié: (2025)
par: Gao, Yunhe, et autres
Publié: (2025)
NoTVLA: Semantics-Preserving Robot Adaptation via Narrative Action Interfaces
par: Huang, Zheng, et autres
Publié: (2025)
par: Huang, Zheng, et autres
Publié: (2025)
Bridge Thinking and Acting: Unleashing Physical Potential of VLM with Generalizable Action Expert
par: Liu, Mingyu, et autres
Publié: (2025)
par: Liu, Mingyu, et autres
Publié: (2025)
FreeCompose: Generic Zero-Shot Image Composition with Diffusion Prior
par: Chen, Zhekai, et autres
Publié: (2024)
par: Chen, Zhekai, et autres
Publié: (2024)
Object-aware Inversion and Reassembly for Image Editing
par: Yang, Zhen, et autres
Publié: (2023)
par: Yang, Zhen, et autres
Publié: (2023)
Adaptive FSS: A Novel Few-Shot Segmentation Framework via Prototype Enhancement
par: Wang, Jing, et autres
Publié: (2023)
par: Wang, Jing, et autres
Publié: (2023)
PerturboLLaVA: Reducing Multimodal Hallucinations with Perturbative Visual Training
par: Chen, Cong, et autres
Publié: (2025)
par: Chen, Cong, et autres
Publié: (2025)
FreeCustom: Tuning-Free Customized Image Generation for Multi-Concept Composition
par: Ding, Ganggui, et autres
Publié: (2024)
par: Ding, Ganggui, et autres
Publié: (2024)
DC-SAM: In-Context Segment Anything in Images and Videos via Dual Consistency
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Probabilistic Modeling of Multi-rater Medical Image Segmentation for Diversity and Personalization
par: Liu, Ke, et autres
Publié: (2025)
par: Liu, Ke, et autres
Publié: (2025)
Decoupled Competitive Framework for Semi-supervised Medical Image Segmentation
par: Chen, Jiahe, et autres
Publié: (2025)
par: Chen, Jiahe, et autres
Publié: (2025)
SimpleFusion: A Simple Fusion Framework for Infrared and Visible Images
par: Chen, Ming, et autres
Publié: (2024)
par: Chen, Ming, et autres
Publié: (2024)
DiffuMask: Synthesizing Images with Pixel-level Annotations for Semantic Segmentation Using Diffusion Models
par: Wu, Weijia, et autres
Publié: (2023)
par: Wu, Weijia, et autres
Publié: (2023)
Ultrasound Nodule Segmentation Using Asymmetric Learning with Simple Clinical Annotation
par: Zhao, Xingyue, et autres
Publié: (2024)
par: Zhao, Xingyue, et autres
Publié: (2024)
ActDistill: General Action-Guided Self-Derived Distillation for Efficient Vision-Language-Action Models
par: Ye, Wencheng, et autres
Publié: (2025)
par: Ye, Wencheng, et autres
Publié: (2025)
Learning by Imagining: Debiased Feature Augmentation for Compositional Zero-Shot Learning
par: Zhang, Haozhe, et autres
Publié: (2025)
par: Zhang, Haozhe, et autres
Publié: (2025)
GeoMotion: Rethinking Motion Segmentation via Latent 4D Geometry
par: He, Xiankang, et autres
Publié: (2026)
par: He, Xiankang, et autres
Publié: (2026)
Med-Tuning: A New Parameter-Efficient Tuning Framework for Medical Volumetric Segmentation
par: Shen, Jiachen, et autres
Publié: (2023)
par: Shen, Jiachen, et autres
Publié: (2023)
Unveiling Parts Beyond Objects:Towards Finer-Granularity Referring Expression Segmentation
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
AQD: Towards Accurate Fully-Quantized Object Detection
par: Chen, Peng, et autres
Publié: (2020)
par: Chen, Peng, et autres
Publié: (2020)
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
CoIN: A Benchmark of Continual Instruction tuNing for Multimodel Large Language Model
par: Chen, Cheng, et autres
Publié: (2024)
par: Chen, Cheng, et autres
Publié: (2024)
Documents similaires
-
Matcher: Segment Anything with One Shot Using All-Purpose Feature Matching
par: Liu, Yang, et autres
Publié: (2023) -
Unleashing the Potential of the Diffusion Model in Few-shot Semantic Segmentation
par: Zhu, Muzhi, et autres
Publié: (2024) -
Unified Open-World Segmentation with Multi-Modal Prompts
par: Liu, Yang, et autres
Publié: (2025) -
Generative Active Learning for Long-tailed Instance Segmentation
par: Zhu, Muzhi, et autres
Publié: (2024) -
DiverGen: Improving Instance Segmentation by Learning Wider Data Distribution with More Diverse Generative Data
par: Fan, Chengxiang, et autres
Publié: (2024)