Fine-Grained Image-Text Correspondence with Cost Aggregation for Open-Vocabulary Part Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Choi, Jiho, Lee, Seonho, Lee, Minhyun, Lee, Seungho, Shim, Hyunjung |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Understanding Multi-Granularity for Open-Vocabulary Part Segmentation
par: Choi, Jiho, et autres
Publié: (2024)
par: Choi, Jiho, et autres
Publié: (2024)
Scribble-Guided Diffusion for Training-free Text-to-Image Generation
par: Lee, Seonho, et autres
Publié: (2024)
par: Lee, Seonho, et autres
Publié: (2024)
MaskRIS: Semantic Distortion-aware Data Augmentation for Referring Image Segmentation
par: Lee, Minhyun, et autres
Publié: (2024)
par: Lee, Minhyun, et autres
Publié: (2024)
Learning from Spatio-temporal Correlation for Semi-Supervised LiDAR Semantic Segmentation
par: Lee, Seungho, et autres
Publié: (2024)
par: Lee, Seungho, et autres
Publié: (2024)
3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation
par: Lee, Seonho, et autres
Publié: (2025)
par: Lee, Seonho, et autres
Publié: (2025)
Self-Supervised Vision Transformers Are Efficient Segmentation Learners for Imperfect Labels
par: Lee, Seungho, et autres
Publié: (2024)
par: Lee, Seungho, et autres
Publié: (2024)
DreamCatalyst: Fast and High-Quality 3D Editing via Controlling Editability and Identity Preservation
par: Kim, Jiwook, et autres
Publié: (2024)
par: Kim, Jiwook, et autres
Publié: (2024)
Weakly Supervised Semantic Segmentation for Driving Scenes
par: Kim, Dongseob, et autres
Publié: (2023)
par: Kim, Dongseob, et autres
Publié: (2023)
What "Not" to Detect: Negation-Aware VLMs via Structured Reasoning and Token Merging
par: Kang, Inha, et autres
Publié: (2025)
par: Kang, Inha, et autres
Publié: (2025)
Blind to Position, Biased in Language: Probing Mid-Layer Representational Bias in Vision-Language Encoders for Zero-Shot Language-Grounded Spatial Understanding
par: An, Na Min, et autres
Publié: (2025)
par: An, Na Min, et autres
Publié: (2025)
Sampling Bag of Views for Open-Vocabulary Object Detection
par: Choi, Hojun, et autres
Publié: (2024)
par: Choi, Hojun, et autres
Publié: (2024)
SeiT++: Masked Token Modeling Improves Storage-efficient Training
par: Lee, Minhyun, et autres
Publié: (2023)
par: Lee, Minhyun, et autres
Publié: (2023)
CoT-PL: Chain-of-Thought Pseudo-Labeling for Open-Vocabulary Object Detection
par: Choi, Hojun, et autres
Publié: (2025)
par: Choi, Hojun, et autres
Publié: (2025)
PCA-Seg: Revisiting Cost Aggregation for Open-Vocabulary Semantic and Part Segmentation
par: Yin, Jianjian, et autres
Publié: (2026)
par: Yin, Jianjian, et autres
Publié: (2026)
Evaluating Image Hallucination in Text-to-Image Generation with Question-Answering
par: Lim, Youngsun, et autres
Publié: (2024)
par: Lim, Youngsun, et autres
Publié: (2024)
Effective SAM Combination for Open-Vocabulary Semantic Segmentation
par: Lee, Minhyeok, et autres
Publié: (2024)
par: Lee, Minhyeok, et autres
Publié: (2024)
Addressing Image Hallucination in Text-to-Image Generation through Factual Image Retrieval
par: Lim, Youngsun, et autres
Publié: (2024)
par: Lim, Youngsun, et autres
Publié: (2024)
MomentMix Augmentation with Length-Aware DETR for Temporally Robust Moment Retrieval
par: Park, Seojeong, et autres
Publié: (2024)
par: Park, Seojeong, et autres
Publié: (2024)
FGAseg: Fine-Grained Pixel-Text Alignment for Open-Vocabulary Semantic Segmentation
par: Li, Bingyu, et autres
Publié: (2025)
par: Li, Bingyu, et autres
Publié: (2025)
TextBoost: Boosting Text Encoder for Personalized Text-to-Image Generation
par: Park, NaHyeon, et autres
Publié: (2024)
par: Park, NaHyeon, et autres
Publié: (2024)
CAT-Seg: Cost Aggregation for Open-Vocabulary Semantic Segmentation
par: Cho, Seokju, et autres
Publié: (2023)
par: Cho, Seokju, et autres
Publié: (2023)
No Thing, Nothing: Highlighting Safety-Critical Classes for Robust LiDAR Semantic Segmentation in Adverse Weather
par: Park, Junsung, et autres
Publié: (2025)
par: Park, Junsung, et autres
Publié: (2025)
OV-COAST: Cost Aggregation with Optimal Transport for Open-Vocabulary Semantic Segmentation
par: Gandhamal, Aditya, et autres
Publié: (2025)
par: Gandhamal, Aditya, et autres
Publié: (2025)
SGSoft: Learning Fused Semantic-Geometric Features for 3D Shape Correspondence via Template-Guided Soft Signals
par: Yoon, Soyeon, et autres
Publié: (2026)
par: Yoon, Soyeon, et autres
Publié: (2026)
Beyond-Labels: Advancing Open-Vocabulary Segmentation With Vision-Language Models
par: Rahman, Muhammad Atta ur, et autres
Publié: (2025)
par: Rahman, Muhammad Atta ur, et autres
Publié: (2025)
WaymoQA: A Multi-View Visual Question Answering Dataset for Safety-Critical Reasoning in Autonomous Driving
par: Yu, Seungjun, et autres
Publié: (2025)
par: Yu, Seungjun, et autres
Publié: (2025)
Fine-Grained Open-Vocabulary Object Recognition via User-Guided Segmentation
par: Ahn, Jinwoo, et autres
Publié: (2024)
par: Ahn, Jinwoo, et autres
Publié: (2024)
Personalized OVSS: Understanding Personal Concept in Open-Vocabulary Semantic Segmentation
par: Park, Sunghyun, et autres
Publié: (2025)
par: Park, Sunghyun, et autres
Publié: (2025)
Periodic-MAE: Periodic Video Masked Autoencoder for rPPG Estimation
par: Choi, Jiho, et autres
Publié: (2025)
par: Choi, Jiho, et autres
Publié: (2025)
DGQ: Distribution-Aware Group Quantization for Text-to-Image Diffusion Models
par: Ryu, Hyogon, et autres
Publié: (2025)
par: Ryu, Hyogon, et autres
Publié: (2025)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
par: Wang, Chenhao, et autres
Publié: (2026)
par: Wang, Chenhao, et autres
Publié: (2026)
Text-Guided Variational Image Generation for Industrial Anomaly Detection and Segmentation
par: Lee, Mingyu, et autres
Publié: (2024)
par: Lee, Mingyu, et autres
Publié: (2024)
Memory-Efficient Fine-Tuning for Quantized Diffusion Model
par: Ryu, Hyogon, et autres
Publié: (2024)
par: Ryu, Hyogon, et autres
Publié: (2024)
Rethinking Open-Vocabulary Segmentation of Radiance Fields in 3D Space
par: Lee, Hyunjee, et autres
Publié: (2024)
par: Lee, Hyunjee, et autres
Publié: (2024)
Directional Textual Inversion for Personalized Text-to-Image Generation
par: Kim, Kunhee, et autres
Publié: (2025)
par: Kim, Kunhee, et autres
Publié: (2025)
OVS Meets Continual Learning: Towards Sustainable Open-Vocabulary Segmentation
par: Hwang, Dongjun, et autres
Publié: (2024)
par: Hwang, Dongjun, et autres
Publié: (2024)
Open-Vocabulary 3D Semantic Segmentation with Text-to-Image Diffusion Models
par: Zhu, Xiaoyu, et autres
Publié: (2024)
par: Zhu, Xiaoyu, et autres
Publié: (2024)
Attentive Fine-Grained Structured Sparsity for Image Restoration
par: Oh, Junghun, et autres
Publié: (2022)
par: Oh, Junghun, et autres
Publié: (2022)
Rethinking Data Augmentation for Robust LiDAR Semantic Segmentation in Adverse Weather
par: Park, Junsung, et autres
Publié: (2024)
par: Park, Junsung, et autres
Publié: (2024)
Weighted Knowledge Distillation for Semi-Supervised Segmentation of Maxillary Sinus in Panoramic X-ray Images
par: Park, Juha, et autres
Publié: (2026)
par: Park, Juha, et autres
Publié: (2026)
Documents similaires
-
Understanding Multi-Granularity for Open-Vocabulary Part Segmentation
par: Choi, Jiho, et autres
Publié: (2024) -
Scribble-Guided Diffusion for Training-free Text-to-Image Generation
par: Lee, Seonho, et autres
Publié: (2024) -
MaskRIS: Semantic Distortion-aware Data Augmentation for Referring Image Segmentation
par: Lee, Minhyun, et autres
Publié: (2024) -
Learning from Spatio-temporal Correlation for Semi-Supervised LiDAR Semantic Segmentation
par: Lee, Seungho, et autres
Publié: (2024) -
3D-Aware Vision-Language Models Fine-Tuning with Geometric Distillation
par: Lee, Seonho, et autres
Publié: (2025)