Personalized OVSS: Understanding Personal Concept in Open-Vocabulary Semantic Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Park, Sunghyun, Lee, Jungsoo, Borse, Shubhankar, Hayat, Munawar, Choi, Sungha, Hwang, Kyuwoong, Porikli, Fatih |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FLoC: Facility Location-Based Efficient Visual Token Compression for Long Video Understanding
di: Cho, Janghoon, et al.
Pubblicazione: (2025)
di: Cho, Janghoon, et al.
Pubblicazione: (2025)
CustomKD: Customizing Large Vision Foundation for Edge Model Improvement via Knowledge Distillation
di: Lee, Jungsoo, et al.
Pubblicazione: (2025)
di: Lee, Jungsoo, et al.
Pubblicazione: (2025)
CA-LoRA: Concept-Aware LoRA for Domain-Aligned Segmentation Dataset Generation
di: Park, Minho, et al.
Pubblicazione: (2025)
di: Park, Minho, et al.
Pubblicazione: (2025)
Generalized Contrastive Learning for Universal Multimodal Retrieval
di: Lee, Jungsoo, et al.
Pubblicazione: (2025)
di: Lee, Jungsoo, et al.
Pubblicazione: (2025)
Resolving the Identity Crisis in Text-to-Image Generation
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
PosSAM: Panoptic Open-vocabulary Segment Anything
di: VS, Vibashan, et al.
Pubblicazione: (2024)
di: VS, Vibashan, et al.
Pubblicazione: (2024)
MultiHuman-Testbench: Benchmarking Image Generation for Multiple Humans
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
MADI: Masking-Augmented Diffusion with Inference-Time Scaling for Visual Editing
di: Kadambi, Shreya, et al.
Pubblicazione: (2025)
di: Kadambi, Shreya, et al.
Pubblicazione: (2025)
SubZero: Composing Subject, Style, and Action via Zero-Shot Personalization
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
LoRA-X: Bridging Foundation Models with Training-Free Cross-Model Adaptation
di: Farhadzadeh, Farzad, et al.
Pubblicazione: (2025)
di: Farhadzadeh, Farzad, et al.
Pubblicazione: (2025)
ForeSea: AI Forensic Search with Multi-modal Queries for Video Surveillance
di: Park, Hyojin, et al.
Pubblicazione: (2026)
di: Park, Hyojin, et al.
Pubblicazione: (2026)
Ar2Can: An Architect and an Artist Leveraging a Canvas for Multi-Human Generation
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
FouRA: Fourier Low Rank Adaptation
di: Borse, Shubhankar, et al.
Pubblicazione: (2024)
di: Borse, Shubhankar, et al.
Pubblicazione: (2024)
Memory-Efficient Fine-Tuning Diffusion Transformers via Dynamic Patch Sampling and Block Skipping
di: Park, Sunghyun, et al.
Pubblicazione: (2026)
di: Park, Sunghyun, et al.
Pubblicazione: (2026)
ConsNoTrainLoRA: Data-driven Weight Initialization of Low-rank Adapters using Constraints
di: Das, Debasmit, et al.
Pubblicazione: (2025)
di: Das, Debasmit, et al.
Pubblicazione: (2025)
DDIL: Diversity Enhancing Diffusion Distillation With Imitation Learning
di: Garrepalli, Risheek, et al.
Pubblicazione: (2024)
di: Garrepalli, Risheek, et al.
Pubblicazione: (2024)
Attention Guided Alignment in Efficient Vision-Language Models
di: Mahajan, Shweta, et al.
Pubblicazione: (2025)
di: Mahajan, Shweta, et al.
Pubblicazione: (2025)
Do-Undo Bench: Reversibility for Action Understanding in Image Generation
di: Mahajan, Shweta, et al.
Pubblicazione: (2025)
di: Mahajan, Shweta, et al.
Pubblicazione: (2025)
OCAI: Improving Optical Flow Estimation by Occlusion and Consistency Aware Interpolation
di: Jeong, Jisoo, et al.
Pubblicazione: (2024)
di: Jeong, Jisoo, et al.
Pubblicazione: (2024)
Understanding Multi-Granularity for Open-Vocabulary Part Segmentation
di: Choi, Jiho, et al.
Pubblicazione: (2024)
di: Choi, Jiho, et al.
Pubblicazione: (2024)
Effective SAM Combination for Open-Vocabulary Semantic Segmentation
di: Lee, Minhyeok, et al.
Pubblicazione: (2024)
di: Lee, Minhyeok, et al.
Pubblicazione: (2024)
Steering Guidance for Personalized Text-to-Image Diffusion Models
di: Park, Sunghyun, et al.
Pubblicazione: (2025)
di: Park, Sunghyun, et al.
Pubblicazione: (2025)
From Open-Vocabulary to Vocabulary-Free Semantic Segmentation
di: Reichard, Klara, et al.
Pubblicazione: (2025)
di: Reichard, Klara, et al.
Pubblicazione: (2025)
Memory-Efficient Personalization of Text-to-Image Diffusion Models via Selective Optimization Strategies
di: Choi, Seokeon, et al.
Pubblicazione: (2025)
di: Choi, Seokeon, et al.
Pubblicazione: (2025)
Distilling Spectral Graph for Object-Context Aware Open-Vocabulary Semantic Segmentation
di: Kim, Chanyoung, et al.
Pubblicazione: (2024)
di: Kim, Chanyoung, et al.
Pubblicazione: (2024)
Segmentation-Free Guidance for Text-to-Image Diffusion Models
di: Azarian, Kambiz, et al.
Pubblicazione: (2024)
di: Azarian, Kambiz, et al.
Pubblicazione: (2024)
Open-Vocabulary Segmentation with Semantic-Assisted Calibration
di: Liu, Yong, et al.
Pubblicazione: (2023)
di: Liu, Yong, et al.
Pubblicazione: (2023)
Open Vocabulary Semantic Scene Sketch Understanding
di: Bourouis, Ahmed, et al.
Pubblicazione: (2023)
di: Bourouis, Ahmed, et al.
Pubblicazione: (2023)
Semantic Alignment in Hyperbolic Space for Open-Vocabulary Semantic Segmentation
di: Truong, Hoang M., et al.
Pubblicazione: (2026)
di: Truong, Hoang M., et al.
Pubblicazione: (2026)
Towards Open-Vocabulary Semantic Segmentation Without Semantic Labels
di: Shin, Heeseong, et al.
Pubblicazione: (2024)
di: Shin, Heeseong, et al.
Pubblicazione: (2024)
Hollowed Net for On-Device Personalization of Text-to-Image Diffusion Models
di: Cho, Wonguk, et al.
Pubblicazione: (2024)
di: Cho, Wonguk, et al.
Pubblicazione: (2024)
OVS Meets Continual Learning: Towards Sustainable Open-Vocabulary Segmentation
di: Hwang, Dongjun, et al.
Pubblicazione: (2024)
di: Hwang, Dongjun, et al.
Pubblicazione: (2024)
CoCo-SAM3: Harnessing Concept Conflict in Open-Vocabulary Semantic Segmentation
di: Chen, Yanhui, et al.
Pubblicazione: (2026)
di: Chen, Yanhui, et al.
Pubblicazione: (2026)
Efficient Redundancy Reduction for Open-Vocabulary Semantic Segmentation
di: Chen, Lin, et al.
Pubblicazione: (2025)
di: Chen, Lin, et al.
Pubblicazione: (2025)
Open-Vocabulary Semantic Segmentation with Image Embedding Balancing
di: Shan, Xiangheng, et al.
Pubblicazione: (2024)
di: Shan, Xiangheng, et al.
Pubblicazione: (2024)
TAG: Guidance-free Open-Vocabulary Semantic Segmentation
di: Kawano, Yasufumi, et al.
Pubblicazione: (2024)
di: Kawano, Yasufumi, et al.
Pubblicazione: (2024)
Open-Vocabulary Semantic Segmentation with Uncertainty Alignment for Robotic Scene Understanding in Indoor Building Environments
di: Xu, Yifan, et al.
Pubblicazione: (2025)
di: Xu, Yifan, et al.
Pubblicazione: (2025)
Fine-Grained Image-Text Correspondence with Cost Aggregation for Open-Vocabulary Part Segmentation
di: Choi, Jiho, et al.
Pubblicazione: (2025)
di: Choi, Jiho, et al.
Pubblicazione: (2025)
Tripartite Weight-Space Ensemble for Few-Shot Class-Incremental Learning
di: Lee, Juntae, et al.
Pubblicazione: (2025)
di: Lee, Juntae, et al.
Pubblicazione: (2025)
Lost in Translation? Vocabulary Alignment for Source-Free Adaptation in Open-Vocabulary Semantic Segmentation
di: Mazzucco, Silvio, et al.
Pubblicazione: (2025)
di: Mazzucco, Silvio, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FLoC: Facility Location-Based Efficient Visual Token Compression for Long Video Understanding
di: Cho, Janghoon, et al.
Pubblicazione: (2025) -
CustomKD: Customizing Large Vision Foundation for Edge Model Improvement via Knowledge Distillation
di: Lee, Jungsoo, et al.
Pubblicazione: (2025) -
CA-LoRA: Concept-Aware LoRA for Domain-Aligned Segmentation Dataset Generation
di: Park, Minho, et al.
Pubblicazione: (2025) -
Generalized Contrastive Learning for Universal Multimodal Retrieval
di: Lee, Jungsoo, et al.
Pubblicazione: (2025) -
Resolving the Identity Crisis in Text-to-Image Generation
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)