Mining Open Semantics from CLIP: A Relation Transition Perspective for Few-Shot Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yan, Cilin, Wang, Haochen, Jiang, Xiaolong, Hu, Yao, Tang, Xu, Kang, Guoliang, Gavves, Efstratios |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PiClick: Picking the desired mask from multiple candidates in click-based interactive segmentation
di: Yan, Cilin, et al.
Pubblicazione: (2023)
di: Yan, Cilin, et al.
Pubblicazione: (2023)
VISA: Reasoning Video Object Segmentation via Large Language Models
di: Yan, Cilin, et al.
Pubblicazione: (2024)
di: Yan, Cilin, et al.
Pubblicazione: (2024)
Object-centric Video Question Answering with Visual Grounding and Referring
di: Wang, Haochen, et al.
Pubblicazione: (2025)
di: Wang, Haochen, et al.
Pubblicazione: (2025)
LTCA: Long-range Temporal Context Attention for Referring Video Object Segmentation
di: Yan, Cilin, et al.
Pubblicazione: (2025)
di: Yan, Cilin, et al.
Pubblicazione: (2025)
ReCLIP++: Learn to Rectify the Bias of CLIP for Unsupervised Semantic Segmentation
di: Wang, Jingyun, et al.
Pubblicazione: (2024)
di: Wang, Jingyun, et al.
Pubblicazione: (2024)
Dynamic Prototype Adaptation with Distillation for Few-shot Point Cloud Segmentation
di: Liu, Jie, et al.
Pubblicazione: (2024)
di: Liu, Jie, et al.
Pubblicazione: (2024)
Rethinking the Global Knowledge of CLIP in Training-Free Open-Vocabulary Semantic Segmentation
di: Wang, Jingyun, et al.
Pubblicazione: (2025)
di: Wang, Jingyun, et al.
Pubblicazione: (2025)
Probabilistic Prototype Calibration of Vision-Language Models for Generalized Few-shot Semantic Segmentation
di: Liu, Jie, et al.
Pubblicazione: (2025)
di: Liu, Jie, et al.
Pubblicazione: (2025)
Attention Head Purification: A New Perspective to Harness CLIP for Domain Generalization
di: Wang, Yingfan, et al.
Pubblicazione: (2024)
di: Wang, Yingfan, et al.
Pubblicazione: (2024)
Simple Semantic-Aided Few-Shot Learning
di: Zhang, Hai, et al.
Pubblicazione: (2023)
di: Zhang, Hai, et al.
Pubblicazione: (2023)
Logits DeConfusion with CLIP for Few-Shot Learning
di: Li, Shuo, et al.
Pubblicazione: (2025)
di: Li, Shuo, et al.
Pubblicazione: (2025)
AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning
di: Qiu, Yilun, et al.
Pubblicazione: (2026)
di: Qiu, Yilun, et al.
Pubblicazione: (2026)
CrossVid: A Comprehensive Benchmark for Evaluating Cross-Video Reasoning in Multimodal Large Language Models
di: Li, Jingyao, et al.
Pubblicazione: (2025)
di: Li, Jingyao, et al.
Pubblicazione: (2025)
CLIP-FSAC++: Few-Shot Anomaly Classification with Anomaly Descriptor Based on CLIP
di: Zuo, Zuo, et al.
Pubblicazione: (2024)
di: Zuo, Zuo, et al.
Pubblicazione: (2024)
Semantic Relation-Enhanced CLIP Adapter for Domain Adaptive Zero-Shot Learning
di: Yu, Jiaao, et al.
Pubblicazione: (2025)
di: Yu, Jiaao, et al.
Pubblicazione: (2025)
Topology-Aware CLIP Few-Shot Learning
di: Huang, Dazhi
Pubblicazione: (2025)
di: Huang, Dazhi
Pubblicazione: (2025)
Learning to Adapt Category Consistent Meta-Feature of CLIP for Few-Shot Classification
di: Shi, Jiaying, et al.
Pubblicazione: (2024)
di: Shi, Jiaying, et al.
Pubblicazione: (2024)
Transductive Zero-Shot and Few-Shot CLIP
di: Martin, Ségolène, et al.
Pubblicazione: (2024)
di: Martin, Ségolène, et al.
Pubblicazione: (2024)
CorrCLIP: Reconstructing Patch Correlations in CLIP for Open-Vocabulary Semantic Segmentation
di: Zhang, Dengke, et al.
Pubblicazione: (2024)
di: Zhang, Dengke, et al.
Pubblicazione: (2024)
Any-Resolution AI-Generated Image Detection by Spectral Learning
di: Karageorgiou, Dimitrios, et al.
Pubblicazione: (2024)
di: Karageorgiou, Dimitrios, et al.
Pubblicazione: (2024)
ActivityCLIP: Enhancing Group Activity Recognition by Mining Complementary Information from Text to Supplement Image Modality
di: Xu, Guoliang, et al.
Pubblicazione: (2024)
di: Xu, Guoliang, et al.
Pubblicazione: (2024)
Dual Relation Mining Network for Zero-Shot Learning
di: Han, Jinwei, et al.
Pubblicazione: (2024)
di: Han, Jinwei, et al.
Pubblicazione: (2024)
RSBuilding: Towards General Remote Sensing Image Building Extraction and Change Detection with Foundation Model
di: Wang, Mingze, et al.
Pubblicazione: (2024)
di: Wang, Mingze, et al.
Pubblicazione: (2024)
Proto-CLIP: Vision-Language Prototypical Network for Few-Shot Learning
di: P, Jishnu Jaykumar, et al.
Pubblicazione: (2023)
di: P, Jishnu Jaykumar, et al.
Pubblicazione: (2023)
Concentrate on Weakness: Mining Hard Prototypes for Few-Shot Medical Image Segmentation
di: Jiang, Jianchao, et al.
Pubblicazione: (2025)
di: Jiang, Jianchao, et al.
Pubblicazione: (2025)
MA-FSAR: Multimodal Adaptation of CLIP for Few-Shot Action Recognition
di: Xing, Jiazheng, et al.
Pubblicazione: (2023)
di: Xing, Jiazheng, et al.
Pubblicazione: (2023)
CLIP3D-AD: Extending CLIP for 3D Few-Shot Anomaly Detection with Multi-View Images Generation
di: Zuo, Zuo, et al.
Pubblicazione: (2024)
di: Zuo, Zuo, et al.
Pubblicazione: (2024)
Few-Shot Semantic Segmentation Meets SAM3
di: Tsai, Yi-Jen, et al.
Pubblicazione: (2026)
di: Tsai, Yi-Jen, et al.
Pubblicazione: (2026)
Multimodal CLIP Inference for Meta-Few-Shot Image Classification
di: Ferragu, Constance, et al.
Pubblicazione: (2024)
di: Ferragu, Constance, et al.
Pubblicazione: (2024)
Language-Aware Information Maximization for Transductive Few-Shot CLIP
di: Baklouti, Ghassen, et al.
Pubblicazione: (2025)
di: Baklouti, Ghassen, et al.
Pubblicazione: (2025)
Rethinking Prior Information Generation with CLIP for Few-Shot Segmentation
di: Wang, Jin, et al.
Pubblicazione: (2024)
di: Wang, Jin, et al.
Pubblicazione: (2024)
Dual Guidance Semi-Supervised Action Detection
di: Singh, Ankit, et al.
Pubblicazione: (2025)
di: Singh, Ankit, et al.
Pubblicazione: (2025)
Hold-One-Shot-Out (HOSO) for Validation-Free Few-Shot CLIP Adapters
di: Vorster, Chris, et al.
Pubblicazione: (2026)
di: Vorster, Chris, et al.
Pubblicazione: (2026)
SeMoBridge: Semantic Modality Bridge for Efficient Few-Shot Adaptation of CLIP
di: Timmermann, Christoph, et al.
Pubblicazione: (2025)
di: Timmermann, Christoph, et al.
Pubblicazione: (2025)
MediCLIP: Adapting CLIP for Few-shot Medical Image Anomaly Detection
di: Zhang, Ximiao, et al.
Pubblicazione: (2024)
di: Zhang, Ximiao, et al.
Pubblicazione: (2024)
Multi-Text Guided Few-Shot Semantic Segmentation
di: Jiao, Qiang, et al.
Pubblicazione: (2025)
di: Jiao, Qiang, et al.
Pubblicazione: (2025)
Dream to Manipulate: Compositional World Models Empowering Robot Imitation Learning with Imagination
di: Barcellona, Leonardo, et al.
Pubblicazione: (2024)
di: Barcellona, Leonardo, et al.
Pubblicazione: (2024)
SpatialFormer: Semantic and Target Aware Attentions for Few-Shot Learning
di: Lai, Jinxiang, et al.
Pubblicazione: (2023)
di: Lai, Jinxiang, et al.
Pubblicazione: (2023)
Fully Fine-tuned CLIP Models are Efficient Few-Shot Learners
di: Liu, Mushui, et al.
Pubblicazione: (2024)
di: Liu, Mushui, et al.
Pubblicazione: (2024)
LP++: A Surprisingly Strong Linear Probe for Few-Shot CLIP
di: Huang, Yunshi, et al.
Pubblicazione: (2024)
di: Huang, Yunshi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PiClick: Picking the desired mask from multiple candidates in click-based interactive segmentation
di: Yan, Cilin, et al.
Pubblicazione: (2023) -
VISA: Reasoning Video Object Segmentation via Large Language Models
di: Yan, Cilin, et al.
Pubblicazione: (2024) -
Object-centric Video Question Answering with Visual Grounding and Referring
di: Wang, Haochen, et al.
Pubblicazione: (2025) -
LTCA: Long-range Temporal Context Attention for Referring Video Object Segmentation
di: Yan, Cilin, et al.
Pubblicazione: (2025) -
ReCLIP++: Learn to Rectify the Bias of CLIP for Unsupervised Semantic Segmentation
di: Wang, Jingyun, et al.
Pubblicazione: (2024)