Beyond the Seen: Bounded Distribution Estimation for Open-Vocabulary Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Fan, Xiaomeng, Mao, Yuchuan, Gao, Zhi, Wu, Yuwei, Chen, Jin, Jia, Yunde |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Curvature Learning for Generalization of Hyperbolic Neural Networks
di: Fan, Xiaomeng, et al.
Pubblicazione: (2025)
di: Fan, Xiaomeng, et al.
Pubblicazione: (2025)
Large-Scale Riemannian Meta-Optimization via Subspace Adaptation
di: Yu, Peilin, et al.
Pubblicazione: (2025)
di: Yu, Peilin, et al.
Pubblicazione: (2025)
Adaptive Model Ensemble for Continual Learning
di: Mao, Yuchuan, et al.
Pubblicazione: (2025)
di: Mao, Yuchuan, et al.
Pubblicazione: (2025)
Modality Alignment across Trees on Heterogeneous Hyperbolic Manifolds
di: Wu, Wei, et al.
Pubblicazione: (2025)
di: Wu, Wei, et al.
Pubblicazione: (2025)
A Set-to-Set Distance Measure in Hyperbolic Space
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
Hyperbolic Dual Feature Augmentation for Open-Environment
di: Yu, Peilin, et al.
Pubblicazione: (2025)
di: Yu, Peilin, et al.
Pubblicazione: (2025)
Geometry-aware Distance Measure for Diverse Hierarchical Structures in Hyperbolic Spaces
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
TV100: A TV Series Dataset that Pre-Trained CLIP Has Not Seen
di: Zhou, Da-Wei, et al.
Pubblicazione: (2024)
di: Zhou, Da-Wei, et al.
Pubblicazione: (2024)
Anytime Continual Learning for Open Vocabulary Classification
di: Zhu, Zhen, et al.
Pubblicazione: (2024)
di: Zhu, Zhen, et al.
Pubblicazione: (2024)
Escaping the SpuriVerse: Can Large Vision-Language Models Generalize Beyond Seen Spurious Correlations?
di: Yang, Yiwei, et al.
Pubblicazione: (2025)
di: Yang, Yiwei, et al.
Pubblicazione: (2025)
Multi-Label Stereo Matching for Transparent Scene Depth Estimation
di: Liu, Zhidan, et al.
Pubblicazione: (2025)
di: Liu, Zhidan, et al.
Pubblicazione: (2025)
Exploring Simple Open-Vocabulary Semantic Segmentation
di: Lai, Zihang
Pubblicazione: (2024)
di: Lai, Zihang
Pubblicazione: (2024)
OVGaussian: Generalizable 3D Gaussian Segmentation with Open Vocabularies
di: Chen, Runnan, et al.
Pubblicazione: (2024)
di: Chen, Runnan, et al.
Pubblicazione: (2024)
LMSeg: Unleashing the Power of Large-Scale Models for Open-Vocabulary Semantic Segmentation
di: Tang, Huadong, et al.
Pubblicazione: (2024)
di: Tang, Huadong, et al.
Pubblicazione: (2024)
Seen-to-Scene: Keep the Seen, Generate the Unseen for Video Outpainting
di: Jeon, Inseok, et al.
Pubblicazione: (2026)
di: Jeon, Inseok, et al.
Pubblicazione: (2026)
Closed-Loop Open-Vocabulary Mobile Manipulation with GPT-4V
di: Zhi, Peiyuan, et al.
Pubblicazione: (2024)
di: Zhi, Peiyuan, et al.
Pubblicazione: (2024)
Plug-in Feedback Self-adaptive Attention in CLIP for Training-free Open-Vocabulary Segmentation
di: Chi, Zhixiang, et al.
Pubblicazione: (2025)
di: Chi, Zhixiang, et al.
Pubblicazione: (2025)
Temporally Consistent Stereo Matching
di: Zeng, Jiaxi, et al.
Pubblicazione: (2024)
di: Zeng, Jiaxi, et al.
Pubblicazione: (2024)
Differential-Integral Neural Operator for Long-Term Turbulence Forecasting
di: Wu, Hao, et al.
Pubblicazione: (2025)
di: Wu, Hao, et al.
Pubblicazione: (2025)
Consistency of Compositional Generalization across Multiple Levels
di: Li, Chuanhao, et al.
Pubblicazione: (2024)
di: Li, Chuanhao, et al.
Pubblicazione: (2024)
3D Visual Illusion Depth Estimation
di: Yao, Chengtang, et al.
Pubblicazione: (2025)
di: Yao, Chengtang, et al.
Pubblicazione: (2025)
Lightweight Modular Parameter-Efficient Tuning for Open-Vocabulary Object Detection
di: Faye, Bilal, et al.
Pubblicazione: (2024)
di: Faye, Bilal, et al.
Pubblicazione: (2024)
Missing Fine Details in Images: Last Seen in High Frequencies
di: Medi, Tejaswini, et al.
Pubblicazione: (2025)
di: Medi, Tejaswini, et al.
Pubblicazione: (2025)
COVTrack++: Learning Open-Vocabulary Multi-Object Tracking from Continuous Videos via a Synergistic Paradigm
di: Qian, Zekun, et al.
Pubblicazione: (2026)
di: Qian, Zekun, et al.
Pubblicazione: (2026)
DitHub: A Modular Framework for Incremental Open-Vocabulary Object Detection
di: Cappellino, Chiara, et al.
Pubblicazione: (2025)
di: Cappellino, Chiara, et al.
Pubblicazione: (2025)
The MixCount Dataset: Bridging the Data Gap for Open-Vocabulary Object Counting
di: Dumery, Corentin, et al.
Pubblicazione: (2026)
di: Dumery, Corentin, et al.
Pubblicazione: (2026)
FROSTER: Frozen CLIP Is A Strong Teacher for Open-Vocabulary Action Recognition
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
Structure-aware Prompt Adaptation from Seen to Unseen for Open-Vocabulary Compositional Zero-Shot Learning
di: Duan, Yihang, et al.
Pubblicazione: (2026)
di: Duan, Yihang, et al.
Pubblicazione: (2026)
Facial Expression Generation Aligned with Human Preference for Natural Dyadic Interaction
di: Chen, Xu, et al.
Pubblicazione: (2026)
di: Chen, Xu, et al.
Pubblicazione: (2026)
Fine-Grained 3D Facial Reconstruction for Micro-Expressions
di: Sun, Che, et al.
Pubblicazione: (2026)
di: Sun, Che, et al.
Pubblicazione: (2026)
Injecting Distributional Awareness into MLLMs via Reinforcement Learning for Deep Imbalanced Regression
di: Du, Yao, et al.
Pubblicazione: (2026)
di: Du, Yao, et al.
Pubblicazione: (2026)
Open Vocabulary Compositional Explanations for Neuron Alignment
di: La Rosa, Biagio, et al.
Pubblicazione: (2025)
di: La Rosa, Biagio, et al.
Pubblicazione: (2025)
Efficient Multi-turn RL for GUI Agents via Decoupled Training and Adaptive Data Curation
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
FOR: Finetuning for Object Level Open Vocabulary Image Retrieval
di: Levi, Hila, et al.
Pubblicazione: (2024)
di: Levi, Hila, et al.
Pubblicazione: (2024)
O3SLM: Open Weight, Open Data, and Open Vocabulary Sketch-Language Model
di: Gupta, Rishi, et al.
Pubblicazione: (2025)
di: Gupta, Rishi, et al.
Pubblicazione: (2025)
GeoPurify: A Data-Efficient Geometric Distillation Framework for Open-Vocabulary 3D Segmentation
di: Dou, Weijia, et al.
Pubblicazione: (2025)
di: Dou, Weijia, et al.
Pubblicazione: (2025)
Composition-Incremental Learning for Compositional Generalization
di: Li, Zhen, et al.
Pubblicazione: (2025)
di: Li, Zhen, et al.
Pubblicazione: (2025)
Do Open-Vocabulary Detectors Transfer to Aerial Imagery? A Comparative Evaluation
di: Tsourveloudis, Christos
Pubblicazione: (2026)
di: Tsourveloudis, Christos
Pubblicazione: (2026)
PRISM-0: A Predicate-Rich Scene Graph Generation Framework for Zero-Shot Open-Vocabulary Tasks
di: Elskhawy, Abdelrahman, et al.
Pubblicazione: (2025)
di: Elskhawy, Abdelrahman, et al.
Pubblicazione: (2025)
OV-HHIR: Open Vocabulary Human Interaction Recognition Using Cross-modal Integration of Large Language Models
di: Ray, Lala Shakti Swarup, et al.
Pubblicazione: (2024)
di: Ray, Lala Shakti Swarup, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Curvature Learning for Generalization of Hyperbolic Neural Networks
di: Fan, Xiaomeng, et al.
Pubblicazione: (2025) -
Large-Scale Riemannian Meta-Optimization via Subspace Adaptation
di: Yu, Peilin, et al.
Pubblicazione: (2025) -
Adaptive Model Ensemble for Continual Learning
di: Mao, Yuchuan, et al.
Pubblicazione: (2025) -
Modality Alignment across Trees on Heterogeneous Hyperbolic Manifolds
di: Wu, Wei, et al.
Pubblicazione: (2025) -
A Set-to-Set Distance Measure in Hyperbolic Space
di: Li, Pengxiang, et al.
Pubblicazione: (2025)