Non-Contrastive Vision-Language Learning with Predictive Embedding Alignment
Fuente:
arXiv
Guardado en:
| Autores principales: | Kuhn, Lukas, Serra, Giuseppe, Buettner, Florian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LVLM-Aided Alignment of Task-Specific Vision Models
por: Koebler, Alexander, et al.
Publicado: (2025)
por: Koebler, Alexander, et al.
Publicado: (2025)
A Multimodal Recaptioning Framework to Account for Perceptual Diversity Across Languages in Vision-Language Modeling
por: Buettner, Kyle, et al.
Publicado: (2025)
por: Buettner, Kyle, et al.
Publicado: (2025)
FALCON: False-Negative Aware Learning of Contrastive Negatives in Vision-Language Alignment
por: Kim, Myunsoo, et al.
Publicado: (2025)
por: Kim, Myunsoo, et al.
Publicado: (2025)
Time Series, Vision, and Language: Exploring the Limits of Alignment in Contrastive Representation Spaces
por: Yashwante, Pratham, et al.
Publicado: (2026)
por: Yashwante, Pratham, et al.
Publicado: (2026)
Topological Alignment of Shared Vision-Language Embedding Space
por: You, Junwon, et al.
Publicado: (2025)
por: You, Junwon, et al.
Publicado: (2025)
Quantifying the Gaps Between Translation and Native Perception in Training for Multimodal, Multilingual Retrieval
por: Buettner, Kyle, et al.
Publicado: (2024)
por: Buettner, Kyle, et al.
Publicado: (2024)
Grasping Partially Occluded Objects Using Autoencoder-Based Point Cloud Inpainting
por: Koebler, Alexander, et al.
Publicado: (2025)
por: Koebler, Alexander, et al.
Publicado: (2025)
Learning to Look: Cognitive Attention Alignment with Vision-Language Models
por: Yang, Ryan L., et al.
Publicado: (2025)
por: Yang, Ryan L., et al.
Publicado: (2025)
Enhance Vision-Language Alignment with Noise
por: Huang, Sida, et al.
Publicado: (2024)
por: Huang, Sida, et al.
Publicado: (2024)
Safety Alignment for Vision Language Models
por: Liu, Zhendong, et al.
Publicado: (2024)
por: Liu, Zhendong, et al.
Publicado: (2024)
Vision-Core Guided Contrastive Learning for Balanced Multi-modal Prognosis Prediction of Stroke
por: Chen, Liren, et al.
Publicado: (2026)
por: Chen, Liren, et al.
Publicado: (2026)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
por: Lan, Zhibin, et al.
Publicado: (2025)
por: Lan, Zhibin, et al.
Publicado: (2025)
When Language Overwrites Vision: Over-Alignment and Geometric Debiasing in Vision-Language Models
por: Saini, Harshvardhan, et al.
Publicado: (2026)
por: Saini, Harshvardhan, et al.
Publicado: (2026)
Improved Object-Centric Diffusion Learning with Registers and Contrastive Alignment
por: Nguyen, Bac, et al.
Publicado: (2026)
por: Nguyen, Bac, et al.
Publicado: (2026)
Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning
por: Zhan, Yufei, et al.
Publicado: (2025)
por: Zhan, Yufei, et al.
Publicado: (2025)
REVEAL: Multimodal Vision-Language Alignment of Retinal Morphometry and Clinical Risks for Incident AD and Dementia Prediction
por: Leem, Seowung, et al.
Publicado: (2026)
por: Leem, Seowung, et al.
Publicado: (2026)
Ego: Embedding-Guided Personalization of Vision-Language Models
por: Seifi, Soroush, et al.
Publicado: (2026)
por: Seifi, Soroush, et al.
Publicado: (2026)
SLIP: Structural-aware Language-Image Pretraining for Vision-Language Alignment
por: Lu, Wenbo
Publicado: (2025)
por: Lu, Wenbo
Publicado: (2025)
Bayesian Gated Non-Negative Contrastive Learning
por: Cui, Peng, et al.
Publicado: (2026)
por: Cui, Peng, et al.
Publicado: (2026)
No Filter: Cultural and Socioeconomic Diversity in Contrastive Vision-Language Models
por: Pouget, Angéline, et al.
Publicado: (2024)
por: Pouget, Angéline, et al.
Publicado: (2024)
Hyperbolic Contrastive Learning for Hierarchical 3D Point Cloud Embedding
por: Liu, Yingjie, et al.
Publicado: (2025)
por: Liu, Yingjie, et al.
Publicado: (2025)
Semantic Compositions Enhance Vision-Language Contrastive Learning
por: Aladago, Maxwell, et al.
Publicado: (2024)
por: Aladago, Maxwell, et al.
Publicado: (2024)
Object-centric Binding in Contrastive Language-Image Pretraining
por: Assouel, Rim, et al.
Publicado: (2025)
por: Assouel, Rim, et al.
Publicado: (2025)
Subspace Alignment for Vision-Language Model Test-time Adaptation
por: Zeng, Zhichen, et al.
Publicado: (2026)
por: Zeng, Zhichen, et al.
Publicado: (2026)
Information-Theoretic Constraints for Continual Vision-Language-Action Alignment
por: Zhao, Libang, et al.
Publicado: (2026)
por: Zhao, Libang, et al.
Publicado: (2026)
Token-Level Inference-Time Alignment for Vision-Language Models
por: Chen, Kejia, et al.
Publicado: (2025)
por: Chen, Kejia, et al.
Publicado: (2025)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
por: Zhang, Zhifang, et al.
Publicado: (2024)
por: Zhang, Zhifang, et al.
Publicado: (2024)
Learning User Embeddings from Human Gaze for Personalised Saliency Prediction
por: Strohm, Florian, et al.
Publicado: (2024)
por: Strohm, Florian, et al.
Publicado: (2024)
BASIC: Boosting Visual Alignment with Intrinsic Refined Embeddings in Multimodal Large Language Models
por: Tang, Jianting, et al.
Publicado: (2025)
por: Tang, Jianting, et al.
Publicado: (2025)
Positive-Augmented Contrastive Learning for Vision-and-Language Evaluation and Training
por: Sarto, Sara, et al.
Publicado: (2024)
por: Sarto, Sara, et al.
Publicado: (2024)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
por: Wang, Chenhao, et al.
Publicado: (2026)
por: Wang, Chenhao, et al.
Publicado: (2026)
TagAlign: Improving Vision-Language Alignment with Multi-Tag Classification
por: Liu, Qinying, et al.
Publicado: (2023)
por: Liu, Qinying, et al.
Publicado: (2023)
Enhancing Medical Large Vision-Language Models via Alignment Distillation
por: Chang, Aofei, et al.
Publicado: (2025)
por: Chang, Aofei, et al.
Publicado: (2025)
CLAY: Conditional Visual Similarity Modulation in Vision-Language Embedding Space
por: Lim, Sohwi, et al.
Publicado: (2026)
por: Lim, Sohwi, et al.
Publicado: (2026)
HarmoCLIP: Harmonizing Global and Regional Representations in Contrastive Vision-Language Models
por: Zeng, Haoxi, et al.
Publicado: (2025)
por: Zeng, Haoxi, et al.
Publicado: (2025)
COST: Contrastive One-Stage Transformer for Vision-Language Small Object Tracking
por: Zhang, Chunhui, et al.
Publicado: (2025)
por: Zhang, Chunhui, et al.
Publicado: (2025)
HiPath: Hierarchical Vision-Language Alignment for Structured Pathology Report Prediction
por: Yuan, Ruicheng, et al.
Publicado: (2026)
por: Yuan, Ruicheng, et al.
Publicado: (2026)
Vision-Based Neurosurgical Guidance: Unsupervised Localization and Camera-Pose Prediction
por: Sarwin, Gary, et al.
Publicado: (2024)
por: Sarwin, Gary, et al.
Publicado: (2024)
PictSure: Pretraining Embeddings Matters for In-Context Learning Image Classifiers
por: Schiesser, Lukas, et al.
Publicado: (2025)
por: Schiesser, Lukas, et al.
Publicado: (2025)
When Alignment Fails: Multimodal Adversarial Attacks on Vision-Language-Action Models
por: Yan, Yuping, et al.
Publicado: (2025)
por: Yan, Yuping, et al.
Publicado: (2025)
Ejemplares similares
-
LVLM-Aided Alignment of Task-Specific Vision Models
por: Koebler, Alexander, et al.
Publicado: (2025) -
A Multimodal Recaptioning Framework to Account for Perceptual Diversity Across Languages in Vision-Language Modeling
por: Buettner, Kyle, et al.
Publicado: (2025) -
FALCON: False-Negative Aware Learning of Contrastive Negatives in Vision-Language Alignment
por: Kim, Myunsoo, et al.
Publicado: (2025) -
Time Series, Vision, and Language: Exploring the Limits of Alignment in Contrastive Representation Spaces
por: Yashwante, Pratham, et al.
Publicado: (2026) -
Topological Alignment of Shared Vision-Language Embedding Space
por: You, Junwon, et al.
Publicado: (2025)