Guardado en:
| Autores principales: | Roman, Claire, Meyer, Philippe |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2603.06180 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Self-Supervised Visual Preference Alignment
por: Zhu, Ke, et al.
Publicado: (2024)
por: Zhu, Ke, et al.
Publicado: (2024)
Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs
por: Pan, Zhiyu, et al.
Publicado: (2026)
por: Pan, Zhiyu, et al.
Publicado: (2026)
Similarity-Dissimilarity Loss for Multi-label Supervised Contrastive Learning
por: Huang, Guangming, et al.
Publicado: (2024)
por: Huang, Guangming, et al.
Publicado: (2024)
Mitigating Object and Action Hallucinations in Multimodal LLMs via Self-Augmented Contrastive Alignment
por: Chang, Kai-Po, et al.
Publicado: (2025)
por: Chang, Kai-Po, et al.
Publicado: (2025)
Impact of Noisy Supervision in Foundation Model Learning
por: Chen, Hao, et al.
Publicado: (2024)
por: Chen, Hao, et al.
Publicado: (2024)
Prompt-Driven Contrastive Learning for Transferable Adversarial Attacks
por: Yang, Hunmin, et al.
Publicado: (2024)
por: Yang, Hunmin, et al.
Publicado: (2024)
Contrastive Learning Is Spectral Clustering On Similarity Graph
por: Tan, Zhiquan, et al.
Publicado: (2023)
por: Tan, Zhiquan, et al.
Publicado: (2023)
SEASON: Mitigating Temporal Hallucination in Video Large Language Models via Self-Diagnostic Contrastive Decoding
por: Wu, Chang-Hsun, et al.
Publicado: (2025)
por: Wu, Chang-Hsun, et al.
Publicado: (2025)
Advancing Multimodal Reasoning: From Optimized Cold Start to Staged Reinforcement Learning
por: Chen, Shuang, et al.
Publicado: (2025)
por: Chen, Shuang, et al.
Publicado: (2025)
Finding Distributed Object-Centric Properties in Self-Supervised Transformers
por: Rawlekar, Samyak, et al.
Publicado: (2026)
por: Rawlekar, Samyak, et al.
Publicado: (2026)
Contrasting with Symile: Simple Model-Agnostic Representation Learning for Unlimited Modalities
por: Saporta, Adriel, et al.
Publicado: (2024)
por: Saporta, Adriel, et al.
Publicado: (2024)
Do Vision and Language Encoders Represent the World Similarly?
por: Maniparambil, Mayug, et al.
Publicado: (2024)
por: Maniparambil, Mayug, et al.
Publicado: (2024)
Tracing Representation Progression: Analyzing and Enhancing Layer-Wise Similarity
por: Jiang, Jiachen, et al.
Publicado: (2024)
por: Jiang, Jiachen, et al.
Publicado: (2024)
Symmetrical Visual Contrastive Optimization: Aligning Vision-Language Models with Minimal Contrastive Images
por: Wu, Shengguang, et al.
Publicado: (2025)
por: Wu, Shengguang, et al.
Publicado: (2025)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
por: Lan, Zhibin, et al.
Publicado: (2025)
por: Lan, Zhibin, et al.
Publicado: (2025)
DOCCI: Descriptions of Connected and Contrasting Images
por: Onoe, Yasumasa, et al.
Publicado: (2024)
por: Onoe, Yasumasa, et al.
Publicado: (2024)
VCM: Vision Concept Modeling Based on Implicit Contrastive Learning with Vision-Language Instruction Fine-Tuning
por: Luo, Run, et al.
Publicado: (2025)
por: Luo, Run, et al.
Publicado: (2025)
Masking Improves Contrastive Self-Supervised Learning for ConvNets, and Saliency Tells You Where
por: Chin, Zhi-Yi, et al.
Publicado: (2023)
por: Chin, Zhi-Yi, et al.
Publicado: (2023)
On the Effectiveness of Supervision in Asymmetric Non-Contrastive Learning
por: Oh, Jeongheon, et al.
Publicado: (2024)
por: Oh, Jeongheon, et al.
Publicado: (2024)
Modeling Caption Diversity in Contrastive Vision-Language Pretraining
por: Lavoie, Samuel, et al.
Publicado: (2024)
por: Lavoie, Samuel, et al.
Publicado: (2024)
Continual SFT Matches Multimodal RLHF with Negative Supervision
por: Zhu, Ke, et al.
Publicado: (2024)
por: Zhu, Ke, et al.
Publicado: (2024)
Feedback-Driven Vision-Language Alignment with Minimal Human Supervision
por: Giannone, Giorgio, et al.
Publicado: (2025)
por: Giannone, Giorgio, et al.
Publicado: (2025)
Rerouting Connection: Hybrid Computer Vision Analysis Reveals Visual Similarity Between Indus and Tibetan-Yi Corridor Writing Systems
por: Reddy, Ooha Lakkadi
Publicado: (2025)
por: Reddy, Ooha Lakkadi
Publicado: (2025)
VLCD: Vision-Language Contrastive Distillation for Accurate and Efficient Automatic Placenta Analysis
por: Mehta, Manas, et al.
Publicado: (2025)
por: Mehta, Manas, et al.
Publicado: (2025)
Contrastive Region Guidance: Improving Grounding in Vision-Language Models without Training
por: Wan, David, et al.
Publicado: (2024)
por: Wan, David, et al.
Publicado: (2024)
Contrastive Visual Data Augmentation
por: Zhou, Yu, et al.
Publicado: (2025)
por: Zhou, Yu, et al.
Publicado: (2025)
Machine Unlearning in Hyperbolic vs. Euclidean Multimodal Contrastive Learning: Adapting Alignment Calibration to MERU
por: Vidal, Àlex Pujol, et al.
Publicado: (2025)
por: Vidal, Àlex Pujol, et al.
Publicado: (2025)
Vision-OPD: Learning to See Fine Details for Multimodal LLMs via On-Policy Self-Distillation
por: Yuan, Qianhao, et al.
Publicado: (2026)
por: Yuan, Qianhao, et al.
Publicado: (2026)
Metis-SPECS: Decoupling Multimodal Learning via Self-distilled Preference-based Cold Start
por: Chen, Kun, et al.
Publicado: (2025)
por: Chen, Kun, et al.
Publicado: (2025)
Naturally Supervised 3D Visual Grounding with Language-Regularized Concept Learners
por: Feng, Chun, et al.
Publicado: (2024)
por: Feng, Chun, et al.
Publicado: (2024)
Efficient Contrastive Decoding with Probabilistic Hallucination Detection - Mitigating Hallucinations in Large Vision Language Models -
por: Fieback, Laura, et al.
Publicado: (2025)
por: Fieback, Laura, et al.
Publicado: (2025)
SimO Loss: Anchor-Free Contrastive Loss for Fine-Grained Supervised Contrastive Learning
por: Bouhsine, Taha, et al.
Publicado: (2024)
por: Bouhsine, Taha, et al.
Publicado: (2024)
MultiIoT: Benchmarking Machine Learning for the Internet of Things
por: Mo, Shentong, et al.
Publicado: (2023)
por: Mo, Shentong, et al.
Publicado: (2023)
Understanding and Mitigating Human-Labelling Errors in Supervised Contrastive Learning
por: Long, Zijun, et al.
Publicado: (2024)
por: Long, Zijun, et al.
Publicado: (2024)
HiT-JEPA: A Hierarchical Self-supervised Trajectory Embedding Framework for Similarity Computation
por: Li, Lihuan, et al.
Publicado: (2025)
por: Li, Lihuan, et al.
Publicado: (2025)
Self-Supervised Learning of Color Constancy
por: Ernst, Markus R., et al.
Publicado: (2024)
por: Ernst, Markus R., et al.
Publicado: (2024)
Blockwise Self-Supervised Learning at Scale
por: Siddiqui, Shoaib Ahmed, et al.
Publicado: (2023)
por: Siddiqui, Shoaib Ahmed, et al.
Publicado: (2023)
Benchmarking Robustness of Contrastive Learning Models for Medical Image-Report Retrieval
por: Deanda, Demetrio, et al.
Publicado: (2025)
por: Deanda, Demetrio, et al.
Publicado: (2025)
What to align in multimodal contrastive learning?
por: Dufumier, Benoit, et al.
Publicado: (2024)
por: Dufumier, Benoit, et al.
Publicado: (2024)
A Primal-Dual Framework for Transformers and Neural Networks
por: Nguyen, Tan M., et al.
Publicado: (2024)
por: Nguyen, Tan M., et al.
Publicado: (2024)
Ejemplares similares
-
Self-Supervised Visual Preference Alignment
por: Zhu, Ke, et al.
Publicado: (2024) -
Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs
por: Pan, Zhiyu, et al.
Publicado: (2026) -
Similarity-Dissimilarity Loss for Multi-label Supervised Contrastive Learning
por: Huang, Guangming, et al.
Publicado: (2024) -
Mitigating Object and Action Hallucinations in Multimodal LLMs via Self-Augmented Contrastive Alignment
por: Chang, Kai-Po, et al.
Publicado: (2025) -
Impact of Noisy Supervision in Foundation Model Learning
por: Chen, Hao, et al.
Publicado: (2024)