Ranked from Within: Ranking Large Multimodal Models Without Labels
Fuente:
arXiv
Saved in:
| Main Authors: | Tu, Weijie, Deng, Weijian, Campbell, Dylan, Yao, Yu, Zheng, Jiyang, Gedeon, Tom, Liu, Tongliang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
What Does Softmax Probability Tell Us about Classifiers Ranking Across Diverse Test Conditions?
by: Tu, Weijie, et al.
Published: (2024)
by: Tu, Weijie, et al.
Published: (2024)
Toward a Holistic Evaluation of Robustness in CLIP Models
by: Tu, Weijie, et al.
Published: (2024)
by: Tu, Weijie, et al.
Published: (2024)
An Empirical Study Into What Matters for Calibrating Vision-Language Models
by: Tu, Weijie, et al.
Published: (2024)
by: Tu, Weijie, et al.
Published: (2024)
A Closer Look at the Robustness of Contrastive Language-Image Pre-Training (CLIP)
by: Tu, Weijie, et al.
Published: (2024)
by: Tu, Weijie, et al.
Published: (2024)
Confidence and Dispersity as Signals: Unsupervised Model Evaluation and Ranking
by: Deng, Weijian, et al.
Published: (2025)
by: Deng, Weijian, et al.
Published: (2025)
When Preference Labels Fall Short: Aligning Diffusion Models from Real Data
by: Chen, Weiyan, et al.
Published: (2026)
by: Chen, Weiyan, et al.
Published: (2026)
RefRef: A Synthetic Dataset and Benchmark for Reconstructing Refractive and Reflective Objects
by: Yin, Yue, et al.
Published: (2025)
by: Yin, Yue, et al.
Published: (2025)
Multimodal Label Relevance Ranking via Reinforcement Learning
by: Guo, Taian, et al.
Published: (2024)
by: Guo, Taian, et al.
Published: (2024)
Self-Calibrating BCIs: Ranking and Recovery of Mental Targets Without Labels
by: Grizou, Jonathan, et al.
Published: (2025)
by: Grizou, Jonathan, et al.
Published: (2025)
Bipartite Mode Matching for Vision Training Set Search from a Hierarchical Data Server
by: Yao, Yue, et al.
Published: (2026)
by: Yao, Yue, et al.
Published: (2026)
Beyond Optimal Transport: Model-Aligned Coupling for Flow Matching
by: Lin, Yexiong, et al.
Published: (2025)
by: Lin, Yexiong, et al.
Published: (2025)
Machine Vision Therapy: Multimodal Large Language Models Can Enhance Visual Robustness via Denoising In-Context Learning
by: Huang, Zhuo, et al.
Published: (2023)
by: Huang, Zhuo, et al.
Published: (2023)
Ranking Distillation for Open-Ended Video Question Answering with Insufficient Labels
by: Liang, Tianming, et al.
Published: (2024)
by: Liang, Tianming, et al.
Published: (2024)
MokA: Multimodal Low-Rank Adaptation for MLLMs
by: Wei, Yake, et al.
Published: (2025)
by: Wei, Yake, et al.
Published: (2025)
LMOD: A Large Multimodal Ophthalmology Dataset and Benchmark for Large Vision-Language Models
by: Qin, Zhenyue, et al.
Published: (2024)
by: Qin, Zhenyue, et al.
Published: (2024)
Combating Noisy Labels through Fostering Self- and Neighbor-Consistency
by: Sun, Zeren, et al.
Published: (2026)
by: Sun, Zeren, et al.
Published: (2026)
UniNote: A Unified Embedding Model for Multimodal Representation and Ranking
by: Zhao, Jinghan, et al.
Published: (2026)
by: Zhao, Jinghan, et al.
Published: (2026)
LightHarmony3D: Harmonizing Illumination and Shadows for Object Insertion in 3D Gaussian Splatting
by: Huang, Tianyu, et al.
Published: (2026)
by: Huang, Tianyu, et al.
Published: (2026)
MRAC Track 1: 2nd Workshop on Multimodal, Generative and Responsible Affective Computing
by: Ghosh, Shreya, et al.
Published: (2024)
by: Ghosh, Shreya, et al.
Published: (2024)
Low-Rank Knowledge Decomposition for Medical Foundation Models
by: Zhou, Yuhang, et al.
Published: (2024)
by: Zhou, Yuhang, et al.
Published: (2024)
A Flow Model with Low-Rank Transformers for Incomplete Multimodal Survival Analysis
by: Yin, Yi, et al.
Published: (2025)
by: Yin, Yi, et al.
Published: (2025)
Conformal Prediction for Deep Classifier via Label Ranking
by: Huang, Jianguo, et al.
Published: (2023)
by: Huang, Jianguo, et al.
Published: (2023)
Beyond Low-Rank Tuning: Model Prior-Guided Rank Allocation for Effective Transfer in Low-Data and Large-Gap Regimes
by: Zhang, Chuyan, et al.
Published: (2025)
by: Zhang, Chuyan, et al.
Published: (2025)
Data-Centric Benchmark for Label Noise Estimation and Ranking in Remote Sensing Image Segmentation
by: Nogueira, Keiller, et al.
Published: (2026)
by: Nogueira, Keiller, et al.
Published: (2026)
Efficient Dataset Distillation through Low-Rank Space Sampling
by: Kong, Hangyang, et al.
Published: (2025)
by: Kong, Hangyang, et al.
Published: (2025)
Low-Rank Interconnected Adaptation across Layers
by: Zhong, Yibo, et al.
Published: (2024)
by: Zhong, Yibo, et al.
Published: (2024)
Collaborative Low-Rank Adaptation for Pre-Trained Vision Transformers
by: Liu, Zheng, et al.
Published: (2025)
by: Liu, Zheng, et al.
Published: (2025)
VRSA: Jailbreaking Multimodal Large Language Models through Visual Reasoning Sequential Attack
by: Zhao, Shiji, et al.
Published: (2025)
by: Zhao, Shiji, et al.
Published: (2025)
Diffusion Low Rank Hybrid Reconstruction for Sparse View Medical Imaging
by: Deng, Zongyin, et al.
Published: (2025)
by: Deng, Zongyin, et al.
Published: (2025)
Top-K Pairwise Ranking: Bridging the Gap Among Ranking-Based Measures for Multi-Label Classification
by: Wang, Zitai, et al.
Published: (2024)
by: Wang, Zitai, et al.
Published: (2024)
Visual Prompting in LLMs for Enhancing Emotion Recognition
by: Zhang, Qixuan, et al.
Published: (2024)
by: Zhang, Qixuan, et al.
Published: (2024)
Gems: Group Emotion Profiling Through Multimodal Situational Understanding
by: Kataria, Anubhav, et al.
Published: (2025)
by: Kataria, Anubhav, et al.
Published: (2025)
Negative Label Guided OOD Detection with Pretrained Vision-Language Models
by: Jiang, Xue, et al.
Published: (2024)
by: Jiang, Xue, et al.
Published: (2024)
Taylor Videos for Action Recognition
by: Wang, Lei, et al.
Published: (2024)
by: Wang, Lei, et al.
Published: (2024)
MLLM-For3D: Adapting Multimodal Large Language Model for 3D Reasoning Segmentation
by: Huang, Jiaxin, et al.
Published: (2025)
by: Huang, Jiaxin, et al.
Published: (2025)
Rank-based No-reference Quality Assessment for Face Swapping
by: Zhou, Xinghui, et al.
Published: (2024)
by: Zhou, Xinghui, et al.
Published: (2024)
Task-Aware Low-Rank Adaptation of Segment Anything Model
by: Wang, Xuehao, et al.
Published: (2024)
by: Wang, Xuehao, et al.
Published: (2024)
LMOD+: A Comprehensive Multimodal Dataset and Benchmark for Developing and Evaluating Multimodal Large Language Models in Ophthalmology
by: Qin, Zhenyue, et al.
Published: (2025)
by: Qin, Zhenyue, et al.
Published: (2025)
MARS: a Multimodal Alignment and Ranking System for Few-Shot Segmentation
by: Catalano, Nico, et al.
Published: (2025)
by: Catalano, Nico, et al.
Published: (2025)
LoRA-Composer: Leveraging Low-Rank Adaptation for Multi-Concept Customization in Training-Free Diffusion Models
by: Yang, Yang, et al.
Published: (2024)
by: Yang, Yang, et al.
Published: (2024)
Similar Items
-
What Does Softmax Probability Tell Us about Classifiers Ranking Across Diverse Test Conditions?
by: Tu, Weijie, et al.
Published: (2024) -
Toward a Holistic Evaluation of Robustness in CLIP Models
by: Tu, Weijie, et al.
Published: (2024) -
An Empirical Study Into What Matters for Calibrating Vision-Language Models
by: Tu, Weijie, et al.
Published: (2024) -
A Closer Look at the Robustness of Contrastive Language-Image Pre-Training (CLIP)
by: Tu, Weijie, et al.
Published: (2024) -
Confidence and Dispersity as Signals: Unsupervised Model Evaluation and Ranking
by: Deng, Weijian, et al.
Published: (2025)