Multimodal Learning on Low-Quality Data with Conformal Predictive Self-Calibration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Xun, Gu, Yufan, Hu, Disen, Hou, Yuqing, Yao, Yazhou, Shen, Fumin, Shen, Heng Tao, Xu, Xing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dual Dynamic Threshold Adjustment Strategy for Deep Metric Learning
par: Jiang, Xiruo, et autres
Publié: (2024)
par: Jiang, Xiruo, et autres
Publié: (2024)
Truth in the Few: High-Value Data Selection for Efficient Multi-Modal Reasoning
par: Li, Shenshen, et autres
Publié: (2025)
par: Li, Shenshen, et autres
Publié: (2025)
CM$^3$: Calibrating Multimodal Recommendation
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models
par: Xu, Siyuan, et autres
Publié: (2026)
par: Xu, Siyuan, et autres
Publié: (2026)
Efficient Token Compression for Vision Transformer with Spatial Information Preserved
par: Mao, Junzhu, et autres
Publié: (2025)
par: Mao, Junzhu, et autres
Publié: (2025)
Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
par: Liu, Xinwei, et autres
Publié: (2024)
par: Liu, Xinwei, et autres
Publié: (2024)
A Light-weight Transformer-based Self-supervised Matching Network for Heterogeneous Images
par: Zhang, Wang, et autres
Publié: (2024)
par: Zhang, Wang, et autres
Publié: (2024)
Group Benefits Instances Selection for Data Purification
par: Cai, Zhenhuang, et autres
Publié: (2024)
par: Cai, Zhenhuang, et autres
Publié: (2024)
Domain-Skewed Federated Learning with Feature Decoupling and Calibration
par: Wang, Huan, et autres
Publié: (2026)
par: Wang, Huan, et autres
Publié: (2026)
Multimodal Fusion via Hypergraph Autoencoder and Contrastive Learning for Emotion Recognition in Conversation
par: Yi, Zijian, et autres
Publié: (2024)
par: Yi, Zijian, et autres
Publié: (2024)
RealBench: A Chinese Multi-image Understanding Benchmark Close to Real-world Scenarios
par: Zhao, Fei, et autres
Publié: (2025)
par: Zhao, Fei, et autres
Publié: (2025)
Balanced Multimodal Learning: An Unidirectional Dynamic Interaction Perspective
par: Wang, Shijie, et autres
Publié: (2025)
par: Wang, Shijie, et autres
Publié: (2025)
Universal Organizer of SAM for Unsupervised Semantic Segmentation
par: Li, Tingting, et autres
Publié: (2024)
par: Li, Tingting, et autres
Publié: (2024)
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
par: Gong, HongLin, et autres
Publié: (2024)
par: Gong, HongLin, et autres
Publié: (2024)
Modeling Human Responses to Multimodal AI Content
par: Shen, Zhiqi, et autres
Publié: (2025)
par: Shen, Zhiqi, et autres
Publié: (2025)
GalleryGPT: Analyzing Paintings with Large Multimodal Models
par: Bin, Yi, et autres
Publié: (2024)
par: Bin, Yi, et autres
Publié: (2024)
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2026)
par: Zhou, Qianrui, et autres
Publié: (2026)
Is One-Shot In-Context Learning Helpful for Data Selection in Task-Specific Fine-Tuning of Multimodal LLMs?
par: An, Xiao, et autres
Publié: (2026)
par: An, Xiao, et autres
Publié: (2026)
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
par: Wang, Tianshi, et autres
Publié: (2023)
par: Wang, Tianshi, et autres
Publié: (2023)
DPC-VQA: Decoupling Quality Perception and Residual Calibration for Video Quality Assessment
par: Li, Xinyue, et autres
Publié: (2026)
par: Li, Xinyue, et autres
Publié: (2026)
A Multimodal Transformer for Live Streaming Highlight Prediction
par: Deng, Jiaxin, et autres
Publié: (2024)
par: Deng, Jiaxin, et autres
Publié: (2024)
A Survey on Cross-Modal Interaction Between Music and Multimodal Data
par: Li, Sifei, et autres
Publié: (2025)
par: Li, Sifei, et autres
Publié: (2025)
Any2Any: Incomplete Multimodal Retrieval with Conformal Prediction
par: Li, Po-han, et autres
Publié: (2024)
par: Li, Po-han, et autres
Publié: (2024)
Semi-supervised Semantic Segmentation with Multi-Constraint Consistency Learning
par: Yin, Jianjian, et autres
Publié: (2025)
par: Yin, Jianjian, et autres
Publié: (2025)
Enhancing Multimodal Retrieval via Complementary Information Extraction and Alignment
par: Zeng, Delong, et autres
Publié: (2026)
par: Zeng, Delong, et autres
Publié: (2026)
Structure-Aware Residual-Center Representation for Self-Supervised Open-Set 3D Cross-Modal Retrieval
par: Xu, Yang, et autres
Publié: (2024)
par: Xu, Yang, et autres
Publié: (2024)
Predictive Sampling for Efficient Pairwise Subjective Image Quality Assessment
par: Mohammadi, Shima, et autres
Publié: (2023)
par: Mohammadi, Shima, et autres
Publié: (2023)
Learning Item Representations Directly from Multimodal Features for Effective Recommendation
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
Multimodal Pre-training Framework for Sequential Recommendation via Contrastive Learning
par: Zhang, Lingzi, et autres
Publié: (2023)
par: Zhang, Lingzi, et autres
Publié: (2023)
REAL: Realism Evaluation of Text-to-Image Generation Models for Effective Data Augmentation
par: Li, Ran, et autres
Publié: (2025)
par: Li, Ran, et autres
Publié: (2025)
Evaluating Multimodal Large Language Models on Spoken Sarcasm Understanding
par: Li, Zhu, et autres
Publié: (2025)
par: Li, Zhu, et autres
Publié: (2025)
Hyper-modal Imputation Diffusion Embedding with Dual-Distillation for Federated Multimodal Knowledge Graph Completion
par: Zhang, Ying, et autres
Publié: (2025)
par: Zhang, Ying, et autres
Publié: (2025)
Does Multimodality Improve Recommender Systems as Expected? A Critical Analysis and Future Directions
par: Zhou, Hongyu, et autres
Publié: (2025)
par: Zhou, Hongyu, et autres
Publié: (2025)
Angle-Optimized Partial Disentanglement for Multimodal Emotion Recognition in Conversation
par: Che, Xinyi, et autres
Publié: (2025)
par: Che, Xinyi, et autres
Publié: (2025)
Optimal Quality and Efficiency in Adaptive Live Streaming with JND-Aware Low latency Encoding
par: Menon, Vignesh V, et autres
Publié: (2024)
par: Menon, Vignesh V, et autres
Publié: (2024)
PSA-MF: Personality-Sentiment Aligned Multi-Level Fusion for Multimodal Sentiment Analysis
par: Xie, Heng, et autres
Publié: (2025)
par: Xie, Heng, et autres
Publié: (2025)
Leveraging Weak Cross-Modal Guidance for Coherence Modelling via Iterative Learning
par: Bin, Yi, et autres
Publié: (2024)
par: Bin, Yi, et autres
Publié: (2024)
Graph-based Interaction Augmentation Network for Robust Multimodal Sentiment Analysis
par: Zhangfeng, Hu, et autres
Publié: (2025)
par: Zhangfeng, Hu, et autres
Publié: (2025)
Adaptive Offloading and Enhancement for Low-Light Video Analytics on Mobile Devices
par: He, Yuanyi, et autres
Publié: (2024)
par: He, Yuanyi, et autres
Publié: (2024)
Content-Adaptive Rate-Quality Curve Prediction Model in Media Processing System
par: Yin, Shibo, et autres
Publié: (2024)
par: Yin, Shibo, et autres
Publié: (2024)
Documents similaires
-
Dual Dynamic Threshold Adjustment Strategy for Deep Metric Learning
par: Jiang, Xiruo, et autres
Publié: (2024) -
Truth in the Few: High-Value Data Selection for Efficient Multi-Modal Reasoning
par: Li, Shenshen, et autres
Publié: (2025) -
CM$^3$: Calibrating Multimodal Recommendation
par: Zhou, Xin, et autres
Publié: (2025) -
DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models
par: Xu, Siyuan, et autres
Publié: (2026) -
Efficient Token Compression for Vision Transformer with Spatial Information Preserved
par: Mao, Junzhu, et autres
Publié: (2025)