MMDG-Bench: A Benchmark for Multimodal Domain Generalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhan, Qianshan, Wang, Qian, Li, Da, Zeng, Xiao-Jun, Zhu, Xiatian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Source-Free Domain Adaptation with Frozen Multimodal Foundation Model
di: Tang, Song, et al.
Pubblicazione: (2023)
di: Tang, Song, et al.
Pubblicazione: (2023)
MERGETUNE: Continued Fine-Tuning of Vision-Language Models
di: Wang, Wenqing, et al.
Pubblicazione: (2026)
di: Wang, Wenqing, et al.
Pubblicazione: (2026)
Unified Source-Free Domain Adaptation
di: Tang, Song, et al.
Pubblicazione: (2024)
di: Tang, Song, et al.
Pubblicazione: (2024)
MMDeepResearch-Bench: A Benchmark for Multimodal Deep Research Agents
di: Huang, Peizhou, et al.
Pubblicazione: (2026)
di: Huang, Peizhou, et al.
Pubblicazione: (2026)
MER-Bench: A Comprehensive Benchmark for Multimodal Meme Reappraisal
di: Nie, Yiqi, et al.
Pubblicazione: (2026)
di: Nie, Yiqi, et al.
Pubblicazione: (2026)
GT23D-Bench: A Comprehensive General Text-to-3D Generation Benchmark
di: Cai, Xiao, et al.
Pubblicazione: (2024)
di: Cai, Xiao, et al.
Pubblicazione: (2024)
OmniGenBench: A Benchmark for Omnipotent Multimodal Generation across 50+ Tasks
di: Wang, Jiayu, et al.
Pubblicazione: (2025)
di: Wang, Jiayu, et al.
Pubblicazione: (2025)
Deep Leakage with Generative Flow Matching Denoiser
di: Baglin, Isaac, et al.
Pubblicazione: (2026)
di: Baglin, Isaac, et al.
Pubblicazione: (2026)
Preconditioned Score-based Generative Models
di: Ma, Hengyuan, et al.
Pubblicazione: (2023)
di: Ma, Hengyuan, et al.
Pubblicazione: (2023)
OmniVaT: Single Domain Generalization for Multimodal Visual-Tactile Learning
di: Qiu, Liuxiang, et al.
Pubblicazione: (2026)
di: Qiu, Liuxiang, et al.
Pubblicazione: (2026)
Res-Bench: Benchmarking the Robustness of Multimodal Large Language Models to Dynamic Resolution Input
di: Li, Chenxu, et al.
Pubblicazione: (2025)
di: Li, Chenxu, et al.
Pubblicazione: (2025)
Single Image, Any Face: Generalisable 3D Face Generation
di: Wang, Wenqing, et al.
Pubblicazione: (2024)
di: Wang, Wenqing, et al.
Pubblicazione: (2024)
Enhancing High-Resolution 3D Generation through Pixel-wise Gradient Clipping
di: Pan, Zijie, et al.
Pubblicazione: (2023)
di: Pan, Zijie, et al.
Pubblicazione: (2023)
PresentBench: A Fine-Grained Rubric-Based Benchmark for Slide Generation
di: Chen, Xin-Sheng, et al.
Pubblicazione: (2026)
di: Chen, Xin-Sheng, et al.
Pubblicazione: (2026)
SpineBench: Benchmarking Multimodal LLMs for Spinal Pathology Analysis
di: Zhang, Chenghanyu, et al.
Pubblicazione: (2025)
di: Zhang, Chenghanyu, et al.
Pubblicazione: (2025)
EEE-Bench: A Comprehensive Multimodal Electrical And Electronics Engineering Benchmark
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
LithoBench: Benchmarking Large Multimodal Models for Remote-Sensing Lithology Interpretation
di: Wang, Jun, et al.
Pubblicazione: (2026)
di: Wang, Jun, et al.
Pubblicazione: (2026)
Source-Free Domain Adaptive Object Detection with Semantics Compensation
di: Tang, Song, et al.
Pubblicazione: (2024)
di: Tang, Song, et al.
Pubblicazione: (2024)
FunBench: Benchmarking Fundus Reading Skills of MLLMs
di: Wei, Qijie, et al.
Pubblicazione: (2025)
di: Wei, Qijie, et al.
Pubblicazione: (2025)
Efficient4D: Fast Dynamic 3D Object Generation from a Single-view Video
di: Pan, Zijie, et al.
Pubblicazione: (2024)
di: Pan, Zijie, et al.
Pubblicazione: (2024)
Uncertainty-Aware Pseudo-Label Filtering for Source-Free Unsupervised Domain Adaptation
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models
di: Liu, Xin, et al.
Pubblicazione: (2023)
di: Liu, Xin, et al.
Pubblicazione: (2023)
IV-Bench: A Benchmark for Image-Grounded Video Perception and Reasoning in Multimodal LLMs
di: Ma, David, et al.
Pubblicazione: (2025)
di: Ma, David, et al.
Pubblicazione: (2025)
Reflective Gaussian Splatting
di: Yao, Yuxuan, et al.
Pubblicazione: (2024)
di: Yao, Yuxuan, et al.
Pubblicazione: (2024)
M-ErasureBench: A Comprehensive Multimodal Evaluation Benchmark for Concept Erasure in Diffusion Models
di: Weng, Ju-Hsuan, et al.
Pubblicazione: (2025)
di: Weng, Ju-Hsuan, et al.
Pubblicazione: (2025)
KANs for Computer Vision: An Experimental Study
di: Mohan, Karthik, et al.
Pubblicazione: (2024)
di: Mohan, Karthik, et al.
Pubblicazione: (2024)
EarthSpatialBench: Benchmarking Spatial Reasoning Capabilities of Multimodal LLMs on Earth Imagery
di: Xu, Zelin, et al.
Pubblicazione: (2026)
di: Xu, Zelin, et al.
Pubblicazione: (2026)
Proxy Denoising for Source-Free Domain Adaptation
di: Tang, Song, et al.
Pubblicazione: (2024)
di: Tang, Song, et al.
Pubblicazione: (2024)
V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models
di: Luo, Yang, et al.
Pubblicazione: (2025)
di: Luo, Yang, et al.
Pubblicazione: (2025)
MMRareBench: A Rare-Disease Multimodal and Multi-Image Medical Benchmark
di: Ning, Junzhi, et al.
Pubblicazione: (2026)
di: Ning, Junzhi, et al.
Pubblicazione: (2026)
Tetrahedron Splatting for 3D Generation
di: Gu, Chun, et al.
Pubblicazione: (2024)
di: Gu, Chun, et al.
Pubblicazione: (2024)
FTII-Bench: A Comprehensive Multimodal Benchmark for Flow Text with Image Insertion
di: Ruan, Jiacheng, et al.
Pubblicazione: (2024)
di: Ruan, Jiacheng, et al.
Pubblicazione: (2024)
Source-Free Domain Adaptation with Vision-Language Prior
di: Tang, Song, et al.
Pubblicazione: (2026)
di: Tang, Song, et al.
Pubblicazione: (2026)
On Path to Multimodal Generalist: General-Level and General-Bench
di: Fei, Hao, et al.
Pubblicazione: (2025)
di: Fei, Hao, et al.
Pubblicazione: (2025)
Hanfu-Bench: A Multimodal Benchmark on Cross-Temporal Cultural Understanding and Transcreation
di: Zhou, Li, et al.
Pubblicazione: (2025)
di: Zhou, Li, et al.
Pubblicazione: (2025)
Driving View Synthesis on Free-form Trajectories with Generative Prior
di: Yang, Zeyu, et al.
Pubblicazione: (2024)
di: Yang, Zeyu, et al.
Pubblicazione: (2024)
VP-Bench: A Comprehensive Benchmark for Visual Prompting in Multimodal Large Language Models
di: Xu, Mingjie, et al.
Pubblicazione: (2025)
di: Xu, Mingjie, et al.
Pubblicazione: (2025)
PRISMM-Bench: A Benchmark of Peer-Review Grounded Multimodal Inconsistencies
di: Selch, Lukas, et al.
Pubblicazione: (2025)
di: Selch, Lukas, et al.
Pubblicazione: (2025)
BackdoorBench: A Comprehensive Benchmark and Analysis of Backdoor Learning
di: Wu, Baoyuan, et al.
Pubblicazione: (2024)
di: Wu, Baoyuan, et al.
Pubblicazione: (2024)
ReactBench: A Cause-Driven Benchmark for Multimodal Hallucination via Systematic Evaluation
di: Zhou, Shizhe, et al.
Pubblicazione: (2026)
di: Zhou, Shizhe, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Source-Free Domain Adaptation with Frozen Multimodal Foundation Model
di: Tang, Song, et al.
Pubblicazione: (2023) -
MERGETUNE: Continued Fine-Tuning of Vision-Language Models
di: Wang, Wenqing, et al.
Pubblicazione: (2026) -
Unified Source-Free Domain Adaptation
di: Tang, Song, et al.
Pubblicazione: (2024) -
MMDeepResearch-Bench: A Benchmark for Multimodal Deep Research Agents
di: Huang, Peizhou, et al.
Pubblicazione: (2026) -
MER-Bench: A Comprehensive Benchmark for Multimodal Meme Reappraisal
di: Nie, Yiqi, et al.
Pubblicazione: (2026)