AlignMMBench: Evaluating Chinese Multimodal Alignment in Large Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Yuhang, Yu, Wenmeng, Cheng, Yean, Wang, Yan, Zhang, Xiaohan, Xu, Jiazheng, Ding, Ming, Dong, Yuxiao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AlignBench: Benchmarking Chinese Alignment of Large Language Models
di: Liu, Xiao, et al.
Pubblicazione: (2023)
di: Liu, Xiao, et al.
Pubblicazione: (2023)
CogAgent: A Visual Language Model for GUI Agents
di: Hong, Wenyi, et al.
Pubblicazione: (2023)
di: Hong, Wenyi, et al.
Pubblicazione: (2023)
MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents
di: Wang, Xuehui, et al.
Pubblicazione: (2025)
di: Wang, Xuehui, et al.
Pubblicazione: (2025)
Deciphering Cross-Modal Alignment in Large Vision-Language Models with Modality Integration Rate
di: Huang, Qidong, et al.
Pubblicazione: (2024)
di: Huang, Qidong, et al.
Pubblicazione: (2024)
AdaptMMBench: Benchmarking Adaptive Multimodal Reasoning for Mode Selection and Reasoning Process
di: Zhang, Xintong, et al.
Pubblicazione: (2026)
di: Zhang, Xintong, et al.
Pubblicazione: (2026)
FewMMBench: A Benchmark for Multimodal Few-Shot Learning
di: Dogan, Mustafa, et al.
Pubblicazione: (2026)
di: Dogan, Mustafa, et al.
Pubblicazione: (2026)
CogVLM: Visual Expert for Pretrained Language Models
di: Wang, Weihan, et al.
Pubblicazione: (2023)
di: Wang, Weihan, et al.
Pubblicazione: (2023)
INS-MMBench: A Comprehensive Benchmark for Evaluating LVLMs' Performance in Insurance
di: Lin, Chenwei, et al.
Pubblicazione: (2024)
di: Lin, Chenwei, et al.
Pubblicazione: (2024)
LongAlign: A Recipe for Long Context Alignment of Large Language Models
di: Bai, Yushi, et al.
Pubblicazione: (2024)
di: Bai, Yushi, et al.
Pubblicazione: (2024)
GeoMMBench and GeoMMAgent: Toward Expert-Level Multimodal Intelligence in Geoscience and Remote Sensing
di: Xiao, Aoran, et al.
Pubblicazione: (2026)
di: Xiao, Aoran, et al.
Pubblicazione: (2026)
MotionBench: Benchmarking and Improving Fine-grained Video Motion Understanding for Vision Language Models
di: Hong, Wenyi, et al.
Pubblicazione: (2025)
di: Hong, Wenyi, et al.
Pubblicazione: (2025)
GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI
di: Chen, Pengcheng, et al.
Pubblicazione: (2024)
di: Chen, Pengcheng, et al.
Pubblicazione: (2024)
ChatGLM-RLHF: Practices of Aligning Large Language Models with Human Feedback
di: Hou, Zhenyu, et al.
Pubblicazione: (2024)
di: Hou, Zhenyu, et al.
Pubblicazione: (2024)
DreamPolish: Domain Score Distillation With Progressive Geometry Generation
di: Cheng, Yean, et al.
Pubblicazione: (2024)
di: Cheng, Yean, et al.
Pubblicazione: (2024)
MSR-Align: Policy-Grounded Multimodal Alignment for Safety-Aware Reasoning in Vision-Language Models
di: Xia, Yinan, et al.
Pubblicazione: (2025)
di: Xia, Yinan, et al.
Pubblicazione: (2025)
LVBench: An Extreme Long Video Understanding Benchmark
di: Wang, Weihan, et al.
Pubblicazione: (2024)
di: Wang, Weihan, et al.
Pubblicazione: (2024)
Black-Box Prompt Optimization: Aligning Large Language Models without Model Training
di: Cheng, Jiale, et al.
Pubblicazione: (2023)
di: Cheng, Jiale, et al.
Pubblicazione: (2023)
CFBenchmark-MM: Chinese Financial Assistant Benchmark for Multimodal Large Language Model
di: Li, Jiangtong, et al.
Pubblicazione: (2025)
di: Li, Jiangtong, et al.
Pubblicazione: (2025)
VPO: Aligning Text-to-Video Generation Models with Prompt Optimization
di: Cheng, Jiale, et al.
Pubblicazione: (2025)
di: Cheng, Jiale, et al.
Pubblicazione: (2025)
CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer
di: Yang, Zhuoyi, et al.
Pubblicazione: (2024)
di: Yang, Zhuoyi, et al.
Pubblicazione: (2024)
ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time
di: Ding, Yi, et al.
Pubblicazione: (2024)
di: Ding, Yi, et al.
Pubblicazione: (2024)
CogVLM2: Visual Language Models for Image and Video Understanding
di: Hong, Wenyi, et al.
Pubblicazione: (2024)
di: Hong, Wenyi, et al.
Pubblicazione: (2024)
A Human-Centric Pipeline for Aligning Large Language Models with Chinese Medical Ethics
di: Jin, Haoan, et al.
Pubblicazione: (2026)
di: Jin, Haoan, et al.
Pubblicazione: (2026)
RuleAlign: Making Large Language Models Better Physicians with Diagnostic Rule Alignment
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
Modest-Align: Data-Efficient Alignment for Vision-Language Models
di: Liu, Jiaxiang, et al.
Pubblicazione: (2025)
di: Liu, Jiaxiang, et al.
Pubblicazione: (2025)
Vision Search Assistant: Empower Vision-Language Models as Multimodal Search Engines
di: Zhang, Zhixin, et al.
Pubblicazione: (2024)
di: Zhang, Zhixin, et al.
Pubblicazione: (2024)
MMBench: Is Your Multi-modal Model an All-around Player?
di: Liu, Yuan, et al.
Pubblicazione: (2023)
di: Liu, Yuan, et al.
Pubblicazione: (2023)
Evaluating and Analyzing Relationship Hallucinations in Large Vision-Language Models
di: Wu, Mingrui, et al.
Pubblicazione: (2024)
di: Wu, Mingrui, et al.
Pubblicazione: (2024)
Creation-MMBench: Assessing Context-Aware Creative Intelligence in MLLM
di: Fang, Xinyu, et al.
Pubblicazione: (2025)
di: Fang, Xinyu, et al.
Pubblicazione: (2025)
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
di: Yan, Ziang, et al.
Pubblicazione: (2024)
di: Yan, Ziang, et al.
Pubblicazione: (2024)
GuardAlign: Test-time Safety Alignment in Multimodal Large Language Models
di: Zhu, Xingyu, et al.
Pubblicazione: (2026)
di: Zhu, Xingyu, et al.
Pubblicazione: (2026)
C-VARC: A Large-Scale Chinese Value Rule Corpus for Value Alignment of Large Language Models
di: Wu, Ping, et al.
Pubblicazione: (2025)
di: Wu, Ping, et al.
Pubblicazione: (2025)
TagAlign: Improving Vision-Language Alignment with Multi-Tag Classification
di: Liu, Qinying, et al.
Pubblicazione: (2023)
di: Liu, Qinying, et al.
Pubblicazione: (2023)
MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model
di: Yang, Zhen, et al.
Pubblicazione: (2024)
di: Yang, Zhen, et al.
Pubblicazione: (2024)
Large Vision-Language Model Alignment and Misalignment: A Survey Through the Lens of Explainability
di: Shu, Dong, et al.
Pubblicazione: (2025)
di: Shu, Dong, et al.
Pubblicazione: (2025)
Are We on the Right Way for Evaluating Large Vision-Language Models?
di: Chen, Lin, et al.
Pubblicazione: (2024)
di: Chen, Lin, et al.
Pubblicazione: (2024)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
ComAlign: Compositional Alignment in Vision-Language Models
di: Abdollah, Ali, et al.
Pubblicazione: (2024)
di: Abdollah, Ali, et al.
Pubblicazione: (2024)
Predictive Regularization Against Visual Representation Degradation in Multimodal Large Language Models
di: Wang, Enguang, et al.
Pubblicazione: (2026)
di: Wang, Enguang, et al.
Pubblicazione: (2026)
AlignGPT: Multi-modal Large Language Models with Adaptive Alignment Capability
di: Zhao, Fei, et al.
Pubblicazione: (2024)
di: Zhao, Fei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AlignBench: Benchmarking Chinese Alignment of Large Language Models
di: Liu, Xiao, et al.
Pubblicazione: (2023) -
CogAgent: A Visual Language Model for GUI Agents
di: Hong, Wenyi, et al.
Pubblicazione: (2023) -
MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents
di: Wang, Xuehui, et al.
Pubblicazione: (2025) -
Deciphering Cross-Modal Alignment in Large Vision-Language Models with Modality Integration Rate
di: Huang, Qidong, et al.
Pubblicazione: (2024) -
AdaptMMBench: Benchmarking Adaptive Multimodal Reasoning for Mode Selection and Reasoning Process
di: Zhang, Xintong, et al.
Pubblicazione: (2026)