Evaluating and Steering Modality Preferences in Multimodal Large Language Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Yu, Ma, Jinlong, Hou, Yongshuai, Bai, Xuefeng, Chen, Kehai, Xiang, Yang, Yu, Jun, Zhang, Min |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models
por: Zhu, Yingjie, et al.
Publicado: (2025)
por: Zhu, Yingjie, et al.
Publicado: (2025)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
por: Zhu, Yingjie, et al.
Publicado: (2024)
por: Zhu, Yingjie, et al.
Publicado: (2024)
Beyond Unimodal Shortcuts: MLLMs as Cross-Modal Reasoners for Grounded Named Entity Recognition
por: Ma, Jinlong, et al.
Publicado: (2026)
por: Ma, Jinlong, et al.
Publicado: (2026)
Exploring the Translation Mechanism of Large Language Models
por: Zhang, Hongbin, et al.
Publicado: (2025)
por: Zhang, Hongbin, et al.
Publicado: (2025)
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
por: Zhang, Hongbin, et al.
Publicado: (2024)
por: Zhang, Hongbin, et al.
Publicado: (2024)
Through the Lens of Character: Resolving Modality-Role Interference in Multimodal Role-Playing Agent
por: Tang, Yihong, et al.
Publicado: (2026)
por: Tang, Yihong, et al.
Publicado: (2026)
Instruction Anchor: Dissecting the Mechanistic Dynamics of Modality Arbitration
por: Zhang, Yu, et al.
Publicado: (2026)
por: Zhang, Yu, et al.
Publicado: (2026)
Evaluating and Improving Cultural Awareness of Reward Models for LLM Alignment
por: Zhang, Hongbin, et al.
Publicado: (2025)
por: Zhang, Hongbin, et al.
Publicado: (2025)
Efficient Safety Alignment of Large Language Models via Preference Re-ranking and Representation-based Reward Modeling
por: Deng, Qiyuan, et al.
Publicado: (2025)
por: Deng, Qiyuan, et al.
Publicado: (2025)
Mitigating Multimodal Hallucination via Phase-wise Self-reward
por: Zhang, Yu, et al.
Publicado: (2026)
por: Zhang, Yu, et al.
Publicado: (2026)
Agentic Tool Use in Large Language Models
por: Hu, Jinchao, et al.
Publicado: (2026)
por: Hu, Jinchao, et al.
Publicado: (2026)
TF-Attack: Transferable and Fast Adversarial Attacks on Large Language Models
por: Li, Zelin, et al.
Publicado: (2024)
por: Li, Zelin, et al.
Publicado: (2024)
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
por: Chen, Andong, et al.
Publicado: (2024)
por: Chen, Andong, et al.
Publicado: (2024)
A Survey on Human Preference Learning for Large Language Models
por: Jiang, Ruili, et al.
Publicado: (2024)
por: Jiang, Ruili, et al.
Publicado: (2024)
LinguaLIFT: An Effective Two-stage Instruction Tuning Framework for Low-Resource Language Reasoning
por: Zhang, Hongbin, et al.
Publicado: (2024)
por: Zhang, Hongbin, et al.
Publicado: (2024)
XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
por: Li, Zhenyu, et al.
Publicado: (2025)
por: Li, Zhenyu, et al.
Publicado: (2025)
Generator-Assistant Stepwise Rollback Framework for Large Language Model Agent
por: Li, Xingzuo, et al.
Publicado: (2025)
por: Li, Xingzuo, et al.
Publicado: (2025)
The Power of Personality: A Human Simulation Perspective to Investigate Large Language Model Agents
por: Duan, Yifan, et al.
Publicado: (2025)
por: Duan, Yifan, et al.
Publicado: (2025)
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
por: Xu, Mufan, et al.
Publicado: (2026)
por: Xu, Mufan, et al.
Publicado: (2026)
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
por: Chen, Andong, et al.
Publicado: (2024)
por: Chen, Andong, et al.
Publicado: (2024)
HITSZ's End-To-End Speech Translation Systems Combining Sequence-to-Sequence Auto Speech Recognition Model and Indic Large Language Model for IWSLT 2025 in Indic Track
por: Wei, Xuchen, et al.
Publicado: (2025)
por: Wei, Xuchen, et al.
Publicado: (2025)
Multimodal Large Language Model-Enabled Video Translation: A Role-Oriented Survey
por: Qu, Bingzheng, et al.
Publicado: (2026)
por: Qu, Bingzheng, et al.
Publicado: (2026)
Question-guided Knowledge Graph Re-scoring and Injection for Knowledge Graph Question Answering
por: Zhang, Yu, et al.
Publicado: (2024)
por: Zhang, Yu, et al.
Publicado: (2024)
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering
por: Xu, Mufan, et al.
Publicado: (2024)
por: Xu, Mufan, et al.
Publicado: (2024)
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
por: Xiang, Hao, et al.
Publicado: (2024)
por: Xiang, Hao, et al.
Publicado: (2024)
Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization
por: Cao, Yuanpu, et al.
Publicado: (2024)
por: Cao, Yuanpu, et al.
Publicado: (2024)
MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching
por: Yue, Liang, et al.
Publicado: (2025)
por: Yue, Liang, et al.
Publicado: (2025)
Constituency Parsing using LLMs
por: Bai, Xuefeng, et al.
Publicado: (2023)
por: Bai, Xuefeng, et al.
Publicado: (2023)
Single-to-mix Modality Alignment with Multimodal Large Language Model for Document Image Machine Translation
por: Liang, Yupu, et al.
Publicado: (2025)
por: Liang, Yupu, et al.
Publicado: (2025)
LLM-based Translation Inference with Iterative Bilingual Understanding
por: Chen, Andong, et al.
Publicado: (2024)
por: Chen, Andong, et al.
Publicado: (2024)
Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation
por: Zhan, Zaifu, et al.
Publicado: (2025)
por: Zhan, Zaifu, et al.
Publicado: (2025)
MDIT-Bench: Evaluating the Dual-Implicit Toxicity in Large Multimodal Models
por: Jin, Bohan, et al.
Publicado: (2025)
por: Jin, Bohan, et al.
Publicado: (2025)
The Rise of Darkness: Safety-Utility Trade-Offs in Role-Playing Dialogue Agents
por: Tang, Yihong, et al.
Publicado: (2025)
por: Tang, Yihong, et al.
Publicado: (2025)
Character-R1: Enhancing Role-Aware Reasoning in Role-Playing Agents via RLVR
por: Tang, Yihong, et al.
Publicado: (2026)
por: Tang, Yihong, et al.
Publicado: (2026)
Dynamics Within Latent Chain-of-Thought: An Empirical Study of Causal Structure
por: Li, Zirui, et al.
Publicado: (2026)
por: Li, Zirui, et al.
Publicado: (2026)
How to Bridge the Gap between Modalities: Survey on Multimodal Large Language Model
por: Song, Shezheng, et al.
Publicado: (2023)
por: Song, Shezheng, et al.
Publicado: (2023)
Decomposing and Steering Functional Metacognition in Large Language Models
por: Li, Yanshi, et al.
Publicado: (2026)
por: Li, Yanshi, et al.
Publicado: (2026)
SAT: Balancing Reasoning Accuracy and Efficiency with Stepwise Adaptive Thinking
por: Huang, Weiyang, et al.
Publicado: (2026)
por: Huang, Weiyang, et al.
Publicado: (2026)
SeaPO: Strategic Error Amplification for Robust Preference Optimization of Large Language Models
por: Rao, Jun, et al.
Publicado: (2025)
por: Rao, Jun, et al.
Publicado: (2025)
Make Imagination Clearer! Stable Diffusion-based Visual Imagination for Multimodal Machine Translation
por: Chen, Andong, et al.
Publicado: (2024)
por: Chen, Andong, et al.
Publicado: (2024)
Ejemplares similares
-
Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models
por: Zhu, Yingjie, et al.
Publicado: (2025) -
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
por: Zhu, Yingjie, et al.
Publicado: (2024) -
Beyond Unimodal Shortcuts: MLLMs as Cross-Modal Reasoners for Grounded Named Entity Recognition
por: Ma, Jinlong, et al.
Publicado: (2026) -
Exploring the Translation Mechanism of Large Language Models
por: Zhang, Hongbin, et al.
Publicado: (2025) -
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
por: Zhang, Hongbin, et al.
Publicado: (2024)