MNAFT: modality neuron-aware fine-tuning of multimodal large language models for image translation
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Bo, Deng, Ningyuan, Dong, Tianyu, Wang, Shaobo, Zhu, Shaolin, Wen, Lijie |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
por: Li, Bo, et al.
Publicado: (2026)
por: Li, Bo, et al.
Publicado: (2026)
FuxiMT: Sparsifying Large Language Models for Chinese-Centric Multilingual Machine Translation
por: Zhu, Shaolin, et al.
Publicado: (2025)
por: Zhu, Shaolin, et al.
Publicado: (2025)
How does fine-tuning improve sensorimotor representations in large language models?
por: Wu, Minghua, et al.
Publicado: (2026)
por: Wu, Minghua, et al.
Publicado: (2026)
The representation landscape of few-shot learning and fine-tuning in large language models
por: Doimo, Diego, et al.
Publicado: (2024)
por: Doimo, Diego, et al.
Publicado: (2024)
VaaWIT: Visual-Aware Adaptation of Large Language Models for Multilingual Web Image Translation
por: Li, Bo, et al.
Publicado: (2026)
por: Li, Bo, et al.
Publicado: (2026)
Automated scoring of the Ambiguous Intentions Hostility Questionnaire using fine-tuned large language models
por: Lyu, Y., et al.
Publicado: (2025)
por: Lyu, Y., et al.
Publicado: (2025)
Evolution of meta's llama models and parameter-efficient fine-tuning of large language models: a survey
por: Abdullah, Abdulhady Abas, et al.
Publicado: (2025)
por: Abdullah, Abdulhady Abas, et al.
Publicado: (2025)
Complexity-aware fine-tuning
por: Goncharov, Andrey, et al.
Publicado: (2025)
por: Goncharov, Andrey, et al.
Publicado: (2025)
Is your multimodal large language model a good science tutor?
por: Liu, Ming, et al.
Publicado: (2025)
por: Liu, Ming, et al.
Publicado: (2025)
Metaphor identification using large language models: A comparison of RAG, prompt engineering, and fine-tuning
por: Fuoli, Matteo, et al.
Publicado: (2025)
por: Fuoli, Matteo, et al.
Publicado: (2025)
Protecting multimodal large language models against misleading visualizations
por: Tonglet, Jonathan, et al.
Publicado: (2025)
por: Tonglet, Jonathan, et al.
Publicado: (2025)
CXR-LLAVA: a multimodal large language model for interpreting chest X-ray images
por: Lee, Seowoo, et al.
Publicado: (2023)
por: Lee, Seowoo, et al.
Publicado: (2023)
DocLLM: A layout-aware generative language model for multimodal document understanding
por: Wang, Dongsheng, et al.
Publicado: (2023)
por: Wang, Dongsheng, et al.
Publicado: (2023)
MIT-10M: A Large Scale Parallel Corpus of Multilingual Image Translation
por: Li, Bo, et al.
Publicado: (2024)
por: Li, Bo, et al.
Publicado: (2024)
Integrating gender inclusivity into large language models via instruction tuning
por: Wróblewska, Alina, et al.
Publicado: (2025)
por: Wróblewska, Alina, et al.
Publicado: (2025)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
por: Han, Yifu, et al.
Publicado: (2025)
por: Han, Yifu, et al.
Publicado: (2025)
Deep literature reviews: an application of fine-tuned language models to migration research
por: Iacus, Stefano M., et al.
Publicado: (2025)
por: Iacus, Stefano M., et al.
Publicado: (2025)
FSMR: A Feature Swapping Multi-modal Reasoning Approach with Joint Textual and Visual Clues
por: Li, Shuang, et al.
Publicado: (2024)
por: Li, Shuang, et al.
Publicado: (2024)
Explaining latent representations of generative models with large multimodal models
por: Zhu, Mengdan, et al.
Publicado: (2024)
por: Zhu, Mengdan, et al.
Publicado: (2024)
Understanding the effects of language-specific class imbalance in multilingual fine-tuning
por: Jung, Vincent, et al.
Publicado: (2024)
por: Jung, Vincent, et al.
Publicado: (2024)
Human-like object concept representations emerge naturally in multimodal large language models
por: Du, Changde, et al.
Publicado: (2024)
por: Du, Changde, et al.
Publicado: (2024)
Zero-shot cross-lingual transfer in instruction tuning of large language models
por: Chirkova, Nadezhda, et al.
Publicado: (2024)
por: Chirkova, Nadezhda, et al.
Publicado: (2024)
OpenMedLM: Prompt engineering can out-perform fine-tuning in medical question-answering with open-source large language models
por: Maharjan, Jenish, et al.
Publicado: (2024)
por: Maharjan, Jenish, et al.
Publicado: (2024)
Dynamic data sampler for cross-language transfer learning in large language models
por: Li, Yudong, et al.
Publicado: (2024)
por: Li, Yudong, et al.
Publicado: (2024)
What explains the success of cross-modal fine-tuning with ORCA?
por: García-de-Herreros, Paloma, et al.
Publicado: (2024)
por: García-de-Herreros, Paloma, et al.
Publicado: (2024)
Latent-space adversarial training with post-aware calibration for defending large language models against jailbreak attacks
por: Yi, Xin, et al.
Publicado: (2025)
por: Yi, Xin, et al.
Publicado: (2025)
Retention analysis of edited knowledge after fine-tuning
por: Wen, Fufang, et al.
Publicado: (2025)
por: Wen, Fufang, et al.
Publicado: (2025)
LANDeRMT: Detecting and Routing Language-Aware Neurons for Selectively Finetuning LLMs to Machine Translation
por: Zhu, Shaolin, et al.
Publicado: (2024)
por: Zhu, Shaolin, et al.
Publicado: (2024)
When language and vision meet road safety: leveraging multimodal large language models for video-based traffic accident analysis
por: Zhang, Ruixuan, et al.
Publicado: (2025)
por: Zhang, Ruixuan, et al.
Publicado: (2025)
RandLoRA: Full-rank parameter-efficient fine-tuning of large models
por: Albert, Paul, et al.
Publicado: (2025)
por: Albert, Paul, et al.
Publicado: (2025)
Fine-tuning of lightweight large language models for sentiment classification on heterogeneous financial textual data
por: Amorin, Alvaro Paredes, et al.
Publicado: (2025)
por: Amorin, Alvaro Paredes, et al.
Publicado: (2025)
Learning diverse attacks on large language models for robust red-teaming and safety tuning
por: Lee, Seanie, et al.
Publicado: (2024)
por: Lee, Seanie, et al.
Publicado: (2024)
Retrieval augmentation of large language models for lay language generation
por: Guo, Yue, et al.
Publicado: (2022)
por: Guo, Yue, et al.
Publicado: (2022)
CCI3.0-HQ: a large-scale Chinese dataset of high quality designed for pre-training large language models
por: Wang, Liangdong, et al.
Publicado: (2024)
por: Wang, Liangdong, et al.
Publicado: (2024)
Do large language models resemble humans in language use?
por: Cai, Zhenguang G., et al.
Publicado: (2023)
por: Cai, Zhenguang G., et al.
Publicado: (2023)
Developing ChemDFM as a large language foundation model for chemistry
por: Zhao, Zihan, et al.
Publicado: (2024)
por: Zhao, Zihan, et al.
Publicado: (2024)
WorldMedQA-V: a multilingual, multimodal medical examination dataset for multimodal language models evaluation
por: Matos, João, et al.
Publicado: (2024)
por: Matos, João, et al.
Publicado: (2024)
ROME: Memorization Insights from Text, Logits and Representation
por: Li, Bo, et al.
Publicado: (2024)
por: Li, Bo, et al.
Publicado: (2024)
Symbol tuning improves in-context learning in language models
por: Wei, Jerry, et al.
Publicado: (2023)
por: Wei, Jerry, et al.
Publicado: (2023)
AIDBench: A benchmark for evaluating the authorship identification capability of large language models
por: Wen, Zichen, et al.
Publicado: (2024)
por: Wen, Zichen, et al.
Publicado: (2024)
Ejemplares similares
-
Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
por: Li, Bo, et al.
Publicado: (2026) -
FuxiMT: Sparsifying Large Language Models for Chinese-Centric Multilingual Machine Translation
por: Zhu, Shaolin, et al.
Publicado: (2025) -
How does fine-tuning improve sensorimotor representations in large language models?
por: Wu, Minghua, et al.
Publicado: (2026) -
The representation landscape of few-shot learning and fine-tuning in large language models
por: Doimo, Diego, et al.
Publicado: (2024) -
VaaWIT: Visual-Aware Adaptation of Large Language Models for Multilingual Web Image Translation
por: Li, Bo, et al.
Publicado: (2026)