MPN: Leveraging Multilingual Patch Neuron for Cross-lingual Model Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Si, Nianwen, Zhang, Hao, Zhang, Weiqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Leveraging LLMs for On-the-Fly Instruction Guided Image Editing
di: Santos, Rodrigo, et al.
Pubblicazione: (2024)
di: Santos, Rodrigo, et al.
Pubblicazione: (2024)
CLAIM: Mitigating Multilingual Object Hallucination in Large Vision-Language Models with Cross-Lingual Attention Intervention
di: Ye, Zekai, et al.
Pubblicazione: (2025)
di: Ye, Zekai, et al.
Pubblicazione: (2025)
MULTITEXTEDIT: Benchmarking Cross-Lingual Degradation in Text-in-Image Editing
di: Cheng, Liwei, et al.
Pubblicazione: (2026)
di: Cheng, Liwei, et al.
Pubblicazione: (2026)
Cross-lingual Editing in Multilingual Language Models
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024)
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024)
ETCHR: Editing To Clarify and Harness Reasoning
di: Zhang, Beichen, et al.
Pubblicazione: (2026)
di: Zhang, Beichen, et al.
Pubblicazione: (2026)
Error-Driven Scene Editing for 3D Grounding in Large Language Models
di: Zhang, Yue, et al.
Pubblicazione: (2025)
di: Zhang, Yue, et al.
Pubblicazione: (2025)
Mitigating Multilingual Hallucination in Large Vision-Language Models
di: Qu, Xiaoye, et al.
Pubblicazione: (2024)
di: Qu, Xiaoye, et al.
Pubblicazione: (2024)
VisionGraph: Leveraging Large Multimodal Models for Graph Theory Problems in Visual Context
di: Li, Yunxin, et al.
Pubblicazione: (2024)
di: Li, Yunxin, et al.
Pubblicazione: (2024)
MoKus: Leveraging Cross-Modal Knowledge Transfer for Knowledge-Aware Concept Customization
di: Zhu, Chenyang, et al.
Pubblicazione: (2026)
di: Zhu, Chenyang, et al.
Pubblicazione: (2026)
Cross-modal Information Flow in Multimodal Large Language Models
di: Zhang, Zhi, et al.
Pubblicazione: (2024)
di: Zhang, Zhi, et al.
Pubblicazione: (2024)
The Mirage of Performance Gains: Why Contrastive Decoding Fails to Mitigate Object Hallucinations in MLLMs?
di: Yin, Hao, et al.
Pubblicazione: (2025)
di: Yin, Hao, et al.
Pubblicazione: (2025)
Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs
di: Ji, Yikun, et al.
Pubblicazione: (2025)
di: Ji, Yikun, et al.
Pubblicazione: (2025)
VEGGIE: Instructional Editing and Reasoning Video Concepts with Grounded Generation
di: Yu, Shoubin, et al.
Pubblicazione: (2025)
di: Yu, Shoubin, et al.
Pubblicazione: (2025)
Bayesian Optimization for Controlled Image Editing via LLMs
di: Cai, Chengkun, et al.
Pubblicazione: (2025)
di: Cai, Chengkun, et al.
Pubblicazione: (2025)
POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
di: Xu, Yichen, et al.
Pubblicazione: (2025)
di: Xu, Yichen, et al.
Pubblicazione: (2025)
Bifrost-1: Bridging Multimodal LLMs and Diffusion Models with Patch-level CLIP Latents
di: Lin, Han, et al.
Pubblicazione: (2025)
di: Lin, Han, et al.
Pubblicazione: (2025)
MagicBrush: A Manually Annotated Dataset for Instruction-Guided Image Editing
di: Zhang, Kai, et al.
Pubblicazione: (2023)
di: Zhang, Kai, et al.
Pubblicazione: (2023)
VLKEB: A Large Vision-Language Model Knowledge Editing Benchmark
di: Huang, Han, et al.
Pubblicazione: (2024)
di: Huang, Han, et al.
Pubblicazione: (2024)
XL-HeadTags: Leveraging Multimodal Retrieval Augmentation for the Multilingual Generation of News Headlines and Tags
di: Shohan, Faisal Tareque, et al.
Pubblicazione: (2024)
di: Shohan, Faisal Tareque, et al.
Pubblicazione: (2024)
EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing
di: Wu, Keming, et al.
Pubblicazione: (2025)
di: Wu, Keming, et al.
Pubblicazione: (2025)
Image-Text Relation Prediction for Multilingual Tweets
di: Rikters, Matīss, et al.
Pubblicazione: (2025)
di: Rikters, Matīss, et al.
Pubblicazione: (2025)
Leveraging Open Knowledge for Advancing Task Expertise in Large Language Models
di: Yang, Yuncheng, et al.
Pubblicazione: (2024)
di: Yang, Yuncheng, et al.
Pubblicazione: (2024)
GRR-CoCa: Leveraging LLM Mechanisms in Multimodal Model Architectures
di: Patock, Jake R., et al.
Pubblicazione: (2025)
di: Patock, Jake R., et al.
Pubblicazione: (2025)
DART: Leveraging Multi-Agent Disagreement for Tool Recruitment in Multimodal Reasoning
di: Sivakumaran, Nithin, et al.
Pubblicazione: (2025)
di: Sivakumaran, Nithin, et al.
Pubblicazione: (2025)
MAMI: Multi-Attentional Mutual-Information for Long Sequence Neuron Captioning
di: Fauzulhaq, Alfirsa Damasyifa, et al.
Pubblicazione: (2024)
di: Fauzulhaq, Alfirsa Damasyifa, et al.
Pubblicazione: (2024)
VEFX-Bench: A Holistic Benchmark for Generic Video Editing and Visual Effects
di: Gao, Xiangbo, et al.
Pubblicazione: (2026)
di: Gao, Xiangbo, et al.
Pubblicazione: (2026)
Law of the Weakest Link: Cross Capabilities of Large Language Models
di: Zhong, Ming, et al.
Pubblicazione: (2024)
di: Zhong, Ming, et al.
Pubblicazione: (2024)
MENTOR: Efficient Multimodal-Conditioned Tuning for Autoregressive Vision Generation Models
di: Zhao, Haozhe, et al.
Pubblicazione: (2025)
di: Zhao, Haozhe, et al.
Pubblicazione: (2025)
Uni3D-LLM: Unifying Point Cloud Perception, Generation and Editing with Large Language Models
di: Liu, Dingning, et al.
Pubblicazione: (2024)
di: Liu, Dingning, et al.
Pubblicazione: (2024)
CoPE-VideoLM: Leveraging Codec Primitives For Efficient Video Language Modeling
di: Sarkar, Sayan Deb, et al.
Pubblicazione: (2026)
di: Sarkar, Sayan Deb, et al.
Pubblicazione: (2026)
NeoBabel: A Multilingual Open Tower for Visual Generation
di: Derakhshani, Mohammad Mahdi, et al.
Pubblicazione: (2025)
di: Derakhshani, Mohammad Mahdi, et al.
Pubblicazione: (2025)
Chitrakshara: A Large Multilingual Multimodal Dataset for Indian languages
di: Khan, Shaharukh, et al.
Pubblicazione: (2026)
di: Khan, Shaharukh, et al.
Pubblicazione: (2026)
Concept Lancet: Image Editing with Compositional Representation Transplant
di: Luo, Jinqi, et al.
Pubblicazione: (2025)
di: Luo, Jinqi, et al.
Pubblicazione: (2025)
ZINA: Multimodal Fine-grained Hallucination Detection and Editing
di: Wada, Yuiga, et al.
Pubblicazione: (2025)
di: Wada, Yuiga, et al.
Pubblicazione: (2025)
Multimodal LLM Enhanced Cross-lingual Cross-modal Retrieval
di: Wang, Yabing, et al.
Pubblicazione: (2024)
di: Wang, Yabing, et al.
Pubblicazione: (2024)
Beyond Translation: Cross-Cultural Meme Transcreation with Vision-Language Models
di: Zhao, Yuming, et al.
Pubblicazione: (2026)
di: Zhao, Yuming, et al.
Pubblicazione: (2026)
Annotations on a Budget: Leveraging Geo-Data Similarity to Balance Model Performance and Annotation Cost
di: Ignat, Oana, et al.
Pubblicazione: (2024)
di: Ignat, Oana, et al.
Pubblicazione: (2024)
MotionEdit: Benchmarking and Learning Motion-Centric Image Editing
di: Wan, Yixin, et al.
Pubblicazione: (2025)
di: Wan, Yixin, et al.
Pubblicazione: (2025)
Cross-Modal Adapter for Vision-Language Retrieval
di: Jiang, Haojun, et al.
Pubblicazione: (2022)
di: Jiang, Haojun, et al.
Pubblicazione: (2022)
HNC: Leveraging Hard Negative Captions towards Models with Fine-Grained Visual-Linguistic Comprehension Capabilities
di: Dönmez, Esra, et al.
Pubblicazione: (2026)
di: Dönmez, Esra, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Leveraging LLMs for On-the-Fly Instruction Guided Image Editing
di: Santos, Rodrigo, et al.
Pubblicazione: (2024) -
CLAIM: Mitigating Multilingual Object Hallucination in Large Vision-Language Models with Cross-Lingual Attention Intervention
di: Ye, Zekai, et al.
Pubblicazione: (2025) -
MULTITEXTEDIT: Benchmarking Cross-Lingual Degradation in Text-in-Image Editing
di: Cheng, Liwei, et al.
Pubblicazione: (2026) -
Cross-lingual Editing in Multilingual Language Models
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024) -
ETCHR: Editing To Clarify and Harness Reasoning
di: Zhang, Beichen, et al.
Pubblicazione: (2026)