m3P: Towards Multimodal Multilingual Translation with Multimodal Prompt
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Jian, Guo, Hongcheng, Yin, Yuwei, Bai, Jiaqi, Wang, Bing, Liu, Jiaheng, Liang, Xinnian, Cahi, Linzheng, Yang, Liqun, Li, Zhoujun |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
UniCoder: Scaling Code Large Language Model via Universal Code
by: Sun, Tao, et al.
Published: (2024)
by: Sun, Tao, et al.
Published: (2024)
McEval: Massively Multilingual Code Evaluation
by: Chai, Linzheng, et al.
Published: (2024)
by: Chai, Linzheng, et al.
Published: (2024)
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
by: Chai, Linzheng, et al.
Published: (2024)
by: Chai, Linzheng, et al.
Published: (2024)
Multilingual Multimodal Software Developer for Code Generation
by: Chai, Linzheng, et al.
Published: (2025)
by: Chai, Linzheng, et al.
Published: (2025)
FuzzCoder: Byte-level Fuzzing Test via Large Language Model
by: Yang, Liqun, et al.
Published: (2024)
by: Yang, Liqun, et al.
Published: (2024)
OWL: A Large Language Model for IT Operations
by: Guo, Hongcheng, et al.
Published: (2023)
by: Guo, Hongcheng, et al.
Published: (2023)
Mitigating Hallucinations in Large Vision-Language Models by Adaptively Constraining Information Flow
by: Bai, Jiaqi, et al.
Published: (2025)
by: Bai, Jiaqi, et al.
Published: (2025)
MdEval: Massively Multilingual Code Debugging
by: Liu, Shukai, et al.
Published: (2024)
by: Liu, Shukai, et al.
Published: (2024)
Towards Real-world Scenario: Imbalanced New Intent Discovery
by: Zhang, Shun, et al.
Published: (2024)
by: Zhang, Shun, et al.
Published: (2024)
MAC-SQL: A Multi-Agent Collaborative Framework for Text-to-SQL
by: Wang, Bing, et al.
Published: (2023)
by: Wang, Bing, et al.
Published: (2023)
Scalable Multilingual Multimodal Machine Translation with Speech-Text Fusion
by: Du, Yexing, et al.
Published: (2026)
by: Du, Yexing, et al.
Published: (2026)
SCM: Enhancing Large Language Model with Self-Controlled Memory Framework
by: Wang, Bing, et al.
Published: (2023)
by: Wang, Bing, et al.
Published: (2023)
Towards Red Teaming in Multimodal and Multilingual Translation
by: Ropers, Christophe, et al.
Published: (2024)
by: Ropers, Christophe, et al.
Published: (2024)
SNS-Bench-VL: Benchmarking Multimodal Large Language Models in Social Networking Services
by: Guo, Hongcheng, et al.
Published: (2025)
by: Guo, Hongcheng, et al.
Published: (2025)
XFormParser: A Simple and Effective Multimodal Multilingual Semi-structured Form Parser
by: Cheng, Xianfu, et al.
Published: (2024)
by: Cheng, Xianfu, et al.
Published: (2024)
Dual-branch Prompting for Multimodal Machine Translation
by: Wang, Jie, et al.
Published: (2025)
by: Wang, Jie, et al.
Published: (2025)
IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web
by: Guo, Hongcheng, et al.
Published: (2024)
by: Guo, Hongcheng, et al.
Published: (2024)
H2HTalk: Evaluating Large Language Models as Emotional Companion
by: Wang, Boyang, et al.
Published: (2025)
by: Wang, Boyang, et al.
Published: (2025)
M3TQA: Massively Multilingual Multitask Table Question Answering
by: Shu, Daixin, et al.
Published: (2025)
by: Shu, Daixin, et al.
Published: (2025)
TableBench: A Comprehensive and Complex Benchmark for Table Question Answering
by: Wu, Xianjie, et al.
Published: (2024)
by: Wu, Xianjie, et al.
Published: (2024)
IFEvalCode: Controlled Code Generation
by: Yang, Jian, et al.
Published: (2025)
by: Yang, Jian, et al.
Published: (2025)
SimpleVQA: Multimodal Factuality Evaluation for Multimodal Large Language Models
by: Cheng, Xianfu, et al.
Published: (2025)
by: Cheng, Xianfu, et al.
Published: (2025)
What Are They Talking About? A Benchmark of Knowledge-Grounded Discussion Summarization
by: Zhou, Weixiao, et al.
Published: (2025)
by: Zhou, Weixiao, et al.
Published: (2025)
Refining Transcripts With TV Subtitles by Prompt-Based Weakly Supervised Training of ASR
by: Zhao, Xinnian, et al.
Published: (2025)
by: Zhao, Xinnian, et al.
Published: (2025)
New Intent Discovery with Attracting and Dispersing Prototype
by: Zhang, Shun, et al.
Published: (2024)
by: Zhang, Shun, et al.
Published: (2024)
M2G-Eval: Enhancing and Evaluating Multi-granularity Multilingual Code Generation
by: Xu, Fanglin, et al.
Published: (2025)
by: Xu, Fanglin, et al.
Published: (2025)
Towards Zero-Shot Multimodal Machine Translation
by: Futeral, Matthieu, et al.
Published: (2024)
by: Futeral, Matthieu, et al.
Published: (2024)
OmniFusion: Simultaneous Multilingual Multimodal Translations via Modular Fusion
by: Koneru, Sai, et al.
Published: (2025)
by: Koneru, Sai, et al.
Published: (2025)
RoNID: New Intent Discovery with Generated-Reliable Labels and Cluster-friendly Representations
by: Zhang, Shun, et al.
Published: (2024)
by: Zhang, Shun, et al.
Published: (2024)
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
by: Mu, Yongyu, et al.
Published: (2025)
by: Mu, Yongyu, et al.
Published: (2025)
Redefining Machine Translation on Social Network Services with Large Language Models
by: Guo, Hongcheng, et al.
Published: (2025)
by: Guo, Hongcheng, et al.
Published: (2025)
TopicVD: A Topic-Based Dataset of Video-Guided Multimodal Machine Translation for Documentaries
by: Lv, Jinze, et al.
Published: (2025)
by: Lv, Jinze, et al.
Published: (2025)
M$^{3}$D: A Multimodal, Multilingual and Multitask Dataset for Grounded Document-level Information Extraction
by: Liu, Jiang, et al.
Published: (2024)
by: Liu, Jiang, et al.
Published: (2024)
ECLIPSE: Semantic Entropy-LCS for Cross-Lingual Industrial Log Parsing
by: Zhang, Wei, et al.
Published: (2024)
by: Zhang, Wei, et al.
Published: (2024)
SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence
by: Ji, Hangyuan, et al.
Published: (2024)
by: Ji, Hangyuan, et al.
Published: (2024)
LLaVA-NeuMT: Selective Layer-Neuron Modulation for Efficient Multilingual Multimodal Translation
by: Wei, Jingxuan, et al.
Published: (2025)
by: Wei, Jingxuan, et al.
Published: (2025)
M2rc-Eval: Massively Multilingual Repository-level Code Completion Evaluation
by: Liu, Jiaheng, et al.
Published: (2024)
by: Liu, Jiaheng, et al.
Published: (2024)
M3DR: Towards Universal Multilingual Multimodal Document Retrieval
by: Kolavi, Adithya S, et al.
Published: (2025)
by: Kolavi, Adithya S, et al.
Published: (2025)
LogFormer: A Pre-train and Tuning Pipeline for Log Anomaly Detection
by: Guo, Hongcheng, et al.
Published: (2024)
by: Guo, Hongcheng, et al.
Published: (2024)
Joint Visual and Text Prompting for Improved Object-Centric Perception with Multimodal Large Language Models
by: Jiang, Songtao, et al.
Published: (2024)
by: Jiang, Songtao, et al.
Published: (2024)
Similar Items
-
UniCoder: Scaling Code Large Language Model via Universal Code
by: Sun, Tao, et al.
Published: (2024) -
McEval: Massively Multilingual Code Evaluation
by: Chai, Linzheng, et al.
Published: (2024) -
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
by: Chai, Linzheng, et al.
Published: (2024) -
Multilingual Multimodal Software Developer for Code Generation
by: Chai, Linzheng, et al.
Published: (2025) -
FuzzCoder: Byte-level Fuzzing Test via Large Language Model
by: Yang, Liqun, et al.
Published: (2024)