Exploring the Necessity of Visual Modality in Multimodal Machine Translation using Authentic Datasets
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Long, Zi, Tang, Zhenhao, Fu, Xianghua, Chen, Jian, Hou, Shilong, Lyu, Jinze |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TopicVD: A Topic-Based Dataset of Video-Guided Multimodal Machine Translation for Documentaries
par: Lv, Jinze, et autres
Publié: (2025)
par: Lv, Jinze, et autres
Publié: (2025)
A General Pseudonymization Framework for Cloud-Based LLMs: Replacing Privacy Information in Controlled Text Generation
par: Hou, Shilong, et autres
Publié: (2025)
par: Hou, Shilong, et autres
Publié: (2025)
Video-guided Machine Translation with Global Video Context
par: Chen, Jian, et autres
Publié: (2026)
par: Chen, Jian, et autres
Publié: (2026)
Detecting Concrete Visual Tokens for Multimodal Machine Translation
par: Bowen, Braeden, et autres
Publié: (2024)
par: Bowen, Braeden, et autres
Publié: (2024)
Paraphrase-Aligned Machine Translation
par: Chang, Ke-Ching, et autres
Publié: (2024)
par: Chang, Ke-Ching, et autres
Publié: (2024)
Make Imagination Clearer! Stable Diffusion-based Visual Imagination for Multimodal Machine Translation
par: Chen, Andong, et autres
Publié: (2024)
par: Chen, Andong, et autres
Publié: (2024)
Multimodal Multi-turn Conversation Stance Detection: A Challenge Dataset and Effective Model
par: Niu, Fuqiang, et autres
Publié: (2024)
par: Niu, Fuqiang, et autres
Publié: (2024)
M3T: A New Benchmark Dataset for Multi-Modal Document-Level Machine Translation
par: Hsu, Benjamin, et autres
Publié: (2024)
par: Hsu, Benjamin, et autres
Publié: (2024)
C-MTCSD: A Chinese Multi-Turn Conversational Stance Detection Dataset
par: Niu, Fuqiang, et autres
Publié: (2025)
par: Niu, Fuqiang, et autres
Publié: (2025)
Multilingual, Multimodal Pipeline for Creating Authentic and Structured Fact-Checked Claim Dataset
par: Hüsünbeyi, Z. Melce, et autres
Publié: (2026)
par: Hüsünbeyi, Z. Melce, et autres
Publié: (2026)
VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation
par: Pan, Jingheng, et autres
Publié: (2026)
par: Pan, Jingheng, et autres
Publié: (2026)
Context-Informed Machine Translation of Manga using Multimodal Large Language Models
par: Lippmann, Philip, et autres
Publié: (2024)
par: Lippmann, Philip, et autres
Publié: (2024)
Towards Zero-Shot Multimodal Machine Translation
par: Futeral, Matthieu, et autres
Publié: (2024)
par: Futeral, Matthieu, et autres
Publié: (2024)
The Case for Evaluating Multimodal Translation Models on Text Datasets
par: Vijayan, Vipin, et autres
Publié: (2024)
par: Vijayan, Vipin, et autres
Publié: (2024)
Exploring In-context Example Generation for Machine Translation
par: Lee, Dohyun, et autres
Publié: (2025)
par: Lee, Dohyun, et autres
Publié: (2025)
Exploring the Necessity of Reasoning in LLM-based Agent Scenarios
par: Zhou, Xueyang, et autres
Publié: (2025)
par: Zhou, Xueyang, et autres
Publié: (2025)
Syntax-Aware Complex-Valued Neural Machine Translation
par: Liu, Yang, et autres
Publié: (2023)
par: Liu, Yang, et autres
Publié: (2023)
Single-to-mix Modality Alignment with Multimodal Large Language Model for Document Image Machine Translation
par: Liang, Yupu, et autres
Publié: (2025)
par: Liang, Yupu, et autres
Publié: (2025)
ACADATA: Parallel Dataset of Academic Data for Machine Translation
par: Lacunza, Iñaki, et autres
Publié: (2025)
par: Lacunza, Iñaki, et autres
Publié: (2025)
Advancing Bangla Machine Translation Through Informal Datasets
par: Roy, Ayon, et autres
Publié: (2025)
par: Roy, Ayon, et autres
Publié: (2025)
Is a Picture Worth a Thousand Words? Adaptive Multimodal Fact-Checking with Visual Evidence Necessity
par: Jung, Jaeyoon, et autres
Publié: (2026)
par: Jung, Jaeyoon, et autres
Publié: (2026)
ForMaT: Dataset for Visually-Grounded Multilingual PDF Translation
par: Ciesiółka, Michał, et autres
Publié: (2026)
par: Ciesiółka, Michał, et autres
Publié: (2026)
Samasāmayik: A Parallel Dataset for Hindi-Sanskrit Machine Translation
par: Karthika, N J, et autres
Publié: (2026)
par: Karthika, N J, et autres
Publié: (2026)
Mitrasamgraha: A Comprehensive Classical Sanskrit Machine Translation Dataset
par: Nehrdich, Sebastian, et autres
Publié: (2026)
par: Nehrdich, Sebastian, et autres
Publié: (2026)
Dual-branch Prompting for Multimodal Machine Translation
par: Wang, Jie, et autres
Publié: (2025)
par: Wang, Jie, et autres
Publié: (2025)
Visual Reasoning Benchmark: Evaluating Multimodal LLMs on Classroom-Authentic Visual Problems from Primary Education
par: Huti, Mohamed, et autres
Publié: (2026)
par: Huti, Mohamed, et autres
Publié: (2026)
Scalable Multilingual Multimodal Machine Translation with Speech-Text Fusion
par: Du, Yexing, et autres
Publié: (2026)
par: Du, Yexing, et autres
Publié: (2026)
CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation
par: Villa-Cueva, Emilio, et autres
Publié: (2025)
par: Villa-Cueva, Emilio, et autres
Publié: (2025)
Benchmarking Machine Translation on Chinese Social Media Texts
par: Zhao, Kaiyan, et autres
Publié: (2026)
par: Zhao, Kaiyan, et autres
Publié: (2026)
How Well Do Large Reasoning Models Translate? A Comprehensive Evaluation for Multi-Domain Machine Translation
par: Ye, Yongshi, et autres
Publié: (2025)
par: Ye, Yongshi, et autres
Publié: (2025)
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
par: Zhang, Yu, et autres
Publié: (2025)
par: Zhang, Yu, et autres
Publié: (2025)
Multimodal Coreference Resolution for Chinese Social Media Dialogues: Dataset and Benchmark Approach
par: Li, Xingyu, et autres
Publié: (2025)
par: Li, Xingyu, et autres
Publié: (2025)
Exploring the Potential of Machine Translation for Generating Named Entity Datasets: A Case Study between Persian and English
par: Sartipi, Amir, et autres
Publié: (2023)
par: Sartipi, Amir, et autres
Publié: (2023)
Bidirectional Chinese and English Passive Sentences Dataset for Machine Translation
par: Ma, Xinyue, et autres
Publié: (2026)
par: Ma, Xinyue, et autres
Publié: (2026)
POMP: Probability-driven Meta-graph Prompter for LLMs in Low-resource Unsupervised Neural Machine Translation
par: Pan, Shilong, et autres
Publié: (2024)
par: Pan, Shilong, et autres
Publié: (2024)
Exploring In-Image Machine Translation with Real-World Background
par: Tian, Yanzhi, et autres
Publié: (2025)
par: Tian, Yanzhi, et autres
Publié: (2025)
Exploring the Correlation between Human and Machine Evaluation of Simultaneous Speech Translation
par: Wang, Xiaoman, et autres
Publié: (2024)
par: Wang, Xiaoman, et autres
Publié: (2024)
New Trends for Modern Machine Translation with Large Reasoning Models
par: Liu, Sinuo, et autres
Publié: (2025)
par: Liu, Sinuo, et autres
Publié: (2025)
Building Bridges: A Dataset for Evaluating Gender-Fair Machine Translation into German
par: Lardelli, Manuel, et autres
Publié: (2024)
par: Lardelli, Manuel, et autres
Publié: (2024)
FAME-MT Dataset: Formality Awareness Made Easy for Machine Translation Purposes
par: Wiśniewski, Dawid, et autres
Publié: (2024)
par: Wiśniewski, Dawid, et autres
Publié: (2024)
Documents similaires
-
TopicVD: A Topic-Based Dataset of Video-Guided Multimodal Machine Translation for Documentaries
par: Lv, Jinze, et autres
Publié: (2025) -
A General Pseudonymization Framework for Cloud-Based LLMs: Replacing Privacy Information in Controlled Text Generation
par: Hou, Shilong, et autres
Publié: (2025) -
Video-guided Machine Translation with Global Video Context
par: Chen, Jian, et autres
Publié: (2026) -
Detecting Concrete Visual Tokens for Multimodal Machine Translation
par: Bowen, Braeden, et autres
Publié: (2024) -
Paraphrase-Aligned Machine Translation
par: Chang, Ke-Ching, et autres
Publié: (2024)