M3T: A New Benchmark Dataset for Multi-Modal Document-Level Machine Translation
Fuente:
arXiv
Guardado en:
| Autores principales: | Hsu, Benjamin, Liu, Xiaoyu, Li, Huayang, Fujinuma, Yoshinari, Nadejde, Maria, Niu, Xing, Kittenplon, Yair, Litman, Ron, Pappagari, Raghavendra |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Contrastive Decoding Mitigates Score Range Bias in LLM-as-a-Judge
por: Fujinuma, Yoshinari
Publicado: (2025)
por: Fujinuma, Yoshinari
Publicado: (2025)
Unlocking Prompt Infilling Capability for Diffusion Language Models
por: Fujinuma, Yoshinari, et al.
Publicado: (2026)
por: Fujinuma, Yoshinari, et al.
Publicado: (2026)
Question Aware Vision Transformer for Multimodal Reasoning
por: Ganz, Roy, et al.
Publicado: (2024)
por: Ganz, Roy, et al.
Publicado: (2024)
TAP-VL: Text Layout-Aware Pre-training for Enriched Vision-Language Models
por: Fhima, Jonathan, et al.
Publicado: (2024)
por: Fhima, Jonathan, et al.
Publicado: (2024)
DocVLM: Make Your VLM an Efficient Reader
por: Nacson, Mor Shpigel, et al.
Publicado: (2024)
por: Nacson, Mor Shpigel, et al.
Publicado: (2024)
Fine-Grained and Multi-Dimensional Metrics for Document-Level Machine Translation
por: Sun, Yirong, et al.
Publicado: (2024)
por: Sun, Yirong, et al.
Publicado: (2024)
Entropy governs the structure and reactivity of water dissociation under electric fields
por: Litman, Yair, et al.
Publicado: (2025)
por: Litman, Yair, et al.
Publicado: (2025)
Diable: Efficient Dialogue State Tracking as Operations on Tables
por: Lesci, Pietro, et al.
Publicado: (2023)
por: Lesci, Pietro, et al.
Publicado: (2023)
3AM: An Ambiguity-Aware Multi-Modal Machine Translation Dataset
por: Ma, Xinyu, et al.
Publicado: (2024)
por: Ma, Xinyu, et al.
Publicado: (2024)
Explaining Principles of Tip-Enhanced Raman Images with Ab Initio Modeling
por: Brezina, Krystof, et al.
Publicado: (2025)
por: Brezina, Krystof, et al.
Publicado: (2025)
M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery
por: Guo, Siyuan, et al.
Publicado: (2024)
por: Guo, Siyuan, et al.
Publicado: (2024)
MuS-Polar3D: A Benchmark Dataset for Computational Polarimetric 3D Imaging under Multi-Scattering Conditions
por: Wang, Puyun, et al.
Publicado: (2025)
por: Wang, Puyun, et al.
Publicado: (2025)
Defenses & Enablers For Skill Injection Attacks on Terminal Based Agents
por: Fujinuma, Yoshinari, et al.
Publicado: (2026)
por: Fujinuma, Yoshinari, et al.
Publicado: (2026)
IMTBench: A Multi-Scenario Cross-Modal Collaborative Evaluation Benchmark for In-Image Machine Translation
por: Lyu, Jiahao, et al.
Publicado: (2026)
por: Lyu, Jiahao, et al.
Publicado: (2026)
Discourse-Driven Evaluation: Unveiling Factual Inconsistency in Long Document Summarization
por: Zhong, Yang, et al.
Publicado: (2025)
por: Zhong, Yang, et al.
Publicado: (2025)
Align-then-Slide: A complete evaluation framework for Ultra-Long Document-Level Machine Translation
por: Guo, Jiaxin, et al.
Publicado: (2025)
por: Guo, Jiaxin, et al.
Publicado: (2025)
Building Age Estimation: A New Multi-Modal Benchmark Dataset and Community Challenge
por: Dionelis, Nikolaos, et al.
Publicado: (2025)
por: Dionelis, Nikolaos, et al.
Publicado: (2025)
Adapting Large Language Models for Document-Level Machine Translation
por: Wu, Minghao, et al.
Publicado: (2024)
por: Wu, Minghao, et al.
Publicado: (2024)
DOLFIN -- Document-Level Financial test set for Machine Translation
por: Nakhlé, Mariam, et al.
Publicado: (2025)
por: Nakhlé, Mariam, et al.
Publicado: (2025)
Document-Level Machine Translation as a Re-translation Process
por: Eva Martínez Garcia
Publicado: (2014)
por: Eva Martínez Garcia
Publicado: (2014)
Exploring the Necessity of Visual Modality in Multimodal Machine Translation using Authentic Datasets
por: Long, Zi, et al.
Publicado: (2024)
por: Long, Zi, et al.
Publicado: (2024)
ARC: Argument Representation and Coverage Analysis for Zero-Shot Long Document Summarization with Instruction Following LLMs
por: Elaraby, Mohamed, et al.
Publicado: (2025)
por: Elaraby, Mohamed, et al.
Publicado: (2025)
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
por: O'Brien, Dayyán, et al.
Publicado: (2025)
por: O'Brien, Dayyán, et al.
Publicado: (2025)
MUVR: A Multi-Modal Untrimmed Video Retrieval Benchmark with Multi-Level Visual Correspondence
por: Feng, Yue, et al.
Publicado: (2025)
por: Feng, Yue, et al.
Publicado: (2025)
Leveraging Perceptual Scores for Dataset Pruning in Computer Vision Tasks
por: Singh, Raghavendra
Publicado: (2024)
por: Singh, Raghavendra
Publicado: (2024)
Importance-Aware Data Augmentation for Document-Level Neural Machine Translation
por: Wu, Minghao, et al.
Publicado: (2024)
por: Wu, Minghao, et al.
Publicado: (2024)
Multilingual Contextualization of Large Language Models for Document-Level Machine Translation
por: Ramos, Miguel Moura, et al.
Publicado: (2025)
por: Ramos, Miguel Moura, et al.
Publicado: (2025)
AICircuit: A Multi-Level Dataset and Benchmark for AI-Driven Analog Integrated Circuit Design
por: Mehradfar, Asal, et al.
Publicado: (2024)
por: Mehradfar, Asal, et al.
Publicado: (2024)
Wetting Transparency of Graphene: A macroscopic Window but Nanoscopic Mirror
por: Wang, Yongkang, et al.
Publicado: (2025)
por: Wang, Yongkang, et al.
Publicado: (2025)
The Origin of Edge of Stability
por: Litman, Elon
Publicado: (2026)
por: Litman, Elon
Publicado: (2026)
Scaled-Dot-Product Attention as One-Sided Entropic Optimal Transport
por: Litman, Elon
Publicado: (2025)
por: Litman, Elon
Publicado: (2025)
Equilibrium Propagation Without Limits
por: Litman, Elon
Publicado: (2025)
por: Litman, Elon
Publicado: (2025)
DelTA: An Online Document-Level Translation Agent Based on Multi-Level Memory
por: Wang, Yutong, et al.
Publicado: (2024)
por: Wang, Yutong, et al.
Publicado: (2024)
Auto-SLURP: A Benchmark Dataset for Evaluating Multi-Agent Frameworks in Smart Personal Assistant
por: Shen, Lei, et al.
Publicado: (2025)
por: Shen, Lei, et al.
Publicado: (2025)
FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation
por: Luo, Junyu, et al.
Publicado: (2025)
por: Luo, Junyu, et al.
Publicado: (2025)
Establishing the Primary HEFT as a Precision Benchmark for UV-HEFT Matching
por: Ge, Zizhou, et al.
Publicado: (2026)
por: Ge, Zizhou, et al.
Publicado: (2026)
A New Dataset and Benchmark for Grounding Multimodal Misinformation
por: Yang, Bingjian, et al.
Publicado: (2025)
por: Yang, Bingjian, et al.
Publicado: (2025)
Single-to-mix Modality Alignment with Multimodal Large Language Model for Document Image Machine Translation
por: Liang, Yupu, et al.
Publicado: (2025)
por: Liang, Yupu, et al.
Publicado: (2025)
Empathy Level Prediction in Multi-Modal Scenario with Supervisory Documentation Assistance
por: Xiao, Yufei, et al.
Publicado: (2025)
por: Xiao, Yufei, et al.
Publicado: (2025)
Is Adversarial Training with Compressed Datasets Effective?
por: Chen, Tong, et al.
Publicado: (2024)
por: Chen, Tong, et al.
Publicado: (2024)
Ejemplares similares
-
Contrastive Decoding Mitigates Score Range Bias in LLM-as-a-Judge
por: Fujinuma, Yoshinari
Publicado: (2025) -
Unlocking Prompt Infilling Capability for Diffusion Language Models
por: Fujinuma, Yoshinari, et al.
Publicado: (2026) -
Question Aware Vision Transformer for Multimodal Reasoning
por: Ganz, Roy, et al.
Publicado: (2024) -
TAP-VL: Text Layout-Aware Pre-training for Enriched Vision-Language Models
por: Fhima, Jonathan, et al.
Publicado: (2024) -
DocVLM: Make Your VLM an Efficient Reader
por: Nacson, Mor Shpigel, et al.
Publicado: (2024)