VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation
Fuente:
arXiv
Salvato in:
| Autori principali: | Pan, Jingheng, Wang, Xintong, Wang, Longyue, Ding, Liang, Luo, Weihua, Biemann, Chris |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CogSteer: Cognition-Inspired Selective Layer Intervention for Efficiently Steering Large Language Models
di: Wang, Xintong, et al.
Pubblicazione: (2024)
di: Wang, Xintong, et al.
Pubblicazione: (2024)
Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding
di: Wang, Xintong, et al.
Pubblicazione: (2024)
di: Wang, Xintong, et al.
Pubblicazione: (2024)
Chinese Toxic Language Mitigation via Sentiment Polarity Consistent Rewrites
di: Wang, Xintong, et al.
Pubblicazione: (2025)
di: Wang, Xintong, et al.
Pubblicazione: (2025)
Rethinking Multilingual Vision-Language Translation: Dataset, Evaluation, and Adaptation
di: Wang, Xintong, et al.
Pubblicazione: (2025)
di: Wang, Xintong, et al.
Pubblicazione: (2025)
Just Use XML: Revisiting Joint Translation and Label Projection
di: DK, Thennal, et al.
Pubblicazione: (2026)
di: DK, Thennal, et al.
Pubblicazione: (2026)
Finding the Translation Switch: Discovering and Exploiting the Task-Initiation Features in LLMs
di: Wu, Xinwei, et al.
Pubblicazione: (2026)
di: Wu, Xinwei, et al.
Pubblicazione: (2026)
Incentivizing Parametric Knowledge via Reinforcement Learning with Verifiable Rewards for Cross-Cultural Entity Translation
di: Zhou, Jiang, et al.
Pubblicazione: (2026)
di: Zhou, Jiang, et al.
Pubblicazione: (2026)
The Gray Zone of Faithfulness: Taming Ambiguity in Unfaithfulness Detection
di: Ding, Qiang, et al.
Pubblicazione: (2025)
di: Ding, Qiang, et al.
Pubblicazione: (2025)
VisionGraph: Leveraging Large Multimodal Models for Graph Theory Problems in Visual Context
di: Li, Yunxin, et al.
Pubblicazione: (2024)
di: Li, Yunxin, et al.
Pubblicazione: (2024)
Marco-MoE: Open Multilingual Mixture-of-Expert Language Models with Efficient Upcycling
di: Jiang, Fan, et al.
Pubblicazione: (2026)
di: Jiang, Fan, et al.
Pubblicazione: (2026)
Large Language Models Are Overparameterized Text Encoders
di: K, Thennal D, et al.
Pubblicazione: (2024)
di: K, Thennal D, et al.
Pubblicazione: (2024)
POMP: Probability-driven Meta-graph Prompter for LLMs in Low-resource Unsupervised Neural Machine Translation
di: Pan, Shilong, et al.
Pubblicazione: (2024)
di: Pan, Shilong, et al.
Pubblicazione: (2024)
Evaluation of Machine Translation Based on Semantic Dependencies and Keywords
di: Yuan, Kewei, et al.
Pubblicazione: (2024)
di: Yuan, Kewei, et al.
Pubblicazione: (2024)
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
di: Zhu, Bin, et al.
Pubblicazione: (2026)
di: Zhu, Bin, et al.
Pubblicazione: (2026)
nvBench 2.0: Resolving Ambiguity in Text-to-Visualization through Stepwise Reasoning
di: Luo, Tianqi, et al.
Pubblicazione: (2025)
di: Luo, Tianqi, et al.
Pubblicazione: (2025)
Comprehensive Comparison of RAG Methods Across Multi-Domain Conversational QA
di: Alushi, Klejda, et al.
Pubblicazione: (2026)
di: Alushi, Klejda, et al.
Pubblicazione: (2026)
EncouRAGe: Evaluating RAG Local, Fast, and Reliable
di: Strich, Jan, et al.
Pubblicazione: (2025)
di: Strich, Jan, et al.
Pubblicazione: (2025)
LEMUR: A Corpus for Robust Fine-Tuning of Multilingual Law Embedding Models for Retrieval
di: Ahmadi, Narges Baba, et al.
Pubblicazione: (2026)
di: Ahmadi, Narges Baba, et al.
Pubblicazione: (2026)
Fine-Tuned Machine Translation Metrics Struggle in Unseen Domains
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
m3P: Towards Multimodal Multilingual Translation with Multimodal Prompt
di: Yang, Jian, et al.
Pubblicazione: (2024)
di: Yang, Jian, et al.
Pubblicazione: (2024)
Comparing Large Language Models and Traditional Machine Translation Tools for Translating Medical Consultation Summaries: A Pilot Study
di: Li, Andy, et al.
Pubblicazione: (2025)
di: Li, Andy, et al.
Pubblicazione: (2025)
HSCodeComp: A Realistic and Expert-level Benchmark for Deep Search Agents in Hierarchical Rule Application
di: Yang, Yiqian, et al.
Pubblicazione: (2025)
di: Yang, Yiqian, et al.
Pubblicazione: (2025)
TextBind: Multi-turn Interleaved Multimodal Instruction-following in the Wild
di: Li, Huayang, et al.
Pubblicazione: (2023)
di: Li, Huayang, et al.
Pubblicazione: (2023)
Towards Understanding and Improving Knowledge Distillation for Neural Machine Translation
di: Zhang, Songming, et al.
Pubblicazione: (2023)
di: Zhang, Songming, et al.
Pubblicazione: (2023)
GIIFT: Graph-guided Inductive Image-free Multimodal Machine Translation
di: Xiong, Jiafeng, et al.
Pubblicazione: (2025)
di: Xiong, Jiafeng, et al.
Pubblicazione: (2025)
Probing Large Language Models from A Human Behavioral Perspective
di: Wang, Xintong, et al.
Pubblicazione: (2023)
di: Wang, Xintong, et al.
Pubblicazione: (2023)
Position: Multimodal Large Language Models Can Significantly Advance Scientific Reasoning
di: Yan, Yibo, et al.
Pubblicazione: (2025)
di: Yan, Yibo, et al.
Pubblicazione: (2025)
Retrieval-Augmented Machine Translation with Unstructured Knowledge
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
Attention with Dependency Parsing Augmentation for Fine-Grained Attribution
di: Ding, Qiang, et al.
Pubblicazione: (2024)
di: Ding, Qiang, et al.
Pubblicazione: (2024)
Vectra: A New Metric, Dataset, and Model for Visual Quality Assessment in E-Commerce In-Image Machine Translation
di: Wu, Qingyu, et al.
Pubblicazione: (2026)
di: Wu, Qingyu, et al.
Pubblicazione: (2026)
Vision-Grounded Machine Interpreting: Improving the Translation Process through Visual Cues
di: Fantinuoli, Claudio
Pubblicazione: (2025)
di: Fantinuoli, Claudio
Pubblicazione: (2025)
Corrections Meet Explanations: A Unified Framework for Explainable Grammatical Error Correction
di: Ye, Jingheng, et al.
Pubblicazione: (2025)
di: Ye, Jingheng, et al.
Pubblicazione: (2025)
On the Shortcut Learning in Multilingual Neural Machine Translation
di: Wang, Wenxuan, et al.
Pubblicazione: (2024)
di: Wang, Wenxuan, et al.
Pubblicazione: (2024)
Textual Similarity as a Key Metric in Machine Translation Quality Estimation
di: Sun, Kun, et al.
Pubblicazione: (2024)
di: Sun, Kun, et al.
Pubblicazione: (2024)
EssayJudge: A Multi-Granular Benchmark for Assessing Automated Essay Scoring Capabilities of Multimodal Large Language Models
di: Su, Jiamin, et al.
Pubblicazione: (2025)
di: Su, Jiamin, et al.
Pubblicazione: (2025)
ACT-MNMT Auto-Constriction Turning for Multilingual Neural Machine Translation
di: Dai, Shaojie, et al.
Pubblicazione: (2024)
di: Dai, Shaojie, et al.
Pubblicazione: (2024)
New Trends for Modern Machine Translation with Large Reasoning Models
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
Uni-MoE: Scaling Unified Multimodal LLMs with Mixture of Experts
di: Li, Yunxin, et al.
Pubblicazione: (2024)
di: Li, Yunxin, et al.
Pubblicazione: (2024)
Multimodal Commonsense Knowledge Distillation for Visual Question Answering
di: Yang, Shuo, et al.
Pubblicazione: (2024)
di: Yang, Shuo, et al.
Pubblicazione: (2024)
Memory Reviving, Continuing Learning and Beyond: Evaluation of Pre-trained Encoders and Decoders for Multimodal Machine Translation
di: Yu, Zhuang, et al.
Pubblicazione: (2025)
di: Yu, Zhuang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CogSteer: Cognition-Inspired Selective Layer Intervention for Efficiently Steering Large Language Models
di: Wang, Xintong, et al.
Pubblicazione: (2024) -
Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding
di: Wang, Xintong, et al.
Pubblicazione: (2024) -
Chinese Toxic Language Mitigation via Sentiment Polarity Consistent Rewrites
di: Wang, Xintong, et al.
Pubblicazione: (2025) -
Rethinking Multilingual Vision-Language Translation: Dataset, Evaluation, and Adaptation
di: Wang, Xintong, et al.
Pubblicazione: (2025) -
Just Use XML: Revisiting Joint Translation and Label Projection
di: DK, Thennal, et al.
Pubblicazione: (2026)