The Box is in the Pen: Evaluating Commonsense Reasoning in Neural Machine Translation
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Jie, Wang, Tao, Xiong, Deyi, Liu, Qun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Meta-RTL: Reinforcement-Based Meta-Transfer Learning for Low-Resource Commonsense Reasoning
di: Fu, Yu, et al.
Pubblicazione: (2024)
di: Fu, Yu, et al.
Pubblicazione: (2024)
An Empirical Study on the Robustness of Massively Multilingual Neural Machine Translation
di: Supryadi, et al.
Pubblicazione: (2024)
di: Supryadi, et al.
Pubblicazione: (2024)
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
di: Yu, Linhao, et al.
Pubblicazione: (2024)
di: Yu, Linhao, et al.
Pubblicazione: (2024)
Evaluating Discourse Cohesion in Pre-trained Language Models
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Tgea: An error-annotated dataset and benchmark tasks for text generation from pretrained language models
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Efficiently Exploring Large Language Models for Document-Level Machine Translation with In-context Learning
di: Cui, Menglong, et al.
Pubblicazione: (2024)
di: Cui, Menglong, et al.
Pubblicazione: (2024)
LANDeRMT: Detecting and Routing Language-Aware Neurons for Selectively Finetuning LLMs to Machine Translation
di: Zhu, Shaolin, et al.
Pubblicazione: (2024)
di: Zhu, Shaolin, et al.
Pubblicazione: (2024)
MetaXCR: Reinforcement-Based Meta-Transfer Learning for Cross-Lingual Commonsense Reasoning
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
FuxiMT: Sparsifying Large Language Models for Chinese-Centric Multilingual Machine Translation
di: Zhu, Shaolin, et al.
Pubblicazione: (2025)
di: Zhu, Shaolin, et al.
Pubblicazione: (2025)
Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs
di: Li, Bo, et al.
Pubblicazione: (2026)
di: Li, Bo, et al.
Pubblicazione: (2026)
CRiskEval: A Chinese Multi-Level Risk Evaluation Benchmark Dataset for Large Language Models
di: Shi, Ling, et al.
Pubblicazione: (2024)
di: Shi, Ling, et al.
Pubblicazione: (2024)
SCoRE: Benchmarking Long-Chain Reasoning in Commonsense Scenarios
di: Zhan, Weidong, et al.
Pubblicazione: (2025)
di: Zhan, Weidong, et al.
Pubblicazione: (2025)
ACORN: Aspect-wise Commonsense Reasoning Explanation Evaluation
di: Brassard, Ana, et al.
Pubblicazione: (2024)
di: Brassard, Ana, et al.
Pubblicazione: (2024)
Zero-shot Commonsense Reasoning over Machine Imagination
di: Park, Hyuntae, et al.
Pubblicazione: (2024)
di: Park, Hyuntae, et al.
Pubblicazione: (2024)
AdaST: Dynamically Adapting Encoder States in the Decoder for End-to-End Speech-to-Text Translation
di: Huang, Wuwei, et al.
Pubblicazione: (2025)
di: Huang, Wuwei, et al.
Pubblicazione: (2025)
Commonsense Reasoning in Arab Culture
di: Sadallah, Abdelrahman, et al.
Pubblicazione: (2025)
di: Sadallah, Abdelrahman, et al.
Pubblicazione: (2025)
Global PIQA: Evaluating Commonsense Reasoning Across 100+ Languages and Cultures
di: Chang, Tyler A., et al.
Pubblicazione: (2025)
di: Chang, Tyler A., et al.
Pubblicazione: (2025)
Evaluating and Improving Graph to Text Generation with Large Language Models
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Evaluating Structural Generalization in Neural Machine Translation
di: Kumon, Ryoma, et al.
Pubblicazione: (2024)
di: Kumon, Ryoma, et al.
Pubblicazione: (2024)
LHMKE: A Large-scale Holistic Multi-subject Knowledge Evaluation Benchmark for Chinese Large Language Models
di: Liu, Chuang, et al.
Pubblicazione: (2024)
di: Liu, Chuang, et al.
Pubblicazione: (2024)
Evaluating the Evaluation of Diversity in Commonsense Generation
di: Zhang, Tianhui, et al.
Pubblicazione: (2025)
di: Zhang, Tianhui, et al.
Pubblicazione: (2025)
HellaSwag-Pro: A Large-Scale Bilingual Benchmark for Evaluating the Robustness of LLMs in Commonsense Reasoning
di: Li, Xiaoyuan, et al.
Pubblicazione: (2025)
di: Li, Xiaoyuan, et al.
Pubblicazione: (2025)
Benchmarking Chinese Commonsense Reasoning of LLMs: From Chinese-Specifics to Reasoning-Memorization Correlations
di: Sun, Jiaxing, et al.
Pubblicazione: (2024)
di: Sun, Jiaxing, et al.
Pubblicazione: (2024)
GRASP: A Grid-Based Benchmark for Evaluating Commonsense Spatial Reasoning
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)
Susu Box or Piggy Bank: Assessing Cultural Commonsense Knowledge between Ghana and the U.S
di: Acquaye, Christabel, et al.
Pubblicazione: (2024)
di: Acquaye, Christabel, et al.
Pubblicazione: (2024)
RoleEval: A Bilingual Role Evaluation Benchmark for Large Language Models
di: Shen, Tianhao, et al.
Pubblicazione: (2023)
di: Shen, Tianhao, et al.
Pubblicazione: (2023)
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
di: You, Wangjie, et al.
Pubblicazione: (2025)
di: You, Wangjie, et al.
Pubblicazione: (2025)
An Interdisciplinary Review of Commonsense Reasoning and Intent Detection
di: Sakib, Md Nazmus
Pubblicazione: (2025)
di: Sakib, Md Nazmus
Pubblicazione: (2025)
PyMarian: Fast Neural Machine Translation and Evaluation in Python
di: Gowda, Thamme, et al.
Pubblicazione: (2024)
di: Gowda, Thamme, et al.
Pubblicazione: (2024)
MuDRiC: Multi-Dialect Reasoning for Arabic Commonsense Validation
di: Elozeiri, Kareem, et al.
Pubblicazione: (2025)
di: Elozeiri, Kareem, et al.
Pubblicazione: (2025)
ReTraceQA: Evaluating Reasoning Traces of Small Language Models in Commonsense Question Answering
di: Molfese, Francesco Maria, et al.
Pubblicazione: (2025)
di: Molfese, Francesco Maria, et al.
Pubblicazione: (2025)
Towards Understanding Multi-Task Learning (Generalization) of LLMs via Detecting and Exploring Task-Specific Neurons
di: Leng, Yongqi, et al.
Pubblicazione: (2024)
di: Leng, Yongqi, et al.
Pubblicazione: (2024)
Self-Vocabularizing Training for Neural Machine Translation
di: Lin, Pin-Jie, et al.
Pubblicazione: (2025)
di: Lin, Pin-Jie, et al.
Pubblicazione: (2025)
Doing Good or Doing Right? Exploring the Weakness of Commonsense Causal Reasoning Models
di: Han, Mingyue, et al.
Pubblicazione: (2021)
di: Han, Mingyue, et al.
Pubblicazione: (2021)
Pluggable Neural Machine Translation Models via Memory-augmented Adapters
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
N2C2: Nearest Neighbor Enhanced Confidence Calibration for Cross-Lingual In-Context Learning
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
CKBP v2: Better Annotation and Reasoning for Commonsense Knowledge Base Population
di: Fang, Tianqing, et al.
Pubblicazione: (2023)
di: Fang, Tianqing, et al.
Pubblicazione: (2023)
Detecting Emotional Incongruity of Sarcasm by Commonsense Reasoning
di: Qiu, Ziqi, et al.
Pubblicazione: (2024)
di: Qiu, Ziqi, et al.
Pubblicazione: (2024)
New Trends for Modern Machine Translation with Large Reasoning Models
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
CANDLE: Iterative Conceptualization and Instantiation Distillation from Large Language Models for Commonsense Reasoning
di: Wang, Weiqi, et al.
Pubblicazione: (2024)
di: Wang, Weiqi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Meta-RTL: Reinforcement-Based Meta-Transfer Learning for Low-Resource Commonsense Reasoning
di: Fu, Yu, et al.
Pubblicazione: (2024) -
An Empirical Study on the Robustness of Massively Multilingual Neural Machine Translation
di: Supryadi, et al.
Pubblicazione: (2024) -
LFED: A Literary Fiction Evaluation Dataset for Large Language Models
di: Yu, Linhao, et al.
Pubblicazione: (2024) -
Evaluating Discourse Cohesion in Pre-trained Language Models
di: He, Jie, et al.
Pubblicazione: (2025) -
Tgea: An error-annotated dataset and benchmark tasks for text generation from pretrained language models
di: He, Jie, et al.
Pubblicazione: (2025)