Guardado en:
| Autores principales: | Yan, Jianhao, Yan, Pingchuan, Chen, Yulong, Li, Judy, Zhu, Xianchao, Zhang, Yue |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2407.03658 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Benchmarking GPT-4 against Human Translators: A Comprehensive Evaluation Across Languages, Domains, and Expertise Levels
por: Yan, Jianhao, et al.
Publicado: (2024)
por: Yan, Jianhao, et al.
Publicado: (2024)
What Have We Achieved on Non-autoregressive Translation?
por: Li, Yafu, et al.
Publicado: (2024)
por: Li, Yafu, et al.
Publicado: (2024)
RefuteBench: Evaluating Refuting Instruction-Following for Large Language Models
por: Yan, Jianhao, et al.
Publicado: (2024)
por: Yan, Jianhao, et al.
Publicado: (2024)
Gradable ChatGPT Translation Evaluation
por: Jiao, Hui, et al.
Publicado: (2024)
por: Jiao, Hui, et al.
Publicado: (2024)
Creative and Context-Aware Translation of East Asian Idioms with GPT-4
por: Tang, Kenan, et al.
Publicado: (2024)
por: Tang, Kenan, et al.
Publicado: (2024)
How Well Do Large Reasoning Models Translate? A Comprehensive Evaluation for Multi-Domain Machine Translation
por: Ye, Yongshi, et al.
Publicado: (2025)
por: Ye, Yongshi, et al.
Publicado: (2025)
RefuteBench 2.0 -- Agentic Benchmark for Dynamic Evaluation of LLM Responses to Refutation Instruction
por: Yan, Jianhao, et al.
Publicado: (2025)
por: Yan, Jianhao, et al.
Publicado: (2025)
To Diverge or Not to Diverge: A Morphosyntactic Perspective on Machine Translation vs Human Translation
por: Luo, Jiaming, et al.
Publicado: (2024)
por: Luo, Jiaming, et al.
Publicado: (2024)
LLM4FS: Leveraging Large Language Models for Feature Selection
por: Li, Jianhao, et al.
Publicado: (2025)
por: Li, Jianhao, et al.
Publicado: (2025)
Chapter Translation complexities
por: Yue, Yan
Publicado: (2026)
por: Yue, Yan
Publicado: (2026)
Convergences and Divergences between Automatic Assessment and Human Evaluation: Insights from Comparing ChatGPT-Generated Translation and Neural Machine Translation
por: Jiang, Zhaokun, et al.
Publicado: (2024)
por: Jiang, Zhaokun, et al.
Publicado: (2024)
The Paradox of Poetic Intent in Back-Translation: Evaluating the Quality of Large Language Models in Chinese Translation
por: Weigang, Li, et al.
Publicado: (2025)
por: Weigang, Li, et al.
Publicado: (2025)
Quality Estimation Reranking for Document-Level Translation
por: Mrozinski, Krzysztof, et al.
Publicado: (2025)
por: Mrozinski, Krzysztof, et al.
Publicado: (2025)
Evaluating the Translation Performance of Large Language Models Based on Euas-20
por: Huang, Yan, et al.
Publicado: (2024)
por: Huang, Yan, et al.
Publicado: (2024)
MMTE: Corpus and Metrics for Evaluating Machine Translation Quality of Metaphorical Language
por: Wang, Shun, et al.
Publicado: (2024)
por: Wang, Shun, et al.
Publicado: (2024)
Lost in the Source Language: How Large Language Models Evaluate the Quality of Machine Translation
por: Huang, Xu, et al.
Publicado: (2024)
por: Huang, Xu, et al.
Publicado: (2024)
Distinguishing Translations by Human, NMT, and ChatGPT: A Linguistic and Statistical Approach
por: Jiang, Zhaokun, et al.
Publicado: (2023)
por: Jiang, Zhaokun, et al.
Publicado: (2023)
Who Endorsed It? Measuring Authority Bias Across Expertise Levels in Language Models
por: Mammen, Priyanka Mary, et al.
Publicado: (2026)
por: Mammen, Priyanka Mary, et al.
Publicado: (2026)
DiscoX: Benchmarking Discourse-Level Translation task in Expert Domains
por: Zhao, Xiying, et al.
Publicado: (2025)
por: Zhao, Xiying, et al.
Publicado: (2025)
Questionnaires for Everyone: Streamlining Cross-Cultural Questionnaire Adaptation with GPT-Based Translation Quality Evaluation
por: Haavisto, Otso, et al.
Publicado: (2024)
por: Haavisto, Otso, et al.
Publicado: (2024)
Spatial Speech Translation: Translating Across Space With Binaural Hearables
por: Chen, Tuochao, et al.
Publicado: (2025)
por: Chen, Tuochao, et al.
Publicado: (2025)
Ready to Translate, Not to Represent? Bias and Performance Gaps in Multilingual LLMs Across Language Families and Domains
por: Sayeedi, Md. Faiyaz Abdullah, et al.
Publicado: (2025)
por: Sayeedi, Md. Faiyaz Abdullah, et al.
Publicado: (2025)
Evaluating o1-Like LLMs: Unlocking Reasoning for Translation through Comprehensive Analysis
por: Chen, Andong, et al.
Publicado: (2025)
por: Chen, Andong, et al.
Publicado: (2025)
Beyond Human-Only: Evaluating Human-Machine Collaboration for Collecting High-Quality Translation Data
por: Liu, Zhongtao, et al.
Publicado: (2024)
por: Liu, Zhongtao, et al.
Publicado: (2024)
How Good Are LLMs for Literary Translation, Really? Literary Translation Evaluation with Humans and LLMs
por: Zhang, Ran, et al.
Publicado: (2024)
por: Zhang, Ran, et al.
Publicado: (2024)
See What LLMs Cannot Answer: A Self-Challenge Framework for Uncovering LLM Weaknesses
por: Chen, Yulong, et al.
Publicado: (2024)
por: Chen, Yulong, et al.
Publicado: (2024)
Sentiment Analysis Across Languages: Evaluation Before and After Machine Translation to English
por: Kathunia, Aekansh, et al.
Publicado: (2024)
por: Kathunia, Aekansh, et al.
Publicado: (2024)
Can Uniform Meaning Representation Help GPT-4 Translate from Indigenous Languages?
por: Wein, Shira
Publicado: (2025)
por: Wein, Shira
Publicado: (2025)
Text Understanding in GPT-4 vs Humans
por: Shultz, Thomas R., et al.
Publicado: (2024)
por: Shultz, Thomas R., et al.
Publicado: (2024)
Reconsidering Sentence-Level Sign Language Translation
por: Tanzer, Garrett, et al.
Publicado: (2024)
por: Tanzer, Garrett, et al.
Publicado: (2024)
Chapter Translation as registerial interaction in cross-cultural communication
por: Yue, Yan
Publicado: (2026)
por: Yue, Yan
Publicado: (2026)
Span-Level Machine Translation Meta-Evaluation
por: Perrella, Stefano, et al.
Publicado: (2026)
por: Perrella, Stefano, et al.
Publicado: (2026)
Should I Share this Translation? Evaluating Quality Feedback for User Reliance on Machine Translation
por: Ki, Dayeon, et al.
Publicado: (2025)
por: Ki, Dayeon, et al.
Publicado: (2025)
Potential and Challenges of Model Editing for Social Debiasing
por: Yan, Jianhao, et al.
Publicado: (2024)
por: Yan, Jianhao, et al.
Publicado: (2024)
Flexible and Adaptable Summarization via Expertise Separation
por: Chen, Xiuying, et al.
Publicado: (2024)
por: Chen, Xiuying, et al.
Publicado: (2024)
AI-Assisted Human Evaluation of Machine Translation
por: Zouhar, Vilém, et al.
Publicado: (2024)
por: Zouhar, Vilém, et al.
Publicado: (2024)
Non-Linear Scoring Model for Translation Quality Evaluation
por: Gladkoff, Serge, et al.
Publicado: (2025)
por: Gladkoff, Serge, et al.
Publicado: (2025)
ROC Analysis for Evaluating Translation Quality Estimation Systems
por: Garland, Evelyn Y., et al.
Publicado: (2026)
por: Garland, Evelyn Y., et al.
Publicado: (2026)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024)
por: Huang, Pengcheng, et al.
Publicado: (2024)
Lost in Translation: Do LVLM Judges Generalize Across Languages?
por: Laskar, Md Tahmid Rahman, et al.
Publicado: (2026)
por: Laskar, Md Tahmid Rahman, et al.
Publicado: (2026)
Ejemplares similares
-
Benchmarking GPT-4 against Human Translators: A Comprehensive Evaluation Across Languages, Domains, and Expertise Levels
por: Yan, Jianhao, et al.
Publicado: (2024) -
What Have We Achieved on Non-autoregressive Translation?
por: Li, Yafu, et al.
Publicado: (2024) -
RefuteBench: Evaluating Refuting Instruction-Following for Large Language Models
por: Yan, Jianhao, et al.
Publicado: (2024) -
Gradable ChatGPT Translation Evaluation
por: Jiao, Hui, et al.
Publicado: (2024) -
Creative and Context-Aware Translation of East Asian Idioms with GPT-4
por: Tang, Kenan, et al.
Publicado: (2024)