TransEvalnia: Reasoning-based Evaluation and Ranking of Translations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sproat, Richard, Zhao, Tianyu, Jones, Llion |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Building Tailored Speech Recognizers for Japanese Speaking Assessment
par: Kubo, Yotaro, et autres
Publié: (2025)
par: Kubo, Yotaro, et autres
Publié: (2025)
Fast-weight Product Key Memory
par: Zhao, Tianyu, et autres
Publié: (2026)
par: Zhao, Tianyu, et autres
Publié: (2026)
Sudoku-Bench: Evaluating creative reasoning with Sudoku variants
par: Seely, Jeffrey, et autres
Publié: (2025)
par: Seely, Jeffrey, et autres
Publié: (2025)
RePo: Language Models with Context Re-Positioning
par: Li, Huayang, et autres
Publié: (2025)
par: Li, Huayang, et autres
Publié: (2025)
Creating ConLangs to Probe the Metalinguistic Grammatical Knowledge of LLMs
par: Taguchi, Chihiro, et autres
Publié: (2025)
par: Taguchi, Chihiro, et autres
Publié: (2025)
Transformer Layers as Painters
par: Sun, Qi, et autres
Publié: (2024)
par: Sun, Qi, et autres
Publié: (2024)
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
Evaluating the Impact of Verbal Multiword Expressions on Machine Translation
par: Liu, Linfeng, et autres
Publié: (2025)
par: Liu, Linfeng, et autres
Publié: (2025)
TransLLaMa: LLM-based Simultaneous Translation System
par: Koshkin, Roman, et autres
Publié: (2024)
par: Koshkin, Roman, et autres
Publié: (2024)
Sparser, Faster, Lighter Transformer Language Models
par: Cetin, Edoardo, et autres
Publié: (2026)
par: Cetin, Edoardo, et autres
Publié: (2026)
KamonBench: A Grammar-Based Dataset for Evaluating Compositional Factor Recovery in Vision-Language Models
par: Sproat, Richard, et autres
Publié: (2026)
par: Sproat, Richard, et autres
Publié: (2026)
TransBench: Benchmarking Machine Translation for Industrial-Scale Applications
par: Li, Haijun, et autres
Publié: (2025)
par: Li, Haijun, et autres
Publié: (2025)
TransAug: Translate as Augmentation for Sentence Embeddings
par: Wang, Jue
Publié: (2021)
par: Wang, Jue
Publié: (2021)
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
LiTransProQA: an LLM-based Literary Translation evaluation metric with Professional Question Answering
par: Zhang, Ran, et autres
Publié: (2025)
par: Zhang, Ran, et autres
Publié: (2025)
Evaluating o1-Like LLMs: Unlocking Reasoning for Translation through Comprehensive Analysis
par: Chen, Andong, et autres
Publié: (2025)
par: Chen, Andong, et autres
Publié: (2025)
The Box is in the Pen: Evaluating Commonsense Reasoning in Neural Machine Translation
par: He, Jie, et autres
Publié: (2025)
par: He, Jie, et autres
Publié: (2025)
HI-TransPA: Hearing Impairments Translation Personal Assistant
par: Ma, Zhiming, et autres
Publié: (2025)
par: Ma, Zhiming, et autres
Publié: (2025)
Graphemic Normalization of the Perso-Arabic Script
par: Doctor, Raiomond, et autres
Publié: (2022)
par: Doctor, Raiomond, et autres
Publié: (2022)
Beyond Arabic: Software for Perso-Arabic Script Manipulation
par: Gutkin, Alexander, et autres
Publié: (2023)
par: Gutkin, Alexander, et autres
Publié: (2023)
TransERR: Translation-based Knowledge Graph Embedding via Efficient Relation Rotation
par: Li, Jiang, et autres
Publié: (2023)
par: Li, Jiang, et autres
Publié: (2023)
ReasoningRank: Teaching Student Models to Rank through Reasoning-Based Knowledge Distillation
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
TransAlign: Machine Translation Encoders are Strong Word Aligners, Too
par: Ebing, Benedikt, et autres
Publié: (2025)
par: Ebing, Benedikt, et autres
Publié: (2025)
How Well Do Large Reasoning Models Translate? A Comprehensive Evaluation for Multi-Domain Machine Translation
par: Ye, Yongshi, et autres
Publié: (2025)
par: Ye, Yongshi, et autres
Publié: (2025)
TASER: Translation Assessment via Systematic Evaluation and Reasoning
par: Maheswaran, Monishwaran, et autres
Publié: (2025)
par: Maheswaran, Monishwaran, et autres
Publié: (2025)
Remedy-R: Generative Reasoning for Machine Translation Evaluation without Error Annotations
par: Tan, Shaomu, et autres
Publié: (2025)
par: Tan, Shaomu, et autres
Publié: (2025)
NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs
par: Luo, Yingfeng, et autres
Publié: (2025)
par: Luo, Yingfeng, et autres
Publié: (2025)
ATD-Trans: A Geographically Grounded Japanese-English Travelogue Translation Dataset
par: Higashiyama, Shohei, et autres
Publié: (2026)
par: Higashiyama, Shohei, et autres
Publié: (2026)
LimRank: Less is More for Reasoning-Intensive Information Reranking
par: Song, Tingyu, et autres
Publié: (2025)
par: Song, Tingyu, et autres
Publié: (2025)
Preliminary Ranking of WMT25 General Machine Translation Systems
par: Kocmi, Tom, et autres
Publié: (2025)
par: Kocmi, Tom, et autres
Publié: (2025)
Evaluating OpenAI GPT Models for Translation of Endangered Uralic Languages: A Comparison of Reasoning and Non-Reasoning Architectures
par: Tereshchenko, Yehor, et autres
Publié: (2025)
par: Tereshchenko, Yehor, et autres
Publié: (2025)
Are Large Reasoning Models Good Translation Evaluators? Analysis and Performance Boost
par: Zhan, Runzhe, et autres
Publié: (2025)
par: Zhan, Runzhe, et autres
Publié: (2025)
From Hypothesis to Premises: LLM-based Backward Logical Reasoning with Selective Symbolic Translation
par: Li, Qingchuan, et autres
Publié: (2025)
par: Li, Qingchuan, et autres
Publié: (2025)
Efficient Knowledge Transfer in Multi-Task Learning through Task-Adaptive Low-Rank Representation
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
How Good Are LLMs for Literary Translation, Really? Literary Translation Evaluation with Humans and LLMs
par: Zhang, Ran, et autres
Publié: (2024)
par: Zhang, Ran, et autres
Publié: (2024)
Reasoners or Translators? Contamination-aware Evaluation and Neuro-Symbolic Robustness in Tax Law
par: Kordjamshidi, Parisa, et autres
Publié: (2026)
par: Kordjamshidi, Parisa, et autres
Publié: (2026)
Trans-Zero: Self-Play Incentivizes Large Language Models for Multilingual Translation Without Parallel Data
par: Zou, Wei, et autres
Publié: (2025)
par: Zou, Wei, et autres
Publié: (2025)
Question Translation Training for Better Multilingual Reasoning
par: Zhu, Wenhao, et autres
Publié: (2024)
par: Zhu, Wenhao, et autres
Publié: (2024)
InstaTrans: An Instruction-Aware Translation Framework for Non-English Instruction Datasets
par: Kim, Yungi, et autres
Publié: (2024)
par: Kim, Yungi, et autres
Publié: (2024)
Divide and Translate: Compositional First-Order Logic Translation and Verification for Complex Logical Reasoning
par: Ryu, Hyun, et autres
Publié: (2024)
par: Ryu, Hyun, et autres
Publié: (2024)
Documents similaires
-
Building Tailored Speech Recognizers for Japanese Speaking Assessment
par: Kubo, Yotaro, et autres
Publié: (2025) -
Fast-weight Product Key Memory
par: Zhao, Tianyu, et autres
Publié: (2026) -
Sudoku-Bench: Evaluating creative reasoning with Sudoku variants
par: Seely, Jeffrey, et autres
Publié: (2025) -
RePo: Language Models with Context Re-Positioning
par: Li, Huayang, et autres
Publié: (2025) -
Creating ConLangs to Probe the Metalinguistic Grammatical Knowledge of LLMs
par: Taguchi, Chihiro, et autres
Publié: (2025)