Translationese-index: Using Likelihood Ratios for Graded and Generalizable Measurement of Translationese
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yikang, Zhang, Wanyang, Wang, Yiming, Tang, Jialong, Zhang, Pei, Yang, Baosong, Huang, Fei, Wang, Rui, Hu, Hai |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pretraining Language Models Using Translationese
par: Doshi, Meet, et autres
Publié: (2024)
par: Doshi, Meet, et autres
Publié: (2024)
Measuring Spurious Correlation in Classification: 'Clever Hans' in Translationese
par: Borah, Angana, et autres
Publié: (2023)
par: Borah, Angana, et autres
Publié: (2023)
Lost in Literalism: How Supervised Training Shapes Translationese in LLMs
par: Li, Yafu, et autres
Publié: (2025)
par: Li, Yafu, et autres
Publié: (2025)
Lost in Translationese? Reducing Translation Effect Using Abstract Meaning Representation
par: Wein, Shira, et autres
Publié: (2023)
par: Wein, Shira, et autres
Publié: (2023)
Mitigating Translationese Bias in Multilingual LLM-as-a-Judge via Disentangled Information Bottleneck
par: Zhang, Hongbin, et autres
Publié: (2026)
par: Zhang, Hongbin, et autres
Publié: (2026)
Mitigating Translationese in Low-resource Languages: The Storyboard Approach
par: Kuwanto, Garry, et autres
Publié: (2024)
par: Kuwanto, Garry, et autres
Publié: (2024)
A Dataset for Probing Translationese Preferences in English-to-Swedish Translation
par: Kunz, Jenny, et autres
Publié: (2026)
par: Kunz, Jenny, et autres
Publié: (2026)
Direct Simultaneous Translation Activation for Large Audio-Language Models
par: Zhang, Pei, et autres
Publié: (2025)
par: Zhang, Pei, et autres
Publié: (2025)
Decoding Machine Translationese in English-Chinese News: LLMs vs. NMTs
par: Kong, Delu, et autres
Publié: (2025)
par: Kong, Delu, et autres
Publié: (2025)
The Comparison of Translationese in Machine Translation and Human Transation in terms of Translation Relations
par: Zhou, Fan
Publié: (2024)
par: Zhou, Fan
Publié: (2024)
Translationese as a Rational Response to Translation Task Difficulty
par: Kunilovskaya, Maria
Publié: (2026)
par: Kunilovskaya, Maria
Publié: (2026)
A Systematic Assessment of Language Models with Linguistic Minimal Pairs in Chinese
par: Liu, Yikang, et autres
Publié: (2024)
par: Liu, Yikang, et autres
Publié: (2024)
Meta-Reasoning: Semantics-Symbol Deconstruction for Large Language Models
par: Wang, Yiming, et autres
Publié: (2023)
par: Wang, Yiming, et autres
Publié: (2023)
Sampling-Efficient Test-Time Scaling: Self-Estimating the Best-of-N Sampling in Early Decoding
par: Wang, Yiming, et autres
Publié: (2025)
par: Wang, Yiming, et autres
Publié: (2025)
Training Models on Dialects of Translationese Shows How Lexical Diversity and Source-Target Syntactic Similarity Shape Learning
par: Kunz, Jenny
Publié: (2026)
par: Kunz, Jenny
Publié: (2026)
CultureSynth: A Hierarchical Taxonomy-Guided and Retrieval-Augmented Framework for Cultural Question-Answer Synthesis
par: Zhang, Xinyu, et autres
Publié: (2025)
par: Zhang, Xinyu, et autres
Publié: (2025)
Latent Space Chain-of-Embedding Enables Output-free LLM Self-Evaluation
par: Wang, Yiming, et autres
Publié: (2024)
par: Wang, Yiming, et autres
Publié: (2024)
Embedding Trajectory for Out-of-Distribution Detection in Mathematical Reasoning
par: Wang, Yiming, et autres
Publié: (2024)
par: Wang, Yiming, et autres
Publié: (2024)
PolyMath: Evaluating Mathematical Reasoning in Multilingual Contexts
par: Wang, Yiming, et autres
Publié: (2025)
par: Wang, Yiming, et autres
Publié: (2025)
Towards Cross-lingual Values Judgment: A Consensus-Pluralism Perspective
par: Chen, Yukun, et autres
Publié: (2026)
par: Chen, Yukun, et autres
Publié: (2026)
Large Language Model for Multi-Domain Translation: Benchmarking and Domain CoT Fine-tuning
par: Hu, Tianxiang, et autres
Publié: (2024)
par: Hu, Tianxiang, et autres
Publié: (2024)
MELA: Multilingual Evaluation of Linguistic Acceptability
par: Zhang, Ziyin, et autres
Publié: (2023)
par: Zhang, Ziyin, et autres
Publié: (2023)
Locate-and-Focus: Enhancing Terminology Translation in Speech Language Models
par: Wu, Suhang, et autres
Publié: (2025)
par: Wu, Suhang, et autres
Publié: (2025)
PART: Progressive Alignment Representation Training for Multilingual Speech-To-Text with LLMs
par: Zhang, Pei, et autres
Publié: (2025)
par: Zhang, Pei, et autres
Publié: (2025)
CultureForest: Understanding and Evaluating Cultural Norm Grounded Reasoning in LLMs
par: Ye, Yangfan, et autres
Publié: (2026)
par: Ye, Yangfan, et autres
Publié: (2026)
Not All Languages are Equal: Insights into Multilingual Retrieval-Augmented Generation
par: Wu, Suhang, et autres
Publié: (2024)
par: Wu, Suhang, et autres
Publié: (2024)
Language as a Latent Variable for Reasoning Optimization
par: Wu, Linjuan, et autres
Publié: (2026)
par: Wu, Linjuan, et autres
Publié: (2026)
SASFT: Sparse Autoencoder-guided Supervised Finetuning to Mitigate Unexpected Code-Switching in LLMs
par: Deng, Boyi, et autres
Publié: (2025)
par: Deng, Boyi, et autres
Publié: (2025)
mGTE: Generalized Long-Context Text Representation and Reranking Models for Multilingual Text Retrieval
par: Zhang, Xin, et autres
Publié: (2024)
par: Zhang, Xin, et autres
Publié: (2024)
Judge Like Human Examiners: A Weighted Importance Multi-Point Evaluation Framework for Generative Tasks with Long-form Answers
par: Yu, Guoxin, et autres
Publié: (2026)
par: Yu, Guoxin, et autres
Publié: (2026)
Aligning Language Models Using Follow-up Likelihood as Reward Signal
par: Zhang, Chen, et autres
Publié: (2024)
par: Zhang, Chen, et autres
Publié: (2024)
Generalizable Chain-of-Thought Prompting in Mixed-task Scenarios with Large Language Models
par: Zou, Anni, et autres
Publié: (2023)
par: Zou, Anni, et autres
Publié: (2023)
ConText: Driving In-context Learning for Text Removal and Segmentation
par: Zhang, Fei, et autres
Publié: (2025)
par: Zhang, Fei, et autres
Publié: (2025)
P-MMEval: A Parallel Multilingual Multitask Benchmark for Consistent Evaluation of LLMs
par: Zhang, Yidan, et autres
Publié: (2024)
par: Zhang, Yidan, et autres
Publié: (2024)
Enhancing LLM Language Adaption through Cross-lingual In-Context Pre-training
par: Wu, Linjuan, et autres
Publié: (2025)
par: Wu, Linjuan, et autres
Publié: (2025)
Unveiling Language-Specific Features in Large Language Models via Sparse Autoencoders
par: Deng, Boyi, et autres
Publié: (2025)
par: Deng, Boyi, et autres
Publié: (2025)
ReCaLL: Membership Inference via Relative Conditional Log-Likelihoods
par: Xie, Roy, et autres
Publié: (2024)
par: Xie, Roy, et autres
Publié: (2024)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
par: Zhang, Yanzhao, et autres
Publié: (2025)
par: Zhang, Yanzhao, et autres
Publié: (2025)
On the Overscaling Curse of Parallel Thinking: System Efficacy Contradicts Sample Efficiency
par: Wang, Yiming, et autres
Publié: (2026)
par: Wang, Yiming, et autres
Publié: (2026)
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
par: Deng, Boyi, et autres
Publié: (2026)
par: Deng, Boyi, et autres
Publié: (2026)
Documents similaires
-
Pretraining Language Models Using Translationese
par: Doshi, Meet, et autres
Publié: (2024) -
Measuring Spurious Correlation in Classification: 'Clever Hans' in Translationese
par: Borah, Angana, et autres
Publié: (2023) -
Lost in Literalism: How Supervised Training Shapes Translationese in LLMs
par: Li, Yafu, et autres
Publié: (2025) -
Lost in Translationese? Reducing Translation Effect Using Abstract Meaning Representation
par: Wein, Shira, et autres
Publié: (2023) -
Mitigating Translationese Bias in Multilingual LLM-as-a-Judge via Disentangled Information Bottleneck
par: Zhang, Hongbin, et autres
Publié: (2026)