Evaluating o1-Like LLMs: Unlocking Reasoning for Translation through Comprehensive Analysis
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Andong, Song, Yuchen, Zhu, Wenxin, Chen, Kehai, Yang, Muyun, Zhao, Tiejun, zhang, Min |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Make Imagination Clearer! Stable Diffusion-based Visual Imagination for Multimodal Machine Translation
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
LLM-based Translation Inference with Iterative Bilingual Understanding
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
From Perception to Reasoning: Deep Thinking Empowers Multimodal Large Language Models
von: Zhu, Wenxin, et al.
Veröffentlicht: (2025)
von: Zhu, Wenxin, et al.
Veröffentlicht: (2025)
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
Thinking with Comics: Enhancing Multimodal Reasoning through Structured Visual Storytelling
von: Chen, Andong, et al.
Veröffentlicht: (2026)
von: Chen, Andong, et al.
Veröffentlicht: (2026)
Culture In a Frame: C$^3$B as a Comic-Based Benchmark for Multimodal Culturally Awareness
von: Song, Yuchen, et al.
Veröffentlicht: (2025)
von: Song, Yuchen, et al.
Veröffentlicht: (2025)
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering
von: Xu, Mufan, et al.
Veröffentlicht: (2024)
von: Xu, Mufan, et al.
Veröffentlicht: (2024)
Thinking in Character: Advancing Role-Playing Agents with Role-Aware Reasoning
von: Tang, Yihong, et al.
Veröffentlicht: (2025)
von: Tang, Yihong, et al.
Veröffentlicht: (2025)
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
Memory-augmented Query Reconstruction for LLM-based Knowledge Graph Reasoning
von: Xu, Mufan, et al.
Veröffentlicht: (2025)
von: Xu, Mufan, et al.
Veröffentlicht: (2025)
User-Aware Active Knowledge Acquisition for Emotional Support Dialogue
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
Toward Robust LLM-Based Judges: Taxonomic Bias Evaluation and Debiasing Optimization
von: Zhou, Hongli, et al.
Veröffentlicht: (2026)
von: Zhou, Hongli, et al.
Veröffentlicht: (2026)
Look Before You Leap: Enhancing Attention and Vigilance Regarding Harmful Content with GuidelineLLM
von: Zhang, Shaoqing, et al.
Veröffentlicht: (2024)
von: Zhang, Shaoqing, et al.
Veröffentlicht: (2024)
Long-form RewardBench: Evaluating Reward Models for Long-form Generation
von: Huang, Hui, et al.
Veröffentlicht: (2026)
von: Huang, Hui, et al.
Veröffentlicht: (2026)
A Survey on Human Preference Learning for Large Language Models
von: Jiang, Ruili, et al.
Veröffentlicht: (2024)
von: Jiang, Ruili, et al.
Veröffentlicht: (2024)
Beyond Global Emotion: Fine-Grained Emotional Speech Synthesis with Dynamic Word-Level Modulation
von: Wang, Sirui, et al.
Veröffentlicht: (2025)
von: Wang, Sirui, et al.
Veröffentlicht: (2025)
Adaptive Inner Speech-Text Alignment for LLM-based Speech Translation
von: Liu, Henglyu, et al.
Veröffentlicht: (2025)
von: Liu, Henglyu, et al.
Veröffentlicht: (2025)
LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation
von: Zhou, Hongyun, et al.
Veröffentlicht: (2024)
von: Zhou, Hongyun, et al.
Veröffentlicht: (2024)
Mitigating the Bias of Large Language Model Evaluation
von: Zhou, Hongli, et al.
Veröffentlicht: (2024)
von: Zhou, Hongli, et al.
Veröffentlicht: (2024)
On the Hallucination in Simultaneous Machine Translation
von: Zhong, Meizhi, et al.
Veröffentlicht: (2024)
von: Zhong, Meizhi, et al.
Veröffentlicht: (2024)
Self-Evaluation of Large Language Model based on Glass-box Features
von: Huang, Hui, et al.
Veröffentlicht: (2024)
von: Huang, Hui, et al.
Veröffentlicht: (2024)
Lost in Benchmarks? Rethinking Large Language Model Benchmarking with Item Response Theory
von: Zhou, Hongli, et al.
Veröffentlicht: (2025)
von: Zhou, Hongli, et al.
Veröffentlicht: (2025)
Exploring the Translation Mechanism of Large Language Models
von: Zhang, Hongbin, et al.
Veröffentlicht: (2025)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2025)
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
PMoL: Parameter Efficient MoE for Preference Mixing of LLM Alignment
von: Liu, Dongxu, et al.
Veröffentlicht: (2024)
von: Liu, Dongxu, et al.
Veröffentlicht: (2024)
Dynamic Planning for LLM-based Graphical User Interface Automation
von: Zhang, Shaoqing, et al.
Veröffentlicht: (2024)
von: Zhang, Shaoqing, et al.
Veröffentlicht: (2024)
Crowd Comparative Reasoning: Unlocking Comprehensive Evaluations for LLM-as-a-Judge
von: Zhang, Qiyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Qiyuan, et al.
Veröffentlicht: (2025)
LinguaLIFT: An Effective Two-stage Instruction Tuning Framework for Low-Resource Language Reasoning
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2024)
DuplexMamba: Enhancing Real-time Speech Conversations with Duplex and Streaming Capabilities
von: Lu, Xiangyu, et al.
Veröffentlicht: (2025)
von: Lu, Xiangyu, et al.
Veröffentlicht: (2025)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
von: Zhu, Yingjie, et al.
Veröffentlicht: (2024)
von: Zhu, Yingjie, et al.
Veröffentlicht: (2024)
An Empirical Study of LLM-as-a-Judge for LLM Evaluation: Fine-tuned Judge Model is not a General Substitute for GPT-4
von: Huang, Hui, et al.
Veröffentlicht: (2024)
von: Huang, Hui, et al.
Veröffentlicht: (2024)
Constituency Parsing using LLMs
von: Bai, Xuefeng, et al.
Veröffentlicht: (2023)
von: Bai, Xuefeng, et al.
Veröffentlicht: (2023)
Evaluating and Improving Cultural Awareness of Reward Models for LLM Alignment
von: Zhang, Hongbin, et al.
Veröffentlicht: (2025)
von: Zhang, Hongbin, et al.
Veröffentlicht: (2025)
CRPO: Character-centric Group Relative Policy Optimization for Role-aware Reasoning in Role-playing Agents
von: Tang, Yihong, et al.
Veröffentlicht: (2026)
von: Tang, Yihong, et al.
Veröffentlicht: (2026)
Unlocking Fine-Grained Translation Quality Estimation in LRMs through Synergistically Evolving Implicit and Explicit Reasoning
von: Dang, Renfei, et al.
Veröffentlicht: (2026)
von: Dang, Renfei, et al.
Veröffentlicht: (2026)
How Well Do Large Reasoning Models Translate? A Comprehensive Evaluation for Multi-Domain Machine Translation
von: Ye, Yongshi, et al.
Veröffentlicht: (2025)
von: Ye, Yongshi, et al.
Veröffentlicht: (2025)
DMDTEval: An Evaluation and Analysis of LLMs on Disambiguation in Multi-domain Translation
von: Man, Zhibo, et al.
Veröffentlicht: (2025)
von: Man, Zhibo, et al.
Veröffentlicht: (2025)
Are Large Reasoning Models Good Translation Evaluators? Analysis and Performance Boost
von: Zhan, Runzhe, et al.
Veröffentlicht: (2025)
von: Zhan, Runzhe, et al.
Veröffentlicht: (2025)
Reasoning or Not? A Comprehensive Evaluation of Reasoning LLMs for Dialogue Summarization
von: Jin, Keyan, et al.
Veröffentlicht: (2025)
von: Jin, Keyan, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Make Imagination Clearer! Stable Diffusion-based Visual Imagination for Multimodal Machine Translation
von: Chen, Andong, et al.
Veröffentlicht: (2024) -
LLM-based Translation Inference with Iterative Bilingual Understanding
von: Chen, Andong, et al.
Veröffentlicht: (2024) -
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
von: Chen, Andong, et al.
Veröffentlicht: (2024) -
From Perception to Reasoning: Deep Thinking Empowers Multimodal Large Language Models
von: Zhu, Wenxin, et al.
Veröffentlicht: (2025) -
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
von: Chen, Andong, et al.
Veröffentlicht: (2024)