DeepTrans: Deep Reasoning Translation via Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Jiaan, Meng, Fandong, Zhou, Jie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
Retrieval-Augmented Machine Translation with Unstructured Knowledge
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
EAG: Extract and Generate Multi-way Aligned Corpus for Complete Multi-lingual Neural Machine Translation
di: Xu, Yulin, et al.
Pubblicazione: (2022)
di: Xu, Yulin, et al.
Pubblicazione: (2022)
SlangDIT: Benchmarking LLMs in Interpretative Slang Translation
di: Liang, Yunlong, et al.
Pubblicazione: (2025)
di: Liang, Yunlong, et al.
Pubblicazione: (2025)
An Empirical Study of Many-to-Many Summarization with Large Language Models
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
Cross-Lingual Knowledge Editing in Large Language Models
di: Wang, Jiaan, et al.
Pubblicazione: (2023)
di: Wang, Jiaan, et al.
Pubblicazione: (2023)
TasTe: Teaching Large Language Models to Translate through Self-Reflection
di: Wang, Yutong, et al.
Pubblicazione: (2024)
di: Wang, Yutong, et al.
Pubblicazione: (2024)
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
di: Hu, Yong, et al.
Pubblicazione: (2022)
di: Hu, Yong, et al.
Pubblicazione: (2022)
Translatotron-V(ison): An End-to-End Model for In-Image Machine Translation
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
LCS: A Language Converter Strategy for Zero-Shot Neural Machine Translation
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
DelTA: An Online Document-Level Translation Agent Based on Multi-Level Memory
di: Wang, Yutong, et al.
Pubblicazione: (2024)
di: Wang, Yutong, et al.
Pubblicazione: (2024)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2024)
di: Shao, Chenze, et al.
Pubblicazione: (2024)
TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
di: Yang, Zhen, et al.
Pubblicazione: (2023)
di: Yang, Zhen, et al.
Pubblicazione: (2023)
DeepRAG: Thinking to Retrieve Step by Step for Large Language Models
di: Guan, Xinyan, et al.
Pubblicazione: (2025)
di: Guan, Xinyan, et al.
Pubblicazione: (2025)
General learned delegation by clones
di: Li, Darren, et al.
Pubblicazione: (2026)
di: Li, Darren, et al.
Pubblicazione: (2026)
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
di: DeepSeek-AI, et al.
Pubblicazione: (2025)
di: DeepSeek-AI, et al.
Pubblicazione: (2025)
Continuous Autoregressive Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2025)
di: Shao, Chenze, et al.
Pubblicazione: (2025)
DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition
di: Ren, Z. Z., et al.
Pubblicazione: (2025)
di: Ren, Z. Z., et al.
Pubblicazione: (2025)
Unleashing the Power of Emojis in Texts via Self-supervised Graph Pre-Training
di: Zhang, Zhou, et al.
Pubblicazione: (2024)
di: Zhang, Zhou, et al.
Pubblicazione: (2024)
DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning
di: Zhang, Ziyin, et al.
Pubblicazione: (2025)
di: Zhang, Ziyin, et al.
Pubblicazione: (2025)
SFR-DeepResearch: Towards Effective Reinforcement Learning for Autonomously Reasoning Single Agents
di: Nguyen, Xuan-Phi, et al.
Pubblicazione: (2025)
di: Nguyen, Xuan-Phi, et al.
Pubblicazione: (2025)
From Prediction to Justification: Aligning Sentiment Reasoning with Human Rationale via Reinforcement Learning
di: Zhang, Shihao, et al.
Pubblicazione: (2026)
di: Zhang, Shihao, et al.
Pubblicazione: (2026)
Improving the Robustness of Knowledge-Grounded Dialogue via Contrastive Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning
di: Huang, Haoyu, et al.
Pubblicazione: (2026)
di: Huang, Haoyu, et al.
Pubblicazione: (2026)
On the token distance modeling ability of higher RoPE attention dimension
di: Hong, Xiangyu, et al.
Pubblicazione: (2024)
di: Hong, Xiangyu, et al.
Pubblicazione: (2024)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
di: Lan, Zhibin, et al.
Pubblicazione: (2025)
di: Lan, Zhibin, et al.
Pubblicazione: (2025)
Deep Dense Exploration for LLM Reinforcement Learning via Pivot-Driven Resampling
di: Guo, Yiran, et al.
Pubblicazione: (2026)
di: Guo, Yiran, et al.
Pubblicazione: (2026)
ConCISE: Confidence-guided Compression in Step-by-step Efficient Reasoning
di: Qiao, Ziqing, et al.
Pubblicazione: (2025)
di: Qiao, Ziqing, et al.
Pubblicazione: (2025)
DeepResearcher: Scaling Deep Research via Reinforcement Learning in Real-world Environments
di: Zheng, Yuxiang, et al.
Pubblicazione: (2025)
di: Zheng, Yuxiang, et al.
Pubblicazione: (2025)
Incentivizing Parametric Knowledge via Reinforcement Learning with Verifiable Rewards for Cross-Cultural Entity Translation
di: Zhou, Jiang, et al.
Pubblicazione: (2026)
di: Zhou, Jiang, et al.
Pubblicazione: (2026)
KAG-Thinker: Interactive Thinking and Deep Reasoning in LLMs via Knowledge-Augmented Generation
di: Zhang, Dalong, et al.
Pubblicazione: (2025)
di: Zhang, Dalong, et al.
Pubblicazione: (2025)
DeepImagine: Learning Biomedical Reasoning via Successive Counterfactual Imagining
di: Zheng, Youze, et al.
Pubblicazione: (2026)
di: Zheng, Youze, et al.
Pubblicazione: (2026)
Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning
di: Zhang, Hang, et al.
Pubblicazione: (2026)
di: Zhang, Hang, et al.
Pubblicazione: (2026)
PEER: Unified Process-Outcome Reinforcement Learning for Structured Empathetic Reasoning
di: Wang, Yunxiao, et al.
Pubblicazione: (2025)
di: Wang, Yunxiao, et al.
Pubblicazione: (2025)
Learning When to Translate for Multilingual Reasoning
di: Kang, Deokhyung, et al.
Pubblicazione: (2026)
di: Kang, Deokhyung, et al.
Pubblicazione: (2026)
Seed-Prover: Deep and Broad Reasoning for Automated Theorem Proving
di: Chen, Luoxin, et al.
Pubblicazione: (2025)
di: Chen, Luoxin, et al.
Pubblicazione: (2025)
TransERR: Translation-based Knowledge Graph Embedding via Efficient Relation Rotation
di: Li, Jiang, et al.
Pubblicazione: (2023)
di: Li, Jiang, et al.
Pubblicazione: (2023)
Documenti analoghi
-
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025) -
DRT: Deep Reasoning Translation via Long Chain-of-Thought
di: Wang, Jiaan, et al.
Pubblicazione: (2024) -
Retrieval-Augmented Machine Translation with Unstructured Knowledge
di: Wang, Jiaan, et al.
Pubblicazione: (2024) -
Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge
di: Sun, Zengkui, et al.
Pubblicazione: (2024) -
EAG: Extract and Generate Multi-way Aligned Corpus for Complete Multi-lingual Neural Machine Translation
di: Xu, Yulin, et al.
Pubblicazione: (2022)