TasTe: Teaching Large Language Models to Translate through Self-Reflection
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yutong, Zeng, Jiali, Liu, Xuebo, Meng, Fandong, Zhou, Jie, Zhang, Min |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DelTA: An Online Document-Level Translation Agent Based on Multi-Level Memory
di: Wang, Yutong, et al.
Pubblicazione: (2024)
di: Wang, Yutong, et al.
Pubblicazione: (2024)
TIM: Teaching Large Language Models to Translate with Comparison
di: Zeng, Jiali, et al.
Pubblicazione: (2023)
di: Zeng, Jiali, et al.
Pubblicazione: (2023)
TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
di: Yang, Zhen, et al.
Pubblicazione: (2023)
di: Yang, Zhen, et al.
Pubblicazione: (2023)
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2024)
di: Shao, Chenze, et al.
Pubblicazione: (2024)
Translatotron-V(ison): An End-to-End Model for In-Image Machine Translation
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
Retrieval-Augmented Machine Translation with Unstructured Knowledge
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
Improving Machine Translation with Large Language Models: A Preliminary Study with Cooperative Decoding
di: Zeng, Jiali, et al.
Pubblicazione: (2023)
di: Zeng, Jiali, et al.
Pubblicazione: (2023)
DeepRAG: Thinking to Retrieve Step by Step for Large Language Models
di: Guan, Xinyan, et al.
Pubblicazione: (2025)
di: Guan, Xinyan, et al.
Pubblicazione: (2025)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
LCS: A Language Converter Strategy for Zero-Shot Neural Machine Translation
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
di: Sun, Zengkui, et al.
Pubblicazione: (2024)
EAG: Extract and Generate Multi-way Aligned Corpus for Complete Multi-lingual Neural Machine Translation
di: Xu, Yulin, et al.
Pubblicazione: (2022)
di: Xu, Yulin, et al.
Pubblicazione: (2022)
Continuous Autoregressive Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2025)
di: Shao, Chenze, et al.
Pubblicazione: (2025)
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
di: Chen, Andong, et al.
Pubblicazione: (2024)
di: Chen, Andong, et al.
Pubblicazione: (2024)
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
di: Hu, Yong, et al.
Pubblicazione: (2022)
di: Hu, Yong, et al.
Pubblicazione: (2022)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
An Empirical Study of Many-to-Many Summarization with Large Language Models
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
di: Wang, Jiaan, et al.
Pubblicazione: (2025)
AgentDropout: Dynamic Agent Elimination for Token-Efficient and High-Performance LLM-Based Multi-Agent Collaboration
di: Wang, Zhexuan, et al.
Pubblicazione: (2025)
di: Wang, Zhexuan, et al.
Pubblicazione: (2025)
Loong: A Human-Like Long Document Translation Agent with Observe-and-Act Adaptive Context Selection
di: Wang, Yutong, et al.
Pubblicazione: (2026)
di: Wang, Yutong, et al.
Pubblicazione: (2026)
On Prompt-Driven Safeguarding for Large Language Models
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
CommonIT: Commonality-Aware Instruction Tuning for Large Language Models via Data Partitions
di: Rao, Jun, et al.
Pubblicazione: (2024)
di: Rao, Jun, et al.
Pubblicazione: (2024)
Improving Attributed Text Generation of Large Language Models via Preference Learning
di: Li, Dongfang, et al.
Pubblicazione: (2024)
di: Li, Dongfang, et al.
Pubblicazione: (2024)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
Understanding and Addressing the Under-Translation Problem from the Perspective of Decoding Objective
di: Shao, Chenze, et al.
Pubblicazione: (2024)
di: Shao, Chenze, et al.
Pubblicazione: (2024)
RewardAnything: Generalizable Principle-Following Reward Models
di: Yu, Zhuohao, et al.
Pubblicazione: (2025)
di: Yu, Zhuohao, et al.
Pubblicazione: (2025)
Cross-Lingual Knowledge Editing in Large Language Models
di: Wang, Jiaan, et al.
Pubblicazione: (2023)
di: Wang, Jiaan, et al.
Pubblicazione: (2023)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
di: Lan, Zhibin, et al.
Pubblicazione: (2025)
di: Lan, Zhibin, et al.
Pubblicazione: (2025)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
di: Liu, Liangxin, et al.
Pubblicazione: (2024)
di: Liu, Liangxin, et al.
Pubblicazione: (2024)
AgentDropoutV2: Optimizing Information Flow in Multi-Agent Systems via Test-Time Rectify-or-Reject Pruning
di: Wang, Yutong, et al.
Pubblicazione: (2026)
di: Wang, Yutong, et al.
Pubblicazione: (2026)
CRAT: A Multi-Agent Framework for Causality-Enhanced Reflective and Retrieval-Augmented Translation with Large Language Models
di: Chen, Meiqi, et al.
Pubblicazione: (2024)
di: Chen, Meiqi, et al.
Pubblicazione: (2024)
General learned delegation by clones
di: Li, Darren, et al.
Pubblicazione: (2026)
di: Li, Darren, et al.
Pubblicazione: (2026)
ConCISE: Confidence-guided Compression in Step-by-step Efficient Reasoning
di: Qiao, Ziqing, et al.
Pubblicazione: (2025)
di: Qiao, Ziqing, et al.
Pubblicazione: (2025)
Advancing the Robustness of Large Language Models through Self-Denoised Smoothing
di: Ji, Jiabao, et al.
Pubblicazione: (2024)
di: Ji, Jiabao, et al.
Pubblicazione: (2024)
PsychCounsel-Bench: Evaluating the Psychology Intelligence of Large Language Models
di: Zeng, Min
Pubblicazione: (2025)
di: Zeng, Min
Pubblicazione: (2025)
AVG-LLaVA: An Efficient Large Multimodal Model with Adaptive Visual Granularity
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
Dynamic Sampling that Adapts: Self-Aware Iterative Data Persistent Optimization for Mathematical Reasoning
di: Rao, Jun, et al.
Pubblicazione: (2025)
di: Rao, Jun, et al.
Pubblicazione: (2025)
Cleansing the Artificial Mind: A Self-Reflective Detoxification Framework for Large Language Models
di: Zhang, Kaituo, et al.
Pubblicazione: (2026)
di: Zhang, Kaituo, et al.
Pubblicazione: (2026)
Runaway is Ashamed, But Helpful: On the Early-Exit Behavior of Large Language Model-based Agents in Embodied Environments
di: Lu, Qingyu, et al.
Pubblicazione: (2025)
di: Lu, Qingyu, et al.
Pubblicazione: (2025)
A Novel Self-Evolution Framework for Large Language Models
di: Sun, Haoran, et al.
Pubblicazione: (2025)
di: Sun, Haoran, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DelTA: An Online Document-Level Translation Agent Based on Multi-Level Memory
di: Wang, Yutong, et al.
Pubblicazione: (2024) -
TIM: Teaching Large Language Models to Translate with Comparison
di: Zeng, Jiali, et al.
Pubblicazione: (2023) -
TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
di: Yang, Zhen, et al.
Pubblicazione: (2023) -
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
di: Wang, Jiaan, et al.
Pubblicazione: (2025) -
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2024)