General learned delegation by clones
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Darren, Chen, Meiqi, Shao, Chenze, Meng, Fandong, Zhou, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Continuous Autoregressive Language Models
par: Shao, Chenze, et autres
Publié: (2025)
par: Shao, Chenze, et autres
Publié: (2025)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
par: Shao, Chenze, et autres
Publié: (2024)
par: Shao, Chenze, et autres
Publié: (2024)
Language Generation with Strictly Proper Scoring Rules
par: Shao, Chenze, et autres
Publié: (2024)
par: Shao, Chenze, et autres
Publié: (2024)
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
par: Hu, Yong, et autres
Publié: (2022)
par: Hu, Yong, et autres
Publié: (2022)
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
Understanding and Addressing the Under-Translation Problem from the Perspective of Decoding Objective
par: Shao, Chenze, et autres
Publié: (2024)
par: Shao, Chenze, et autres
Publié: (2024)
EAG: Extract and Generate Multi-way Aligned Corpus for Complete Multi-lingual Neural Machine Translation
par: Xu, Yulin, et autres
Publié: (2022)
par: Xu, Yulin, et autres
Publié: (2022)
Retrieval-Augmented Machine Translation with Unstructured Knowledge
par: Wang, Jiaan, et autres
Publié: (2024)
par: Wang, Jiaan, et autres
Publié: (2024)
TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
par: Yang, Zhen, et autres
Publié: (2023)
par: Yang, Zhen, et autres
Publié: (2023)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
par: Wang, Jiaan, et autres
Publié: (2024)
par: Wang, Jiaan, et autres
Publié: (2024)
Figure It Out: Improve the Frontier of Reasoning with Executable Visual States
par: Chen, Meiqi, et autres
Publié: (2025)
par: Chen, Meiqi, et autres
Publié: (2025)
LCS: A Language Converter Strategy for Zero-Shot Neural Machine Translation
par: Sun, Zengkui, et autres
Publié: (2024)
par: Sun, Zengkui, et autres
Publié: (2024)
Continuous Visual Autoregressive Generation via Score Maximization
par: Shao, Chenze, et autres
Publié: (2025)
par: Shao, Chenze, et autres
Publié: (2025)
Translatotron-V(ison): An End-to-End Model for In-Image Machine Translation
par: Lan, Zhibin, et autres
Publié: (2024)
par: Lan, Zhibin, et autres
Publié: (2024)
TasTe: Teaching Large Language Models to Translate through Self-Reflection
par: Wang, Yutong, et autres
Publié: (2024)
par: Wang, Yutong, et autres
Publié: (2024)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
par: Zhang, Xue, et autres
Publié: (2025)
par: Zhang, Xue, et autres
Publié: (2025)
Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge
par: Sun, Zengkui, et autres
Publié: (2024)
par: Sun, Zengkui, et autres
Publié: (2024)
On the token distance modeling ability of higher RoPE attention dimension
par: Hong, Xiangyu, et autres
Publié: (2024)
par: Hong, Xiangyu, et autres
Publié: (2024)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
par: Xu, Shicheng, et autres
Publié: (2024)
par: Xu, Shicheng, et autres
Publié: (2024)
AVG-LLaVA: An Efficient Large Multimodal Model with Adaptive Visual Granularity
par: Lan, Zhibin, et autres
Publié: (2024)
par: Lan, Zhibin, et autres
Publié: (2024)
DelTA: An Online Document-Level Translation Agent Based on Multi-Level Memory
par: Wang, Yutong, et autres
Publié: (2024)
par: Wang, Yutong, et autres
Publié: (2024)
An Empirical Study of Many-to-Many Summarization with Large Language Models
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
Towards Threshold-Free KV Cache Pruning
par: Ni, Xuanfan, et autres
Publié: (2025)
par: Ni, Xuanfan, et autres
Publié: (2025)
HGMEM: Hypergraph-based Working Memory to Improve Multi-step RAG for Long-Context Complex Relational Modeling
par: Zhou, Chulun, et autres
Publié: (2025)
par: Zhou, Chulun, et autres
Publié: (2025)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
par: Lan, Zhibin, et autres
Publié: (2025)
par: Lan, Zhibin, et autres
Publié: (2025)
Efficient Speech Language Modeling via Energy Distance in Continuous Latent Space
par: Ma, Zhengrui, et autres
Publié: (2025)
par: Ma, Zhengrui, et autres
Publié: (2025)
Investigating Cross-Modal Skill Injection: Scenarios, Methods, and Hyperparameters
par: Xu, Zhiyu, et autres
Publié: (2026)
par: Xu, Zhiyu, et autres
Publié: (2026)
CRAT: A Multi-Agent Framework for Causality-Enhanced Reflective and Retrieval-Augmented Translation with Large Language Models
par: Chen, Meiqi, et autres
Publié: (2024)
par: Chen, Meiqi, et autres
Publié: (2024)
On Prompt-Driven Safeguarding for Large Language Models
par: Zheng, Chujie, et autres
Publié: (2024)
par: Zheng, Chujie, et autres
Publié: (2024)
Cross-Lingual Knowledge Editing in Large Language Models
par: Wang, Jiaan, et autres
Publié: (2023)
par: Wang, Jiaan, et autres
Publié: (2023)
Differences in Text Generated by Diffusion and Autoregressive Language Models
par: Zhang, Zeyang, et autres
Publié: (2026)
par: Zhang, Zeyang, et autres
Publié: (2026)
DeepRAG: Thinking to Retrieve Step by Step for Large Language Models
par: Guan, Xinyan, et autres
Publié: (2025)
par: Guan, Xinyan, et autres
Publié: (2025)
RewardAnything: Generalizable Principle-Following Reward Models
par: Yu, Zhuohao, et autres
Publié: (2025)
par: Yu, Zhuohao, et autres
Publié: (2025)
ConCISE: Confidence-guided Compression in Step-by-step Efficient Reasoning
par: Qiao, Ziqing, et autres
Publié: (2025)
par: Qiao, Ziqing, et autres
Publié: (2025)
Who Reasons in the Large Language Models?
par: Shao, Jie, et autres
Publié: (2025)
par: Shao, Jie, et autres
Publié: (2025)
Toward Efficient Agents: Memory, Tool learning, and Planning
par: Yang, Xiaofang, et autres
Publié: (2026)
par: Yang, Xiaofang, et autres
Publié: (2026)
Prompt-Based Length Controlled Generation with Multiple Control Types
par: Jie, Renlong, et autres
Publié: (2024)
par: Jie, Renlong, et autres
Publié: (2024)
WorldCoder, a Model-Based LLM Agent: Building World Models by Writing Code and Interacting with the Environment
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
APB-V: Accelerating Long-Video Understanding via Sequence-Parallelism-aware Approximate Attention
par: Huang, Yuxiang, et autres
Publié: (2026)
par: Huang, Yuxiang, et autres
Publié: (2026)
Documents similaires
-
Continuous Autoregressive Language Models
par: Shao, Chenze, et autres
Publié: (2025) -
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
par: Shao, Chenze, et autres
Publié: (2024) -
Language Generation with Strictly Proper Scoring Rules
par: Shao, Chenze, et autres
Publié: (2024) -
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
par: Hu, Yong, et autres
Publié: (2022) -
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
par: Wang, Jiaan, et autres
Publié: (2025)