Guardado en:
| Autores principales: | Ramos, Miguel Moura, Alves, Duarte M., Martins, André F. T. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2605.12227 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multilingual Contextualization of Large Language Models for Document-Level Machine Translation
por: Ramos, Miguel Moura, et al.
Publicado: (2025)
por: Ramos, Miguel Moura, et al.
Publicado: (2025)
Aligning Neural Machine Translation Models: Human Feedback in Training and Inference
por: Ramos, Miguel Moura, et al.
Publicado: (2023)
por: Ramos, Miguel Moura, et al.
Publicado: (2023)
OPSDL: On-Policy Self-Distillation for Long-Context Language Models
por: Zhang, Xinsen, et al.
Publicado: (2026)
por: Zhang, Xinsen, et al.
Publicado: (2026)
On-Policy Context Distillation for Language Models
por: Ye, Tianzhu, et al.
Publicado: (2026)
por: Ye, Tianzhu, et al.
Publicado: (2026)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
por: Zhao, Siyan, et al.
Publicado: (2026)
por: Zhao, Siyan, et al.
Publicado: (2026)
Fine-Grained Reward Optimization for Machine Translation using Error Severity Mappings
por: Ramos, Miguel Moura, et al.
Publicado: (2024)
por: Ramos, Miguel Moura, et al.
Publicado: (2024)
Tower: An Open Multilingual Large Language Model for Translation-Related Tasks
por: Alves, Duarte M., et al.
Publicado: (2024)
por: Alves, Duarte M., et al.
Publicado: (2024)
Long-Context Generalization with Sparse Attention
por: Vasylenko, Pavlo, et al.
Publicado: (2025)
por: Vasylenko, Pavlo, et al.
Publicado: (2025)
Should We Still Pretrain Encoders with Masked Language Modeling?
por: Gisserot-Boukhlef, Hippolyte, et al.
Publicado: (2025)
por: Gisserot-Boukhlef, Hippolyte, et al.
Publicado: (2025)
Evidence-Augmented Policy Optimization with Reward Co-Evolution for Long-Context Reasoning
por: Guan, Xin, et al.
Publicado: (2026)
por: Guan, Xin, et al.
Publicado: (2026)
Mil-SCORE: Benchmarking Long-Context Geospatial Reasoning and Planning in Large Language Models
por: Palnitkar, Aadi, et al.
Publicado: (2026)
por: Palnitkar, Aadi, et al.
Publicado: (2026)
Rethinking Visual Dependency in Long-Context Reasoning for Large Vision-Language Models
por: Zhou, Yucheng, et al.
Publicado: (2024)
por: Zhou, Yucheng, et al.
Publicado: (2024)
SEQUOR: A Multi-Turn Benchmark for Realistic Constraint Following
por: Canaverde, Beatriz, et al.
Publicado: (2026)
por: Canaverde, Beatriz, et al.
Publicado: (2026)
A Recipe of Parallel Corpora Exploitation for Multilingual Large Language Models
por: Lin, Peiqin, et al.
Publicado: (2024)
por: Lin, Peiqin, et al.
Publicado: (2024)
LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation
por: Dong, Zican, et al.
Publicado: (2025)
por: Dong, Zican, et al.
Publicado: (2025)
A Survey of On-Policy Distillation for Large Language Models
por: Song, Mingyang, et al.
Publicado: (2026)
por: Song, Mingyang, et al.
Publicado: (2026)
MiniLLM: On-Policy Distillation of Large Language Models
por: Gu, Yuxian, et al.
Publicado: (2023)
por: Gu, Yuxian, et al.
Publicado: (2023)
Black-Box On-Policy Distillation of Large Language Models
por: Ye, Tianzhu, et al.
Publicado: (2025)
por: Ye, Tianzhu, et al.
Publicado: (2025)
E2LLM: Encoder Elongated Large Language Models for Long-Context Understanding and Reasoning
por: Liao, Zihan, et al.
Publicado: (2024)
por: Liao, Zihan, et al.
Publicado: (2024)
Recall with Reasoning: Chain-of-Thought Distillation for Mamba's Long-Context Memory and Extrapolation
por: Ma, Junyu, et al.
Publicado: (2025)
por: Ma, Junyu, et al.
Publicado: (2025)
DebateBench: A Challenging Long Context Reasoning Benchmark For Large Language Models
por: Tiwari, Utkarsh, et al.
Publicado: (2025)
por: Tiwari, Utkarsh, et al.
Publicado: (2025)
InftyThink: Breaking the Length Limits of Long-Context Reasoning in Large Language Models
por: Yan, Yuchen, et al.
Publicado: (2025)
por: Yan, Yuchen, et al.
Publicado: (2025)
Thus Spake Long-Context Large Language Model
por: Liu, Xiaoran, et al.
Publicado: (2025)
por: Liu, Xiaoran, et al.
Publicado: (2025)
AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese
por: Simplício, Afonso, et al.
Publicado: (2026)
por: Simplício, Afonso, et al.
Publicado: (2026)
Self-Preference Bias in Rubric-Based Evaluation of Large Language Models
por: Pombal, José, et al.
Publicado: (2026)
por: Pombal, José, et al.
Publicado: (2026)
MaLA-500: Massive Language Adaptation of Large Language Models
por: Lin, Peiqin, et al.
Publicado: (2024)
por: Lin, Peiqin, et al.
Publicado: (2024)
ToM: Leveraging Tree-oriented MapReduce for Long-Context Reasoning in Large Language Models
por: Guo, Jiani, et al.
Publicado: (2025)
por: Guo, Jiani, et al.
Publicado: (2025)
LongPO: Long Context Self-Evolution of Large Language Models through Short-to-Long Preference Optimization
por: Chen, Guanzheng, et al.
Publicado: (2025)
por: Chen, Guanzheng, et al.
Publicado: (2025)
Out-of-Context Reasoning in Large Language Models
por: Shaki, Jonathan, et al.
Publicado: (2025)
por: Shaki, Jonathan, et al.
Publicado: (2025)
Making Long-Context Language Models Better Multi-Hop Reasoners
por: Li, Yanyang, et al.
Publicado: (2024)
por: Li, Yanyang, et al.
Publicado: (2024)
Improving In-Context Learning with Reasoning Distillation
por: Sadeq, Nafis, et al.
Publicado: (2025)
por: Sadeq, Nafis, et al.
Publicado: (2025)
QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning
por: Wan, Fanqi, et al.
Publicado: (2025)
por: Wan, Fanqi, et al.
Publicado: (2025)
Knowledge Distillation for Temporal Knowledge Graph Reasoning with Large Language Models
por: Xing, Wang, et al.
Publicado: (2026)
por: Xing, Wang, et al.
Publicado: (2026)
Foresight Optimization for Strategic Reasoning in Large Language Models
por: Wang, Jiashuo, et al.
Publicado: (2026)
por: Wang, Jiashuo, et al.
Publicado: (2026)
Distilling Reasoning Ability from Large Language Models with Adaptive Thinking
por: Chen, Xiaoshu, et al.
Publicado: (2024)
por: Chen, Xiaoshu, et al.
Publicado: (2024)
The Valley of Code Reasoning: Scaling Knowledge Distillation of Large Language Models
por: He, Muyu, et al.
Publicado: (2025)
por: He, Muyu, et al.
Publicado: (2025)
EuroLLM: Multilingual Language Models for Europe
por: Martins, Pedro Henrique, et al.
Publicado: (2024)
por: Martins, Pedro Henrique, et al.
Publicado: (2024)
LongRecipe: Recipe for Efficient Long Context Generalization in Large Language Models
por: Hu, Zhiyuan, et al.
Publicado: (2024)
por: Hu, Zhiyuan, et al.
Publicado: (2024)
ROSD: Reflective On-Policy Self-Distillation for Language Model Reasoning across Domains
por: Zhao, Ziqi, et al.
Publicado: (2026)
por: Zhao, Ziqi, et al.
Publicado: (2026)
Analyzing Context Contributions in LLM-based Machine Translation
por: Zaranis, Emmanouil, et al.
Publicado: (2024)
por: Zaranis, Emmanouil, et al.
Publicado: (2024)
Ejemplares similares
-
Multilingual Contextualization of Large Language Models for Document-Level Machine Translation
por: Ramos, Miguel Moura, et al.
Publicado: (2025) -
Aligning Neural Machine Translation Models: Human Feedback in Training and Inference
por: Ramos, Miguel Moura, et al.
Publicado: (2023) -
OPSDL: On-Policy Self-Distillation for Long-Context Language Models
por: Zhang, Xinsen, et al.
Publicado: (2026) -
On-Policy Context Distillation for Language Models
por: Ye, Tianzhu, et al.
Publicado: (2026) -
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
por: Zhao, Siyan, et al.
Publicado: (2026)