QwenLong-L1.5: Post-Training Recipe for Long-Context Reasoning and Memory Management
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Shen, Weizhou, Yang, Ziyi, Li, Chenliang, Lu, Zhiyuan, Peng, Miao, Sun, Huashan, Shi, Yingcheng, Liao, Shengyi, Lai, Shaopeng, Zhang, Bo, Liu, Dayiheng, Huang, Fei, Zhou, Jingren, Yan, Ming |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning
von: Wan, Fanqi, et al.
Veröffentlicht: (2025)
von: Wan, Fanqi, et al.
Veröffentlicht: (2025)
QwenLong-CPRS: Towards $\infty$-LLMs with Dynamic Context Optimization
von: Shen, Weizhou, et al.
Veröffentlicht: (2025)
von: Shen, Weizhou, et al.
Veröffentlicht: (2025)
CorpusQA: A 10 Million Token Benchmark for Corpus-Level Analysis and Reasoning
von: Lu, Zhiyuan, et al.
Veröffentlicht: (2026)
von: Lu, Zhiyuan, et al.
Veröffentlicht: (2026)
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
von: Sun, Huashan, et al.
Veröffentlicht: (2025)
von: Sun, Huashan, et al.
Veröffentlicht: (2025)
Incentivizing In-depth Reasoning over Long Contexts with Process Advantage Shaping
von: Peng, Miao, et al.
Veröffentlicht: (2026)
von: Peng, Miao, et al.
Veröffentlicht: (2026)
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
LongRecipe: Recipe for Efficient Long Context Generalization in Large Language Models
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2024)
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
von: Li, Mingxin, et al.
Veröffentlicht: (2026)
von: Li, Mingxin, et al.
Veröffentlicht: (2026)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
von: Zhang, Yanzhao, et al.
Veröffentlicht: (2025)
von: Zhang, Yanzhao, et al.
Veröffentlicht: (2025)
OmChat: A Recipe to Train Multimodal Language Models with Strong Long Context and Video Understanding
von: Zhao, Tiancheng, et al.
Veröffentlicht: (2024)
von: Zhao, Tiancheng, et al.
Veröffentlicht: (2024)
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
von: Xiao, Chaojun, et al.
Veröffentlicht: (2024)
von: Xiao, Chaojun, et al.
Veröffentlicht: (2024)
LongAlign: A Recipe for Long Context Alignment of Large Language Models
von: Bai, Yushi, et al.
Veröffentlicht: (2024)
von: Bai, Yushi, et al.
Veröffentlicht: (2024)
Learning to Remember: End-to-End Training of Memory Agents for Long-Context Reasoning
von: Zhang, Kehao, et al.
Veröffentlicht: (2026)
von: Zhang, Kehao, et al.
Veröffentlicht: (2026)
Qwen2.5-Coder Technical Report
von: Hui, Binyuan, et al.
Veröffentlicht: (2024)
von: Hui, Binyuan, et al.
Veröffentlicht: (2024)
Evidence-Augmented Policy Optimization with Reward Co-Evolution for Long-Context Reasoning
von: Guan, Xin, et al.
Veröffentlicht: (2026)
von: Guan, Xin, et al.
Veröffentlicht: (2026)
LongSkywork: A Training Recipe for Efficiently Extending Context Length in Large Language Models
von: Zhao, Liang, et al.
Veröffentlicht: (2024)
von: Zhao, Liang, et al.
Veröffentlicht: (2024)
Qwen3Guard Technical Report
von: Zhao, Haiquan, et al.
Veröffentlicht: (2025)
von: Zhao, Haiquan, et al.
Veröffentlicht: (2025)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
von: Ye, Rui, et al.
Veröffentlicht: (2025)
von: Ye, Rui, et al.
Veröffentlicht: (2025)
Qwen-Scope: Turning Sparse Features into Development Tools for Large Language Models
von: Deng, Boyi, et al.
Veröffentlicht: (2026)
von: Deng, Boyi, et al.
Veröffentlicht: (2026)
MKA: Memory-Keyed Attention for Efficient Long-Context Reasoning
von: Liu, Dong, et al.
Veröffentlicht: (2026)
von: Liu, Dong, et al.
Veröffentlicht: (2026)
Writing-RL: Advancing Long-form Writing via Adaptive Curriculum Reinforcement Learning
von: Lei, Xuanyu, et al.
Veröffentlicht: (2025)
von: Lei, Xuanyu, et al.
Veröffentlicht: (2025)
AllMem: A Memory-centric Recipe for Efficient Long-context Modeling
von: Wang, Ziming, et al.
Veröffentlicht: (2026)
von: Wang, Ziming, et al.
Veröffentlicht: (2026)
R2-Write: Reflection and Revision for Open-Ended Writing with Deep Reasoning
von: Liu, Wanlong, et al.
Veröffentlicht: (2026)
von: Liu, Wanlong, et al.
Veröffentlicht: (2026)
An Efficient Recipe for Long Context Extension via Middle-Focused Positional Encoding
von: Wu, Tong, et al.
Veröffentlicht: (2024)
von: Wu, Tong, et al.
Veröffentlicht: (2024)
Language Models can Self-Lengthen to Generate Long Texts
von: Quan, Shanghaoran, et al.
Veröffentlicht: (2024)
von: Quan, Shanghaoran, et al.
Veröffentlicht: (2024)
QUITO: Accelerating Long-Context Reasoning through Query-Guided Context Compression
von: Wang, Wenshan, et al.
Veröffentlicht: (2024)
von: Wang, Wenshan, et al.
Veröffentlicht: (2024)
LongReason: A Synthetic Long-Context Reasoning Benchmark via Context Expansion
von: Ling, Zhan, et al.
Veröffentlicht: (2025)
von: Ling, Zhan, et al.
Veröffentlicht: (2025)
Qwen2.5-1M Technical Report
von: Yang, An, et al.
Veröffentlicht: (2025)
von: Yang, An, et al.
Veröffentlicht: (2025)
Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning
von: Li, Miao, et al.
Veröffentlicht: (2026)
von: Li, Miao, et al.
Veröffentlicht: (2026)
Evaluating Long-Term Memory for Long-Context Question Answering
von: Terranova, Alessandra, et al.
Veröffentlicht: (2025)
von: Terranova, Alessandra, et al.
Veröffentlicht: (2025)
Memory Architectures Beyond Attention: Disambiguating Four Memory Concepts and the Long-Context Reasoning Frontier
von: Mahendrakar, Pranay
Veröffentlicht: (2026)
von: Mahendrakar, Pranay
Veröffentlicht: (2026)
The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs
von: Chen, Jierun, et al.
Veröffentlicht: (2025)
von: Chen, Jierun, et al.
Veröffentlicht: (2025)
Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement
von: Yang, An, et al.
Veröffentlicht: (2024)
von: Yang, An, et al.
Veröffentlicht: (2024)
Qwen-Image Technical Report
von: Wu, Chenfei, et al.
Veröffentlicht: (2025)
von: Wu, Chenfei, et al.
Veröffentlicht: (2025)
When to Memorize and When to Stop: Gated Recurrent Memory for Long-Context Reasoning
von: Sheng, Leheng, et al.
Veröffentlicht: (2026)
von: Sheng, Leheng, et al.
Veröffentlicht: (2026)
Look Back to Reason Forward: Revisitable Memory for Long-Context LLM Agents
von: Shi, Yaorui, et al.
Veröffentlicht: (2025)
von: Shi, Yaorui, et al.
Veröffentlicht: (2025)
COSMIR: Chain Orchestrated Structured Memory for Iterative Reasoning over Long Context
von: Gupta, Naman, et al.
Veröffentlicht: (2025)
von: Gupta, Naman, et al.
Veröffentlicht: (2025)
Recall with Reasoning: Chain-of-Thought Distillation for Mamba's Long-Context Memory and Extrapolation
von: Ma, Junyu, et al.
Veröffentlicht: (2025)
von: Ma, Junyu, et al.
Veröffentlicht: (2025)
Leave No Document Behind: Benchmarking Long-Context LLMs with Extended Multi-Doc QA
von: Wang, Minzheng, et al.
Veröffentlicht: (2024)
von: Wang, Minzheng, et al.
Veröffentlicht: (2024)
Qwen2-Audio Technical Report
von: Chu, Yunfei, et al.
Veröffentlicht: (2024)
von: Chu, Yunfei, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning
von: Wan, Fanqi, et al.
Veröffentlicht: (2025) -
QwenLong-CPRS: Towards $\infty$-LLMs with Dynamic Context Optimization
von: Shen, Weizhou, et al.
Veröffentlicht: (2025) -
CorpusQA: A 10 Million Token Benchmark for Corpus-Level Analysis and Reasoning
von: Lu, Zhiyuan, et al.
Veröffentlicht: (2026) -
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
von: Sun, Huashan, et al.
Veröffentlicht: (2025) -
Incentivizing In-depth Reasoning over Long Contexts with Process Advantage Shaping
von: Peng, Miao, et al.
Veröffentlicht: (2026)