Salvato in:
| Autori principali: | Deng, Haoran, Lin, Yingyu, Lin, Zhenghao, Liu, Xiao, Sun, Yizhou, Ma, Yi-An, Gong, Yeyun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2510.25804 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Data and Reward Design for Scientific Reasoning in Large Language Models
di: Chen, Zijie, et al.
Pubblicazione: (2026)
di: Chen, Zijie, et al.
Pubblicazione: (2026)
HiCaM: A Hierarchical-Causal Modification Framework for Long-Form Text Modification
di: Shi, Yuntao, et al.
Pubblicazione: (2025)
di: Shi, Yuntao, et al.
Pubblicazione: (2025)
LayerNorm Induces Recency Bias in Transformer Decoders
di: Kim, Junu, et al.
Pubblicazione: (2025)
di: Kim, Junu, et al.
Pubblicazione: (2025)
APOLLO: An Optimized Training Approach for Long-form Numerical Reasoning
di: Sun, Jiashuo, et al.
Pubblicazione: (2022)
di: Sun, Jiashuo, et al.
Pubblicazione: (2022)
Beyond Static Dialogues: Benchmarking Realistic, Heterogeneous, and Evolving Long-Term Memory
di: Zhang, Han, et al.
Pubblicazione: (2026)
di: Zhang, Han, et al.
Pubblicazione: (2026)
Learning from the Best, Differently: A Diversity-Driven Rethinking on Data Selection
di: He, Hongyi, et al.
Pubblicazione: (2025)
di: He, Hongyi, et al.
Pubblicazione: (2025)
Competition-Level Problems are Effective LLM Evaluators
di: Huang, Yiming, et al.
Pubblicazione: (2023)
di: Huang, Yiming, et al.
Pubblicazione: (2023)
TL;DR: Too Long, Do Re-weighting for Efficient LLM Reasoning Compression
di: Li, Zhong-Zhi, et al.
Pubblicazione: (2025)
di: Li, Zhong-Zhi, et al.
Pubblicazione: (2025)
Squeezed Attention: Accelerating Long Context Length LLM Inference
di: Hooper, Coleman, et al.
Pubblicazione: (2024)
di: Hooper, Coleman, et al.
Pubblicazione: (2024)
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
di: Xiao, Chaojun, et al.
Pubblicazione: (2024)
di: Xiao, Chaojun, et al.
Pubblicazione: (2024)
LongFaith: Enhancing Long-Context Reasoning in LLMs with Faithful Synthetic Data
di: Yang, Cehao, et al.
Pubblicazione: (2025)
di: Yang, Cehao, et al.
Pubblicazione: (2025)
Megalodon: Efficient LLM Pretraining and Inference with Unlimited Context Length
di: Ma, Xuezhe, et al.
Pubblicazione: (2024)
di: Ma, Xuezhe, et al.
Pubblicazione: (2024)
Chunks as Arms: Multi-Armed Bandit-Guided Sampling for Long-Context LLM Preference Optimization
di: Duan, Shaohua, et al.
Pubblicazione: (2025)
di: Duan, Shaohua, et al.
Pubblicazione: (2025)
AnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators
di: He, Xingwei, et al.
Pubblicazione: (2023)
di: He, Xingwei, et al.
Pubblicazione: (2023)
Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language Models
di: Luo, Yi, et al.
Pubblicazione: (2024)
di: Luo, Yi, et al.
Pubblicazione: (2024)
HyLRA: Hybrid Layer Reuse Attention for Efficient Long-Context Inference
di: Ai, Xuan, et al.
Pubblicazione: (2026)
di: Ai, Xuan, et al.
Pubblicazione: (2026)
Efficient Long-Context LLM Inference via KV Cache Clustering
di: Hu, Jie, et al.
Pubblicazione: (2025)
di: Hu, Jie, et al.
Pubblicazione: (2025)
Rho-1: Not All Tokens Are What You Need
di: Lin, Zhenghao, et al.
Pubblicazione: (2024)
di: Lin, Zhenghao, et al.
Pubblicazione: (2024)
Latent Context Compilation: Distilling Long Context into Compact Portable Memory
di: Li, Zeju, et al.
Pubblicazione: (2026)
di: Li, Zeju, et al.
Pubblicazione: (2026)
Hierarchical Memory for High-Efficiency Long-Term Reasoning in LLM Agents
di: Sun, Haoran, et al.
Pubblicazione: (2025)
di: Sun, Haoran, et al.
Pubblicazione: (2025)
Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning
di: Park, Sungjin, et al.
Pubblicazione: (2024)
di: Park, Sungjin, et al.
Pubblicazione: (2024)
Preference-Aware Memory Update for Long-Term LLM Agents
di: Sun, Haoran, et al.
Pubblicazione: (2025)
di: Sun, Haoran, et al.
Pubblicazione: (2025)
ParallelComp: Parallel Long-Context Compressor for Length Extrapolation
di: Xiong, Jing, et al.
Pubblicazione: (2025)
di: Xiong, Jing, et al.
Pubblicazione: (2025)
HMT: Hierarchical Memory Transformer for Efficient Long Context Language Processing
di: He, Zifan, et al.
Pubblicazione: (2024)
di: He, Zifan, et al.
Pubblicazione: (2024)
LongReason: A Synthetic Long-Context Reasoning Benchmark via Context Expansion
di: Ling, Zhan, et al.
Pubblicazione: (2025)
di: Ling, Zhan, et al.
Pubblicazione: (2025)
Mitigating Posterior Salience Attenuation in Long-Context LLMs with Positional Contrastive Decoding
di: Xiao, Zikai, et al.
Pubblicazione: (2025)
di: Xiao, Zikai, et al.
Pubblicazione: (2025)
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
di: Shin, Haebin, et al.
Pubblicazione: (2025)
di: Shin, Haebin, et al.
Pubblicazione: (2025)
LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMs
di: Jia, Junlong, et al.
Pubblicazione: (2025)
di: Jia, Junlong, et al.
Pubblicazione: (2025)
Extensible Embedding: A Flexible Multipler For LLM's Context Length
di: Shao, Ninglu, et al.
Pubblicazione: (2024)
di: Shao, Ninglu, et al.
Pubblicazione: (2024)
RealICU: Do LLM Agents Understand Long-Context ICU Data? A Benchmark Beyond Behavior Imitation
di: Shen, Chengzhi, et al.
Pubblicazione: (2026)
di: Shen, Chengzhi, et al.
Pubblicazione: (2026)
DeepThink: Aligning Language Models with Domain-Specific User Intents
di: Li, Yang, et al.
Pubblicazione: (2025)
di: Li, Yang, et al.
Pubblicazione: (2025)
NExtLong: Toward Effective Long-Context Training without Long Documents
di: Gao, Chaochen, et al.
Pubblicazione: (2025)
di: Gao, Chaochen, et al.
Pubblicazione: (2025)
Focus-dLLM: Accelerating Long-Context Diffusion LLM Inference via Confidence-Guided Context Focusing
di: Long, Lingkun, et al.
Pubblicazione: (2026)
di: Long, Lingkun, et al.
Pubblicazione: (2026)
A Little Goes a Long Way: Efficient Long Context Training and Inference with Partial Contexts
di: Ge, Suyu, et al.
Pubblicazione: (2024)
di: Ge, Suyu, et al.
Pubblicazione: (2024)
Task Oriented In-Domain Data Augmentation
di: Liang, Xiao, et al.
Pubblicazione: (2024)
di: Liang, Xiao, et al.
Pubblicazione: (2024)
RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents
di: Dai, Zijie, et al.
Pubblicazione: (2026)
di: Dai, Zijie, et al.
Pubblicazione: (2026)
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
InstInfer: In-Storage Attention Offloading for Cost-Effective Long-Context LLM Inference
di: Pan, Xiurui, et al.
Pubblicazione: (2024)
di: Pan, Xiurui, et al.
Pubblicazione: (2024)
Beyond Isolated Capabilities: Bridging Long CoT Reasoning and Long-Context Understanding
di: Wang, Yifei
Pubblicazione: (2025)
di: Wang, Yifei
Pubblicazione: (2025)
LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens
di: Ding, Yiran, et al.
Pubblicazione: (2024)
di: Ding, Yiran, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Improving Data and Reward Design for Scientific Reasoning in Large Language Models
di: Chen, Zijie, et al.
Pubblicazione: (2026) -
HiCaM: A Hierarchical-Causal Modification Framework for Long-Form Text Modification
di: Shi, Yuntao, et al.
Pubblicazione: (2025) -
LayerNorm Induces Recency Bias in Transformer Decoders
di: Kim, Junu, et al.
Pubblicazione: (2025) -
APOLLO: An Optimized Training Approach for Long-form Numerical Reasoning
di: Sun, Jiashuo, et al.
Pubblicazione: (2022) -
Beyond Static Dialogues: Benchmarking Realistic, Heterogeneous, and Evolving Long-Term Memory
di: Zhang, Han, et al.
Pubblicazione: (2026)