Thus Spake Long-Context Large Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Xiaoran, Li, Ruixiao, Huang, Mianqiu, Liu, Zhigeng, Song, Yuerong, Guo, Qipeng, He, Siyang, Wang, Qiqi, Li, Linlin, Liu, Qun, He, Ziwei, Zhou, Yaqian, Huang, Xuanjing, Qiu, Xipeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LongLLaDA: Unlocking Long Context Capabilities in Diffusion LLMs
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
Beyond Homogeneous Attention: Memory-Efficient LLMs via Fourier-Approximated KV Cache
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
Sparse-dLLM: Accelerating Diffusion LLMs with Dynamic Cache Eviction
di: Song, Yuerong, et al.
Pubblicazione: (2025)
di: Song, Yuerong, et al.
Pubblicazione: (2025)
ReAttention: Training-Free Infinite Context with Finite Attention Scope
di: Liu, Xiaoran, et al.
Pubblicazione: (2024)
di: Liu, Xiaoran, et al.
Pubblicazione: (2024)
Beyond Real: Imaginary Extension of Rotary Position Embeddings for Long-Context LLMs
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)
LongSafety: Enhance Safety for Long-Context LLMs
di: Huang, Mianqiu, et al.
Pubblicazione: (2024)
di: Huang, Mianqiu, et al.
Pubblicazione: (2024)
DetectiveQA: Evaluating Long-Context Reasoning on Detective Novels
di: Xu, Zhe, et al.
Pubblicazione: (2024)
di: Xu, Zhe, et al.
Pubblicazione: (2024)
Thus Spake the OPAC User.
di: Markey, Karen
Pubblicazione: (1983)
di: Markey, Karen
Pubblicazione: (1983)
FourierSampler: Unlocking Non-Autoregressive Potential in Diffusion Language Models via Frequency-Guided Generation
di: He, Siyang, et al.
Pubblicazione: (2026)
di: He, Siyang, et al.
Pubblicazione: (2026)
DiRL: An Efficient Post-Training Framework for Diffusion Language Models
di: Zhu, Ying, et al.
Pubblicazione: (2025)
di: Zhu, Ying, et al.
Pubblicazione: (2025)
LongWanjuan: Towards Systematic Measurement for Long Text Quality
di: Lv, Kai, et al.
Pubblicazione: (2024)
di: Lv, Kai, et al.
Pubblicazione: (2024)
AgentLongBench: A Controllable Long Benchmark For Long-Contexts Agents via Environment Rollouts
di: Fang, Shicheng, et al.
Pubblicazione: (2026)
di: Fang, Shicheng, et al.
Pubblicazione: (2026)
MetaAlign: Align Large Language Models with Diverse Preferences during Inference Time
di: Zhang, Mozhi, et al.
Pubblicazione: (2024)
di: Zhang, Mozhi, et al.
Pubblicazione: (2024)
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
Calibrating the Confidence of Large Language Models by Eliciting Fidelity
di: Zhang, Mozhi, et al.
Pubblicazione: (2024)
di: Zhang, Mozhi, et al.
Pubblicazione: (2024)
How Attention Sinks Emerge in Large Language Models: An Interpretability Perspective
di: Peng, Runyu, et al.
Pubblicazione: (2026)
di: Peng, Runyu, et al.
Pubblicazione: (2026)
Beyond Attention Magnitude: Leveraging Inter-layer Rank Consistency for Efficient Vision-Language-Action Models
di: Liu, Peiju, et al.
Pubblicazione: (2026)
di: Liu, Peiju, et al.
Pubblicazione: (2026)
ARISE: An Adaptive Resolution-Aware Metric for Test-Time Scaling Evaluation in Large Reasoning Models
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
Making Large Language Models Better Reasoners with Orchestrated Streaming Experiences
di: Liu, Xiangyang, et al.
Pubblicazione: (2025)
di: Liu, Xiangyang, et al.
Pubblicazione: (2025)
How to Set the Learning Rate for Large-Scale Pre-training?
di: Zhou, Yunhua, et al.
Pubblicazione: (2026)
di: Zhou, Yunhua, et al.
Pubblicazione: (2026)
Scaling Laws for Fact Memorization of Large Language Models
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
Error Classification of Large Language Models on Math Word Problems: A Dynamically Adaptive Framework
di: Sun, Yuhong, et al.
Pubblicazione: (2025)
di: Sun, Yuhong, et al.
Pubblicazione: (2025)
Inference-Time Decontamination: Reusing Leaked Benchmarks for Large Language Model Evaluation
di: Zhu, Qin, et al.
Pubblicazione: (2024)
di: Zhu, Qin, et al.
Pubblicazione: (2024)
Training-Free Long-Context Scaling of Large Language Models
di: An, Chenxin, et al.
Pubblicazione: (2024)
di: An, Chenxin, et al.
Pubblicazione: (2024)
Identifying Semantic Induction Heads to Understand In-Context Learning
di: Ren, Jie, et al.
Pubblicazione: (2024)
di: Ren, Jie, et al.
Pubblicazione: (2024)
Full Parameter Fine-tuning for Large Language Models with Limited Resources
di: Lv, Kai, et al.
Pubblicazione: (2023)
di: Lv, Kai, et al.
Pubblicazione: (2023)
F-Eval: Assessing Fundamental Abilities with Refined Evaluation Methods
di: Sun, Yu, et al.
Pubblicazione: (2024)
di: Sun, Yu, et al.
Pubblicazione: (2024)
Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2024)
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2024)
SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
di: Zhang, Xin, et al.
Pubblicazione: (2023)
di: Zhang, Xin, et al.
Pubblicazione: (2023)
AstroReason-Bench: Evaluating Unified Agentic Planning across Heterogeneous Space Planning Problems
di: Wang, Weiyi, et al.
Pubblicazione: (2026)
di: Wang, Weiyi, et al.
Pubblicazione: (2026)
Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders
di: He, Zhengfu, et al.
Pubblicazione: (2024)
di: He, Zhengfu, et al.
Pubblicazione: (2024)
Prism: Spectral-Aware Block-Sparse Attention
di: Wang, Xinghao, et al.
Pubblicazione: (2026)
di: Wang, Xinghao, et al.
Pubblicazione: (2026)
Cut2Next: Generating Next Shot via In-Context Tuning
di: He, Jingwen, et al.
Pubblicazione: (2025)
di: He, Jingwen, et al.
Pubblicazione: (2025)
EvoSyn: Generalizable Evolutionary Data Synthesis for Verifiable Learning
di: Du, He, et al.
Pubblicazione: (2025)
di: Du, He, et al.
Pubblicazione: (2025)
Rhagoletis flavigenualis Hering. Thus 1958
di: Korneyev, S. V., et al.
Pubblicazione: (2022)
di: Korneyev, S. V., et al.
Pubblicazione: (2022)
Safe Inputs but Unsafe Output: Benchmarking Cross-modality Safety Alignment of Large Vision-Language Model
di: Wang, Siyin, et al.
Pubblicazione: (2024)
di: Wang, Siyin, et al.
Pubblicazione: (2024)
“Silent yet Spake”: Qualities of Silence in Paradise Lost
di: Ariadne Lewis
Pubblicazione: (2025)
di: Ariadne Lewis
Pubblicazione: (2025)
LongHeads: Multi-Head Attention is Secretly a Long Context Processor
di: Lu, Yi, et al.
Pubblicazione: (2024)
di: Lu, Yi, et al.
Pubblicazione: (2024)
Unearthing Large Scale Domain-Specific Knowledge from Public Corpora
di: Fei, Zhaoye, et al.
Pubblicazione: (2024)
di: Fei, Zhaoye, et al.
Pubblicazione: (2024)
DuoDecoding: Hardware-aware Heterogeneous Speculative Decoding with Dynamic Multi-Sequence Drafting
di: Lv, Kai, et al.
Pubblicazione: (2025)
di: Lv, Kai, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LongLLaDA: Unlocking Long Context Capabilities in Diffusion LLMs
di: Liu, Xiaoran, et al.
Pubblicazione: (2025) -
Beyond Homogeneous Attention: Memory-Efficient LLMs via Fourier-Approximated KV Cache
di: Liu, Xiaoran, et al.
Pubblicazione: (2025) -
Sparse-dLLM: Accelerating Diffusion LLMs with Dynamic Cache Eviction
di: Song, Yuerong, et al.
Pubblicazione: (2025) -
ReAttention: Training-Free Infinite Context with Finite Attention Scope
di: Liu, Xiaoran, et al.
Pubblicazione: (2024) -
Beyond Real: Imaginary Extension of Rotary Position Embeddings for Long-Context LLMs
di: Liu, Xiaoran, et al.
Pubblicazione: (2025)