SELF: Self-Extend the Context Length With Logistic Growth Function
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dang, Phat Thanh, Thoppay, Saahil, Yang, Wang, Wang, Qifan, Chaudhary, Vipin, Han, Xiaotian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?
par: Wang, Shouren, et autres
Publié: (2025)
par: Wang, Shouren, et autres
Publié: (2025)
Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Mid-Think: Training-Free Intermediate-Budget Reasoning via Token-Level Triggers
par: Yang, Wang, et autres
Publié: (2026)
par: Yang, Wang, et autres
Publié: (2026)
When Domains Interact: Asymmetric and Order-Sensitive Cross-Domain Effects in Reinforcement Learning for Reasoning
par: Yang, Wang, et autres
Publié: (2026)
par: Yang, Wang, et autres
Publié: (2026)
LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
par: Jin, Hongye, et autres
Publié: (2024)
par: Jin, Hongye, et autres
Publié: (2024)
Beyond the Limits: A Survey of Techniques to Extend the Context Length in Large Language Models
par: Wang, Xindi, et autres
Publié: (2024)
par: Wang, Xindi, et autres
Publié: (2024)
SELF: Self-Evolution with Language Feedback
par: Lu, Jianqiao, et autres
Publié: (2023)
par: Lu, Jianqiao, et autres
Publié: (2023)
Demystifying OPD: Length Inflation and Stabilization Strategies for Large Language Models
par: Luo, Feng, et autres
Publié: (2026)
par: Luo, Feng, et autres
Publié: (2026)
Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Path-Lock Expert: Separating Reasoning Mode in Hybrid Thinking via Architecture-Level Separation
par: Wang, Shouren, et autres
Publié: (2026)
par: Wang, Shouren, et autres
Publié: (2026)
LongEmbed: Extending Embedding Models for Long Context Retrieval
par: Zhu, Dawei, et autres
Publié: (2024)
par: Zhu, Dawei, et autres
Publié: (2024)
Rethinking Perplexity: Revealing the Impact of Input Length on Perplexity Evaluation in LLMs
par: Cheng, Letian, et autres
Publié: (2026)
par: Cheng, Letian, et autres
Publié: (2026)
Intrinsic Entropy of Context Length Scaling in LLMs
par: Shi, Jingzhe, et autres
Publié: (2025)
par: Shi, Jingzhe, et autres
Publié: (2025)
Megalodon: Efficient LLM Pretraining and Inference with Unlimited Context Length
par: Ma, Xuezhe, et autres
Publié: (2024)
par: Ma, Xuezhe, et autres
Publié: (2024)
Length Desensitization in Direct Preference Optimization
par: Liu, Wei, et autres
Publié: (2024)
par: Liu, Wei, et autres
Publié: (2024)
Reward-Based Online LLM Routing via NeuralUCB
par: Tsai, Ming-Hua, et autres
Publié: (2026)
par: Tsai, Ming-Hua, et autres
Publié: (2026)
All You Need is One: Capsule Prompt Tuning with a Single Vector
par: Liu, Yiyang, et autres
Publié: (2025)
par: Liu, Yiyang, et autres
Publié: (2025)
Thinking Preference Optimization
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Don't Pass@k: A Bayesian Framework for Large Language Model Evaluation
par: Hariri, Mohsen, et autres
Publié: (2025)
par: Hariri, Mohsen, et autres
Publié: (2025)
Theoretical Understanding of In-Context Learning in Shallow Transformers with Unstructured Data
par: Xing, Yue, et autres
Publié: (2024)
par: Xing, Yue, et autres
Publié: (2024)
SELF-[IN]CORRECT: LLMs Struggle with Discriminating Self-Generated Responses
par: Jiang, Dongwei, et autres
Publié: (2024)
par: Jiang, Dongwei, et autres
Publié: (2024)
In-Context Environments Induce Evaluation-Awareness in Language Models
par: Chaudhary, Maheep
Publié: (2026)
par: Chaudhary, Maheep
Publié: (2026)
Flux Attention: Context-Aware Hybrid Attention for Efficient LLMs Inference
par: Qiu, Quantong, et autres
Publié: (2026)
par: Qiu, Quantong, et autres
Publié: (2026)
Context-Aware Initialization for Reducing Generative Path Length in Diffusion Language Models
par: Miao, Tongyuan, et autres
Publié: (2025)
par: Miao, Tongyuan, et autres
Publié: (2025)
Proof of Thought : Neurosymbolic Program Synthesis allows Robust and Interpretable Reasoning
par: Ganguly, Debargha, et autres
Publié: (2024)
par: Ganguly, Debargha, et autres
Publié: (2024)
MiniDisc: Minimal Distillation Schedule for Language Model Compression
par: Zhang, Chen, et autres
Publié: (2022)
par: Zhang, Chen, et autres
Publié: (2022)
MEPT: Mixture of Expert Prompt Tuning as a Manifold Mapper
par: Zeng, Runjia, et autres
Publié: (2025)
par: Zeng, Runjia, et autres
Publié: (2025)
Parallelizing Linear Transformers with the Delta Rule over Sequence Length
par: Yang, Songlin, et autres
Publié: (2024)
par: Yang, Songlin, et autres
Publié: (2024)
CausalRAG: Integrating Causal Graphs into Retrieval-Augmented Generation
par: Wang, Nengbo, et autres
Publié: (2025)
par: Wang, Nengbo, et autres
Publié: (2025)
$K^4$: Online Log Anomaly Detection Via Unsupervised Typicality Learning
par: Chen, Weicong, et autres
Publié: (2025)
par: Chen, Weicong, et autres
Publié: (2025)
Representation Deficiency in Masked Language Modeling
par: Meng, Yu, et autres
Publié: (2023)
par: Meng, Yu, et autres
Publié: (2023)
Probe and Skip: Self-Predictive Token Skipping for Efficient Long-Context LLM Inference
par: Wu, Zimeng, et autres
Publié: (2026)
par: Wu, Zimeng, et autres
Publié: (2026)
Winner-Take-All Column Row Sampling for Memory Efficient Adaptation of Language Model
par: Liu, Zirui, et autres
Publié: (2023)
par: Liu, Zirui, et autres
Publié: (2023)
AutoL2S: Auto Long-Short Reasoning for Efficient Large Language Models
par: Luo, Feng, et autres
Publié: (2025)
par: Luo, Feng, et autres
Publié: (2025)
Self-Consolidating Language Models: Continual Knowledge Incorporation from Context
par: Wang, Zekun, et autres
Publié: (2026)
par: Wang, Zekun, et autres
Publié: (2026)
Extending Input Contexts of Language Models through Training on Segmented Sequences
par: Karypis, Petros, et autres
Publié: (2023)
par: Karypis, Petros, et autres
Publié: (2023)
Improving Variable-Length Generation in Diffusion Language Models via Length Regularization
par: Cheng, Zicong, et autres
Publié: (2026)
par: Cheng, Zicong, et autres
Publié: (2026)
Direct Multi-Turn Preference Optimization for Language Agents
par: Shi, Wentao, et autres
Publié: (2024)
par: Shi, Wentao, et autres
Publié: (2024)
Effective Context Modeling Framework for Emotion Recognition in Conversations
par: Van, Cuong Tran, et autres
Publié: (2024)
par: Van, Cuong Tran, et autres
Publié: (2024)
Documents similaires
-
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
par: Yang, Wang, et autres
Publié: (2025) -
Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?
par: Wang, Shouren, et autres
Publié: (2025) -
Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning
par: Yang, Wang, et autres
Publié: (2025) -
Mid-Think: Training-Free Intermediate-Budget Reasoning via Token-Level Triggers
par: Yang, Wang, et autres
Publié: (2026) -
When Domains Interact: Asymmetric and Order-Sensitive Cross-Domain Effects in Reinforcement Learning for Reasoning
par: Yang, Wang, et autres
Publié: (2026)