Guardado en:
| Autores principales: | Jiang, Guochao, Quan, Guofeng, Ding, Zepeng, Luo, Ziqin, Wang, Dixuan, Hu, Zheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2505.13949 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving
por: Ding, Zepeng, et al.
Publicado: (2025)
por: Ding, Zepeng, et al.
Publicado: (2025)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
por: Wang, Dixuan, et al.
Publicado: (2024)
por: Wang, Dixuan, et al.
Publicado: (2024)
Mitigating Out-of-Entity Errors in Named Entity Recognition: A Sentence-Level Strategy
por: Jiang, Guochao, et al.
Publicado: (2024)
por: Jiang, Guochao, et al.
Publicado: (2024)
ToNER: Type-oriented Named Entity Recognition with Generative Language Model
por: Jiang, Guochao, et al.
Publicado: (2024)
por: Jiang, Guochao, et al.
Publicado: (2024)
Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding
por: Li, Yanda, et al.
Publicado: (2024)
por: Li, Yanda, et al.
Publicado: (2024)
Dynamic Early Exit in Reasoning Models
por: Yang, Chenxu, et al.
Publicado: (2025)
por: Yang, Chenxu, et al.
Publicado: (2025)
RASD: Retrieval-Augmented Speculative Decoding
por: Quan, Guofeng, et al.
Publicado: (2025)
por: Quan, Guofeng, et al.
Publicado: (2025)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Adaptive Reinforcement Learning Planning: Harnessing Large Language Models for Complex Information Extraction
por: Ding, Zepeng, et al.
Publicado: (2024)
por: Ding, Zepeng, et al.
Publicado: (2024)
SED: Self-Evaluation Decoding Enhances Large Language Models for Better Generation
por: Luo, Ziqin, et al.
Publicado: (2024)
por: Luo, Ziqin, et al.
Publicado: (2024)
Efficient Reasoning with Balanced Thinking
por: Li, Yulin, et al.
Publicado: (2026)
por: Li, Yulin, et al.
Publicado: (2026)
The Diminishing Returns of Early-Exit Decoding in Modern LLMs
por: Wei, Rui, et al.
Publicado: (2026)
por: Wei, Rui, et al.
Publicado: (2026)
TERMINATOR: Learning Optimal Exit Points for Early Stopping in Chain-of-Thought Reasoning
por: Nagle, Alliot, et al.
Publicado: (2026)
por: Nagle, Alliot, et al.
Publicado: (2026)
Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model
por: Ding, Bowen, et al.
Publicado: (2025)
por: Ding, Bowen, et al.
Publicado: (2025)
ADEPT: Adaptive Dynamic Early-Exit Process for Transformers
por: Yoo, Sangmin, et al.
Publicado: (2026)
por: Yoo, Sangmin, et al.
Publicado: (2026)
SpecExit: Accelerating Large Reasoning Model via Speculative Exit
por: Yang, Rubing, et al.
Publicado: (2025)
por: Yang, Rubing, et al.
Publicado: (2025)
Efficient Reasoning with Hidden Thinking
por: Shen, Xuan, et al.
Publicado: (2025)
por: Shen, Xuan, et al.
Publicado: (2025)
DAdEE: Unsupervised Domain Adaptation in Early Exit PLMs
por: Bajpai, Divya Jyoti, et al.
Publicado: (2024)
por: Bajpai, Divya Jyoti, et al.
Publicado: (2024)
Runaway is Ashamed, But Helpful: On the Early-Exit Behavior of Large Language Model-based Agents in Embodied Environments
por: Lu, Qingyu, et al.
Publicado: (2025)
por: Lu, Qingyu, et al.
Publicado: (2025)
When to Continue Thinking: Adaptive Thinking Mode Switching for Efficient Reasoning
por: Zhang, Xiaoyun, et al.
Publicado: (2025)
por: Zhang, Xiaoyun, et al.
Publicado: (2025)
Dynamic Vocabulary Pruning in Early-Exit LLMs
por: Vincenti, Jort, et al.
Publicado: (2024)
por: Vincenti, Jort, et al.
Publicado: (2024)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
por: Yan, Yuchen, et al.
Publicado: (2026)
por: Yan, Yuchen, et al.
Publicado: (2026)
Controlling Thinking Speed in Reasoning Models
por: Lin, Zhengkai, et al.
Publicado: (2025)
por: Lin, Zhengkai, et al.
Publicado: (2025)
EE-Tuning: An Economical yet Scalable Solution for Tuning Early-Exit Large Language Models
por: Pan, Xuchen, et al.
Publicado: (2024)
por: Pan, Xuchen, et al.
Publicado: (2024)
BEExformer: A Fast Inferencing Binarized Transformer with Early Exits
por: Ansar, Wazib, et al.
Publicado: (2024)
por: Ansar, Wazib, et al.
Publicado: (2024)
CAPEEN: Image Captioning with Early Exits and Knowledge Distillation
por: Bajpai, Divya Jyoti, et al.
Publicado: (2024)
por: Bajpai, Divya Jyoti, et al.
Publicado: (2024)
LYNX: Learning Dynamic Exits for Confidence-Controlled Reasoning
por: Akgül, Ömer Faruk, et al.
Publicado: (2025)
por: Akgül, Ömer Faruk, et al.
Publicado: (2025)
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
por: Chen, Hongwei, et al.
Publicado: (2025)
por: Chen, Hongwei, et al.
Publicado: (2025)
When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning
por: Zhu, Rongzhi, et al.
Publicado: (2025)
por: Zhu, Rongzhi, et al.
Publicado: (2025)
MeTHanol: Modularized Thinking Language Models with Intermediate Layer Thinking, Decoding and Bootstrapping Reasoning
por: Xi, Ningyuan, et al.
Publicado: (2024)
por: Xi, Ningyuan, et al.
Publicado: (2024)
ThinkRouter: Efficient Reasoning via Routing Thinking between Latent and Discrete Spaces
por: Xu, Xin, et al.
Publicado: (2026)
por: Xu, Xin, et al.
Publicado: (2026)
Pipeline Parallelism is All You Need for Optimized Early-Exit Based Self-Speculative Decoding
por: Li, Ruanjun, et al.
Publicado: (2025)
por: Li, Ruanjun, et al.
Publicado: (2025)
LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding
por: Elhoushi, Mostafa, et al.
Publicado: (2024)
por: Elhoushi, Mostafa, et al.
Publicado: (2024)
One Jump Is All You Need: Short-Cutting Transformers for Early Exit Prediction with One Jump to Fit All Exit Levels
por: Seshadri, Amrit Diggavi
Publicado: (2025)
por: Seshadri, Amrit Diggavi
Publicado: (2025)
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
por: Cheng, Xiaoxue, et al.
Publicado: (2025)
Draft-Thinking: Learning Efficient Reasoning in Long Chain-of-Thought LLMs
por: Cao, Jie, et al.
Publicado: (2026)
por: Cao, Jie, et al.
Publicado: (2026)
MixReasoning: Switching Modes to Think
por: Lu, Haiquan, et al.
Publicado: (2025)
por: Lu, Haiquan, et al.
Publicado: (2025)
Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models
por: Guo, Zhenyuan, et al.
Publicado: (2026)
por: Guo, Zhenyuan, et al.
Publicado: (2026)
P-ICL: Point In-Context Learning for Named Entity Recognition with Large Language Models
por: Jiang, Guochao, et al.
Publicado: (2024)
por: Jiang, Guochao, et al.
Publicado: (2024)
FlashEVA: Accelerating LLM inference via Efficient Attention
por: Kostelec, Juan Gabriel, et al.
Publicado: (2025)
por: Kostelec, Juan Gabriel, et al.
Publicado: (2025)
Ejemplares similares
-
RLAP: A Reinforcement Learning Enhanced Adaptive Planning Framework for Multi-step NLP Task Solving
por: Ding, Zepeng, et al.
Publicado: (2025) -
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
por: Wang, Dixuan, et al.
Publicado: (2024) -
Mitigating Out-of-Entity Errors in Named Entity Recognition: A Sentence-Level Strategy
por: Jiang, Guochao, et al.
Publicado: (2024) -
ToNER: Type-oriented Named Entity Recognition with Generative Language Model
por: Jiang, Guochao, et al.
Publicado: (2024) -
Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding
por: Li, Yanda, et al.
Publicado: (2024)