Learning When to Stop: Adaptive Latent Reasoning via Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Ning, Alex, Kuo, Yen-Ling, Gomes, Gabe |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Visualizing LLM Latent Space Geometry Through Dimensionality Reduction
by: Ning, Alex, et al.
Published: (2025)
by: Ning, Alex, et al.
Published: (2025)
Learning When to Switch: Adaptive Policy Selection via Reinforcement Learning
by: Tava, Chris
Published: (2025)
by: Tava, Chris
Published: (2025)
The Courage to Stop: Overcoming Sunk Cost Fallacy in Deep Reinforcement Learning
by: Liu, Jiashun, et al.
Published: (2025)
by: Liu, Jiashun, et al.
Published: (2025)
Learning When to Stop: Selective Imitation Learning Under Arbitrary Dynamics Shift
by: Goel, Surbhi, et al.
Published: (2026)
by: Goel, Surbhi, et al.
Published: (2026)
Lessons Learned: Reproducibility, Replicability, and When to Stop
by: Gomez, Milton S., et al.
Published: (2024)
by: Gomez, Milton S., et al.
Published: (2024)
Learning to Reason Efficiently with Discounted Reinforcement Learning
by: Ayoub, Alex, et al.
Published: (2025)
by: Ayoub, Alex, et al.
Published: (2025)
A Theory of Generalization in Deep Learning
by: Litman, Elon, et al.
Published: (2026)
by: Litman, Elon, et al.
Published: (2026)
When to Stop Federated Learning: Zero-Shot Generation of Synthetic Validation Data with Generative AI for Early Stopping
by: Lee, Youngjoon, et al.
Published: (2025)
by: Lee, Youngjoon, et al.
Published: (2025)
Prolonging Tool Life: Learning Skillful Use of General-purpose Tools through Lifespan-guided Reinforcement Learning
by: Wu, Po-Yen, et al.
Published: (2025)
by: Wu, Po-Yen, et al.
Published: (2025)
Adaptive Active Learning for Regression via Reinforcement Learning
by: Nguyen, Simon D., et al.
Published: (2026)
by: Nguyen, Simon D., et al.
Published: (2026)
Self-Reinforced Graph Contrastive Learning
by: Hsieh, Chou-Ying, et al.
Published: (2025)
by: Hsieh, Chou-Ying, et al.
Published: (2025)
Optimal Stopping in Latent Diffusion Models
by: Wu, Yu-Han, et al.
Published: (2025)
by: Wu, Yu-Han, et al.
Published: (2025)
Act Only When It Pays: Efficient Reinforcement Learning for LLM Reasoning via Selective Rollouts
by: Zheng, Haizhong, et al.
Published: (2025)
by: Zheng, Haizhong, et al.
Published: (2025)
Latent-Space Contrastive Reinforcement Learning for Stable and Efficient LLM Reasoning
by: Shan, Lianlei, et al.
Published: (2026)
by: Shan, Lianlei, et al.
Published: (2026)
Learning to Stop: Deep Learning for Mean Field Optimal Stopping
by: Magnino, Lorenzo, et al.
Published: (2024)
by: Magnino, Lorenzo, et al.
Published: (2024)
When Actions Teach You to Think: Reasoning-Action Synergy via Reinforcement Learning in Conversational Agents
by: Rawat, Mrinal, et al.
Published: (2025)
by: Rawat, Mrinal, et al.
Published: (2025)
Teaching Large Language Models to Reason with Reinforcement Learning
by: Havrilla, Alex, et al.
Published: (2024)
by: Havrilla, Alex, et al.
Published: (2024)
Quantum Reinforcement Learning by Adaptive Non-local Observables
by: Lin, Hsin-Yi, et al.
Published: (2025)
by: Lin, Hsin-Yi, et al.
Published: (2025)
Random Latent Exploration for Deep Reinforcement Learning
by: Mahankali, Srinath, et al.
Published: (2024)
by: Mahankali, Srinath, et al.
Published: (2024)
Latent Poincaré Shaping for Agentic Reinforcement Learning
by: Xia, Hanchen, et al.
Published: (2026)
by: Xia, Hanchen, et al.
Published: (2026)
Learning When to Act: Communication-Efficient Reinforcement Learning via Run-Time Assurance
by: Haroon, Adam, et al.
Published: (2026)
by: Haroon, Adam, et al.
Published: (2026)
AdaptThink: Reasoning Models Can Learn When to Think
by: Zhang, Jiajie, et al.
Published: (2025)
by: Zhang, Jiajie, et al.
Published: (2025)
Multi-Objective Adaptive Rate Limiting in Microservices Using Deep Reinforcement Learning
by: Lyu, Ning, et al.
Published: (2025)
by: Lyu, Ning, et al.
Published: (2025)
Adaptive Guidance Accelerates Reinforcement Learning of Reasoning Models
by: Nath, Vaskar, et al.
Published: (2025)
by: Nath, Vaskar, et al.
Published: (2025)
Early Stopping Tabular In-Context Learning
by: Küken, Jaris, et al.
Published: (2025)
by: Küken, Jaris, et al.
Published: (2025)
Vision Transformers that Never Stop Learning
by: Sun, Caihao, et al.
Published: (2026)
by: Sun, Caihao, et al.
Published: (2026)
LaDi-RL: Latent Diffusion Reasoning Prevents Entropy Collapse in Reinforcement Learning
by: Kang, Haoqiang, et al.
Published: (2026)
by: Kang, Haoqiang, et al.
Published: (2026)
AdaMemento: Adaptive Memory-Assisted Policy Optimization for Reinforcement Learning
by: Yan, Renye, et al.
Published: (2024)
by: Yan, Renye, et al.
Published: (2024)
The Hidden Influence of Latent Feature Magnitude When Learning with Imbalanced Data
by: Dablain, Damien A., et al.
Published: (2024)
by: Dablain, Damien A., et al.
Published: (2024)
Safe Reinforcement Learning for Constrained Markov Decision Processes with Stochastic Stopping Time
by: Mazumdar, Abhijit, et al.
Published: (2024)
by: Mazumdar, Abhijit, et al.
Published: (2024)
When Does Neuroevolution Outcompete Reinforcement Learning in Transfer Learning Tasks?
by: Nisioti, Eleni, et al.
Published: (2025)
by: Nisioti, Eleni, et al.
Published: (2025)
Rich-Observation Reinforcement Learning with Continuous Latent Dynamics
by: Song, Yuda, et al.
Published: (2024)
by: Song, Yuda, et al.
Published: (2024)
Adaptive Robust Learning using Latent Bernoulli Variables
by: Karakulev, Aleksandr, et al.
Published: (2023)
by: Karakulev, Aleksandr, et al.
Published: (2023)
Quantum Hierarchical Reinforcement Learning via Variational Quantum Circuits
by: Lee, Yu-Ting, et al.
Published: (2026)
by: Lee, Yu-Ting, et al.
Published: (2026)
A Reinforcement Learning Inspired Latent Yield Based Adaptive Algorithm Switching Mechanism
by: Nair, Jayprakash S., et al.
Published: (2026)
by: Nair, Jayprakash S., et al.
Published: (2026)
Reinforcement Learning for Adaptive MCMC
by: Wang, Congye, et al.
Published: (2024)
by: Wang, Congye, et al.
Published: (2024)
Multi-Path Collaborative Reasoning via Reinforcement Learning
by: Lv, Jindi, et al.
Published: (2025)
by: Lv, Jindi, et al.
Published: (2025)
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
by: Shi, Taiwei, et al.
Published: (2025)
by: Shi, Taiwei, et al.
Published: (2025)
Advancing Molecular Machine Learning Representations with Stereoelectronics-Infused Molecular Graphs
by: Boiko, Daniil A., et al.
Published: (2024)
by: Boiko, Daniil A., et al.
Published: (2024)
Autonomous Adaptive Solver Selection for Chemistry Integration via Reinforcement Learning
by: Ikponmwoba, Eloghosa, et al.
Published: (2026)
by: Ikponmwoba, Eloghosa, et al.
Published: (2026)
Similar Items
-
Visualizing LLM Latent Space Geometry Through Dimensionality Reduction
by: Ning, Alex, et al.
Published: (2025) -
Learning When to Switch: Adaptive Policy Selection via Reinforcement Learning
by: Tava, Chris
Published: (2025) -
The Courage to Stop: Overcoming Sunk Cost Fallacy in Deep Reinforcement Learning
by: Liu, Jiashun, et al.
Published: (2025) -
Learning When to Stop: Selective Imitation Learning Under Arbitrary Dynamics Shift
by: Goel, Surbhi, et al.
Published: (2026) -
Lessons Learned: Reproducibility, Replicability, and When to Stop
by: Gomez, Milton S., et al.
Published: (2024)