Continual Knowledge Adaptation for Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Hu, Jinwu, Lian, Zihao, Wen, Zhiquan, Li, Chenghao, Chen, Guohao, Wen, Xutao, Xiao, Bin, Tan, Mingkui |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Test-Time Learning for Large Language Models
by: Hu, Jinwu, et al.
Published: (2025)
by: Hu, Jinwu, et al.
Published: (2025)
Beyond Fast and Slow: Cognitive-Inspired Elastic Reasoning for Large Language Models
by: Hu, Jinwu, et al.
Published: (2025)
by: Hu, Jinwu, et al.
Published: (2025)
Precedent-Informed Reasoning: Mitigating Overthinking in Large Reasoning Models via Test-Time Precedent Learning
by: Wang, Qianyue, et al.
Published: (2026)
by: Wang, Qianyue, et al.
Published: (2026)
Efficient Dynamic Ensembling for Multiple LLM Experts
by: Hu, Jinwu, et al.
Published: (2024)
by: Hu, Jinwu, et al.
Published: (2024)
Beyond Model Scaling: Test-Time Intervention for Efficient Deep Reasoning
by: Wang, Qianyue, et al.
Published: (2026)
by: Wang, Qianyue, et al.
Published: (2026)
Dynamic Compressing Prompts for Efficient Inference of Large Language Models
by: Hu, Jinwu, et al.
Published: (2025)
by: Hu, Jinwu, et al.
Published: (2025)
EvidFuse: Writing-Time Evidence Learning for Consistent Text-Chart Data Reporting
by: Lin, Huanxiang, et al.
Published: (2026)
by: Lin, Huanxiang, et al.
Published: (2026)
ProtoDCS: Towards Robust and Efficient Open-Set Test-Time Adaptation for Vision-Language Models
by: Luo, Wei, et al.
Published: (2026)
by: Luo, Wei, et al.
Published: (2026)
Enhancing Perception Capabilities of Multimodal LLMs with Training-Free Fusion
by: Chen, Zhuokun, et al.
Published: (2024)
by: Chen, Zhuokun, et al.
Published: (2024)
Provable Contrastive Continual Learning
by: Wen, Yichen, et al.
Published: (2024)
by: Wen, Yichen, et al.
Published: (2024)
Enhancing User-Oriented Proactivity in Open-Domain Dialogues with Critic Guidance
by: Wang, Yufeng, et al.
Published: (2025)
by: Wang, Yufeng, et al.
Published: (2025)
Large Language Model as a Policy Teacher for Training Reinforcement Learning Agents
by: Zhou, Zihao, et al.
Published: (2023)
by: Zhou, Zihao, et al.
Published: (2023)
ATLAS: Adapter-Based Multi-Modal Continual Learning with a Two-Stage Learning Strategy
by: Li, Hong, et al.
Published: (2024)
by: Li, Hong, et al.
Published: (2024)
Open-World Drone Active Tracking with Goal-Centered Rewards
by: Sun, Haowei, et al.
Published: (2024)
by: Sun, Haowei, et al.
Published: (2024)
Rethinking Reinforcement fine-tuning of LLMs: A Multi-armed Bandit Learning Perspective
by: Hu, Xiao, et al.
Published: (2026)
by: Hu, Xiao, et al.
Published: (2026)
A Unified Knowledge Embedded Reinforcement Learning-based Framework for Generalized Capacitated Vehicle Routing Problems
by: Wang, Wen, et al.
Published: (2026)
by: Wang, Wen, et al.
Published: (2026)
Enabling Intelligent Interactions between an Agent and an LLM: A Reinforcement Learning Approach
by: Hu, Bin, et al.
Published: (2023)
by: Hu, Bin, et al.
Published: (2023)
Demystifying Design Choices of Reinforcement Fine-tuning: A Batched Contextual Bandit Learning Perspective
by: Xie, Hong, et al.
Published: (2026)
by: Xie, Hong, et al.
Published: (2026)
Understanding Grokking Through A Robustness Viewpoint
by: Tan, Zhiquan, et al.
Published: (2023)
by: Tan, Zhiquan, et al.
Published: (2023)
Variational OOD State Correction for Offline Reinforcement Learning
by: Jiang, Ke, et al.
Published: (2025)
by: Jiang, Ke, et al.
Published: (2025)
Reinforcement Learning Enhanced Multi-hop Reasoning for Temporal Knowledge Question Answering
by: Wen, Wuzhenghong, et al.
Published: (2026)
by: Wen, Wuzhenghong, et al.
Published: (2026)
Knowledge-Infused Legal Wisdom: Navigating LLM Consultation through the Lens of Diagnostics and Positive-Unlabeled Reinforcement Learning
by: Wu, Yang, et al.
Published: (2024)
by: Wu, Yang, et al.
Published: (2024)
Reinforcing Numerical Reasoning in LLMs for Tabular Prediction via Structural Priors
by: Cai, Pengxiang, et al.
Published: (2025)
by: Cai, Pengxiang, et al.
Published: (2025)
Multi-granularity Knowledge Transfer for Continual Reinforcement Learning
by: Pan, Chaofan, et al.
Published: (2024)
by: Pan, Chaofan, et al.
Published: (2024)
Instance-level Visual Active Tracking with Occlusion-Aware Planning
by: Sun, Haowei, et al.
Published: (2026)
by: Sun, Haowei, et al.
Published: (2026)
Efficient Reinforcement Learning for Large Language Models with Intrinsic Exploration
by: Sun, Yan, et al.
Published: (2025)
by: Sun, Yan, et al.
Published: (2025)
cuPilot: A Strategy-Coordinated Multi-agent Framework for CUDA Kernel Evolution
by: Chen, Jinwu, et al.
Published: (2025)
by: Chen, Jinwu, et al.
Published: (2025)
A priori Estimates for Deep Residual Network in Continuous-time Reinforcement Learning
by: Yin, Shuyu, et al.
Published: (2024)
by: Yin, Shuyu, et al.
Published: (2024)
BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-World Dexterous VLA Models
by: Chen, Zhongxi, et al.
Published: (2026)
by: Chen, Zhongxi, et al.
Published: (2026)
Knowledge Retention for Continual Model-Based Reinforcement Learning
by: Sun, Yixiang, et al.
Published: (2025)
by: Sun, Yixiang, et al.
Published: (2025)
PIMCST: Physics-Informed Multi-Phase Consensus and Spatio-Temporal Few-Shot Learning for Traffic Flow Forecasting
by: Fofanah, Abdul Joseph, et al.
Published: (2026)
by: Fofanah, Abdul Joseph, et al.
Published: (2026)
PIMPC-GNN: Physics-Informed Multi-Phase Consensus Learning for Enhancing Imbalanced Node Classification in Graph Neural Networks
by: Fofanah, Abdul Joseph, et al.
Published: (2026)
by: Fofanah, Abdul Joseph, et al.
Published: (2026)
Resisting Contextual Interference in RAG via Parametric-Knowledge Reinforcement
by: Lin, Chenyu, et al.
Published: (2025)
by: Lin, Chenyu, et al.
Published: (2025)
Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving
by: Hu, Xuemin, et al.
Published: (2024)
by: Hu, Xuemin, et al.
Published: (2024)
G-SAP: Graph-based Structure-Aware Prompt Learning over Heterogeneous Knowledge for Commonsense Reasoning
by: Dai, Ruiting, et al.
Published: (2024)
by: Dai, Ruiting, et al.
Published: (2024)
Deep Reinforcement Learning for Power Grid Multi-Stage Cascading Failure Mitigation
by: Meng, Bo, et al.
Published: (2025)
by: Meng, Bo, et al.
Published: (2025)
Trustworthy Human-AI Collaboration: Reinforcement Learning with Human Feedback and Physics Knowledge for Safe Autonomous Driving
by: Huang, Zilin, et al.
Published: (2024)
by: Huang, Zilin, et al.
Published: (2024)
Adapting the Interface, Not the Model: Runtime Harness Adaptation for Deterministic LLM Agents
by: Xu, Tianshi, et al.
Published: (2026)
by: Xu, Tianshi, et al.
Published: (2026)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
by: Hu, Kun, et al.
Published: (2025)
by: Hu, Kun, et al.
Published: (2025)
Core Knowledge Learning Framework for Graph Adaptation and Scalability Learning
by: Zhang, Bowen, et al.
Published: (2024)
by: Zhang, Bowen, et al.
Published: (2024)
Similar Items
-
Test-Time Learning for Large Language Models
by: Hu, Jinwu, et al.
Published: (2025) -
Beyond Fast and Slow: Cognitive-Inspired Elastic Reasoning for Large Language Models
by: Hu, Jinwu, et al.
Published: (2025) -
Precedent-Informed Reasoning: Mitigating Overthinking in Large Reasoning Models via Test-Time Precedent Learning
by: Wang, Qianyue, et al.
Published: (2026) -
Efficient Dynamic Ensembling for Multiple LLM Experts
by: Hu, Jinwu, et al.
Published: (2024) -
Beyond Model Scaling: Test-Time Intervention for Efficient Deep Reasoning
by: Wang, Qianyue, et al.
Published: (2026)