RLLTE: Long-Term Evolution Project of Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Yuan, Mingqi, Zhang, Zequn, Xu, Yang, Luo, Shihao, Li, Bo, Jin, Xin, Zeng, Wenjun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Adaptive Data Exploitation in Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025)
por: Yuan, Mingqi, et al.
Publicado: (2025)
ULTHO: Ultra-Lightweight yet Efficient Hyperparameter Optimization in Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025)
por: Yuan, Mingqi, et al.
Publicado: (2025)
Plasticine: Accelerating Research in Plasticity-Motivated Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025)
por: Yuan, Mingqi, et al.
Publicado: (2025)
Deep Reinforcement Learning with Hybrid Intrinsic Reward Model
por: Yuan, Mingqi, et al.
Publicado: (2025)
por: Yuan, Mingqi, et al.
Publicado: (2025)
Long Term Memory: The Foundation of AI Self-Evolution
por: Jiang, Xun, et al.
Publicado: (2024)
por: Jiang, Xun, et al.
Publicado: (2024)
Pinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement Learning
por: Yin, Junxi, et al.
Publicado: (2025)
por: Yin, Junxi, et al.
Publicado: (2025)
Long and Short-Term Constraints Driven Safe Reinforcement Learning for Autonomous Driving
por: Hu, Xuemin, et al.
Publicado: (2024)
por: Hu, Xuemin, et al.
Publicado: (2024)
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
por: Carr, Jonathan Colaço, et al.
Publicado: (2026)
por: Carr, Jonathan Colaço, et al.
Publicado: (2026)
RLeXplore: Accelerating Research in Intrinsically-Motivated Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2024)
por: Yuan, Mingqi, et al.
Publicado: (2024)
Dynamic Action Interpolation: A Universal Approach for Accelerating Reinforcement Learning with Expert Guidance
por: Cao, Wenjun
Publicado: (2025)
por: Cao, Wenjun
Publicado: (2025)
Hiformer: Hybrid Frequency Feature Enhancement Inverted Transformer for Long-Term Wind Power Prediction
por: Wan, Chongyang, et al.
Publicado: (2024)
por: Wan, Chongyang, et al.
Publicado: (2024)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
por: Yang, Yiqin, et al.
Publicado: (2026)
por: Yang, Yiqin, et al.
Publicado: (2026)
Approximate Subgraph Matching with Neural Graph Representations and Reinforcement Learning
por: Li, Kaiyang, et al.
Publicado: (2026)
por: Li, Kaiyang, et al.
Publicado: (2026)
Reinforcement Learning-based Approach for Vehicle-to-Building Charging with Heterogeneous Agents and Long Term Rewards
por: Liu, Fangqi, et al.
Publicado: (2025)
por: Liu, Fangqi, et al.
Publicado: (2025)
Open-World Reinforcement Learning over Long Short-Term Imagination
por: Li, Jiajian, et al.
Publicado: (2024)
por: Li, Jiajian, et al.
Publicado: (2024)
GraphRARE: Reinforcement Learning Enhanced Graph Neural Network with Relative Entropy
por: Peng, Tianhao, et al.
Publicado: (2023)
por: Peng, Tianhao, et al.
Publicado: (2023)
A Survey of Continual Reinforcement Learning
por: Pan, Chaofan, et al.
Publicado: (2025)
por: Pan, Chaofan, et al.
Publicado: (2025)
Efficient Quantification of Multimodal Interaction at Sample Level
por: Yang, Zequn, et al.
Publicado: (2025)
por: Yang, Zequn, et al.
Publicado: (2025)
ESP: Exploiting Symmetry Prior for Multi-Agent Reinforcement Learning
por: Yu, Xin, et al.
Publicado: (2023)
por: Yu, Xin, et al.
Publicado: (2023)
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
por: Zhuang, Yuan, et al.
Publicado: (2026)
por: Zhuang, Yuan, et al.
Publicado: (2026)
EntroPIC: Towards Stable Long-Term Training of LLMs via Entropy Stabilization with Proportional-Integral Control
por: Yang, Kai, et al.
Publicado: (2025)
por: Yang, Kai, et al.
Publicado: (2025)
A Theoretical Understanding of Gradient Bias in Meta-Reinforcement Learning
por: Feng, Xidong, et al.
Publicado: (2021)
por: Feng, Xidong, et al.
Publicado: (2021)
Soft-NBCE: Entropy-Weighted Chunk Fusion for Long-Context
por: Ji, Shihao, et al.
Publicado: (2026)
por: Ji, Shihao, et al.
Publicado: (2026)
Model-Based Safe Reinforcement Learning with Time-Varying State and Control Constraints: An Application to Intelligent Vehicles
por: Zhang, Xinglong, et al.
Publicado: (2021)
por: Zhang, Xinglong, et al.
Publicado: (2021)
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)
por: Zhao, Ziqi, et al.
Publicado: (2024)
LacaDM: A Latent Causal Diffusion Model for Multiobjective Reinforcement Learning
por: Yan, Xueming, et al.
Publicado: (2025)
por: Yan, Xueming, et al.
Publicado: (2025)
STM3: Mixture of Multiscale Mamba for Long-Term Spatio-Temporal Time-Series Prediction
por: Chen, Haolong, et al.
Publicado: (2025)
por: Chen, Haolong, et al.
Publicado: (2025)
Progressive Supervision via Label Decomposition: An Long-Term and Large-Scale Wireless Traffic Forecasting Method
por: Liang, Daojun, et al.
Publicado: (2025)
por: Liang, Daojun, et al.
Publicado: (2025)
Diverse Projection Ensembles for Distributional Reinforcement Learning
por: Zanger, Moritz A., et al.
Publicado: (2023)
por: Zanger, Moritz A., et al.
Publicado: (2023)
Co-jump: Cooperative Jumping with Quadrupedal Robots via Multi-Agent Reinforcement Learning
por: Dong, Shihao, et al.
Publicado: (2026)
por: Dong, Shihao, et al.
Publicado: (2026)
Multimodal Large Language Models for End-to-End Affective Computing: Benchmarking and Boosting with Generative Knowledge Prompting
por: Luo, Miaosen, et al.
Publicado: (2025)
por: Luo, Miaosen, et al.
Publicado: (2025)
SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning
por: Wang, Jichao, et al.
Publicado: (2026)
por: Wang, Jichao, et al.
Publicado: (2026)
BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning
por: Xu, Yuhang, et al.
Publicado: (2026)
por: Xu, Yuhang, et al.
Publicado: (2026)
LPPG-RL: Lexicographically Projected Policy Gradient Reinforcement Learning with Subproblem Exploration
por: Qiu, Ruiyu, et al.
Publicado: (2025)
por: Qiu, Ruiyu, et al.
Publicado: (2025)
A Distance-based Anomaly Detection Framework for Deep Reinforcement Learning
por: Zhang, Hongming, et al.
Publicado: (2021)
por: Zhang, Hongming, et al.
Publicado: (2021)
DEER: A Delay-Resilient Framework for Reinforcement Learning with Variable Delays
por: Xia, Bo, et al.
Publicado: (2024)
por: Xia, Bo, et al.
Publicado: (2024)
Adaptive Unimodal Regulation for Balanced Multimodal Information Acquisition
por: Huang, Chengxiang, et al.
Publicado: (2025)
por: Huang, Chengxiang, et al.
Publicado: (2025)
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
por: Shi, Yiwei, et al.
Publicado: (2024)
por: Shi, Yiwei, et al.
Publicado: (2024)
Linear Transformers as VAR Models: Aligning Autoregressive Attention Mechanisms with Autoregressive Forecasting
por: Lu, Jiecheng, et al.
Publicado: (2025)
por: Lu, Jiecheng, et al.
Publicado: (2025)
Improved Long Short-Term Memory-based Wastewater Treatment Simulators for Deep Reinforcement Learning
por: Mohammadi, Esmaeel, et al.
Publicado: (2024)
por: Mohammadi, Esmaeel, et al.
Publicado: (2024)
Ejemplares similares
-
Adaptive Data Exploitation in Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025) -
ULTHO: Ultra-Lightweight yet Efficient Hyperparameter Optimization in Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025) -
Plasticine: Accelerating Research in Plasticity-Motivated Deep Reinforcement Learning
por: Yuan, Mingqi, et al.
Publicado: (2025) -
Deep Reinforcement Learning with Hybrid Intrinsic Reward Model
por: Yuan, Mingqi, et al.
Publicado: (2025) -
Long Term Memory: The Foundation of AI Self-Evolution
por: Jiang, Xun, et al.
Publicado: (2024)