Counteractive RL: Rethinking Core Principles for Efficient and Scalable Deep Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Korkmaz, Ezgi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Understanding and Diagnosing Deep Reinforcement Learning
par: Korkmaz, Ezgi
Publié: (2024)
par: Korkmaz, Ezgi
Publié: (2024)
A Survey Analyzing Generalization in Deep Reinforcement Learning
par: Korkmaz, Ezgi
Publié: (2024)
par: Korkmaz, Ezgi
Publié: (2024)
Principled Approximation Methods for Efficient and Scalable Deep Learning
par: Savarese, Pedro
Publié: (2025)
par: Savarese, Pedro
Publié: (2025)
Rethinking Plasticity in Deep Reinforcement Learning
par: He, Zhiqiang
Publié: (2026)
par: He, Zhiqiang
Publié: (2026)
SpikeRL: A Scalable and Energy-efficient Framework for Deep Spiking Reinforcement Learning
par: Tahmid, Tokey, et autres
Publié: (2025)
par: Tahmid, Tokey, et autres
Publié: (2025)
AstRL: Analog and Mixed-Signal Circuit Synthesis with Deep Reinforcement Learning
par: Guo, Felicia B., et autres
Publié: (2026)
par: Guo, Felicia B., et autres
Publié: (2026)
SAFE-RL: Saliency-Aware Counterfactual Explainer for Deep Reinforcement Learning Policies
par: Samadi, Amir, et autres
Publié: (2024)
par: Samadi, Amir, et autres
Publié: (2024)
RL$^3$: Boosting Meta Reinforcement Learning via RL inside RL$^2$
par: Bhatia, Abhinav, et autres
Publié: (2023)
par: Bhatia, Abhinav, et autres
Publié: (2023)
Rethinking Efficient Graph Coarsening via a Non-Selfishness Principle
par: Bai, Xu, et autres
Publié: (2026)
par: Bai, Xu, et autres
Publié: (2026)
RL-BioAug: Label-Efficient Reinforcement Learning for Self-Supervised EEG Representation Learning
par: Lee, Cheol-Hui, et autres
Publié: (2026)
par: Lee, Cheol-Hui, et autres
Publié: (2026)
Stop Regressing: Training Value Functions via Classification for Scalable Deep RL
par: Farebrother, Jesse, et autres
Publié: (2024)
par: Farebrother, Jesse, et autres
Publié: (2024)
Rethinking RL Evaluation: Can Benchmarks Truly Reveal Failures of RL Methods?
par: Chen, Zihan, et autres
Publié: (2025)
par: Chen, Zihan, et autres
Publié: (2025)
MindSpeed RL: Distributed Dataflow for Scalable and Efficient RL Training on Ascend NPU Cluster
par: Feng, Laingjun, et autres
Publié: (2025)
par: Feng, Laingjun, et autres
Publié: (2025)
Knowledge Transfer in Deep Reinforcement Learning via an RL-Specific GAN-Based Correspondence Function
par: Ruman, Marko, et autres
Publié: (2022)
par: Ruman, Marko, et autres
Publié: (2022)
Scalable and Efficient Methods for Uncertainty Estimation and Reduction in Deep Learning
par: Ahmed, Soyed Tuhin
Publié: (2024)
par: Ahmed, Soyed Tuhin
Publié: (2024)
Rethinking the Foundations for Continual Reinforcement Learning
par: Elelimy, Esraa, et autres
Publié: (2025)
par: Elelimy, Esraa, et autres
Publié: (2025)
DeepLTL: Learning to Efficiently Satisfy Complex LTL Specifications for Multi-Task RL
par: Jackermeier, Mathias, et autres
Publié: (2024)
par: Jackermeier, Mathias, et autres
Publié: (2024)
Horizon Reduction Makes RL Scalable
par: Park, Seohong, et autres
Publié: (2025)
par: Park, Seohong, et autres
Publié: (2025)
EchoRL: Reinforcement Learning via Rollout Echoing
par: Bi, Jinhe, et autres
Publié: (2026)
par: Bi, Jinhe, et autres
Publié: (2026)
RL-GPT: Integrating Reinforcement Learning and Code-as-policy
par: Liu, Shaoteng, et autres
Publié: (2024)
par: Liu, Shaoteng, et autres
Publié: (2024)
Energy-Efficient Deep Reinforcement Learning with Spiking Transformers
par: Uddin, Mohammad Irfan, et autres
Publié: (2025)
par: Uddin, Mohammad Irfan, et autres
Publié: (2025)
LlamaRL: A Distributed Asynchronous Reinforcement Learning Framework for Efficient Large-scale LLM Training
par: Wu, Bo, et autres
Publié: (2025)
par: Wu, Bo, et autres
Publié: (2025)
IntentRL: Training Proactive User-intent Agents for Open-ended Deep Research via Reinforcement Learning
par: Luo, Haohao, et autres
Publié: (2026)
par: Luo, Haohao, et autres
Publié: (2026)
MILE: Model-based Intervention Learning
par: Korkmaz, Yigit, et autres
Publié: (2025)
par: Korkmaz, Yigit, et autres
Publié: (2025)
Scalable Policy-Based RL Algorithms for POMDPs
par: Anjarlekar, Ameya, et autres
Publié: (2025)
par: Anjarlekar, Ameya, et autres
Publié: (2025)
CaRL: Learning Scalable Planning Policies with Simple Rewards
par: Jaeger, Bernhard, et autres
Publié: (2025)
par: Jaeger, Bernhard, et autres
Publié: (2025)
The Role of Deep Learning Regularizations on Actors in Offline RL
par: Tarasov, Denis, et autres
Publié: (2024)
par: Tarasov, Denis, et autres
Publié: (2024)
Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning
par: Küçükoğlu, Burcu, et autres
Publié: (2025)
par: Küçükoğlu, Burcu, et autres
Publié: (2025)
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning
par: Zhao, Kaiyan, et autres
Publié: (2024)
par: Zhao, Kaiyan, et autres
Publié: (2024)
SwiftRL: Towards Efficient Reinforcement Learning on Real Processing-In-Memory Systems
par: Gogineni, Kailash, et autres
Publié: (2024)
par: Gogineni, Kailash, et autres
Publié: (2024)
Core Knowledge Learning Framework for Graph Adaptation and Scalability Learning
par: Zhang, Bowen, et autres
Publié: (2024)
par: Zhang, Bowen, et autres
Publié: (2024)
SCFCRC: Simultaneously Counteract Feature Camouflage and Relation Camouflage for Fraud Detection
par: Zhang, Xiaocheng, et autres
Publié: (2025)
par: Zhang, Xiaocheng, et autres
Publié: (2025)
Scalable Offline Model-Based RL with Action Chunks
par: Park, Kwanyoung, et autres
Publié: (2025)
par: Park, Kwanyoung, et autres
Publié: (2025)
Towards Principled Unsupervised Multi-Agent Reinforcement Learning
par: Zamboni, Riccardo, et autres
Publié: (2025)
par: Zamboni, Riccardo, et autres
Publié: (2025)
FBOS-RL: Feedback-Driven Bi-Objective Synergistic Reinforcement Learning
par: Zhang, Xikai, et autres
Publié: (2026)
par: Zhang, Xikai, et autres
Publié: (2026)
SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning
par: Wang, Jichao, et autres
Publié: (2026)
par: Wang, Jichao, et autres
Publié: (2026)
RL2Grid: Benchmarking Reinforcement Learning in Power Grid Operations
par: Marchesini, Enrico, et autres
Publié: (2025)
par: Marchesini, Enrico, et autres
Publié: (2025)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
par: Xu, Yifan, et autres
Publié: (2025)
par: Xu, Yifan, et autres
Publié: (2025)
RL4CO: an Extensive Reinforcement Learning for Combinatorial Optimization Benchmark
par: Berto, Federico, et autres
Publié: (2023)
par: Berto, Federico, et autres
Publié: (2023)
Adaptive Policy Synchronization for Scalable Reinforcement Learning
par: Lafuente-Mercado, Rodney
Publié: (2025)
par: Lafuente-Mercado, Rodney
Publié: (2025)
Documents similaires
-
Understanding and Diagnosing Deep Reinforcement Learning
par: Korkmaz, Ezgi
Publié: (2024) -
A Survey Analyzing Generalization in Deep Reinforcement Learning
par: Korkmaz, Ezgi
Publié: (2024) -
Principled Approximation Methods for Efficient and Scalable Deep Learning
par: Savarese, Pedro
Publié: (2025) -
Rethinking Plasticity in Deep Reinforcement Learning
par: He, Zhiqiang
Publié: (2026) -
SpikeRL: A Scalable and Energy-efficient Framework for Deep Spiking Reinforcement Learning
par: Tahmid, Tokey, et autres
Publié: (2025)