CADENT: Gated Hybrid Distillation for Sample-Efficient Transfer in Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alinejad, Mahyar, Wang, Yue, Atia, George |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RLAF: Reinforcement Learning from Automaton Feedback
par: Alinejad, Mahyar, et autres
Publié: (2025)
par: Alinejad, Mahyar, et autres
Publié: (2025)
LANTERN: LLM-Augmented Neurosymbolic Transfer with Experience-Gated Reasoning Networks
par: Alinejad, Mahyar, et autres
Publié: (2026)
par: Alinejad, Mahyar, et autres
Publié: (2026)
Automaton Distillation: Neuro-Symbolic Transfer Learning for Deep Reinforcement Learning
par: Singireddy, Suraj, et autres
Publié: (2023)
par: Singireddy, Suraj, et autres
Publié: (2023)
Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
par: Roch, Zachary, et autres
Publié: (2025)
par: Roch, Zachary, et autres
Publié: (2025)
Model-Free Robust Reinforcement Learning with Sample Complexity Analysis
par: Wang, Yudan, et autres
Publié: (2024)
par: Wang, Yudan, et autres
Publié: (2024)
Distilled Thompson Sampling: Practical and Efficient Thompson Sampling via Imitation Learning
par: Namkoong, Hongseok, et autres
Publié: (2020)
par: Namkoong, Hongseok, et autres
Publié: (2020)
Sample and Computationally Efficient Continuous-Time Reinforcement Learning with General Function Approximation
par: Zhao, Runze, et autres
Publié: (2025)
par: Zhao, Runze, et autres
Publié: (2025)
Reset & Distill: A Recipe for Overcoming Negative Transfer in Continual Reinforcement Learning
par: Ahn, Hongjoon, et autres
Publié: (2024)
par: Ahn, Hongjoon, et autres
Publié: (2024)
Generative Modeling with Continuous Flows: Sample Complexity of Flow Matching
par: Gaur, Mudit, et autres
Publié: (2025)
par: Gaur, Mudit, et autres
Publié: (2025)
Sample Efficient Active Algorithms for Offline Reinforcement Learning
par: Roy, Soumyadeep, et autres
Publié: (2026)
par: Roy, Soumyadeep, et autres
Publié: (2026)
Sample-Efficient Constrained Reinforcement Learning with General Parameterization
par: Mondal, Washim Uddin, et autres
Publié: (2024)
par: Mondal, Washim Uddin, et autres
Publié: (2024)
On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond
par: Nguyen-Tang, Thanh, et autres
Publié: (2024)
par: Nguyen-Tang, Thanh, et autres
Publié: (2024)
GCHR : Goal-Conditioned Hindsight Regularization for Sample-Efficient Reinforcement Learning
par: Lei, Xing, et autres
Publié: (2025)
par: Lei, Xing, et autres
Publié: (2025)
Leveraging Knowledge Distillation for Efficient Deep Reinforcement Learning in Resource-Constrained Environments
par: Meng, Guanlin
Publié: (2023)
par: Meng, Guanlin
Publié: (2023)
Speculative Sampling with Reinforcement Learning
par: Wang, Chenan, et autres
Publié: (2026)
par: Wang, Chenan, et autres
Publié: (2026)
When is Offline Policy Selection Sample Efficient for Reinforcement Learning?
par: Liu, Vincent, et autres
Publié: (2023)
par: Liu, Vincent, et autres
Publié: (2023)
Sample-Efficient Bayesian Optimization with Transfer Learning for Heterogeneous Search Spaces
par: Deshwal, Aryan, et autres
Publié: (2024)
par: Deshwal, Aryan, et autres
Publié: (2024)
Reinforcement Learning via Self-Distillation
par: Hübotter, Jonas, et autres
Publié: (2026)
par: Hübotter, Jonas, et autres
Publié: (2026)
Dataset Distillation for Offline Reinforcement Learning
par: Light, Jonathan, et autres
Publié: (2024)
par: Light, Jonathan, et autres
Publié: (2024)
When to Stop Reusing: Dynamic Gradient Gating for Sample-Efficient RLVR
par: Miao, Yuchun, et autres
Publié: (2026)
par: Miao, Yuchun, et autres
Publié: (2026)
Provably Efficient Exploration in Inverse Constrained Reinforcement Learning
par: Yue, Bo, et autres
Publié: (2024)
par: Yue, Bo, et autres
Publié: (2024)
Stabilizing Policy Gradients for Sample-Efficient Reinforcement Learning in LLM Reasoning
par: Melo, Luckeciano C., et autres
Publié: (2025)
par: Melo, Luckeciano C., et autres
Publié: (2025)
SEBA: Sample-Efficient Black-Box Attacks on Visual Reinforcement Learning
par: Huang, Tairan, et autres
Publié: (2025)
par: Huang, Tairan, et autres
Publié: (2025)
More Efficient Randomized Exploration for Reinforcement Learning via Approximate Sampling
par: Ishfaq, Haque, et autres
Publié: (2024)
par: Ishfaq, Haque, et autres
Publié: (2024)
Sample-Efficient Preference-based Reinforcement Learning with Dynamics Aware Rewards
par: Metcalf, Katherine, et autres
Publié: (2024)
par: Metcalf, Katherine, et autres
Publié: (2024)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
par: Vora, Kevin, et autres
Publié: (2025)
par: Vora, Kevin, et autres
Publié: (2025)
Sample-Efficient Distributionally Robust Multi-Agent Reinforcement Learning via Online Interaction
par: Farhat, Zain Ulabedeen, et autres
Publié: (2025)
par: Farhat, Zain Ulabedeen, et autres
Publié: (2025)
LiteGUI: Distilling Compact GUI Agents with Reinforcement Learning
par: Wu, Yubin, et autres
Publié: (2026)
par: Wu, Yubin, et autres
Publié: (2026)
Sample and Oracle Efficient Reinforcement Learning for MDPs with Linearly-Realizable Value Functions
par: Mhammedi, Zakaria
Publié: (2024)
par: Mhammedi, Zakaria
Publié: (2024)
When to ASK: Uncertainty-Gated Language Assistance for Reinforcement Learning
par: Monteiro, Juarez, et autres
Publié: (2026)
par: Monteiro, Juarez, et autres
Publié: (2026)
Drama: Mamba-Enabled Model-Based Reinforcement Learning Is Sample and Parameter Efficient
par: Wang, Wenlong, et autres
Publié: (2024)
par: Wang, Wenlong, et autres
Publié: (2024)
Distill-then-Replace: Efficient Task-Specific Hybrid Attention Model Construction
par: Xia, Xiaojie, et autres
Publié: (2026)
par: Xia, Xiaojie, et autres
Publié: (2026)
Physics-Informed Model and Hybrid Planning for Efficient Dyna-Style Reinforcement Learning
par: Asri, Zakariae El, et autres
Publié: (2024)
par: Asri, Zakariae El, et autres
Publié: (2024)
IMU-1: Sample-Efficient Pre-training of Small Language Models
par: Grigorev, George
Publié: (2026)
par: Grigorev, George
Publié: (2026)
Hybrid Inverse Reinforcement Learning
par: Ren, Juntao, et autres
Publié: (2024)
par: Ren, Juntao, et autres
Publié: (2024)
WOMBET: World Model-based Experience Transfer for Robust and Sample-efficient Reinforcement Learning
par: Kim, Mintae, et autres
Publié: (2026)
par: Kim, Mintae, et autres
Publié: (2026)
Learning to Reason: Temporal Saliency Distillation for Interpretable Knowledge Transfer
par: Dehigahawattage, Nilushika Udayangani Hewa, et autres
Publié: (2026)
par: Dehigahawattage, Nilushika Udayangani Hewa, et autres
Publié: (2026)
Evaluating Interpretable Reinforcement Learning by Distilling Policies into Programs
par: Kohler, Hector, et autres
Publié: (2025)
par: Kohler, Hector, et autres
Publié: (2025)
Energy-Based Transfer for Reinforcement Learning
par: Deng, Zeyun, et autres
Publié: (2025)
par: Deng, Zeyun, et autres
Publié: (2025)
Teach Harder, Learn Poorer: Rethinking Hard Sample Distillation for GNN-to-MLP Knowledge Distillation
par: Wu, Lirong, et autres
Publié: (2024)
par: Wu, Lirong, et autres
Publié: (2024)
Documents similaires
-
RLAF: Reinforcement Learning from Automaton Feedback
par: Alinejad, Mahyar, et autres
Publié: (2025) -
LANTERN: LLM-Augmented Neurosymbolic Transfer with Experience-Gated Reasoning Networks
par: Alinejad, Mahyar, et autres
Publié: (2026) -
Automaton Distillation: Neuro-Symbolic Transfer Learning for Deep Reinforcement Learning
par: Singireddy, Suraj, et autres
Publié: (2023) -
Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
par: Roch, Zachary, et autres
Publié: (2025) -
Model-Free Robust Reinforcement Learning with Sample Complexity Analysis
par: Wang, Yudan, et autres
Publié: (2024)