Stackelberg Coupling of Online Representation Learning and Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Martinez, Fernando, Li, Tao, Lu, Yingdong, Chen, Juntao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
In-Context Reinforcement Learning via Communicative World Models
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025)
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025)
SPRIG: Stackelberg Perception-Reinforcement Learning with Internal Game Dynamics
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025)
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025)
The Three Regimes of Offline-to-Online Reinforcement Learning
von: Li, Lu, et al.
Veröffentlicht: (2025)
von: Li, Lu, et al.
Veröffentlicht: (2025)
Squeezing More from the Stream : Learning Representation Online for Streaming Reinforcement Learning
von: Nilaksh, et al.
Veröffentlicht: (2026)
von: Nilaksh, et al.
Veröffentlicht: (2026)
Flow-Based Policy for Online Reinforcement Learning
von: Lv, Lei, et al.
Veröffentlicht: (2025)
von: Lv, Lei, et al.
Veröffentlicht: (2025)
Controllable Flow Matching for Online Reinforcement Learning
von: Wang, Bin, et al.
Veröffentlicht: (2025)
von: Wang, Bin, et al.
Veröffentlicht: (2025)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
Diffusion Spectral Representation for Reinforcement Learning
von: Shribak, Dmitry, et al.
Veröffentlicht: (2024)
von: Shribak, Dmitry, et al.
Veröffentlicht: (2024)
Hybrid Inverse Reinforcement Learning
von: Ren, Juntao, et al.
Veröffentlicht: (2024)
von: Ren, Juntao, et al.
Veröffentlicht: (2024)
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
von: Dai, Juntao, et al.
Veröffentlicht: (2024)
von: Dai, Juntao, et al.
Veröffentlicht: (2024)
Spectral Representation-based Reinforcement Learning
von: Gao, Chenxiao, et al.
Veröffentlicht: (2025)
von: Gao, Chenxiao, et al.
Veröffentlicht: (2025)
The Terminal Representation in Reinforcement Learning
von: Esterhuysen, Amir, et al.
Veröffentlicht: (2026)
von: Esterhuysen, Amir, et al.
Veröffentlicht: (2026)
Representation-Driven Reinforcement Learning
von: Nabati, Ofir, et al.
Veröffentlicht: (2023)
von: Nabati, Ofir, et al.
Veröffentlicht: (2023)
Learning Future Representation with Synthetic Observations for Sample-efficient Reinforcement Learning
von: Liu, Xin, et al.
Veröffentlicht: (2024)
von: Liu, Xin, et al.
Veröffentlicht: (2024)
Online Prompt Pricing based on Combinatorial Multi-Armed Bandit and Hierarchical Stackelberg Game
von: Li, Meiling, et al.
Veröffentlicht: (2024)
von: Li, Meiling, et al.
Veröffentlicht: (2024)
Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions
von: Ma, Lu, et al.
Veröffentlicht: (2025)
von: Ma, Lu, et al.
Veröffentlicht: (2025)
The Power of Resets in Online Reinforcement Learning
von: Mhammedi, Zakaria, et al.
Veröffentlicht: (2024)
von: Mhammedi, Zakaria, et al.
Veröffentlicht: (2024)
Online Reinforcement Learning with Passive Memory
von: Pattanaik, Anay, et al.
Veröffentlicht: (2024)
von: Pattanaik, Anay, et al.
Veröffentlicht: (2024)
Locally Constrained Representations in Reinforcement Learning
von: Nath, Somjit, et al.
Veröffentlicht: (2022)
von: Nath, Somjit, et al.
Veröffentlicht: (2022)
Learning by Doing: An Online Causal Reinforcement Learning Framework with Causal-Aware Policy
von: Cai, Ruichu, et al.
Veröffentlicht: (2024)
von: Cai, Ruichu, et al.
Veröffentlicht: (2024)
Uncoupled Learning of Differential Stackelberg Equilibria with Commitments
von: Loftin, Robert, et al.
Veröffentlicht: (2023)
von: Loftin, Robert, et al.
Veröffentlicht: (2023)
RLSynC: Offline-Online Reinforcement Learning for Synthon Completion
von: Baker, Frazier N., et al.
Veröffentlicht: (2023)
von: Baker, Frazier N., et al.
Veröffentlicht: (2023)
Approximate Subgraph Matching with Neural Graph Representations and Reinforcement Learning
von: Li, Kaiyang, et al.
Veröffentlicht: (2026)
von: Li, Kaiyang, et al.
Veröffentlicht: (2026)
ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization
von: Yang, Letian, et al.
Veröffentlicht: (2026)
von: Yang, Letian, et al.
Veröffentlicht: (2026)
Online Optimization for Offline Safe Reinforcement Learning
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
von: Chemingui, Yassine, et al.
Veröffentlicht: (2025)
Kolmogorov-Arnold Network for Online Reinforcement Learning
von: Kich, Victor Augusto, et al.
Veröffentlicht: (2024)
von: Kich, Victor Augusto, et al.
Veröffentlicht: (2024)
Debiased Offline Representation Learning for Fast Online Adaptation in Non-stationary Dynamics
von: Zhang, Xinyu, et al.
Veröffentlicht: (2024)
von: Zhang, Xinyu, et al.
Veröffentlicht: (2024)
Offline-to-Online Reinforcement Learning with Classifier-Free Diffusion Generation
von: Huang, Xiao, et al.
Veröffentlicht: (2025)
von: Huang, Xiao, et al.
Veröffentlicht: (2025)
Coupled Distributional Random Expert Distillation for World Model Online Imitation Learning
von: Li, Shangzhe, et al.
Veröffentlicht: (2025)
von: Li, Shangzhe, et al.
Veröffentlicht: (2025)
Graph Propagation Transformer for Graph Representation Learning
von: Chen, Zhe, et al.
Veröffentlicht: (2023)
von: Chen, Zhe, et al.
Veröffentlicht: (2023)
Network Sparsity Unlocks the Scaling Potential of Deep Reinforcement Learning
von: Ma, Guozheng, et al.
Veröffentlicht: (2025)
von: Ma, Guozheng, et al.
Veröffentlicht: (2025)
Federated Learning for Discrete Optimal Transport with Large Population under Incomplete Information
von: Kaur, Navpreet, et al.
Veröffentlicht: (2024)
von: Kaur, Navpreet, et al.
Veröffentlicht: (2024)
Enhance Exploration in Safe Reinforcement Learning with Contrastive Representation Learning
von: Doan, Duc Kien, et al.
Veröffentlicht: (2025)
von: Doan, Duc Kien, et al.
Veröffentlicht: (2025)
A Survey of State Representation Learning for Deep Reinforcement Learning
von: Echchahed, Ayoub, et al.
Veröffentlicht: (2025)
von: Echchahed, Ayoub, et al.
Veröffentlicht: (2025)
Towards Fast Safe Online Reinforcement Learning via Policy Finetuning
von: Chen, Keru, et al.
Veröffentlicht: (2024)
von: Chen, Keru, et al.
Veröffentlicht: (2024)
Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective
von: Wang, Haichuan, et al.
Veröffentlicht: (2026)
von: Wang, Haichuan, et al.
Veröffentlicht: (2026)
Solving Continual Offline Reinforcement Learning with Decision Transformer
von: Huang, Kaixin, et al.
Veröffentlicht: (2024)
von: Huang, Kaixin, et al.
Veröffentlicht: (2024)
Harnessing Discrete Representations For Continual Reinforcement Learning
von: Meyer, Edan, et al.
Veröffentlicht: (2023)
von: Meyer, Edan, et al.
Veröffentlicht: (2023)
Enhancing Chess Reinforcement Learning with Graph Representation
von: Rigaux, Tomas, et al.
Veröffentlicht: (2024)
von: Rigaux, Tomas, et al.
Veröffentlicht: (2024)
Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
von: Ma, Guozheng, et al.
Veröffentlicht: (2023)
von: Ma, Guozheng, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
In-Context Reinforcement Learning via Communicative World Models
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025) -
SPRIG: Stackelberg Perception-Reinforcement Learning with Internal Game Dynamics
von: Martinez-Lopez, Fernando, et al.
Veröffentlicht: (2025) -
The Three Regimes of Offline-to-Online Reinforcement Learning
von: Li, Lu, et al.
Veröffentlicht: (2025) -
Squeezing More from the Stream : Learning Representation Online for Streaming Reinforcement Learning
von: Nilaksh, et al.
Veröffentlicht: (2026) -
Flow-Based Policy for Online Reinforcement Learning
von: Lv, Lei, et al.
Veröffentlicht: (2025)