Gespeichert in:
| Hauptverfasser: | Xu, Siyuan, Zhu, Minghui |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2410.09728 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Interactive Inverse Reinforcement Learning of Interaction Scenarios via Bi-level Optimization
von: Mao, Yue, et al.
Veröffentlicht: (2026)
von: Mao, Yue, et al.
Veröffentlicht: (2026)
Provable Meta-Learning with Low-Rank Adaptations
von: Block, Jacob L., et al.
Veröffentlicht: (2024)
von: Block, Jacob L., et al.
Veröffentlicht: (2024)
Provably Optimal Reinforcement Learning under Safety Filtering
von: Oh, Donggeon David, et al.
Veröffentlicht: (2025)
von: Oh, Donggeon David, et al.
Veröffentlicht: (2025)
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning
von: Qiu, Shuang, et al.
Veröffentlicht: (2024)
von: Qiu, Shuang, et al.
Veröffentlicht: (2024)
Provable Domain Adaptation for Offline Reinforcement Learning with Limited Samples
von: Chen, Weiqin, et al.
Veröffentlicht: (2024)
von: Chen, Weiqin, et al.
Veröffentlicht: (2024)
Constrained Meta Reinforcement Learning with Provable Test-Time Safety
von: Ni, Tingting, et al.
Veröffentlicht: (2026)
von: Ni, Tingting, et al.
Veröffentlicht: (2026)
Optimal Policy Adaptation under Covariate Shift
von: Liu, Xueqing, et al.
Veröffentlicht: (2025)
von: Liu, Xueqing, et al.
Veröffentlicht: (2025)
Provably Near-Optimal Federated Ensemble Distillation with Negligible Overhead
von: Jang, Won-Jun, et al.
Veröffentlicht: (2025)
von: Jang, Won-Jun, et al.
Veröffentlicht: (2025)
Transformers Provably Implement In-Context Reinforcement Learning with Policy Improvement
von: Liang, Haodong, et al.
Veröffentlicht: (2026)
von: Liang, Haodong, et al.
Veröffentlicht: (2026)
In-Trajectory Inverse Reinforcement Learning: Learn Incrementally Before An Ongoing Trajectory Terminates
von: Liu, Shicheng, et al.
Veröffentlicht: (2024)
von: Liu, Shicheng, et al.
Veröffentlicht: (2024)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
von: Anisimov, Maksim, et al.
Veröffentlicht: (2026)
von: Anisimov, Maksim, et al.
Veröffentlicht: (2026)
Near-Optimal Reinforcement Learning with Self-Play under Adaptivity Constraints
von: Qiao, Dan, et al.
Veröffentlicht: (2024)
von: Qiao, Dan, et al.
Veröffentlicht: (2024)
Behaviour Policy Optimization: Provably Lower Variance Return Estimates for Off-Policy Reinforcement Learning
von: Goodall, Alexander W., et al.
Veröffentlicht: (2025)
von: Goodall, Alexander W., et al.
Veröffentlicht: (2025)
Provable unlearning in topic modeling and downstream tasks
von: Wei, Stanley, et al.
Veröffentlicht: (2024)
von: Wei, Stanley, et al.
Veröffentlicht: (2024)
Doubly Optimal Policy Evaluation for Reinforcement Learning
von: Liu, Shuze Daniel, et al.
Veröffentlicht: (2024)
von: Liu, Shuze Daniel, et al.
Veröffentlicht: (2024)
Towards Provable Emergence of In-Context Reinforcement Learning
von: Wang, Jiuqi, et al.
Veröffentlicht: (2025)
von: Wang, Jiuqi, et al.
Veröffentlicht: (2025)
ORVIT: Near-Optimal Online Distributionally Robust Reinforcement Learning
von: Ghosh, Debamita, et al.
Veröffentlicht: (2025)
von: Ghosh, Debamita, et al.
Veröffentlicht: (2025)
Meta-Sparsity: Learning Optimal Sparse Structures in Multi-task Networks through Meta-learning
von: Upadhyay, Richa, et al.
Veröffentlicht: (2025)
von: Upadhyay, Richa, et al.
Veröffentlicht: (2025)
Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence
von: Xiao, Minheng, et al.
Veröffentlicht: (2024)
von: Xiao, Minheng, et al.
Veröffentlicht: (2024)
Policy Gradient Converges to the Globally Optimal Policy for Nearly Linear-Quadratic Regulators
von: Han, Yinbin, et al.
Veröffentlicht: (2023)
von: Han, Yinbin, et al.
Veröffentlicht: (2023)
Federated reinforcement learning for robot motion planning with zero-shot generalization
von: Yuan, Zhenyuan, et al.
Veröffentlicht: (2024)
von: Yuan, Zhenyuan, et al.
Veröffentlicht: (2024)
Explainable reinforcement learning from human feedback to improve alignment
von: Liu, Shicheng, et al.
Veröffentlicht: (2025)
von: Liu, Shicheng, et al.
Veröffentlicht: (2025)
Realizable Abstractions: Near-Optimal Hierarchical Reinforcement Learning
von: Cipollone, Roberto, et al.
Veröffentlicht: (2025)
von: Cipollone, Roberto, et al.
Veröffentlicht: (2025)
Model-Based Learning of Near-Optimal Finite-Window Policies in POMDPs
von: Jordan, Philip, et al.
Veröffentlicht: (2026)
von: Jordan, Philip, et al.
Veröffentlicht: (2026)
One Good Source is All You Need: Near-Optimal Regret for Bandits under Heterogeneous Noise
von: Bhat, Amith, et al.
Veröffentlicht: (2026)
von: Bhat, Amith, et al.
Veröffentlicht: (2026)
Boosting Hierarchical Reinforcement Learning with Meta-Learning for Complex Task Adaptation
von: Khajooeinejad, Arash, et al.
Veröffentlicht: (2024)
von: Khajooeinejad, Arash, et al.
Veröffentlicht: (2024)
Distributionally Robust Off-Dynamics Reinforcement Learning: Provable Efficiency with Linear Function Approximation
von: Liu, Zhishuai, et al.
Veröffentlicht: (2024)
von: Liu, Zhishuai, et al.
Veröffentlicht: (2024)
Near-Minimax-Optimal Distributional Reinforcement Learning with a Generative Model
von: Rowland, Mark, et al.
Veröffentlicht: (2024)
von: Rowland, Mark, et al.
Veröffentlicht: (2024)
Provable Partially Observable Reinforcement Learning with Privileged Information
von: Cai, Yang, et al.
Veröffentlicht: (2024)
von: Cai, Yang, et al.
Veröffentlicht: (2024)
Reinforcement Learning Policy as Macro Regulator Rather than Macro Placer
von: Xue, Ke, et al.
Veröffentlicht: (2024)
von: Xue, Ke, et al.
Veröffentlicht: (2024)
Provably Correct Automata Embeddings for Optimal Automata-Conditioned Reinforcement Learning
von: Yalcinkaya, Beyazit, et al.
Veröffentlicht: (2025)
von: Yalcinkaya, Beyazit, et al.
Veröffentlicht: (2025)
Optimal Policy Learning under Budget and Coverage Constraints
von: Cerulli, Giovanni
Veröffentlicht: (2026)
von: Cerulli, Giovanni
Veröffentlicht: (2026)
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning
von: Chen, Jiayu, et al.
Veröffentlicht: (2025)
von: Chen, Jiayu, et al.
Veröffentlicht: (2025)
Is Your Imitation Learning Policy Better than Mine? Policy Comparison with Near-Optimal Stopping
von: Snyder, David, et al.
Veröffentlicht: (2025)
von: Snyder, David, et al.
Veröffentlicht: (2025)
In-Context Learning Is Provably Bayesian Inference: A Generalization Theory for Meta-Learning
von: Wakayama, Tomoya, et al.
Veröffentlicht: (2025)
von: Wakayama, Tomoya, et al.
Veröffentlicht: (2025)
Federated Natural Policy Gradient and Actor Critic Methods for Multi-task Reinforcement Learning
von: Yang, Tong, et al.
Veröffentlicht: (2023)
von: Yang, Tong, et al.
Veröffentlicht: (2023)
Near-Optimal Reinforcement Learning with Shuffle Differential Privacy
von: Bai, Shaojie, et al.
Veröffentlicht: (2024)
von: Bai, Shaojie, et al.
Veröffentlicht: (2024)
Provable and Practical: Efficient Exploration in Reinforcement Learning via Langevin Monte Carlo
von: Ishfaq, Haque, et al.
Veröffentlicht: (2023)
von: Ishfaq, Haque, et al.
Veröffentlicht: (2023)
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
von: Zhuang, Yuan, et al.
Veröffentlicht: (2026)
von: Zhuang, Yuan, et al.
Veröffentlicht: (2026)
Reinforcement Learning for Individual Optimal Policy from Heterogeneous Data
von: Miao, Rui, et al.
Veröffentlicht: (2025)
von: Miao, Rui, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Interactive Inverse Reinforcement Learning of Interaction Scenarios via Bi-level Optimization
von: Mao, Yue, et al.
Veröffentlicht: (2026) -
Provable Meta-Learning with Low-Rank Adaptations
von: Block, Jacob L., et al.
Veröffentlicht: (2024) -
Provably Optimal Reinforcement Learning under Safety Filtering
von: Oh, Donggeon David, et al.
Veröffentlicht: (2025) -
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning
von: Qiu, Shuang, et al.
Veröffentlicht: (2024) -
Provable Domain Adaptation for Offline Reinforcement Learning with Limited Samples
von: Chen, Weiqin, et al.
Veröffentlicht: (2024)