Enregistré dans:
| Auteurs principaux: | Levine, Alexander, Stone, Peter, Zhang, Amy |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2410.03016 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Offline Action-Free Learning of Ex-BMDPs by Comparing Diverse Datasets
par: Levine, Alexander, et autres
Publié: (2025)
par: Levine, Alexander, et autres
Publié: (2025)
Multistep Inverse Is Not All You Need
par: Levine, Alexander, et autres
Publié: (2024)
par: Levine, Alexander, et autres
Publié: (2024)
Federated Learning With Energy Harvesting Devices: An MDP Framework
par: Zhang, Kai, et autres
Publié: (2024)
par: Zhang, Kai, et autres
Publié: (2024)
MDP Planning as Policy Inference
par: Tolpin, David
Publié: (2026)
par: Tolpin, David
Publié: (2026)
t-DGR: A Trajectory-Based Deep Generative Replay Method for Continual Learning in Decision Making
par: Yue, William, et autres
Publié: (2024)
par: Yue, William, et autres
Publié: (2024)
Proto Successor Measure: Representing the Behavior Space of an RL Agent
par: Agarwal, Siddhant, et autres
Publié: (2024)
par: Agarwal, Siddhant, et autres
Publié: (2024)
Will My Robot Achieve My Goals? Predicting the Probability that an MDP Policy Reaches a User-Specified Behavior Target
par: Guyer, Alexander, et autres
Publié: (2022)
par: Guyer, Alexander, et autres
Publié: (2022)
Track-MDP: Reinforcement Learning for Target Tracking with Controlled Sensing
par: Subramaniam, Adarsh M., et autres
Publié: (2024)
par: Subramaniam, Adarsh M., et autres
Publié: (2024)
The Trajectory Alignment Coefficient in Two Acts: From Reward Tuning to Reward Learning
par: Muslimani, Calarina, et autres
Publié: (2026)
par: Muslimani, Calarina, et autres
Publié: (2026)
Geometric Re-Analysis of Classical MDP Solving Algorithms
par: Mustafin, Arsenii, et autres
Publié: (2025)
par: Mustafin, Arsenii, et autres
Publié: (2025)
Learning in Markov Decision Processes with Exogenous Dynamics
par: Maran, Davide, et autres
Publié: (2026)
par: Maran, Davide, et autres
Publié: (2026)
Predictive Control and Regret Analysis of Non-Stationary MDP with Look-ahead Information
par: Zhang, Ziyi, et autres
Publié: (2024)
par: Zhang, Ziyi, et autres
Publié: (2024)
MDP Geometry, Normalization and Reward Balancing Solvers
par: Mustafin, Arsenii, et autres
Publié: (2024)
par: Mustafin, Arsenii, et autres
Publié: (2024)
Reinforcement Learning with Exogenous States and Rewards
par: Trimponias, George, et autres
Publié: (2023)
par: Trimponias, George, et autres
Publié: (2023)
Out-of-Distribution Generalization with a SPARC: Racing 100 Unseen Vehicles with a Single Policy
par: Grooten, Bram, et autres
Publié: (2025)
par: Grooten, Bram, et autres
Publié: (2025)
Online MDP with Transition Prototypes: A Robust Adaptive Approach
par: Sun, Shuo, et autres
Publié: (2024)
par: Sun, Shuo, et autres
Publié: (2024)
None To Optima in Few Shots: Bayesian Optimization with MDP Priors
par: Li, Diantong, et autres
Publié: (2025)
par: Li, Diantong, et autres
Publié: (2025)
A Minimax-MDP Framework with Future-imposed Conditions for Learning-augmented Problems
par: Chen, Xin, et autres
Publié: (2025)
par: Chen, Xin, et autres
Publié: (2025)
Causal Bayesian Optimization via Exogenous Distribution Learning
par: Ren, Shaogang, et autres
Publié: (2024)
par: Ren, Shaogang, et autres
Publié: (2024)
Using Forwards-Backwards Models to Approximate MDP Homomorphisms
par: Mavor-Parker, Augustine N., et autres
Publié: (2022)
par: Mavor-Parker, Augustine N., et autres
Publié: (2022)
Single-Trajectory Distributionally Robust Reinforcement Learning
par: Liang, Zhipeng, et autres
Publié: (2023)
par: Liang, Zhipeng, et autres
Publié: (2023)
Exogenous Isomorphism for Counterfactual Identifiability
par: Chen, Yikang, et autres
Publié: (2025)
par: Chen, Yikang, et autres
Publié: (2025)
Exogenous Matching: Learning Good Proposals for Tractable Counterfactual Estimation
par: Chen, Yikang, et autres
Publié: (2024)
par: Chen, Yikang, et autres
Publié: (2024)
RACER: Epistemic Risk-Sensitive RL Enables Fast Driving with Fewer Crashes
par: Stachowicz, Kyle, et autres
Publié: (2024)
par: Stachowicz, Kyle, et autres
Publié: (2024)
Learning to Stabilize Unknown LTI Systems on a Single Trajectory under Stochastic Noise
par: Zhang, Ziyi, et autres
Publié: (2024)
par: Zhang, Ziyi, et autres
Publié: (2024)
Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning
par: Wan, Jia, et autres
Publié: (2024)
par: Wan, Jia, et autres
Publié: (2024)
ICU-Sepsis: A Benchmark MDP Built from Real Medical Data
par: Choudhary, Kartik, et autres
Publié: (2024)
par: Choudhary, Kartik, et autres
Publié: (2024)
Visual Pre-Training on Unlabeled Images using Reinforcement Learning
par: Ghosh, Dibya, et autres
Publié: (2025)
par: Ghosh, Dibya, et autres
Publié: (2025)
Learning Memory Mechanisms for Decision Making through Demonstrations
par: Yue, William, et autres
Publié: (2024)
par: Yue, William, et autres
Publié: (2024)
AsyncVLA: An Asynchronous VLA for Fast and Robust Navigation on the Edge
par: Hirose, Noriaki, et autres
Publié: (2026)
par: Hirose, Noriaki, et autres
Publié: (2026)
d3LLM: Ultra-Fast Diffusion LLM using Pseudo-Trajectory Distillation
par: Qian, Yu-Yang, et autres
Publié: (2026)
par: Qian, Yu-Yang, et autres
Publié: (2026)
A Finite-Sample Analysis of an Actor-Critic Algorithm for Mean-Variance Optimization in a Discounted MDP
par: Sangadi, Tejaram, et autres
Publié: (2024)
par: Sangadi, Tejaram, et autres
Publié: (2024)
Deep reinforcement learning for weakly coupled MDP's with continuous actions
par: Robledo, Francisco, et autres
Publié: (2024)
par: Robledo, Francisco, et autres
Publié: (2024)
MDP: Multidimensional Vision Model Pruning with Latency Constraint
par: Sun, Xinglong, et autres
Publié: (2025)
par: Sun, Xinglong, et autres
Publié: (2025)
MDP modeling for multi-stage stochastic programs
par: Morton, David P., et autres
Publié: (2025)
par: Morton, David P., et autres
Publié: (2025)
MI-to-Mid Distilled Compression (M2M-DC): An Hybrid-Information-Guided-Block Pruning with Progressive Inner Slicing Approach to Model Compression
par: Levine, Lionel, et autres
Publié: (2025)
par: Levine, Lionel, et autres
Publié: (2025)
Addressing Correlated Latent Exogenous Variables in Debiased Recommender Systems
par: Zhang, Shuqiang, et autres
Publié: (2025)
par: Zhang, Shuqiang, et autres
Publié: (2025)
SaVeR: Optimal Data Collection Strategy for Safe Policy Evaluation in Tabular MDP
par: Mukherjee, Subhojyoti, et autres
Publié: (2024)
par: Mukherjee, Subhojyoti, et autres
Publié: (2024)
Factored Latent Action World Models
par: Wang, Zizhao, et autres
Publié: (2026)
par: Wang, Zizhao, et autres
Publié: (2026)
Exogenous Randomness Empowering Random Forests
par: Mei, Tianxing, et autres
Publié: (2024)
par: Mei, Tianxing, et autres
Publié: (2024)
Documents similaires
-
Offline Action-Free Learning of Ex-BMDPs by Comparing Diverse Datasets
par: Levine, Alexander, et autres
Publié: (2025) -
Multistep Inverse Is Not All You Need
par: Levine, Alexander, et autres
Publié: (2024) -
Federated Learning With Energy Harvesting Devices: An MDP Framework
par: Zhang, Kai, et autres
Publié: (2024) -
MDP Planning as Policy Inference
par: Tolpin, David
Publié: (2026) -
t-DGR: A Trajectory-Based Deep Generative Replay Method for Continual Learning in Decision Making
par: Yue, William, et autres
Publié: (2024)