Submodular Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Prajapat, Manish, Mutný, Mojmír, Zeilinger, Melanie N., Krause, Andreas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Global Reinforcement Learning: Beyond Linear and Convex Rewards via Submodular Semi-gradient Methods
di: De Santi, Riccardo, et al.
Pubblicazione: (2024)
di: De Santi, Riccardo, et al.
Pubblicazione: (2024)
Safe and Near-Optimal Control with Online Dynamics Learning
di: Prajapat, Manish, et al.
Pubblicazione: (2025)
di: Prajapat, Manish, et al.
Pubblicazione: (2025)
Confidence Estimation via Sequential Likelihood Mixing
di: Kirschner, Johannes, et al.
Pubblicazione: (2025)
di: Kirschner, Johannes, et al.
Pubblicazione: (2025)
Sampling-Based Safe Reinforcement Learning
di: Vignola, Luca, et al.
Pubblicazione: (2026)
di: Vignola, Luca, et al.
Pubblicazione: (2026)
Finite-Sample-Based Reachability for Safe Control with Gaussian Process Dynamics
di: Prajapat, Manish, et al.
Pubblicazione: (2025)
di: Prajapat, Manish, et al.
Pubblicazione: (2025)
Performance-driven Constrained Optimal Auto-Tuner for MPC
di: Puigjaner, Albert Gassol, et al.
Pubblicazione: (2025)
di: Puigjaner, Albert Gassol, et al.
Pubblicazione: (2025)
Safe Guaranteed Exploration for Non-linear Systems
di: Prajapat, Manish, et al.
Pubblicazione: (2024)
di: Prajapat, Manish, et al.
Pubblicazione: (2024)
Towards safe and tractable Gaussian process-based MPC: Efficient sampling within a sequential quadratic programming framework
di: Prajapat, Manish, et al.
Pubblicazione: (2024)
di: Prajapat, Manish, et al.
Pubblicazione: (2024)
Efficient Personalization of Generative Models via Optimal Experimental Design
di: Schacht, Guy, et al.
Pubblicazione: (2025)
di: Schacht, Guy, et al.
Pubblicazione: (2025)
Optimistic Games for Combinatorial Bayesian Optimization with Application to Protein Design
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2024)
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2024)
Transition Constrained Bayesian Optimization via Markov Decision Processes
di: Folch, Jose Pablo, et al.
Pubblicazione: (2024)
di: Folch, Jose Pablo, et al.
Pubblicazione: (2024)
Safe Exploration via Policy Priors
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
Stochastic Model Predictive Control for Sub-Gaussian Noise
di: Ao, Yunke, et al.
Pubblicazione: (2025)
di: Ao, Yunke, et al.
Pubblicazione: (2025)
Optimistic Online LQR via Intrinsic Rewards
di: Bartos, Marcell, et al.
Pubblicazione: (2026)
di: Bartos, Marcell, et al.
Pubblicazione: (2026)
$k$-Submodular Interdiction Problems under Distributional Risk-Receptiveness and Robustness: Application to Machine Learning
di: Park, Seonghun, et al.
Pubblicazione: (2024)
di: Park, Seonghun, et al.
Pubblicazione: (2024)
Directed Exploration in Reinforcement Learning from Linear Temporal Logic
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
Stochastic Online Optimization for Cyber-Physical and Robotic Systems
di: Ma, Hao, et al.
Pubblicazione: (2024)
di: Ma, Hao, et al.
Pubblicazione: (2024)
Multi-Agent Reinforcement Learning with Submodular Reward
di: Chen, Wenjing, et al.
Pubblicazione: (2026)
di: Chen, Wenjing, et al.
Pubblicazione: (2026)
SMART: Self-learning Meta-strategy Agent for Reasoning Tasks
di: Liu, Rongxing, et al.
Pubblicazione: (2024)
di: Liu, Rongxing, et al.
Pubblicazione: (2024)
Breeding Programs Optimization with Reinforcement Learning
di: Younis, Omar G., et al.
Pubblicazione: (2024)
di: Younis, Omar G., et al.
Pubblicazione: (2024)
State Space Models as Foundation Models: A Control Theoretic Overview
di: Alonso, Carmen Amo, et al.
Pubblicazione: (2024)
di: Alonso, Carmen Amo, et al.
Pubblicazione: (2024)
Soft Forward-Backward Representations for Zero-shot Reinforcement Learning with General Utilities
di: Bagatella, Marco, et al.
Pubblicazione: (2026)
di: Bagatella, Marco, et al.
Pubblicazione: (2026)
Lambda-Skip Connections: the architectural component that prevents Rank Collapse
di: Joseph, Federico Arangath, et al.
Pubblicazione: (2024)
di: Joseph, Federico Arangath, et al.
Pubblicazione: (2024)
Test-time Offline Reinforcement Learning on Goal-related Experience
di: Bagatella, Marco, et al.
Pubblicazione: (2025)
di: Bagatella, Marco, et al.
Pubblicazione: (2025)
Design Principles for Sequence Models via Coefficient Dynamics
di: Sieber, Jerome, et al.
Pubblicazione: (2025)
di: Sieber, Jerome, et al.
Pubblicazione: (2025)
Approximate non-linear model predictive control with safety-augmented neural networks
di: Hose, Henrik, et al.
Pubblicazione: (2023)
di: Hose, Henrik, et al.
Pubblicazione: (2023)
A robust and adaptive MPC formulation for Gaussian process models
di: Dubied, Mathieu, et al.
Pubblicazione: (2025)
di: Dubied, Mathieu, et al.
Pubblicazione: (2025)
Uncertainty-Aware Robotic World Model Makes Offline Model-Based Reinforcement Learning Work on Real Robots
di: Li, Chenhao, et al.
Pubblicazione: (2025)
di: Li, Chenhao, et al.
Pubblicazione: (2025)
Learning on the Job: Test-Time Curricula for Targeted Reinforcement Learning
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
di: Diaz-Bone, Leander, et al.
Pubblicazione: (2025)
ActSafe: Active Exploration with Safety Constraints for Reinforcement Learning
di: As, Yarden, et al.
Pubblicazione: (2024)
di: As, Yarden, et al.
Pubblicazione: (2024)
VISION-SLS: Safe Perception-Based Control from Learned Visual Representations via System Level Synthesis
di: Leeman, Antoine P., et al.
Pubblicazione: (2026)
di: Leeman, Antoine P., et al.
Pubblicazione: (2026)
Physics-informed learning under mixing: How physical knowledge speeds up learning
di: Scampicchio, Anna, et al.
Pubblicazione: (2025)
di: Scampicchio, Anna, et al.
Pubblicazione: (2025)
Learning Submodular Sequencing from Samples
di: Yuan, Jing, et al.
Pubblicazione: (2024)
di: Yuan, Jing, et al.
Pubblicazione: (2024)
Model-Based Reinforcement Learning for Control under Time-Varying Dynamics
di: Iten, Klemens, et al.
Pubblicazione: (2026)
di: Iten, Klemens, et al.
Pubblicazione: (2026)
Contextual Bilevel Reinforcement Learning for Incentive Alignment
di: Thoma, Vinzenz, et al.
Pubblicazione: (2024)
di: Thoma, Vinzenz, et al.
Pubblicazione: (2024)
Automatic nonlinear MPC approximation with closed-loop guarantees
di: Tokmak, Abdullah, et al.
Pubblicazione: (2023)
di: Tokmak, Abdullah, et al.
Pubblicazione: (2023)
Task-Level Insights from Eigenvalues across Sequence Models
di: Rickenbach, Rahel, et al.
Pubblicazione: (2025)
di: Rickenbach, Rahel, et al.
Pubblicazione: (2025)
Towards Multi-Modal Mastery: A 4.5B Parameter Truly Multi-Modal Small Language Model
di: Koska, Ben, et al.
Pubblicazione: (2024)
di: Koska, Ben, et al.
Pubblicazione: (2024)
SMA: Submodular Modality Aligner For Data Efficient Multimodal Learning
di: Pham, Truong, et al.
Pubblicazione: (2026)
di: Pham, Truong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Global Reinforcement Learning: Beyond Linear and Convex Rewards via Submodular Semi-gradient Methods
di: De Santi, Riccardo, et al.
Pubblicazione: (2024) -
Safe and Near-Optimal Control with Online Dynamics Learning
di: Prajapat, Manish, et al.
Pubblicazione: (2025) -
Confidence Estimation via Sequential Likelihood Mixing
di: Kirschner, Johannes, et al.
Pubblicazione: (2025) -
Sampling-Based Safe Reinforcement Learning
di: Vignola, Luca, et al.
Pubblicazione: (2026) -
Finite-Sample-Based Reachability for Safe Control with Gaussian Process Dynamics
di: Prajapat, Manish, et al.
Pubblicazione: (2025)