Salvato in:
| Autori principali: | Wu, Haochen, Sharma, Shubham, Patra, Sunandita, Gopalakrishnan, Sriram |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2308.12367 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort
di: Gopalakrishnan, Sriram, et al.
Pubblicazione: (2025)
di: Gopalakrishnan, Sriram, et al.
Pubblicazione: (2025)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
di: Anisimov, Maksim, et al.
Pubblicazione: (2026)
di: Anisimov, Maksim, et al.
Pubblicazione: (2026)
The Importance of Time in Causal Algorithmic Recourse
di: Beretta, Isacco, et al.
Pubblicazione: (2023)
di: Beretta, Isacco, et al.
Pubblicazione: (2023)
Reinforcement Learning for Durable Algorithmic Recourse
di: Ceccon, Marina, et al.
Pubblicazione: (2025)
di: Ceccon, Marina, et al.
Pubblicazione: (2025)
Personalized Algorithmic Recourse with Preference Elicitation
di: De Toni, Giovanni, et al.
Pubblicazione: (2022)
di: De Toni, Giovanni, et al.
Pubblicazione: (2022)
Causal Algorithmic Recourse: Foundations and Methods
di: Plecko, Drago, et al.
Pubblicazione: (2026)
di: Plecko, Drago, et al.
Pubblicazione: (2026)
Implicit Safe Set Algorithm for Provably Safe Reinforcement Learning
di: Zhao, Weiye, et al.
Pubblicazione: (2024)
di: Zhao, Weiye, et al.
Pubblicazione: (2024)
Safe Deep Policy Adaptation
di: Xiao, Wenli, et al.
Pubblicazione: (2023)
di: Xiao, Wenli, et al.
Pubblicazione: (2023)
SafeMIL: Learning Offline Safe Imitation Policy from Non-Preferred Trajectories
di: Burnwal, Returaj, et al.
Pubblicazione: (2025)
di: Burnwal, Returaj, et al.
Pubblicazione: (2025)
Safe Flow Q-Learning: Offline Safe Reinforcement Learning with Reachability-Based Flow Policies
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026)
di: Tayal, Mumuksh, et al.
Pubblicazione: (2026)
Safe Exploration via Policy Priors
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
di: Wendl, Manuel, et al.
Pubblicazione: (2026)
Verification-Guided Falsification for Safe RL via Explainable Abstraction and Risk-Aware Exploration
di: Le, Tuan, et al.
Pubblicazione: (2025)
di: Le, Tuan, et al.
Pubblicazione: (2025)
Rating Multi-Modal Time-Series Forecasting Models (MM-TSFM) for Robustness Through a Causal Lens
di: Lakkaraju, Kausik, et al.
Pubblicazione: (2024)
di: Lakkaraju, Kausik, et al.
Pubblicazione: (2024)
From Universal to Individualized Actionability: Revisiting Personalization in Algorithmic Recourse
di: Budde, Lena Marie, et al.
Pubblicazione: (2026)
di: Budde, Lena Marie, et al.
Pubblicazione: (2026)
Skill-based Safe Reinforcement Learning with Risk Planning
di: Zhang, Hanping, et al.
Pubblicazione: (2025)
di: Zhang, Hanping, et al.
Pubblicazione: (2025)
Spectral-Risk Safe Reinforcement Learning with Convergence Guarantees
di: Kim, Dohyeong, et al.
Pubblicazione: (2024)
di: Kim, Dohyeong, et al.
Pubblicazione: (2024)
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning
di: Yao, Yihang, et al.
Pubblicazione: (2023)
di: Yao, Yihang, et al.
Pubblicazione: (2023)
Deep SPI: Safe Policy Improvement via World Models
di: Delgrange, Florent, et al.
Pubblicazione: (2025)
di: Delgrange, Florent, et al.
Pubblicazione: (2025)
Constraint-Adaptive Policy Switching for Offline Safe Reinforcement Learning
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
di: Chemingui, Yassine, et al.
Pubblicazione: (2024)
Creating a Causally Grounded Rating Method for Assessing the Robustness of AI Models for Time-Series Forecasting
di: Lakkaraju, Kausik, et al.
Pubblicazione: (2025)
di: Lakkaraju, Kausik, et al.
Pubblicazione: (2025)
Ethics-Aware Safe Reinforcement Learning for Rare-Event Risk Control in Interactive Urban Driving
di: Li, Dianzhao, et al.
Pubblicazione: (2025)
di: Li, Dianzhao, et al.
Pubblicazione: (2025)
Revisiting Safe Exploration in Safe Reinforcement learning
di: Eckel, David, et al.
Pubblicazione: (2024)
di: Eckel, David, et al.
Pubblicazione: (2024)
Towards Fast Safe Online Reinforcement Learning via Policy Finetuning
di: Chen, Keru, et al.
Pubblicazione: (2024)
di: Chen, Keru, et al.
Pubblicazione: (2024)
RAPO: Risk-Aware Preference Optimization for Generalizable Safe Reasoning
di: Wei, Zeming, et al.
Pubblicazione: (2026)
di: Wei, Zeming, et al.
Pubblicazione: (2026)
Towards Safe Reinforcement Learning via Constraining Conditional Value-at-Risk
di: Ying, Chengyang, et al.
Pubblicazione: (2022)
di: Ying, Chengyang, et al.
Pubblicazione: (2022)
Pareto Optimal Algorithmic Recourse in Multi-cost Function
di: Chen, Wen-Ling, et al.
Pubblicazione: (2025)
di: Chen, Wen-Ling, et al.
Pubblicazione: (2025)
From Algorithm to Hardware: A Survey on Efficient and Safe Deployment of Deep Neural Networks
di: Geng, Xue, et al.
Pubblicazione: (2024)
di: Geng, Xue, et al.
Pubblicazione: (2024)
Safe RLHF Beyond Expectation: Stochastic Dominance for Universal Spectral Risk Control
di: Chittepu, Yaswanth, et al.
Pubblicazione: (2026)
di: Chittepu, Yaswanth, et al.
Pubblicazione: (2026)
Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback
di: Ji, Jiaming, et al.
Pubblicazione: (2025)
di: Ji, Jiaming, et al.
Pubblicazione: (2025)
CAPSULE: Control-Theoretic Action Perturbations for Safe Uncertainty-Aware Reinforcement Learning
di: Narava, Rahul, et al.
Pubblicazione: (2026)
di: Narava, Rahul, et al.
Pubblicazione: (2026)
Iterative Batch Reinforcement Learning via Safe Diversified Model-based Policy Search
di: Najib, Amna, et al.
Pubblicazione: (2024)
di: Najib, Amna, et al.
Pubblicazione: (2024)
Tail-Risk-Safe Monte Carlo Tree Search under PAC-Level Guarantees
di: Zhang, Zuyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zuyuan, et al.
Pubblicazione: (2025)
Verified Safe Reinforcement Learning for Neural Network Dynamic Models
di: Wu, Junlin, et al.
Pubblicazione: (2024)
di: Wu, Junlin, et al.
Pubblicazione: (2024)
Personalized Path Recourse for Reinforcement Learning Agents
di: Hong, Dat, et al.
Pubblicazione: (2023)
di: Hong, Dat, et al.
Pubblicazione: (2023)
Model-Based Proactive Cost Generation for Learning Safe Policies Offline with Limited Violation Data
di: Xue, Ruiqi, et al.
Pubblicazione: (2026)
di: Xue, Ruiqi, et al.
Pubblicazione: (2026)
OSIL: Learning Offline Safe Imitation Policies with Safety Inferred from Non-preferred Trajectories
di: Burnwal, Returaj, et al.
Pubblicazione: (2026)
di: Burnwal, Returaj, et al.
Pubblicazione: (2026)
LIBRA: Language Model Informed Bandit Recourse Algorithm for Personalized Treatment Planning
di: Cao, Junyu, et al.
Pubblicazione: (2026)
di: Cao, Junyu, et al.
Pubblicazione: (2026)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
Information-Theoretic Safe Bayesian Optimization
di: Bottero, Alessandro G., et al.
Pubblicazione: (2024)
di: Bottero, Alessandro G., et al.
Pubblicazione: (2024)
On the Mathematical Impossibility of Safe Universal Approximators
di: Yao, Jasper
Pubblicazione: (2025)
di: Yao, Jasper
Pubblicazione: (2025)
Documenti analoghi
-
QBD-RankedDataGen: Generating Custom Ranked Datasets for Improving Query-By-Document Search Using LLM-Reranking with Reduced Human Effort
di: Gopalakrishnan, Sriram, et al.
Pubblicazione: (2025) -
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
di: Anisimov, Maksim, et al.
Pubblicazione: (2026) -
The Importance of Time in Causal Algorithmic Recourse
di: Beretta, Isacco, et al.
Pubblicazione: (2023) -
Reinforcement Learning for Durable Algorithmic Recourse
di: Ceccon, Marina, et al.
Pubblicazione: (2025) -
Personalized Algorithmic Recourse with Preference Elicitation
di: De Toni, Giovanni, et al.
Pubblicazione: (2022)