Belief-Enriched Pessimistic Q-Learning against Adversarial State Perturbations
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Xiaolin, Zheng, Zizhan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Diffusion Guided Adversarial State Perturbations in Reinforcement Learning
di: Sun, Xiaolin, et al.
Pubblicazione: (2025)
di: Sun, Xiaolin, et al.
Pubblicazione: (2025)
Robust Optimization for Mitigating Reward Hacking with Correlated Proxies
di: Liu, Zixuan, et al.
Pubblicazione: (2026)
di: Liu, Zixuan, et al.
Pubblicazione: (2026)
Enhancing LLM Safety via Constrained Direct Preference Optimization
di: Liu, Zixuan, et al.
Pubblicazione: (2024)
di: Liu, Zixuan, et al.
Pubblicazione: (2024)
Optimistic Policy Learning under Pessimistic Adversaries with Regret and Violation Guarantees
di: Ganguly, Sourav, et al.
Pubblicazione: (2026)
di: Ganguly, Sourav, et al.
Pubblicazione: (2026)
Learning a Pessimistic Reward Model in RLHF
di: Xu, Yinglun, et al.
Pubblicazione: (2025)
di: Xu, Yinglun, et al.
Pubblicazione: (2025)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
di: Wang, Danyang, et al.
Pubblicazione: (2024)
di: Wang, Danyang, et al.
Pubblicazione: (2024)
Perturbation-based Graph Active Learning for Weakly-Supervised Belief Representation Learning
di: Sun, Dachun, et al.
Pubblicazione: (2024)
di: Sun, Dachun, et al.
Pubblicazione: (2024)
Pessimistic Risk-Aware Policy Learning in Contextual Bandits
di: Wan, Yilong, et al.
Pubblicazione: (2026)
di: Wan, Yilong, et al.
Pubblicazione: (2026)
Contrasting Adversarial Perturbations: The Space of Harmless Perturbations
di: Chen, Lu, et al.
Pubblicazione: (2024)
di: Chen, Lu, et al.
Pubblicazione: (2024)
Democratic Training Against Universal Adversarial Perturbations
di: Sun, Bing, et al.
Pubblicazione: (2025)
di: Sun, Bing, et al.
Pubblicazione: (2025)
Logarithmic Smoothing for Pessimistic Off-Policy Evaluation, Selection and Learning
di: Sakhi, Otmane, et al.
Pubblicazione: (2024)
di: Sakhi, Otmane, et al.
Pubblicazione: (2024)
Meta Stackelberg Game: Robust Federated Learning against Adaptive and Mixed Poisoning Attacks
di: Li, Tao, et al.
Pubblicazione: (2024)
di: Li, Tao, et al.
Pubblicazione: (2024)
Pessimistic Backward Policy for GFlowNets
di: Jang, Hyosoon, et al.
Pubblicazione: (2024)
di: Jang, Hyosoon, et al.
Pubblicazione: (2024)
Distributed Learning with Adversarial Gradient Perturbations
di: Sangsiri, Nawapon, et al.
Pubblicazione: (2026)
di: Sangsiri, Nawapon, et al.
Pubblicazione: (2026)
Pessimistic Off-Policy Optimization for Learning to Rank
di: Cief, Matej, et al.
Pubblicazione: (2022)
di: Cief, Matej, et al.
Pubblicazione: (2022)
Hyperparameter Tuning Through Pessimistic Bilevel Optimization
di: Ustun, Meltem Apaydin, et al.
Pubblicazione: (2024)
di: Ustun, Meltem Apaydin, et al.
Pubblicazione: (2024)
Certified Robustness against Sparse Adversarial Perturbations via Data Localization
di: Pal, Ambar, et al.
Pubblicazione: (2024)
di: Pal, Ambar, et al.
Pubblicazione: (2024)
Towards Robust Deep Reinforcement Learning against Environmental State Perturbation
di: Wang, Chenxu, et al.
Pubblicazione: (2025)
di: Wang, Chenxu, et al.
Pubblicazione: (2025)
Defending Quantum Classifiers against Adversarial Perturbations through Quantum Autoencoders
di: Andrews, Emma, et al.
Pubblicazione: (2026)
di: Andrews, Emma, et al.
Pubblicazione: (2026)
Constrained Adversarial Perturbation
di: Nishad, Virendra, et al.
Pubblicazione: (2025)
di: Nishad, Virendra, et al.
Pubblicazione: (2025)
Optimistic Model Rollouts for Pessimistic Offline Policy Optimization
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024)
A Case for Validation Buffer in Pessimistic Actor-Critic
di: Nauman, Michal, et al.
Pubblicazione: (2024)
di: Nauman, Michal, et al.
Pubblicazione: (2024)
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning
di: Di, Qiwei, et al.
Pubblicazione: (2023)
di: Di, Qiwei, et al.
Pubblicazione: (2023)
Conservative DDPG -- Pessimistic RL without Ensemble
di: Soffair, Nitsan, et al.
Pubblicazione: (2024)
di: Soffair, Nitsan, et al.
Pubblicazione: (2024)
Pessimistic Iterative Planning with RNNs for Robust POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)
Fair Algorithms with Probing for Multi-Agent Multi-Armed Bandits
di: Xu, Tianyi, et al.
Pubblicazione: (2025)
di: Xu, Tianyi, et al.
Pubblicazione: (2025)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
di: Bai, Chenjia, et al.
Pubblicazione: (2024)
Uniform Pessimistic Risk and its Optimal Portfolio
di: Hong, Sungchul, et al.
Pubblicazione: (2023)
di: Hong, Sungchul, et al.
Pubblicazione: (2023)
Improving Transformation-based Defenses against Adversarial Examples with First-order Perturbations
di: Zhang, Haimin, et al.
Pubblicazione: (2021)
di: Zhang, Haimin, et al.
Pubblicazione: (2021)
Pessimistic asynchronous sampling in high-cost Bayesian optimization
di: Volk, Amanda A., et al.
Pubblicazione: (2024)
di: Volk, Amanda A., et al.
Pubblicazione: (2024)
On the Effects of Adversarial Perturbations on Distribution Robustness
di: Wang, Yipei, et al.
Pubblicazione: (2026)
di: Wang, Yipei, et al.
Pubblicazione: (2026)
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
di: Yu, Xudong, et al.
Pubblicazione: (2024)
di: Yu, Xudong, et al.
Pubblicazione: (2024)
Feasibility-Aware Pessimistic Estimation: Toward Long-Horizon Safety in Offline RL
di: Tao, Zhikun
Pubblicazione: (2025)
di: Tao, Zhikun
Pubblicazione: (2025)
Theoretical Understanding of Learning from Adversarial Perturbations
di: Kumano, Soichiro, et al.
Pubblicazione: (2024)
di: Kumano, Soichiro, et al.
Pubblicazione: (2024)
Belief-State RWKV for Reinforcement Learning under Partial Observability
di: Xiao, Liu
Pubblicazione: (2026)
di: Xiao, Liu
Pubblicazione: (2026)
T-CIL: Temperature Scaling using Adversarial Perturbation for Calibration in Class-Incremental Learning
di: Hwang, Seong-Hyeon, et al.
Pubblicazione: (2025)
di: Hwang, Seong-Hyeon, et al.
Pubblicazione: (2025)
Subspace Defense: Discarding Adversarial Perturbations by Learning a Subspace for Clean Signals
di: Zheng, Rui, et al.
Pubblicazione: (2024)
di: Zheng, Rui, et al.
Pubblicazione: (2024)
POLAR: A Pessimistic Model-based Policy Learning Algorithm for Dynamic Treatment Regimes
di: Zhang, Ruijia, et al.
Pubblicazione: (2025)
di: Zhang, Ruijia, et al.
Pubblicazione: (2025)
Suppressing Overestimation in Q-Learning through Adversarial Behaviors
di: Lee, HyeAnn, et al.
Pubblicazione: (2023)
di: Lee, HyeAnn, et al.
Pubblicazione: (2023)
On the Perturbed States for Transformed Input-robust Reinforcement Learning
di: Luu, Tung M., et al.
Pubblicazione: (2024)
di: Luu, Tung M., et al.
Pubblicazione: (2024)
Documenti analoghi
-
Diffusion Guided Adversarial State Perturbations in Reinforcement Learning
di: Sun, Xiaolin, et al.
Pubblicazione: (2025) -
Robust Optimization for Mitigating Reward Hacking with Correlated Proxies
di: Liu, Zixuan, et al.
Pubblicazione: (2026) -
Enhancing LLM Safety via Constrained Direct Preference Optimization
di: Liu, Zixuan, et al.
Pubblicazione: (2024) -
Optimistic Policy Learning under Pessimistic Adversaries with Regret and Violation Guarantees
di: Ganguly, Sourav, et al.
Pubblicazione: (2026) -
Learning a Pessimistic Reward Model in RLHF
di: Xu, Yinglun, et al.
Pubblicazione: (2025)