Salvato in:
| Autori principali: | Rank, Ben, Triantafyllou, Stelios, Mandal, Debmalya, Radanovic, Goran |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2402.09838 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Performative Reinforcement Learning with Linear Markov Decision Process
di: Mandal, Debmalya, et al.
Pubblicazione: (2024)
di: Mandal, Debmalya, et al.
Pubblicazione: (2024)
On Corruption-Robustness in Performative Reinforcement Learning
di: Pollatos, Vasilis, et al.
Pubblicazione: (2025)
di: Pollatos, Vasilis, et al.
Pubblicazione: (2025)
Distributionally Robust Reinforcement Learning with Human Feedback
di: Mandal, Debmalya, et al.
Pubblicazione: (2025)
di: Mandal, Debmalya, et al.
Pubblicazione: (2025)
Agent-Specific Effects: A Causal Effect Propagation Analysis in Multi-Agent MDPs
di: Triantafyllou, Stelios, et al.
Pubblicazione: (2023)
di: Triantafyllou, Stelios, et al.
Pubblicazione: (2023)
Independent Learning in Performative Markov Potential Games
di: Sahitaj, Rilind, et al.
Pubblicazione: (2025)
di: Sahitaj, Rilind, et al.
Pubblicazione: (2025)
Corruption-robust Offline Multi-agent Reinforcement Learning From Human Feedback
di: Nika, Andi, et al.
Pubblicazione: (2026)
di: Nika, Andi, et al.
Pubblicazione: (2026)
Corruption Robust Offline Reinforcement Learning with Human Feedback
di: Mandal, Debmalya, et al.
Pubblicazione: (2024)
di: Mandal, Debmalya, et al.
Pubblicazione: (2024)
Sparse Offline Reinforcement Learning with Corruption Robustness
di: Tran, Nam Phuong, et al.
Pubblicazione: (2025)
di: Tran, Nam Phuong, et al.
Pubblicazione: (2025)
Stochastic Principal-Agent Problems: Efficient Computation and Learning
di: Gan, Jiarui, et al.
Pubblicazione: (2023)
di: Gan, Jiarui, et al.
Pubblicazione: (2023)
Corruption-Robust Offline Two-Player Zero-Sum Markov Games
di: Nika, Andi, et al.
Pubblicazione: (2024)
di: Nika, Andi, et al.
Pubblicazione: (2024)
Reward Model Learning vs. Direct Policy Optimization: A Comparative Analysis of Learning from Human Preferences
di: Nika, Andi, et al.
Pubblicazione: (2024)
di: Nika, Andi, et al.
Pubblicazione: (2024)
Policy Teaching via Data Poisoning in Learning from Human Preferences
di: Nika, Andi, et al.
Pubblicazione: (2025)
di: Nika, Andi, et al.
Pubblicazione: (2025)
Counterfactual Effect Decomposition in Multi-Agent Sequential Decision Making
di: Triantafyllou, Stelios, et al.
Pubblicazione: (2024)
di: Triantafyllou, Stelios, et al.
Pubblicazione: (2024)
Can In-Context Reinforcement Learning Recover From Reward Poisoning Attacks?
di: Sasnauskas, Paulius, et al.
Pubblicazione: (2025)
di: Sasnauskas, Paulius, et al.
Pubblicazione: (2025)
Reward Design for Justifiable Sequential Decision-Making
di: Sukovic, Aleksa, et al.
Pubblicazione: (2024)
di: Sukovic, Aleksa, et al.
Pubblicazione: (2024)
Benchmarking the Robustness of Agentic Systems to Adversarially-Induced Harms
di: Nöther, Jonathan, et al.
Pubblicazione: (2025)
di: Nöther, Jonathan, et al.
Pubblicazione: (2025)
Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints
di: Nöther, Jonathan, et al.
Pubblicazione: (2025)
di: Nöther, Jonathan, et al.
Pubblicazione: (2025)
Reinforcement Learning for Durable Algorithmic Recourse
di: Ceccon, Marina, et al.
Pubblicazione: (2025)
di: Ceccon, Marina, et al.
Pubblicazione: (2025)
Learning Embeddings for Sequential Tasks Using Population of Agents
di: Mahajan, Mridul, et al.
Pubblicazione: (2023)
di: Mahajan, Mridul, et al.
Pubblicazione: (2023)
Strategyproof Reinforcement Learning from Human Feedback
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2025)
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2025)
MaMa: A Game-Theoretic Approach for Designing Safe Agentic Systems
di: Nöther, Jonathan, et al.
Pubblicazione: (2026)
di: Nöther, Jonathan, et al.
Pubblicazione: (2026)
GRAPHLCP: Structure-Aware Localized Conformal Prediction on Graphs
di: Baghershahi, Peyman, et al.
Pubblicazione: (2026)
di: Baghershahi, Peyman, et al.
Pubblicazione: (2026)
Surprisingly Popular Voting for Concentric Rank-Order Models
di: Hosseini, Hadi, et al.
Pubblicazione: (2024)
di: Hosseini, Hadi, et al.
Pubblicazione: (2024)
Progressive Weight Loading: Accelerating Initial Inference and Gradually Boosting Performance on Resource-Constrained Environments
di: Kim, Hyunwoo, et al.
Pubblicazione: (2025)
di: Kim, Hyunwoo, et al.
Pubblicazione: (2025)
Symmetric Linear Bandits with Hidden Symmetry
di: Tran, Nam Phuong, et al.
Pubblicazione: (2024)
di: Tran, Nam Phuong, et al.
Pubblicazione: (2024)
Gradual Domain Adaptation for Graph Learning
di: Lei, Pui Ieng, et al.
Pubblicazione: (2025)
di: Lei, Pui Ieng, et al.
Pubblicazione: (2025)
Deep learning enhanced mixed integer optimization: Learning to reduce model dimensionality
di: Triantafyllou, Niki, et al.
Pubblicazione: (2024)
di: Triantafyllou, Niki, et al.
Pubblicazione: (2024)
Assessing the Impact of Distribution Shift on Reinforcement Learning Performance
di: Fujimoto, Ted, et al.
Pubblicazione: (2024)
di: Fujimoto, Ted, et al.
Pubblicazione: (2024)
Gradual Transition from Bellman Optimality Operator to Bellman Operator in Online Reinforcement Learning
di: Omura, Motoki, et al.
Pubblicazione: (2025)
di: Omura, Motoki, et al.
Pubblicazione: (2025)
Gradual Optimization Learning for Conformational Energy Minimization
di: Tsypin, Artem, et al.
Pubblicazione: (2023)
di: Tsypin, Artem, et al.
Pubblicazione: (2023)
Learning the Expected Core of Strictly Convex Stochastic Cooperative Games
di: Tran, Nam Phuong, et al.
Pubblicazione: (2024)
di: Tran, Nam Phuong, et al.
Pubblicazione: (2024)
On Double Descent in Reinforcement Learning with LSTD and Random Features
di: Brellmann, David, et al.
Pubblicazione: (2023)
di: Brellmann, David, et al.
Pubblicazione: (2023)
Collaborative Distributed Machine Learning
di: Jin, David, et al.
Pubblicazione: (2023)
di: Jin, David, et al.
Pubblicazione: (2023)
Gradual Domain Adaptation: Theory and Algorithms
di: He, Yifei, et al.
Pubblicazione: (2023)
di: He, Yifei, et al.
Pubblicazione: (2023)
Distance Matters For Improving Performance Estimation Under Covariate Shift
di: Roschewitz, Mélanie, et al.
Pubblicazione: (2023)
di: Roschewitz, Mélanie, et al.
Pubblicazione: (2023)
Estimating the Joint Probability of Scenario Parameters with Gaussian Mixture Copula Models
di: Reichenbächer, Christian, et al.
Pubblicazione: (2025)
di: Reichenbächer, Christian, et al.
Pubblicazione: (2025)
Intrusion Detection System Using Supervised Machine Learning Models on the KDD Cup 1999 Dataset
di: Hadjioannou, Christos Stelios
Pubblicazione: (2025)
di: Hadjioannou, Christos Stelios
Pubblicazione: (2025)
Gradual Domain Adaptation via Normalizing Flows
di: Sagawa, Shogo, et al.
Pubblicazione: (2022)
di: Sagawa, Shogo, et al.
Pubblicazione: (2022)
Gradual Fine-Tuning for Flow Matching Models
di: Thorkelsdottir, Gudrun, et al.
Pubblicazione: (2026)
di: Thorkelsdottir, Gudrun, et al.
Pubblicazione: (2026)
FedShift: Robust Federated Learning Aggregation Scheme in Resource Constrained Environment via Weight Shifting
di: Seo, Jungwon, et al.
Pubblicazione: (2024)
di: Seo, Jungwon, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Performative Reinforcement Learning with Linear Markov Decision Process
di: Mandal, Debmalya, et al.
Pubblicazione: (2024) -
On Corruption-Robustness in Performative Reinforcement Learning
di: Pollatos, Vasilis, et al.
Pubblicazione: (2025) -
Distributionally Robust Reinforcement Learning with Human Feedback
di: Mandal, Debmalya, et al.
Pubblicazione: (2025) -
Agent-Specific Effects: A Causal Effect Propagation Analysis in Multi-Agent MDPs
di: Triantafyllou, Stelios, et al.
Pubblicazione: (2023) -
Independent Learning in Performative Markov Potential Games
di: Sahitaj, Rilind, et al.
Pubblicazione: (2025)