The Max-Min Formulation of Multi-Objective Reinforcement Learning: From Theory to a Model-Free Algorithm
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Park, Giseung, Byeon, Woohyeon, Kim, Seongmin, Havakuk, Elad, Leshem, Amir, Sung, Youngchul |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
par: Byeon, Woohyeon, et autres
Publié: (2025)
par: Byeon, Woohyeon, et autres
Publié: (2025)
Constrained Multi-Objective Reinforcement Learning with Max-Min Criterion
par: Park, Giseung, et autres
Publié: (2026)
par: Park, Giseung, et autres
Publié: (2026)
Low-Rank Cyclostationarity Predictive Routing Is Almost as Good as Real-Time Data-based Routing
par: Oriel-Singer, et autres
Publié: (2026)
par: Oriel-Singer, et autres
Publié: (2026)
Reward Dimension Reduction for Scalable Multi-Objective Reinforcement Learning
par: Park, Giseung, et autres
Publié: (2025)
par: Park, Giseung, et autres
Publié: (2025)
Generalized Per-Agent Advantage Estimation for Multi-Agent Policy Optimization
par: Kim, Seongmin, et autres
Publié: (2026)
par: Kim, Seongmin, et autres
Publié: (2026)
Near-Optimal Privacy-Preserving Learning for Max-Min Fair Multi-Agent Bandits
par: Leshem, Amir
Publié: (2023)
par: Leshem, Amir
Publié: (2023)
Adaptive Action Chunking via Multi-Chunk Q Value Estimation
par: Shin, Yongjae, et autres
Publié: (2026)
par: Shin, Yongjae, et autres
Publié: (2026)
STAIRS-Former: Spatio-Temporal Attention with Interleaved Recursive Structure Transformer for Offline Multi-task Multi-agent Reinforcement Learning
par: Jeon, Jiwon, et autres
Publié: (2026)
par: Jeon, Jiwon, et autres
Publié: (2026)
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
par: Shin, Yongjae, et autres
Publié: (2026)
par: Shin, Yongjae, et autres
Publié: (2026)
Flow Actor-Critic for Offline Reinforcement Learning
par: Chae, Jongseong, et autres
Publié: (2026)
par: Chae, Jongseong, et autres
Publié: (2026)
MMPB: It's Time for Multi-Modal Personalization
par: Kim, Jaeik, et autres
Publié: (2025)
par: Kim, Jaeik, et autres
Publié: (2025)
MinMaxMin $Q$-learning
par: Soffair, Nitsan, et autres
Publié: (2024)
par: Soffair, Nitsan, et autres
Publié: (2024)
LESSON: Learning to Integrate Exploration Strategies for Reinforcement Learning via an Option Framework
par: Kim, Woojun, et autres
Publié: (2023)
par: Kim, Woojun, et autres
Publié: (2023)
Align While Search: Belief-Guided Exploratory Inference for World-Grounded Embodied Agents
par: Bae, Seohui, et autres
Publié: (2025)
par: Bae, Seohui, et autres
Publié: (2025)
Constrained Reinforcement Learning with Average Reward Objective: Model-Based and Model-Free Algorithms
par: Aggarwal, Vaneet, et autres
Publié: (2024)
par: Aggarwal, Vaneet, et autres
Publié: (2024)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
par: Kim, Jeonghye, et autres
Publié: (2025)
par: Kim, Jeonghye, et autres
Publié: (2025)
Min-Max Optimisation for Nonconvex-Nonconcave Functions Using a Random Zeroth-Order Extragradient Algorithm
par: Farzin, Amir Ali, et autres
Publié: (2025)
par: Farzin, Amir Ali, et autres
Publié: (2025)
Adaptive $Q$-Aid for Conditional Supervised Learning in Offline Reinforcement Learning
par: Kim, Jeonghye, et autres
Publié: (2024)
par: Kim, Jeonghye, et autres
Publié: (2024)
Smooth Min-Max Monotonic Networks
par: Igel, Christian
Publié: (2023)
par: Igel, Christian
Publié: (2023)
Retain-Neutral Surrogates for Min-Max Unlearning
par: Cai, Junhao, et autres
Publié: (2026)
par: Cai, Junhao, et autres
Publié: (2026)
Dual-Objective Reinforcement Learning with Novel Hamilton-Jacobi-Bellman Formulations
par: Sharpless, William, et autres
Publié: (2025)
par: Sharpless, William, et autres
Publié: (2025)
Properties of Fixed Points of Generalised Extra Gradient Methods Applied to Min-Max Problems
par: Farzin, Amir Ali, et autres
Publié: (2025)
par: Farzin, Amir Ali, et autres
Publié: (2025)
MinMax Recurrent Neural Cascades
par: Ronca, Alessandro
Publié: (2026)
par: Ronca, Alessandro
Publié: (2026)
Model-Free Reinforcement Learning for Symbolic Automata-encoded Objectives
par: Balakrishnan, Anand, et autres
Publié: (2022)
par: Balakrishnan, Anand, et autres
Publié: (2022)
A Comprehensive Survey of Reinforcement Learning: From Algorithms to Practical Challenges
par: Ghasemi, Majid, et autres
Publié: (2024)
par: Ghasemi, Majid, et autres
Publié: (2024)
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm
par: Bai, Qinbo, et autres
Publié: (2021)
par: Bai, Qinbo, et autres
Publié: (2021)
Linear Equations with Min and Max Operators: Computational Complexity
par: Chatterjee, Krishnendu, et autres
Publié: (2024)
par: Chatterjee, Krishnendu, et autres
Publié: (2024)
Creating a digital poet
par: Tohar, Vered, et autres
Publié: (2026)
par: Tohar, Vered, et autres
Publié: (2026)
FairDICE: Fairness-Driven Offline Multi-Objective Reinforcement Learning
par: Kim, Woosung, et autres
Publié: (2025)
par: Kim, Woosung, et autres
Publié: (2025)
MergeRec: Model Merging for Data-Isolated Cross-Domain Sequential Recommendation
par: Kim, Hyunsoo, et autres
Publié: (2026)
par: Kim, Hyunsoo, et autres
Publié: (2026)
Bayesian Neural Networks: A Min-Max Game Framework
par: Hong, Junping, et autres
Publié: (2023)
par: Hong, Junping, et autres
Publié: (2023)
Language Models as Semiotic Machines: Reconceptualizing AI Language Systems through Structuralist and Post-Structuralist Theories of Language
par: Vromen, Elad
Publié: (2024)
par: Vromen, Elad
Publié: (2024)
MaxMin-RLHF: Alignment with Diverse Human Preferences
par: Chakraborty, Souradip, et autres
Publié: (2024)
par: Chakraborty, Souradip, et autres
Publié: (2024)
Multi-Objective Instruction-Aware Representation Learning in Procedural Content Generation RL
par: Kim, Sung-Hyun, et autres
Publié: (2025)
par: Kim, Sung-Hyun, et autres
Publié: (2025)
M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation
par: Park, Hyeongcheol, et autres
Publié: (2025)
par: Park, Hyeongcheol, et autres
Publié: (2025)
Multi-Objective Reinforcement Learning for Water Management
par: Osika, Zuzanna, et autres
Publié: (2025)
par: Osika, Zuzanna, et autres
Publié: (2025)
Demonstration Guided Multi-Objective Reinforcement Learning
par: Lu, Junlin, et autres
Publié: (2024)
par: Lu, Junlin, et autres
Publié: (2024)
iMTSP: Solving Min-Max Multiple Traveling Salesman Problem with Imperative Learning
par: Guo, Yifan, et autres
Publié: (2024)
par: Guo, Yifan, et autres
Publié: (2024)
EXOTIC: An Exact, Optimistic, Tree-Based Algorithm for Min-Max Optimization
par: Maheshwari, Chinmay, et autres
Publié: (2025)
par: Maheshwari, Chinmay, et autres
Publié: (2025)
Learning Rate-Free Reinforcement Learning: A Case for Model Selection with Non-Stationary Objectives
par: Afshar, Aida, et autres
Publié: (2024)
par: Afshar, Aida, et autres
Publié: (2024)
Documents similaires
-
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
par: Byeon, Woohyeon, et autres
Publié: (2025) -
Constrained Multi-Objective Reinforcement Learning with Max-Min Criterion
par: Park, Giseung, et autres
Publié: (2026) -
Low-Rank Cyclostationarity Predictive Routing Is Almost as Good as Real-Time Data-based Routing
par: Oriel-Singer, et autres
Publié: (2026) -
Reward Dimension Reduction for Scalable Multi-Objective Reinforcement Learning
par: Park, Giseung, et autres
Publié: (2025) -
Generalized Per-Agent Advantage Estimation for Multi-Agent Policy Optimization
par: Kim, Seongmin, et autres
Publié: (2026)