Monotonic Transformation Invariant Multi-task Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Murthy, Surya, Gupta, Kushagra, Karabag, Mustafa O., Fridovich-Keil, David, Topcu, Ufuk |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cooperative Bargaining Games Without Utilities: Mediated Solutions from Direction Oracles
di: Gupta, Kushagra, et al.
Pubblicazione: (2025)
di: Gupta, Kushagra, et al.
Pubblicazione: (2025)
Deceptive Exploration in Multi-armed Bandits
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025)
Sequential Resource Trading Using Comparison-Based Gradient Estimation
di: Murthy, Surya, et al.
Pubblicazione: (2024)
di: Murthy, Surya, et al.
Pubblicazione: (2024)
A Flow Matching Algorithm for Many-Shot Adaptation to Unseen Distributions
di: Ingebrand, Tyler, et al.
Pubblicazione: (2026)
di: Ingebrand, Tyler, et al.
Pubblicazione: (2026)
A Multi-Fidelity Control Variate Approach for Policy Gradient Estimation
di: Liu, Xinjie, et al.
Pubblicazione: (2025)
di: Liu, Xinjie, et al.
Pubblicazione: (2025)
Do LLMs Strategically Reveal, Conceal, and Infer Information? A Theoretical and Empirical Analysis in The Chameleon Game
di: Karabag, Mustafa O., et al.
Pubblicazione: (2025)
di: Karabag, Mustafa O., et al.
Pubblicazione: (2025)
More Information is Not Always Better: Connections between Zero-Sum Local Nash Equilibria in Feedback and Open-Loop Information Patterns
di: Gupta, Kushagra, et al.
Pubblicazione: (2025)
di: Gupta, Kushagra, et al.
Pubblicazione: (2025)
Interleaved Information Structures in Dynamic Games: A General Framework with Application to the Linear-Quadratic Case
di: K, Janani S, et al.
Pubblicazione: (2026)
di: K, Janani S, et al.
Pubblicazione: (2026)
Bayesian Inverse Games with High-Dimensional Multi-Modal Observations
di: Jain, Yash, et al.
Pubblicazione: (2026)
di: Jain, Yash, et al.
Pubblicazione: (2026)
When Should a Leader Act Suboptimally? The Role of Inferability in Repeated Stackelberg Games
di: Karabag, Mustafa O., et al.
Pubblicazione: (2023)
di: Karabag, Mustafa O., et al.
Pubblicazione: (2023)
Integrated Noise and Safety Management in UAM via A Unified Reinforcement Learning Framework
di: Murthy, Surya, et al.
Pubblicazione: (2025)
di: Murthy, Surya, et al.
Pubblicazione: (2025)
A Reinforcement Learning Approach to Quiet and Safe UAM Traffic Management
di: Murthy, Surya, et al.
Pubblicazione: (2025)
di: Murthy, Surya, et al.
Pubblicazione: (2025)
Second-Order Algorithms for Finding Local Nash Equilibria in Zero-Sum Games
di: Gupta, Kushagra, et al.
Pubblicazione: (2024)
di: Gupta, Kushagra, et al.
Pubblicazione: (2024)
Active Inverse Learning in Stackelberg Trajectory Games
di: Ward, William, et al.
Pubblicazione: (2023)
di: Ward, William, et al.
Pubblicazione: (2023)
Value of Information-based Deceptive Path Planning Under Adversarial Interventions
di: Suttle, Wesley A., et al.
Pubblicazione: (2025)
di: Suttle, Wesley A., et al.
Pubblicazione: (2025)
Auto-Encoding Bayesian Inverse Games
di: Liu, Xinjie, et al.
Pubblicazione: (2024)
di: Liu, Xinjie, et al.
Pubblicazione: (2024)
Identity Concealment Games: How I Learned to Stop Revealing and Love the Coincidences
di: Karabag, Mustafa O., et al.
Pubblicazione: (2021)
di: Karabag, Mustafa O., et al.
Pubblicazione: (2021)
Game-theoretic Occlusion-Aware Motion Planning: an Efficient Hybrid-Information Approach
di: Gupta, Kushagra, et al.
Pubblicazione: (2023)
di: Gupta, Kushagra, et al.
Pubblicazione: (2023)
Stealing That Free Lunch: Exposing the Limits of Dyna-Style Reinforcement Learning
di: Barkley, Brett, et al.
Pubblicazione: (2024)
di: Barkley, Brett, et al.
Pubblicazione: (2024)
Approximate Feedback Nash Equilibria with Sparse Inter-Agent Dependencies
di: Liu, Xinjie, et al.
Pubblicazione: (2024)
di: Liu, Xinjie, et al.
Pubblicazione: (2024)
Decomposing Control Lyapunov Functions for Efficient Reinforcement Learning
di: Lopez, Antonio, et al.
Pubblicazione: (2024)
di: Lopez, Antonio, et al.
Pubblicazione: (2024)
Deceptive Planning Exploiting Inattention Blindness
di: Karabag, Mustafa O., et al.
Pubblicazione: (2025)
di: Karabag, Mustafa O., et al.
Pubblicazione: (2025)
Designing Inferable Signaling Schemes for Bayesian Persuasion
di: Probine, Caleb, et al.
Pubblicazione: (2025)
di: Probine, Caleb, et al.
Pubblicazione: (2025)
Why Do LLMs Struggle in Strategic Play? Broken Links Between Observations, Beliefs, and Actions
di: Sobotka, Jan, et al.
Pubblicazione: (2026)
di: Sobotka, Jan, et al.
Pubblicazione: (2026)
A Decentralized Shotgun Approach for Team Deception
di: Probine, Caleb, et al.
Pubblicazione: (2024)
di: Probine, Caleb, et al.
Pubblicazione: (2024)
Dense Dynamics-Aware Reward Synthesis: Integrating Prior Experience with Demonstrations
di: Koprulu, Cevahir, et al.
Pubblicazione: (2024)
di: Koprulu, Cevahir, et al.
Pubblicazione: (2024)
Chance-Constrained Correlated Equilibria for Robust Noncooperative Coordination
di: Im, Jaehan, et al.
Pubblicazione: (2026)
di: Im, Jaehan, et al.
Pubblicazione: (2026)
Noncooperative Virtual Queue Coordination via Uncertainty-Aware Correlated Equilibria
di: Im, Jaehan, et al.
Pubblicazione: (2026)
di: Im, Jaehan, et al.
Pubblicazione: (2026)
Scalable Coordination with Chance-Constrained Correlated Equilibria via Reduced-Rank Structure
di: Im, Jaehan, et al.
Pubblicazione: (2026)
di: Im, Jaehan, et al.
Pubblicazione: (2026)
A Forensic Analysis of Synthetic Data in RL: Diagnosing and Solving Algorithmic Failures in Model-Based Policy Optimization
di: Barkley, Brett, et al.
Pubblicazione: (2025)
di: Barkley, Brett, et al.
Pubblicazione: (2025)
Deceptive Sequential Decision-Making via Regularized Policy Optimization
di: Kim, Yerin, et al.
Pubblicazione: (2025)
di: Kim, Yerin, et al.
Pubblicazione: (2025)
Learning to Walk from Three Minutes of Real-World Data with Semi-structured Dynamics Models
di: Levy, Jacob, et al.
Pubblicazione: (2024)
di: Levy, Jacob, et al.
Pubblicazione: (2024)
SCOPED: Score-Curvature Out-of-distribution Proximity Evaluator for Diffusion
di: Barkley, Brett, et al.
Pubblicazione: (2025)
di: Barkley, Brett, et al.
Pubblicazione: (2025)
Scaling Pretrained Representations Enables Label-Free Out-of-Distribution Detection Without Fine-Tuning
di: Barkley, Brett, et al.
Pubblicazione: (2026)
di: Barkley, Brett, et al.
Pubblicazione: (2026)
A Recovery Guarantee for Sparse Neural Networks
di: Fridovich-Keil, Sara, et al.
Pubblicazione: (2025)
di: Fridovich-Keil, Sara, et al.
Pubblicazione: (2025)
Zero-Shot Reinforcement Learning via Function Encoders
di: Ingebrand, Tyler, et al.
Pubblicazione: (2024)
di: Ingebrand, Tyler, et al.
Pubblicazione: (2024)
Learning responsibility allocations for multi-agent interactions: A differentiable optimization approach with control barrier functions
di: Remy, Isaac, et al.
Pubblicazione: (2024)
di: Remy, Isaac, et al.
Pubblicazione: (2024)
Function Encoders: A Principled Approach to Transfer Learning in Hilbert Spaces
di: Ingebrand, Tyler, et al.
Pubblicazione: (2025)
di: Ingebrand, Tyler, et al.
Pubblicazione: (2025)
Game-theoretic Decentralized Coordination for Airspace Sector Overload Mitigation
di: Im, Jaehan, et al.
Pubblicazione: (2025)
di: Im, Jaehan, et al.
Pubblicazione: (2025)
Coordination in Noncooperative Multiplayer Matrix Games via Reduced Rank Correlated Equilibria
di: Im, Jaehan, et al.
Pubblicazione: (2024)
di: Im, Jaehan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Cooperative Bargaining Games Without Utilities: Mediated Solutions from Direction Oracles
di: Gupta, Kushagra, et al.
Pubblicazione: (2025) -
Deceptive Exploration in Multi-armed Bandits
di: Vurankaya, I. Arda, et al.
Pubblicazione: (2025) -
Sequential Resource Trading Using Comparison-Based Gradient Estimation
di: Murthy, Surya, et al.
Pubblicazione: (2024) -
A Flow Matching Algorithm for Many-Shot Adaptation to Unseen Distributions
di: Ingebrand, Tyler, et al.
Pubblicazione: (2026) -
A Multi-Fidelity Control Variate Approach for Policy Gradient Estimation
di: Liu, Xinjie, et al.
Pubblicazione: (2025)