On Diffusion Models for Multi-Agent Partial Observability: Shared Attractors, Error Bounds, and Composite Flow
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Tonghan, Dong, Heng, Jiang, Yanchen, Parkes, David C., Tambe, Milind |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GemNet: Menu-Based, Strategy-Proof Multi-Bidder Auctions Through Deep Learning
par: Wang, Tonghan, et autres
Publié: (2024)
par: Wang, Tonghan, et autres
Publié: (2024)
Composite Flow Matching for Reinforcement Learning with Shifted-Dynamics Data
par: Kong, Lingkai, et autres
Publié: (2025)
par: Kong, Lingkai, et autres
Publié: (2025)
BundleFlow: Deep Menus for Combinatorial Auctions by Diffusion-Based Optimization
par: Wang, Tonghan, et autres
Publié: (2025)
par: Wang, Tonghan, et autres
Publié: (2025)
Translate Policy to Language: Flow Matching Generated Rewards for LLM Explanations
par: Yang, Xinyi, et autres
Publié: (2025)
par: Yang, Xinyi, et autres
Publié: (2025)
LLM Active Alignment: A Nash Equilibrium Perspective
par: Wang, Tonghan, et autres
Publié: (2026)
par: Wang, Tonghan, et autres
Publié: (2026)
The Bandit Whisperer: Communication Learning for Restless Bandits
par: Zhao, Yunfan, et autres
Publié: (2024)
par: Zhao, Yunfan, et autres
Publié: (2024)
Social Environment Design
par: Zhang, Edwin, et autres
Publié: (2024)
par: Zhang, Edwin, et autres
Publié: (2024)
Principal-Agent Reinforcement Learning: Orchestrating AI Agents with Contracts
par: Ivanov, Dima, et autres
Publié: (2024)
par: Ivanov, Dima, et autres
Publié: (2024)
Partially Observable Multi-Agent Reinforcement Learning with Information Sharing
par: Liu, Xiangyu, et autres
Publié: (2023)
par: Liu, Xiangyu, et autres
Publié: (2023)
Adaptive Frontier Exploration on Graphs with Applications to Network-Based Disease Testing
par: Choo, Davin, et autres
Publié: (2025)
par: Choo, Davin, et autres
Publié: (2025)
Combining Diverse Information for Coordinated Action: Stochastic Bandit Algorithms for Heterogeneous Agents
par: Gordon, Lucia, et autres
Publié: (2024)
par: Gordon, Lucia, et autres
Publié: (2024)
Analyzing Cost-Sensitive Surrogate Losses via $\mathcal{H}$-calibration
par: Shah, Sanket, et autres
Publié: (2025)
par: Shah, Sanket, et autres
Publié: (2025)
Generative AI Against Poaching: Latent Composite Flow Matching for Wildlife Conservation
par: Kong, Lingkai, et autres
Publié: (2025)
par: Kong, Lingkai, et autres
Publié: (2025)
Rule-Bottleneck Reinforcement Learning: Joint Explanation and Decision Optimization for Resource Allocation with Language Agents
par: Tec, Mauricio, et autres
Publié: (2025)
par: Tec, Mauricio, et autres
Publié: (2025)
Dual-Mandate Patrols: Multi-Armed Bandits for Green Security
par: Xu, Lily, et autres
Publié: (2020)
par: Xu, Lily, et autres
Publié: (2020)
PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making
par: Light, Jonathan, et autres
Publié: (2024)
par: Light, Jonathan, et autres
Publié: (2024)
Decisions and Deployment: The Five-Year SAHELI Project (2020-2025) on Restless Multi-Armed Bandits for Improving Maternal and Child Health
par: Verma, Shresth, et autres
Publié: (2026)
par: Verma, Shresth, et autres
Publié: (2026)
Latent Spherical Flow Policy for Reinforcement Learning with Combinatorial Actions
par: Kong, Lingkai, et autres
Publié: (2026)
par: Kong, Lingkai, et autres
Publié: (2026)
Lightweight Robust Direct Preference Optimization
par: Kim, Cheol Woo, et autres
Publié: (2025)
par: Kim, Cheol Woo, et autres
Publié: (2025)
Preference Robustness for DPO with Applications to Public Health
par: Kim, Cheol Woo, et autres
Publié: (2025)
par: Kim, Cheol Woo, et autres
Publié: (2025)
Leaving the Nest: Going Beyond Local Loss Functions for Predict-Then-Optimize
par: Shah, Sanket, et autres
Publié: (2023)
par: Shah, Sanket, et autres
Publié: (2023)
Efficient Public Health Intervention Planning Using Decomposition-Based Decision-Focused Learning
par: Shah, Sanket, et autres
Publié: (2024)
par: Shah, Sanket, et autres
Publié: (2024)
Improving the Prediction of Individual Engagement in Recommendations Using Cognitive Models
par: Seow, Roderick, et autres
Publié: (2024)
par: Seow, Roderick, et autres
Publié: (2024)
Belief States for Cooperative Multi-Agent Reinforcement Learning under Partial Observability
par: Pritz, Paul J., et autres
Publié: (2025)
par: Pritz, Paul J., et autres
Publié: (2025)
Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective
par: Wang, Haichuan, et autres
Publié: (2026)
par: Wang, Haichuan, et autres
Publié: (2026)
A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health
par: Behari, Nikhil, et autres
Publié: (2024)
par: Behari, Nikhil, et autres
Publié: (2024)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
par: Jain, Gauri, et autres
Publié: (2024)
par: Jain, Gauri, et autres
Publié: (2024)
What is the Right Notion of Distance between Predict-then-Optimize Tasks?
par: Rodriguez-Diaz, Paula, et autres
Publié: (2024)
par: Rodriguez-Diaz, Paula, et autres
Publié: (2024)
Reinforcement learning with combinatorial actions for coupled restless bandits
par: Xu, Lily, et autres
Publié: (2025)
par: Xu, Lily, et autres
Publié: (2025)
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
par: Verma, Shresth, et autres
Publié: (2024)
par: Verma, Shresth, et autres
Publié: (2024)
Error Bounds for Flow Matching Methods
par: Benton, Joe, et autres
Publié: (2023)
par: Benton, Joe, et autres
Publié: (2023)
Context in Public Health for Underserved Communities: A Bayesian Approach to Online Restless Bandits
par: Liang, Biyonka, et autres
Publié: (2024)
par: Liang, Biyonka, et autres
Publié: (2024)
Navigating the Social Welfare Frontier: Portfolios for Multi-objective Reinforcement Learning
par: Kim, Cheol Woo, et autres
Publié: (2025)
par: Kim, Cheol Woo, et autres
Publié: (2025)
Towards a Pretrained Model for Restless Bandits via Multi-arm Generalization
par: Zhao, Yunfan, et autres
Publié: (2023)
par: Zhao, Yunfan, et autres
Publié: (2023)
Multi-View Causal Representation Learning with Partial Observability
par: Yao, Dingling, et autres
Publié: (2023)
par: Yao, Dingling, et autres
Publié: (2023)
Error Bounds for a Diffusion Model-Based Drift Estimator
par: Casado-Telletxea, Ioar, et autres
Publié: (2026)
par: Casado-Telletxea, Ioar, et autres
Publié: (2026)
Contrasting local and global modeling with machine learning and satellite data: A case study estimating tree canopy height in African savannas
par: Rolf, Esther, et autres
Publié: (2024)
par: Rolf, Esther, et autres
Publié: (2024)
Linear Bandits with Partially Observable Features
par: Kim, Wonyoung, et autres
Publié: (2025)
par: Kim, Wonyoung, et autres
Publié: (2025)
LLM-Powered Preference Elicitation in Combinatorial Assignment
par: Soumalias, Ermis, et autres
Publié: (2025)
par: Soumalias, Ermis, et autres
Publié: (2025)
Contextual Linear Optimization with Partial Feedback
par: Hu, Yichun, et autres
Publié: (2024)
par: Hu, Yichun, et autres
Publié: (2024)
Documents similaires
-
GemNet: Menu-Based, Strategy-Proof Multi-Bidder Auctions Through Deep Learning
par: Wang, Tonghan, et autres
Publié: (2024) -
Composite Flow Matching for Reinforcement Learning with Shifted-Dynamics Data
par: Kong, Lingkai, et autres
Publié: (2025) -
BundleFlow: Deep Menus for Combinatorial Auctions by Diffusion-Based Optimization
par: Wang, Tonghan, et autres
Publié: (2025) -
Translate Policy to Language: Flow Matching Generated Rewards for LLM Explanations
par: Yang, Xinyi, et autres
Publié: (2025) -
LLM Active Alignment: A Nash Equilibrium Perspective
par: Wang, Tonghan, et autres
Publié: (2026)