Enregistré dans:
| Auteurs principaux: | Park, Chanwoo, Han, Seungju, Guo, Xingzhi, Ozdaglar, Asuman, Zhang, Kaiqing, Kim, Joo-Kyung |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.18439 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Post-Training LLMs as Better Decision-Making Agents: A Regret-Minimization Approach
par: Park, Chanwoo, et autres
Publié: (2025)
par: Park, Chanwoo, et autres
Publié: (2025)
Multi-Player Zero-Sum Markov Games with Networked Separable Interactions
par: Park, Chanwoo, et autres
Publié: (2023)
par: Park, Chanwoo, et autres
Publié: (2023)
Do LLM Agents Have Regret? A Case Study in Online Learning and Games
par: Park, Chanwoo, et autres
Publié: (2024)
par: Park, Chanwoo, et autres
Publié: (2024)
RLHF from Heterogeneous Feedback via Personalization and Preference Aggregation
par: Park, Chanwoo, et autres
Publié: (2024)
par: Park, Chanwoo, et autres
Publié: (2024)
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
par: Ozdaglar, Asuman, et autres
Publié: (2022)
par: Ozdaglar, Asuman, et autres
Publié: (2022)
The Power of Regularization in Solving Extensive-Form Games
par: Liu, Mingyang, et autres
Publié: (2022)
par: Liu, Mingyang, et autres
Publié: (2022)
Mirror Duality in Convex Optimization
par: Kim, Jaeyeon, et autres
Publié: (2023)
par: Kim, Jaeyeon, et autres
Publié: (2023)
Last-Iterate Convergence of Payoff-Based Independent Learning in Zero-Sum Stochastic Games
par: Chen, Zaiwei, et autres
Publié: (2024)
par: Chen, Zaiwei, et autres
Publié: (2024)
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
par: Zhang, Runyu, et autres
Publié: (2025)
par: Zhang, Runyu, et autres
Publié: (2025)
Online Learning and Equilibrium Computation with Ranking Feedback
par: Liu, Mingyang, et autres
Publié: (2026)
par: Liu, Mingyang, et autres
Publié: (2026)
UFT: Unifying Supervised and Reinforcement Fine-Tuning
par: Liu, Mingyang, et autres
Publié: (2025)
par: Liu, Mingyang, et autres
Publié: (2025)
Equilibrium Selection for Multi-agent Reinforcement Learning: A Unified Framework
par: Zhang, Runyu, et autres
Publié: (2024)
par: Zhang, Runyu, et autres
Publié: (2024)
Learning Decision-Sufficient Representations for Linear Optimization
par: Ye, Yuhan, et autres
Publié: (2026)
par: Ye, Yuhan, et autres
Publié: (2026)
Uniformly Stable Algorithms for Adversarial Training and Beyond
par: Xiao, Jiancong, et autres
Publié: (2024)
par: Xiao, Jiancong, et autres
Publié: (2024)
A Unified Linear Programming Framework for Offline Reward Learning from Human Demonstrations and Feedback
par: Kim, Kihyun, et autres
Publié: (2024)
par: Kim, Kihyun, et autres
Publié: (2024)
LiteEFG: An Efficient Python Library for Solving Extensive-form Games
par: Liu, Mingyang, et autres
Publié: (2024)
par: Liu, Mingyang, et autres
Publié: (2024)
Computing Equilibrium beyond Unilateral Deviation
par: Liu, Mingyang, et autres
Publié: (2026)
par: Liu, Mingyang, et autres
Publié: (2026)
A Policy-Gradient Approach to Solving Imperfect-Information Games with Best-Iterate Convergence
par: Liu, Mingyang, et autres
Publié: (2024)
par: Liu, Mingyang, et autres
Publié: (2024)
Differentially Private Equilibrium Finding in Polymatrix Games
par: Liu, Mingyang, et autres
Publié: (2025)
par: Liu, Mingyang, et autres
Publié: (2025)
Finite-Sample Guarantees for Learning Dynamics in Zero-Sum Polymatrix Games
par: Faizal, Fathima Zarin, et autres
Publié: (2024)
par: Faizal, Fathima Zarin, et autres
Publié: (2024)
Partially Observable Multi-Agent Reinforcement Learning with Information Sharing
par: Liu, Xiangyu, et autres
Publié: (2023)
par: Liu, Xiangyu, et autres
Publié: (2023)
Beyond RLHF and NLHF: Population-Proportional Alignment under an Axiomatic Framework
par: Kim, Kihyun, et autres
Publié: (2025)
par: Kim, Kihyun, et autres
Publié: (2025)
Synthetic Mixed Training: Scaling Parametric Knowledge Acquisition Beyond RAG
par: Han, Seungju, et autres
Publié: (2026)
par: Han, Seungju, et autres
Publié: (2026)
A Bayesian Framework for Human-AI Collaboration: Complementarity and Correlation Neglect
par: Amin, Saurabh, et autres
Publié: (2026)
par: Amin, Saurabh, et autres
Publié: (2026)
Addressing misspecification in contextual optimization
par: Bennouna, Omar, et autres
Publié: (2024)
par: Bennouna, Omar, et autres
Publié: (2024)
How AI Aggregation Affects Knowledge
par: Acemoglu, Daron, et autres
Publié: (2026)
par: Acemoglu, Daron, et autres
Publié: (2026)
What Data Enables Optimal Decisions? An Exact Characterization for Linear Optimization
par: Bennouna, Omar, et autres
Publié: (2025)
par: Bennouna, Omar, et autres
Publié: (2025)
Data Informativeness in Linear Optimization under Uncertainty
par: Bennouna, Omar, et autres
Publié: (2026)
par: Bennouna, Omar, et autres
Publié: (2026)
SafeSearch: Do Not Trade Safety for Utility in LLM Search Agents
par: Zhan, Qiusi, et autres
Publié: (2025)
par: Zhan, Qiusi, et autres
Publié: (2025)
An Effective Energy Mask-based Adversarial Evasion Attacks against Misclassification in Speaker Recognition Systems
par: Park, Chanwoo, et autres
Publié: (2026)
par: Park, Chanwoo, et autres
Publié: (2026)
Reasoning-Based Approach with Chain-of-Thought for Alzheimer's Detection Using Speech and Large Language Models
par: Park, Chanwoo, et autres
Publié: (2025)
par: Park, Chanwoo, et autres
Publié: (2025)
Graph Elicitation for Guiding Multi-Step Reasoning in Large Language Models
par: Park, Jinyoung, et autres
Publié: (2023)
par: Park, Jinyoung, et autres
Publié: (2023)
Zeroth-Order Constrained Optimization from a Control Perspective via Feedback Linearization
par: Zhang, Runyu, et autres
Publié: (2025)
par: Zhang, Runyu, et autres
Publié: (2025)
Matching of Users and Creators in Two-Sided Markets with Departures
par: Huttenlocher, Daniel, et autres
Publié: (2023)
par: Huttenlocher, Daniel, et autres
Publié: (2023)
Optimal interventions in opinion dynamics on large-scale, time-varying, random networks
par: Cianfanelli, Leonardo, et autres
Publié: (2025)
par: Cianfanelli, Leonardo, et autres
Publié: (2025)
Enhancing Robustness in Incremental Learning with Adversarial Training
par: Cho, Seungju, et autres
Publié: (2023)
par: Cho, Seungju, et autres
Publié: (2023)
Enhancing Pre‐Service Teachers' Understanding of Quadrilaterals Through Wiki‐Supported Collaborative Learning
par: Asuman Duatepe‐Paksu
Publié: (2026)
par: Asuman Duatepe‐Paksu
Publié: (2026)
Prism: Spectral Parameter Sharing for Multi-Agent Reinforcement Learning
par: Kim, Kyungbeom, et autres
Publié: (2026)
par: Kim, Kyungbeom, et autres
Publié: (2026)
Co-Learning: Code Learning for Multi-Agent Reinforcement Collaborative Framework with Conversational Natural Language Interfaces
par: Yu, Jiapeng, et autres
Publié: (2024)
par: Yu, Jiapeng, et autres
Publié: (2024)
Wikipedia Contributions in the Wake of ChatGPT
par: Lyu, Liang, et autres
Publié: (2025)
par: Lyu, Liang, et autres
Publié: (2025)
Documents similaires
-
Post-Training LLMs as Better Decision-Making Agents: A Regret-Minimization Approach
par: Park, Chanwoo, et autres
Publié: (2025) -
Multi-Player Zero-Sum Markov Games with Networked Separable Interactions
par: Park, Chanwoo, et autres
Publié: (2023) -
Do LLM Agents Have Regret? A Case Study in Online Learning and Games
par: Park, Chanwoo, et autres
Publié: (2024) -
RLHF from Heterogeneous Feedback via Personalization and Preference Aggregation
par: Park, Chanwoo, et autres
Publié: (2024) -
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints
par: Ozdaglar, Asuman, et autres
Publié: (2022)