Enregistré dans:
| Auteurs principaux: | Frankel, Eric, Chen, Sitan, Li, Jerry, Koh, Pang Wei, Ratliff, Lillian J., Oh, Sewoong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.17423 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PLeaS -- Merging Models with Permutations and Least Squares
par: Nasery, Anshul, et autres
Publié: (2024)
par: Nasery, Anshul, et autres
Publié: (2024)
Optimal Inference Schedules for Masked Diffusion Models
par: Chen, Sitan, et autres
Publié: (2025)
par: Chen, Sitan, et autres
Publié: (2025)
dUltra: Ultra-Fast Diffusion Language Models via Reinforcement Learning
par: Chen, Shirui, et autres
Publié: (2025)
par: Chen, Shirui, et autres
Publié: (2025)
Principal-Agent Bandit Games with Self-Interested and Exploratory Learning Agents
par: Liu, Junyan, et autres
Publié: (2024)
par: Liu, Junyan, et autres
Publié: (2024)
Adaptive Calibration in Non-Stationary Environments
par: Liu, Junyan, et autres
Publié: (2026)
par: Liu, Junyan, et autres
Publié: (2026)
An optimal tradeoff between entanglement and copy complexity for state tomography
par: Chen, Sitan, et autres
Publié: (2024)
par: Chen, Sitan, et autres
Publié: (2024)
Optimal high-precision shadow estimation
par: Chen, Sitan, et autres
Publié: (2024)
par: Chen, Sitan, et autres
Publié: (2024)
Strategically Robust Multi-Agent Reinforcement Learning with Linear Function Approximation
par: Gonzales, Jake, et autres
Publié: (2026)
par: Gonzales, Jake, et autres
Publié: (2026)
Dynamics of Learning under User Choice: Overspecialization and Peer-Model Probing
par: Narang, Adhyyan, et autres
Publié: (2026)
par: Narang, Adhyyan, et autres
Publié: (2026)
On the Limitations and Possibilities of Nash Regret Minimization in Zero-Sum Matrix Games under Noisy Feedback
par: Maiti, Arnab, et autres
Publié: (2023)
par: Maiti, Arnab, et autres
Publié: (2023)
Multilingual Diversity Improves Vision-Language Representations
par: Nguyen, Thao, et autres
Publié: (2024)
par: Nguyen, Thao, et autres
Publié: (2024)
Understanding the Gain from Data Filtering in Multimodal Contrastive Learning
par: Pareek, Divyansh, et autres
Publié: (2025)
par: Pareek, Divyansh, et autres
Publié: (2025)
Understanding the Gains from Repeated Self-Distillation
par: Pareek, Divyansh, et autres
Publié: (2024)
par: Pareek, Divyansh, et autres
Publié: (2024)
Convergence Analysis of Gradient-Based Learning with Non-Uniform Learning Rates in Non-Cooperative Multi-Agent Settings
par: Chasnov, Benjamin, et autres
Publié: (2019)
par: Chasnov, Benjamin, et autres
Publié: (2019)
Convergence of Learning Dynamics in Stackelberg Games
par: Fiez, Tanner, et autres
Publié: (2019)
par: Fiez, Tanner, et autres
Publié: (2019)
A Learning Algorithm That Attains the Human Optimum in a Repeated Human-Machine Interaction Game
par: Isa, Jason T., et autres
Publié: (2025)
par: Isa, Jason T., et autres
Publié: (2025)
Sample Complexity Reduction via Policy Difference Estimation in Tabular Reinforcement Learning
par: Narang, Adhyyan, et autres
Publié: (2024)
par: Narang, Adhyyan, et autres
Publié: (2024)
Randomization Techniques to Mitigate the Risk of Copyright Infringement
par: Chen, Wei-Ning, et autres
Publié: (2024)
par: Chen, Wei-Ning, et autres
Publié: (2024)
A False Sense of Privacy: Evaluating Textual Data Sanitization Beyond Surface-level Privacy Leakage
par: Xin, Rui, et autres
Publié: (2025)
par: Xin, Rui, et autres
Publié: (2025)
Provably learning a multi-head attention layer
par: Chen, Sitan, et autres
Publié: (2024)
par: Chen, Sitan, et autres
Publié: (2024)
Online Learning for Uninformed Markov Games: Empirical Nash-Value Regret and Non-Stationarity Adaptation
par: Liu, Junyan, et autres
Publié: (2026)
par: Liu, Junyan, et autres
Publié: (2026)
Online SuBmodular + SuPermodular (BP) Maximization with Bandit Feedback
par: Narang, Adhyyan, et autres
Publié: (2022)
par: Narang, Adhyyan, et autres
Publié: (2022)
Selective Underfitting in Diffusion Models
par: Song, Kiwhan, et autres
Publié: (2025)
par: Song, Kiwhan, et autres
Publié: (2025)
Blink of an eye: a simple theory for feature localization in generative models
par: Li, Marvin, et autres
Publié: (2025)
par: Li, Marvin, et autres
Publié: (2025)
Faster Diffusion Sampling with Randomized Midpoints: Sequential and Parallel
par: Gupta, Shivam, et autres
Publié: (2024)
par: Gupta, Shivam, et autres
Publié: (2024)
Critical windows: non-asymptotic theory for feature emergence in diffusion models
par: Li, Marvin, et autres
Publié: (2024)
par: Li, Marvin, et autres
Publié: (2024)
Improved Regret and Contextual Linear Extension for Pandora's Box and Prophet Inequality
par: Liu, Junyan, et autres
Publié: (2025)
par: Liu, Junyan, et autres
Publié: (2025)
DiffuSolve: Diffusion-based Solver for Non-convex Trajectory Optimization
par: Li, Anjian, et autres
Publié: (2024)
par: Li, Anjian, et autres
Publié: (2024)
Efficient Near-Optimal Algorithm for Online Shortest Paths in Directed Acyclic Graphs with Bandit Feedback Against Adaptive Adversaries
par: Maiti, Arnab, et autres
Publié: (2025)
par: Maiti, Arnab, et autres
Publié: (2025)
On the Universal Near Optimality of Hedge in Combinatorial Settings
par: Fan, Zhiyuan, et autres
Publié: (2025)
par: Fan, Zhiyuan, et autres
Publié: (2025)
Learning to Incentivize in Repeated Principal-Agent Problems with Adversarial Agent Arrivals
par: Liu, Junyan, et autres
Publié: (2025)
par: Liu, Junyan, et autres
Publié: (2025)
Emergent specialization from participation dynamics and multi-learner retraining
par: Dean, Sarah, et autres
Publié: (2022)
par: Dean, Sarah, et autres
Publié: (2022)
Sampling from Your Language Model One Byte at a Time
par: Hayase, Jonathan, et autres
Publié: (2025)
par: Hayase, Jonathan, et autres
Publié: (2025)
Improved Communication-Privacy Trade-offs in $L_2$ Mean Estimation under Streaming Differential Privacy
par: Chen, Wei-Ning, et autres
Publié: (2024)
par: Chen, Wei-Ning, et autres
Publié: (2024)
DPZero: Private Fine-Tuning of Language Models without Backpropagation
par: Zhang, Liang, et autres
Publié: (2023)
par: Zhang, Liang, et autres
Publié: (2023)
ReGuidance: A Simple Diffusion Wrapper for Boosting Sample Quality on Hard Inverse Problems
par: Karan, Aayush, et autres
Publié: (2025)
par: Karan, Aayush, et autres
Publié: (2025)
Training AI to be Loyal
par: Oh, Sewoong, et autres
Publié: (2025)
par: Oh, Sewoong, et autres
Publié: (2025)
Train for the Worst, Plan for the Best: Understanding Token Ordering in Masked Diffusions
par: Kim, Jaeyeon, et autres
Publié: (2025)
par: Kim, Jaeyeon, et autres
Publié: (2025)
An Efficient Diffusion-based Non-Autoregressive Solver for Traveling Salesman Problem
par: Wang, Mingzhao, et autres
Publié: (2025)
par: Wang, Mingzhao, et autres
Publié: (2025)
Stop Training for the Worst: Progressive Unmasking Accelerates Masked Diffusion Training
par: Kim, Jaeyeon, et autres
Publié: (2026)
par: Kim, Jaeyeon, et autres
Publié: (2026)
Documents similaires
-
PLeaS -- Merging Models with Permutations and Least Squares
par: Nasery, Anshul, et autres
Publié: (2024) -
Optimal Inference Schedules for Masked Diffusion Models
par: Chen, Sitan, et autres
Publié: (2025) -
dUltra: Ultra-Fast Diffusion Language Models via Reinforcement Learning
par: Chen, Shirui, et autres
Publié: (2025) -
Principal-Agent Bandit Games with Self-Interested and Exploratory Learning Agents
par: Liu, Junyan, et autres
Publié: (2024) -
Adaptive Calibration in Non-Stationary Environments
par: Liu, Junyan, et autres
Publié: (2026)