Partition Function Estimation under Bounded f-Divergence
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Block, Adam, Shetty, Abhishek |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Small Loss Bounds for Online Learning Separated Function Classes: A Gaussian Process Perspective
par: Block, Adam, et autres
Publié: (2025)
par: Block, Adam, et autres
Publié: (2025)
On the Performance of Empirical Risk Minimization with Smoothed Data
par: Block, Adam, et autres
Publié: (2024)
par: Block, Adam, et autres
Publié: (2024)
Oracle-Efficient Differentially Private Learning with Public Data
par: Block, Adam, et autres
Publié: (2024)
par: Block, Adam, et autres
Publié: (2024)
Sample Complexity Bounds for Estimating Probability Divergences under Invariances
par: Tahmasebi, Behrooz, et autres
Publié: (2023)
par: Tahmasebi, Behrooz, et autres
Publié: (2023)
Is Multi-Distribution Learning as Easy as PAC Learning: Sharp Rates with Bounded Label Noise
par: Hanashiro, Rafael, et autres
Publié: (2026)
par: Hanashiro, Rafael, et autres
Publié: (2026)
Beyond Worst-Case Online Classification: VC-Based Regret Bounds for Relaxed Benchmarks
par: Montasser, Omar, et autres
Publié: (2025)
par: Montasser, Omar, et autres
Publié: (2025)
Bounding Neyman-Pearson Region with $f$-Divergences
par: Mullhaupt, Andrew, et autres
Publié: (2025)
par: Mullhaupt, Andrew, et autres
Publié: (2025)
Characterizing Online and Private Learnability under Distributional Constraints via Generalized Smoothness
par: Blanchard, Moïse, et autres
Publié: (2026)
par: Blanchard, Moïse, et autres
Publié: (2026)
Loss Functions and Operators Generated by f-Divergences
par: Roulet, Vincent, et autres
Publié: (2025)
par: Roulet, Vincent, et autres
Publié: (2025)
The Sample Complexity of Approximate Rejection Sampling with Applications to Smoothed Online Learning
par: Block, Adam, et autres
Publié: (2023)
par: Block, Adam, et autres
Publié: (2023)
Regularized $f$-Divergence Kernel Tests
par: Ribero, Mónica, et autres
Publié: (2026)
par: Ribero, Mónica, et autres
Publié: (2026)
On Weak-to-Strong Generalization and f-Divergence
par: Yao, Wei, et autres
Publié: (2025)
par: Yao, Wei, et autres
Publié: (2025)
Mutual Information Estimation via $f$-Divergence and Data Derangements
par: Letizia, Nunzio A., et autres
Publié: (2023)
par: Letizia, Nunzio A., et autres
Publié: (2023)
Empirical Risk Minimization with $f$-Divergence Regularization
par: Daunas, Francisco, et autres
Publié: (2026)
par: Daunas, Francisco, et autres
Publié: (2026)
Minimizing $f$-Divergences by Interpolating Velocity Fields
par: Liu, Song, et autres
Publié: (2023)
par: Liu, Song, et autres
Publié: (2023)
Revisiting the (Sub)Optimality of Best-of-N for Inference-Time Alignment
par: Sriraman, Ved, et autres
Publié: (2026)
par: Sriraman, Ved, et autres
Publié: (2026)
EMA Without the Lag: Bias-Corrected Iterate Averaging Schemes
par: Block, Adam, et autres
Publié: (2025)
par: Block, Adam, et autres
Publié: (2025)
Displacement-Resistant Extensions of DPO with Nonconvex $f$-Divergences
par: Pipano, Idan, et autres
Publié: (2026)
par: Pipano, Idan, et autres
Publié: (2026)
Risk Bounds for Mixture Density Estimation on Compact Domains via the $h$-Lifted Kullback--Leibler Divergence
par: Chong, Mark Chiu, et autres
Publié: (2024)
par: Chong, Mark Chiu, et autres
Publié: (2024)
Smoothed Online Learning for Prediction in Piecewise Affine Systems
par: Block, Adam, et autres
Publié: (2023)
par: Block, Adam, et autres
Publié: (2023)
Oracle-Efficient Smoothed Online Learning for Piecewise Continuous Decision Making
par: Block, Adam, et autres
Publié: (2023)
par: Block, Adam, et autres
Publié: (2023)
Robust Semi-supervised Learning via $f$-Divergence and $α$-Rényi Divergence
par: Aminian, Gholamali, et autres
Publié: (2024)
par: Aminian, Gholamali, et autres
Publié: (2024)
Omnipredictors for Regression and the Approximate Rank of Convex Functions
par: Gopalan, Parikshit, et autres
Publié: (2024)
par: Gopalan, Parikshit, et autres
Publié: (2024)
Generalization Error of $f$-Divergence Stabilized Algorithms via Duality
par: Daunas, Francisco, et autres
Publié: (2025)
par: Daunas, Francisco, et autres
Publié: (2025)
A Neural Network Algorithm for KL Divergence Estimation with Quantitative Error Bounds
par: Foss, Mikil, et autres
Publié: (2025)
par: Foss, Mikil, et autres
Publié: (2025)
Sequences of Logits Reveal the Low Rank Structure of Language Models
par: Golowich, Noah, et autres
Publié: (2025)
par: Golowich, Noah, et autres
Publié: (2025)
From Curiosity to Caution: Mitigating Reward Hacking for Best-of-N with Pessimism
par: Yu, Zhuohao, et autres
Publié: (2026)
par: Yu, Zhuohao, et autres
Publié: (2026)
Regularization via f-Divergence: An Application to Multi-Oxide Spectroscopic Analysis
par: Li, Weizhi, et autres
Publié: (2025)
par: Li, Weizhi, et autres
Publié: (2025)
Learning with Monotone Adversarial Corruptions
par: Larsen, Kasper Green, et autres
Publié: (2026)
par: Larsen, Kasper Green, et autres
Publié: (2026)
Provably Learning from Modern Language Models via Low Logit Rank
par: Golowich, Noah, et autres
Publié: (2025)
par: Golowich, Noah, et autres
Publié: (2025)
Machine Unlearning under Overparameterization
par: Block, Jacob L., et autres
Publié: (2025)
par: Block, Jacob L., et autres
Publié: (2025)
A Dual Optimization View to Empirical Risk Minimization with f-Divergence Regularization
par: Daunas, Francisco, et autres
Publié: (2025)
par: Daunas, Francisco, et autres
Publié: (2025)
The Space Complexity of Learning-Unlearning Algorithms
par: Cherapanamjeri, Yeshwanth, et autres
Publié: (2025)
par: Cherapanamjeri, Yeshwanth, et autres
Publié: (2025)
$f$-Divergence Based Classification: Beyond the Use of Cross-Entropy
par: Novello, Nicola, et autres
Publié: (2024)
par: Novello, Nicola, et autres
Publié: (2024)
Equivalence of the Empirical Risk Minimization to Regularization on the Family of f-Divergences
par: Daunas, Francisco, et autres
Publié: (2024)
par: Daunas, Francisco, et autres
Publié: (2024)
Computational-Statistical Tradeoffs at the Next-Token Prediction Barrier: Autoregressive and Imitation Learning under Misspecification
par: Rohatgi, Dhruv, et autres
Publié: (2025)
par: Rohatgi, Dhruv, et autres
Publié: (2025)
Adversarial Resilience in Sequential Prediction via Abstention
par: Goel, Surbhi, et autres
Publié: (2023)
par: Goel, Surbhi, et autres
Publié: (2023)
Tolerant Algorithms for Learning with Arbitrary Covariate Shift
par: Goel, Surbhi, et autres
Publié: (2024)
par: Goel, Surbhi, et autres
Publié: (2024)
f-GRPO and Beyond: Divergence-Based Reinforcement Learning Algorithms for General LLM Alignment
par: Haldar, Rajdeep, et autres
Publié: (2026)
par: Haldar, Rajdeep, et autres
Publié: (2026)
Universal Dynamic Regret and Constraint Violation Bounds for Constrained Online Convex Optimization
par: Supantha, Subhamon, et autres
Publié: (2025)
par: Supantha, Subhamon, et autres
Publié: (2025)
Documents similaires
-
Small Loss Bounds for Online Learning Separated Function Classes: A Gaussian Process Perspective
par: Block, Adam, et autres
Publié: (2025) -
On the Performance of Empirical Risk Minimization with Smoothed Data
par: Block, Adam, et autres
Publié: (2024) -
Oracle-Efficient Differentially Private Learning with Public Data
par: Block, Adam, et autres
Publié: (2024) -
Sample Complexity Bounds for Estimating Probability Divergences under Invariances
par: Tahmasebi, Behrooz, et autres
Publié: (2023) -
Is Multi-Distribution Learning as Easy as PAC Learning: Sharp Rates with Bounded Label Noise
par: Hanashiro, Rafael, et autres
Publié: (2026)