Salvato in:
| Autori principali: | Sokolov, Georgy, Thiessen, Maximilian, Akhmejanova, Margarita, Vitale, Fabio, Orabona, Francesco |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2409.01428 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Finite-Time Analysis of TD Learning with Linear Function Approximation without Projections or Strong Convexity
di: Lee, Wei-Cheng, et al.
Pubblicazione: (2025)
di: Lee, Wei-Cheng, et al.
Pubblicazione: (2025)
A Modern Introduction to Online Learning
di: Orabona, Francesco
Pubblicazione: (2019)
di: Orabona, Francesco
Pubblicazione: (2019)
From Betting to Empirical Bernstein LIL
di: Orabona, Francesco
Pubblicazione: (2026)
di: Orabona, Francesco
Pubblicazione: (2026)
A Note on How to Remove the $\ln\ln T$ Term from the Squint Bound
di: Orabona, Francesco
Pubblicazione: (2026)
di: Orabona, Francesco
Pubblicazione: (2026)
New Lower Bounds for Stochastic Non-Convex Optimization through Divergence Decomposition
di: Saad, El Mehdi, et al.
Pubblicazione: (2025)
di: Saad, El Mehdi, et al.
Pubblicazione: (2025)
Efficient Algorithms for Learning Monophonic Halfspaces in Graphs
di: Bressan, Marco, et al.
Pubblicazione: (2024)
di: Bressan, Marco, et al.
Pubblicazione: (2024)
STaR-Bets: Sequential Target-Recalculating Bets for Tighter Confidence Intervals
di: Voráček, Václav, et al.
Pubblicazione: (2025)
di: Voráček, Václav, et al.
Pubblicazione: (2025)
Square$χ$PO: Differentially Private and Robust $χ^2$-Preference Optimization in Offline Direct Alignment
di: Zhou, Xingyu, et al.
Pubblicazione: (2025)
di: Zhou, Xingyu, et al.
Pubblicazione: (2025)
An Equivalence Between Static and Dynamic Regret Minimization
di: Jacobsen, Andrew, et al.
Pubblicazione: (2024)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2024)
Bandits with Abstention under Expert Advice
di: Pasteris, Stephen, et al.
Pubblicazione: (2024)
di: Pasteris, Stephen, et al.
Pubblicazione: (2024)
New Perspectives on the Polyak Stepsize: Surrogate Functions and Negative Results
di: Orabona, Francesco, et al.
Pubblicazione: (2025)
di: Orabona, Francesco, et al.
Pubblicazione: (2025)
A Best-of-Both-Worlds Proof for Tsallis-INF without Fenchel Conjugates
di: Lee, Wei-Cheng, et al.
Pubblicazione: (2025)
di: Lee, Wei-Cheng, et al.
Pubblicazione: (2025)
Online Conformal Prediction via Universal Portfolio Algorithms
di: Liu, Tuo, et al.
Pubblicazione: (2026)
di: Liu, Tuo, et al.
Pubblicazione: (2026)
Efficient Algorithms for Learning and Compressing Monophonic Halfspaces in Graphs
di: Bressan, Marco, et al.
Pubblicazione: (2025)
di: Bressan, Marco, et al.
Pubblicazione: (2025)
A Unified Theoretical Analysis of Private and Robust Offline Alignment: from RLHF to DPO
di: Zhou, Xingyu, et al.
Pubblicazione: (2025)
di: Zhou, Xingyu, et al.
Pubblicazione: (2025)
Optimal Stochastic Non-smooth Non-convex Optimization through Online-to-Non-convex Conversion
di: Cutkosky, Ashok, et al.
Pubblicazione: (2023)
di: Cutkosky, Ashok, et al.
Pubblicazione: (2023)
Fast and Effective GNN Training through Sequences of Random Path Graphs
di: Bonchi, Francesco, et al.
Pubblicazione: (2023)
di: Bonchi, Francesco, et al.
Pubblicazione: (2023)
Dynamic Regret Reduces to Kernelized Static Regret
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025)
di: Jacobsen, Andrew, et al.
Pubblicazione: (2025)
Offline and Online KL-Regularized RLHF under Differential Privacy
di: Wu, Yulian, et al.
Pubblicazione: (2025)
di: Wu, Yulian, et al.
Pubblicazione: (2025)
ATA: Adaptive Task Allocation for Efficient Resource Management in Distributed Machine Learning
di: Maranjyan, Artavazd, et al.
Pubblicazione: (2025)
di: Maranjyan, Artavazd, et al.
Pubblicazione: (2025)
Beyond the Ideal: Analyzing the Inexact Muon Update
di: Shulgin, Egor, et al.
Pubblicazione: (2025)
di: Shulgin, Egor, et al.
Pubblicazione: (2025)
Better-than-KL PAC-Bayes Bounds
di: Kuzborskij, Ilja, et al.
Pubblicazione: (2024)
di: Kuzborskij, Ilja, et al.
Pubblicazione: (2024)
Adaptive Identification and Modeling of Clinical Pathways with Process Mining
di: Vitale, Francesco, et al.
Pubblicazione: (2025)
di: Vitale, Francesco, et al.
Pubblicazione: (2025)
An Approximation Algorithm for Graph Label Selection
di: John, Josia, et al.
Pubblicazione: (2026)
di: John, Josia, et al.
Pubblicazione: (2026)
Learning Conditional Averages
di: Bressan, Marco, et al.
Pubblicazione: (2026)
di: Bressan, Marco, et al.
Pubblicazione: (2026)
Fractional hypergraph coloring
di: Akhmejanova, Margarita, et al.
Pubblicazione: (2025)
di: Akhmejanova, Margarita, et al.
Pubblicazione: (2025)
On the upper tail of star counts in random graphs
di: Akhmejanova, Margarita, et al.
Pubblicazione: (2025)
di: Akhmejanova, Margarita, et al.
Pubblicazione: (2025)
Run-Time Monitoring of ERTMS/ETCS Control Flow by Process Mining
di: Vitale, Francesco, et al.
Pubblicazione: (2025)
di: Vitale, Francesco, et al.
Pubblicazione: (2025)
Quantum Graph Attention Networks: Trainable Quantum Encoders for Inductive Graph Learning
di: Faria, Arthur M., et al.
Pubblicazione: (2025)
di: Faria, Arthur M., et al.
Pubblicazione: (2025)
Optimal Regret of Bernoulli Bandits under Global Differential Privacy
di: Azize, Achraf, et al.
Pubblicazione: (2025)
di: Azize, Achraf, et al.
Pubblicazione: (2025)
Architecting software monitors for control-flow anomaly detection through large language models and conformance checking
di: Vitale, Francesco, et al.
Pubblicazione: (2025)
di: Vitale, Francesco, et al.
Pubblicazione: (2025)
Dynamic Risk Assessment by Bayesian Attack Graphs and Process Mining
di: Vitale, Francesco, et al.
Pubblicazione: (2026)
di: Vitale, Francesco, et al.
Pubblicazione: (2026)
Graph-Based Uncertainty-Aware Self-Training with Stochastic Node Labeling
di: Liu, Tom, et al.
Pubblicazione: (2025)
di: Liu, Tom, et al.
Pubblicazione: (2025)
The Dimension of Self-Directed Learning
di: Devulapalli, Pramith, et al.
Pubblicazione: (2024)
di: Devulapalli, Pramith, et al.
Pubblicazione: (2024)
Affinity Graph Connectivity in Convex Clustering
di: Rosen, Sam, et al.
Pubblicazione: (2026)
di: Rosen, Sam, et al.
Pubblicazione: (2026)
Parameter-Free Dynamic Regret for Unconstrained Linear Bandits
di: Rumi, Alberto, et al.
Pubblicazione: (2026)
di: Rumi, Alberto, et al.
Pubblicazione: (2026)
Graph Partial Label Learning with Potential Cause Discovering
di: Gao, Hang, et al.
Pubblicazione: (2024)
di: Gao, Hang, et al.
Pubblicazione: (2024)
Learning Multi-Attribute Differential Graphs with Non-Convex Penalties
di: Tugnait, Jitendra K
Pubblicazione: (2025)
di: Tugnait, Jitendra K
Pubblicazione: (2025)
Convolutional Learning on Directed Acyclic Graphs
di: Rey, Samuel, et al.
Pubblicazione: (2024)
di: Rey, Samuel, et al.
Pubblicazione: (2024)
From Distance to Direction: Structure-aware Label-specific Feature Fusion for Label Distribution Learning
di: Xu, Suping, et al.
Pubblicazione: (2025)
di: Xu, Suping, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Finite-Time Analysis of TD Learning with Linear Function Approximation without Projections or Strong Convexity
di: Lee, Wei-Cheng, et al.
Pubblicazione: (2025) -
A Modern Introduction to Online Learning
di: Orabona, Francesco
Pubblicazione: (2019) -
From Betting to Empirical Bernstein LIL
di: Orabona, Francesco
Pubblicazione: (2026) -
A Note on How to Remove the $\ln\ln T$ Term from the Squint Bound
di: Orabona, Francesco
Pubblicazione: (2026) -
New Lower Bounds for Stochastic Non-Convex Optimization through Divergence Decomposition
di: Saad, El Mehdi, et al.
Pubblicazione: (2025)