Distributional value gradients for stochastic environments
Fuente:
arXiv
Salvato in:
| Autori principali: | Debes, Baptiste, Tuytelaars, Tinne |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multivariate Distributional Reinforcement Learning Using Sliced Divergences
di: Debes, Baptiste, et al.
Pubblicazione: (2026)
di: Debes, Baptiste, et al.
Pubblicazione: (2026)
Predicting the Susceptibility of Examples to Catastrophic Forgetting
di: Hacohen, Guy, et al.
Pubblicazione: (2024)
di: Hacohen, Guy, et al.
Pubblicazione: (2024)
Remembering by Reconstructing: Domain Incremental Learning With Test-Time Training on Video Streams
di: Swinnen, Jonathan, et al.
Pubblicazione: (2026)
di: Swinnen, Jonathan, et al.
Pubblicazione: (2026)
Collapse-Proof Non-Contrastive Self-Supervised Learning
di: Sansone, Emanuele, et al.
Pubblicazione: (2024)
di: Sansone, Emanuele, et al.
Pubblicazione: (2024)
Same accuracy, twice as fast: continuous training surpasses retraining from scratch
di: Verwimp, Eli, et al.
Pubblicazione: (2025)
di: Verwimp, Eli, et al.
Pubblicazione: (2025)
Eff-GRot: Efficient and Generalizable Rotation Estimation with Transformers
di: Mathioulakis, Fanis, et al.
Pubblicazione: (2025)
di: Mathioulakis, Fanis, et al.
Pubblicazione: (2025)
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
di: Araujo, Vladimir, et al.
Pubblicazione: (2024)
di: Araujo, Vladimir, et al.
Pubblicazione: (2024)
Unsupervised Parameter Efficient Source-free Post-pretraining
di: Jha, Abhishek, et al.
Pubblicazione: (2025)
di: Jha, Abhishek, et al.
Pubblicazione: (2025)
Putting a Face to Forgetting: Continual Learning meets Mechanistic Interpretability
di: Masip, Sergi, et al.
Pubblicazione: (2026)
di: Masip, Sergi, et al.
Pubblicazione: (2026)
Two Complementary Perspectives to Continual Learning: Ask Not Only What to Optimize, But Also How
di: Hess, Timm, et al.
Pubblicazione: (2023)
di: Hess, Timm, et al.
Pubblicazione: (2023)
DAVE: Diagnostic benchmark for Audio Visual Evaluation
di: Radevski, Gorjan, et al.
Pubblicazione: (2025)
di: Radevski, Gorjan, et al.
Pubblicazione: (2025)
Prediction Error-based Classification for Class-Incremental Learning
di: Zając, Michał, et al.
Pubblicazione: (2023)
di: Zając, Michał, et al.
Pubblicazione: (2023)
The Common Stability Mechanism behind most Self-Supervised Learning Approaches
di: Jha, Abhishek, et al.
Pubblicazione: (2024)
di: Jha, Abhishek, et al.
Pubblicazione: (2024)
Self-Learning for Personalized Keyword Spotting on Ultra-Low-Power Audio Sensors
di: Rusci, Manuele, et al.
Pubblicazione: (2024)
di: Rusci, Manuele, et al.
Pubblicazione: (2024)
Co-LoRA: Collaborative Model Personalization on Heterogeneous Multi-Modal Clients
di: Seo, Minhyuk, et al.
Pubblicazione: (2025)
di: Seo, Minhyuk, et al.
Pubblicazione: (2025)
Adversarial Dependence Minimization
di: De Plaen, Pierre-François, et al.
Pubblicazione: (2025)
di: De Plaen, Pierre-François, et al.
Pubblicazione: (2025)
Knowledge Accumulation in Continually Learned Representations and the Issue of Feature Forgetting
di: Hess, Timm, et al.
Pubblicazione: (2023)
di: Hess, Timm, et al.
Pubblicazione: (2023)
CrIBo: Self-Supervised Learning via Cross-Image Object-Level Bootstrapping
di: Lebailly, Tim, et al.
Pubblicazione: (2023)
di: Lebailly, Tim, et al.
Pubblicazione: (2023)
Continual Learning of Diffusion Models with Generative Distillation
di: Masip, Sergi, et al.
Pubblicazione: (2023)
di: Masip, Sergi, et al.
Pubblicazione: (2023)
Infinite dSprites for Disentangled Continual Learning: Separating Memory Edits from Generalization
di: Dziadzio, Sebastian, et al.
Pubblicazione: (2023)
di: Dziadzio, Sebastian, et al.
Pubblicazione: (2023)
Equivalence of stochastic and deterministic policy gradients
di: Todorov, Emo
Pubblicazione: (2025)
di: Todorov, Emo
Pubblicazione: (2025)
Implicit Gaussian Splatting with Efficient Multi-Level Tri-Plane Representation
di: Wu, Minye, et al.
Pubblicazione: (2024)
di: Wu, Minye, et al.
Pubblicazione: (2024)
Analysis of Spatial augmentation in Self-supervised models in the purview of training and test distributions
di: Jha, Abhishek, et al.
Pubblicazione: (2024)
di: Jha, Abhishek, et al.
Pubblicazione: (2024)
Optimal low-rank stochastic gradient estimation for LLM training
di: Li, Zehao, et al.
Pubblicazione: (2026)
di: Li, Zehao, et al.
Pubblicazione: (2026)
Almost sure convergence rates of stochastic gradient methods under gradient domination
di: Weissmann, Simon, et al.
Pubblicazione: (2024)
di: Weissmann, Simon, et al.
Pubblicazione: (2024)
A stochastic gradient method for trilevel optimization
di: Giovannelli, Tommaso, et al.
Pubblicazione: (2025)
di: Giovannelli, Tommaso, et al.
Pubblicazione: (2025)
Generalized EXTRA stochastic gradient Langevin dynamics
di: Gurbuzbalaban, Mert, et al.
Pubblicazione: (2024)
di: Gurbuzbalaban, Mert, et al.
Pubblicazione: (2024)
Overshoot: Taking advantage of future gradients in momentum-based stochastic optimization
di: Kopal, Jakub, et al.
Pubblicazione: (2025)
di: Kopal, Jakub, et al.
Pubblicazione: (2025)
Dealing with unbounded gradients in stochastic saddle-point optimization
di: Neu, Gergely, et al.
Pubblicazione: (2024)
di: Neu, Gergely, et al.
Pubblicazione: (2024)
JaxSGMC: Modular stochastic gradient MCMC in JAX
di: Thaler, Stephan, et al.
Pubblicazione: (2025)
di: Thaler, Stephan, et al.
Pubblicazione: (2025)
New logarithmic step size for stochastic gradient descent
di: Shamaee, M. Soheil, et al.
Pubblicazione: (2024)
di: Shamaee, M. Soheil, et al.
Pubblicazione: (2024)
Spectral alignment of stochastic gradient descent for high-dimensional classification tasks
di: Arous, Gerard Ben, et al.
Pubblicazione: (2023)
di: Arous, Gerard Ben, et al.
Pubblicazione: (2023)
Guided parallelized stochastic gradient descent for delay compensation
di: Sharma, Anuraganand
Pubblicazione: (2021)
di: Sharma, Anuraganand
Pubblicazione: (2021)
Small steps no more: Global convergence of stochastic gradient bandits for arbitrary learning rates
di: Mei, Jincheng, et al.
Pubblicazione: (2025)
di: Mei, Jincheng, et al.
Pubblicazione: (2025)
Acceleration of stochastic gradient descent with momentum by averaging: finite-sample rates and asymptotic normality
di: Tang, Kejie, et al.
Pubblicazione: (2023)
di: Tang, Kejie, et al.
Pubblicazione: (2023)
Data value estimation on private gradients
di: Zhou, Zijian, et al.
Pubblicazione: (2024)
di: Zhou, Zijian, et al.
Pubblicazione: (2024)
Unregularized limit of stochastic gradient method for Wasserstein distributionally robust optimization
di: Le, Tam
Pubblicazione: (2025)
di: Le, Tam
Pubblicazione: (2025)
One-step corrected projected stochastic gradient descent for statistical estimation
di: Brouste, Alexandre, et al.
Pubblicazione: (2023)
di: Brouste, Alexandre, et al.
Pubblicazione: (2023)
A stochastic gradient descent algorithm with random search directions
di: Gbaguidi, Eméric
Pubblicazione: (2025)
di: Gbaguidi, Eméric
Pubblicazione: (2025)
Universality of high-dimensional scaling limits of stochastic gradient descent
di: Gheissari, Reza, et al.
Pubblicazione: (2025)
di: Gheissari, Reza, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Multivariate Distributional Reinforcement Learning Using Sliced Divergences
di: Debes, Baptiste, et al.
Pubblicazione: (2026) -
Predicting the Susceptibility of Examples to Catastrophic Forgetting
di: Hacohen, Guy, et al.
Pubblicazione: (2024) -
Remembering by Reconstructing: Domain Incremental Learning With Test-Time Training on Video Streams
di: Swinnen, Jonathan, et al.
Pubblicazione: (2026) -
Collapse-Proof Non-Contrastive Self-Supervised Learning
di: Sansone, Emanuele, et al.
Pubblicazione: (2024) -
Same accuracy, twice as fast: continuous training surpasses retraining from scratch
di: Verwimp, Eli, et al.
Pubblicazione: (2025)