Simultaneous Training of First- and Second-Order Optimizers in Population-Based Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Pfeiffer, Felix, Eivazi, Shahram |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generalized Population-Based Training for Hyperparameter Optimization in Reinforcement Learning
di: Bai, Hui, et al.
Pubblicazione: (2024)
di: Bai, Hui, et al.
Pubblicazione: (2024)
Comparing BFGS and OGR for Second-Order Optimization
di: Przybysz, Adrian, et al.
Pubblicazione: (2025)
di: Przybysz, Adrian, et al.
Pubblicazione: (2025)
Second-Order Convergence in Private Stochastic Non-Convex Optimization
di: Tao, Youming, et al.
Pubblicazione: (2025)
di: Tao, Youming, et al.
Pubblicazione: (2025)
Train Less, Learn More: Adaptive Efficient Rollout Optimization for Group-Based Reinforcement Learning
di: Zhang, Zhi, et al.
Pubblicazione: (2026)
di: Zhang, Zhi, et al.
Pubblicazione: (2026)
A Spatiotemporal Radar-Based Precipitation Model for Water Level Prediction and Flood Forecasting
di: Dhankhar, Sakshi, et al.
Pubblicazione: (2025)
di: Dhankhar, Sakshi, et al.
Pubblicazione: (2025)
Dimer-Enhanced Optimization: A First-Order Approach to Escaping Saddle Points in Neural Network Training
di: Hu, Yue, et al.
Pubblicazione: (2025)
di: Hu, Yue, et al.
Pubblicazione: (2025)
Taming Preconditioner Drift: Unlocking the Potential of Second-Order Optimizers for Federated Learning on Non-IID Data
di: Liu, Junkang, et al.
Pubblicazione: (2026)
di: Liu, Junkang, et al.
Pubblicazione: (2026)
The Potential of Second-Order Optimization for LLMs: A Study with Full Gauss-Newton
di: Abreu, Natalie, et al.
Pubblicazione: (2025)
di: Abreu, Natalie, et al.
Pubblicazione: (2025)
A Second-Order Perspective on Model Compositionality and Incremental Learning
di: Porrello, Angelo, et al.
Pubblicazione: (2024)
di: Porrello, Angelo, et al.
Pubblicazione: (2024)
Beyond Training: Optimizing Reinforcement Learning Based Job Shop Scheduling Through Adaptive Action Sampling
di: de Puiseau, Constantin Waubert, et al.
Pubblicazione: (2024)
di: de Puiseau, Constantin Waubert, et al.
Pubblicazione: (2024)
Performance Optimization of Ratings-Based Reinforcement Learning
di: Rose, Evelyn, et al.
Pubblicazione: (2025)
di: Rose, Evelyn, et al.
Pubblicazione: (2025)
Beyond First-Order: Training LLMs with Stochastic Conjugate Subgradients and AdamW
di: Zhang, Di, et al.
Pubblicazione: (2025)
di: Zhang, Di, et al.
Pubblicazione: (2025)
Hierarchical Learning for Maze Navigation: Emergence of Mental Representations via Second-Order Learning
di: Manir, Shalima Binta, et al.
Pubblicazione: (2025)
di: Manir, Shalima Binta, et al.
Pubblicazione: (2025)
OptEx: Expediting First-Order Optimization with Approximately Parallelized Iterations
di: Shu, Yao, et al.
Pubblicazione: (2024)
di: Shu, Yao, et al.
Pubblicazione: (2024)
Value-Distributional Model-Based Reinforcement Learning
di: Luis, Carlos E., et al.
Pubblicazione: (2023)
di: Luis, Carlos E., et al.
Pubblicazione: (2023)
PB$^2$: Preference Space Exploration via Population-Based Methods in Preference-Based Reinforcement Learning
di: Driss, Brahim, et al.
Pubblicazione: (2025)
di: Driss, Brahim, et al.
Pubblicazione: (2025)
Learning to Optimize for Reinforcement Learning
di: Lan, Qingfeng, et al.
Pubblicazione: (2023)
di: Lan, Qingfeng, et al.
Pubblicazione: (2023)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
di: Hu, Kun, et al.
Pubblicazione: (2025)
di: Hu, Kun, et al.
Pubblicazione: (2025)
Kernelized Reinforcement Learning with Order Optimal Regret Bounds
di: Vakili, Sattar, et al.
Pubblicazione: (2023)
di: Vakili, Sattar, et al.
Pubblicazione: (2023)
An End-to-End Reinforcement Learning Based Approach for Micro-View Order-Dispatching in Ride-Hailing
di: Yue, Xinlang, et al.
Pubblicazione: (2024)
di: Yue, Xinlang, et al.
Pubblicazione: (2024)
Visual Perceptual to Conceptual First-Order Rule Learning Networks
di: Gao, Kun, et al.
Pubblicazione: (2026)
di: Gao, Kun, et al.
Pubblicazione: (2026)
Generative Pre-Trained Transformer for Symbolic Regression Base In-Context Reinforcement Learning
di: Li, Yanjie, et al.
Pubblicazione: (2024)
di: Li, Yanjie, et al.
Pubblicazione: (2024)
Explaining Predictive Uncertainty by Exposing Second-Order Effects
di: Bley, Florian, et al.
Pubblicazione: (2024)
di: Bley, Florian, et al.
Pubblicazione: (2024)
Second Order Bounds for Contextual Bandits with Function Approximation
di: Pacchiano, Aldo
Pubblicazione: (2024)
di: Pacchiano, Aldo
Pubblicazione: (2024)
Optimizing the Unknown: Black Box Bayesian Optimization with Energy-Based Model and Reinforcement Learning
di: Miao, Ruiyao, et al.
Pubblicazione: (2025)
di: Miao, Ruiyao, et al.
Pubblicazione: (2025)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
Phasic Diversity Optimization for Population-Based Reinforcement Learning
di: Jiang, Jingcheng, et al.
Pubblicazione: (2024)
di: Jiang, Jingcheng, et al.
Pubblicazione: (2024)
SORA: Free Second-Order Attacks in Fast Adversarial Training
di: Teymourian, Mazdak, et al.
Pubblicazione: (2026)
di: Teymourian, Mazdak, et al.
Pubblicazione: (2026)
Efficient Zero-Order Federated Finetuning of Language Models for Resource-Constrained Devices
di: Ahmed, Mohamed Aboelenien, et al.
Pubblicazione: (2025)
di: Ahmed, Mohamed Aboelenien, et al.
Pubblicazione: (2025)
Deep Multi-Objective Reinforcement Learning for Utility-Based Infrastructural Maintenance Optimization
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
di: van Remmerden, Jesse, et al.
Pubblicazione: (2024)
Multiobjective Hydropower Reservoir Operation Optimization with Transformer-Based Deep Reinforcement Learning
di: Wu, Rixin, et al.
Pubblicazione: (2023)
di: Wu, Rixin, et al.
Pubblicazione: (2023)
First Order Model-Based RL through Decoupled Backpropagation
di: Amigo, Joseph, et al.
Pubblicazione: (2025)
di: Amigo, Joseph, et al.
Pubblicazione: (2025)
Attention Mechanisms Don't Learn Additive Models: Rethinking Feature Importance for Transformers
di: Leemann, Tobias, et al.
Pubblicazione: (2024)
di: Leemann, Tobias, et al.
Pubblicazione: (2024)
Primitive Agentic First-Order Optimization
di: Sala, R.
Pubblicazione: (2024)
di: Sala, R.
Pubblicazione: (2024)
PAC-Bayesian Reinforcement Learning Trains Generalizable Policies
di: Zitouni, Abdelkrim, et al.
Pubblicazione: (2025)
di: Zitouni, Abdelkrim, et al.
Pubblicazione: (2025)
On the Interplay Between Sparsity and Training in Deep Reinforcement Learning
di: Davelouis, Fatima, et al.
Pubblicazione: (2025)
di: Davelouis, Fatima, et al.
Pubblicazione: (2025)
RLVR-World: Training World Models with Reinforcement Learning
di: Wu, Jialong, et al.
Pubblicazione: (2025)
di: Wu, Jialong, et al.
Pubblicazione: (2025)
Adaptive Cubic Regularized Second-Order Latent Factor Analysis Model
di: Wang, Jialiang, et al.
Pubblicazione: (2025)
di: Wang, Jialiang, et al.
Pubblicazione: (2025)
Gradient Alignment in Physics-informed Neural Networks: A Second-Order Optimization Perspective
di: Wang, Sifan, et al.
Pubblicazione: (2025)
di: Wang, Sifan, et al.
Pubblicazione: (2025)
OAT-Rephrase: Optimization-Aware Training Data Rephrasing for Zeroth-Order LLM Fine-Tuning
di: Long, Jikai, et al.
Pubblicazione: (2025)
di: Long, Jikai, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Generalized Population-Based Training for Hyperparameter Optimization in Reinforcement Learning
di: Bai, Hui, et al.
Pubblicazione: (2024) -
Comparing BFGS and OGR for Second-Order Optimization
di: Przybysz, Adrian, et al.
Pubblicazione: (2025) -
Second-Order Convergence in Private Stochastic Non-Convex Optimization
di: Tao, Youming, et al.
Pubblicazione: (2025) -
Train Less, Learn More: Adaptive Efficient Rollout Optimization for Group-Based Reinforcement Learning
di: Zhang, Zhi, et al.
Pubblicazione: (2026) -
A Spatiotemporal Radar-Based Precipitation Model for Water Level Prediction and Flood Forecasting
di: Dhankhar, Sakshi, et al.
Pubblicazione: (2025)