AM-PPO: (Advantage) Alpha-Modulation with Proximal Policy Optimization
Fuente:
arXiv
Salvato in:
| Autore principale: | Sane, Soham |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AlphaGrad: Non-Linear Gradient Normalization Optimizer
di: Sane, Soham
Pubblicazione: (2025)
di: Sane, Soham
Pubblicazione: (2025)
Proximal Policy Optimization with Evolutionary Mutations
di: Czworkowski, Casimir, et al.
Pubblicazione: (2026)
di: Czworkowski, Casimir, et al.
Pubblicazione: (2026)
AlphaEvolve: A coding agent for scientific and algorithmic discovery
di: Novikov, Alexander, et al.
Pubblicazione: (2025)
di: Novikov, Alexander, et al.
Pubblicazione: (2025)
Can We Optimize Deep RL Policy Weights as Trajectory Modeling?
di: Tang, Hongyao
Pubblicazione: (2025)
di: Tang, Hongyao
Pubblicazione: (2025)
The Alpha-Alternator: Dynamic Adaptation To Varying Noise Levels In Sequences Using The Vendi Score For Improved Robustness and Performance
di: Rezaei, Mohammad Reza, et al.
Pubblicazione: (2025)
di: Rezaei, Mohammad Reza, et al.
Pubblicazione: (2025)
On-line Policy Improvement using Monte-Carlo Search
di: Tesauro, Gerald, et al.
Pubblicazione: (2025)
di: Tesauro, Gerald, et al.
Pubblicazione: (2025)
Discovering Effective Policies for Land-Use Planning with Neuroevolution
di: Young, Daniel, et al.
Pubblicazione: (2023)
di: Young, Daniel, et al.
Pubblicazione: (2023)
Seemingly Redundant Modules Enhance Robust Odor Learning in Fruit Flies
di: Li, Haiyang, et al.
Pubblicazione: (2025)
di: Li, Haiyang, et al.
Pubblicazione: (2025)
Robust Lagrangian and Adversarial Policy Gradient for Robust Constrained Markov Decision Processes
di: Bossens, David M.
Pubblicazione: (2023)
di: Bossens, David M.
Pubblicazione: (2023)
Vector Policy Optimization: Training for Diversity Improves Test-Time Search
di: Bahlous-Boldi, Ryan, et al.
Pubblicazione: (2026)
di: Bahlous-Boldi, Ryan, et al.
Pubblicazione: (2026)
Offline Multi-Objective Optimization
di: Xue, Ke, et al.
Pubblicazione: (2024)
di: Xue, Ke, et al.
Pubblicazione: (2024)
Surrogate Benchmarks for Model Merging Optimization
di: Akizuki, Rio, et al.
Pubblicazione: (2025)
di: Akizuki, Rio, et al.
Pubblicazione: (2025)
Few-shot Quality-Diversity Optimization
di: Salehi, Achkan, et al.
Pubblicazione: (2021)
di: Salehi, Achkan, et al.
Pubblicazione: (2021)
Reinforced In-Context Black-Box Optimization
di: Song, Lei, et al.
Pubblicazione: (2024)
di: Song, Lei, et al.
Pubblicazione: (2024)
Understanding Transformer Optimization via Gradient Heterogeneity
di: Tomihari, Akiyoshi, et al.
Pubblicazione: (2025)
di: Tomihari, Akiyoshi, et al.
Pubblicazione: (2025)
Automated Algorithm Design for Auto-Tuning Optimizers
di: Willemsen, Floris-Jan, et al.
Pubblicazione: (2025)
di: Willemsen, Floris-Jan, et al.
Pubblicazione: (2025)
Why Flow Matching is Particle Swarm Optimization?
di: Ouyang, Kaichen
Pubblicazione: (2025)
di: Ouyang, Kaichen
Pubblicazione: (2025)
Multi-Task Optimization over Networks of Tasks
di: Hatzky, Julian, et al.
Pubblicazione: (2026)
di: Hatzky, Julian, et al.
Pubblicazione: (2026)
Offline Model-Based Optimization by Learning to Rank
di: Tan, Rong-Xi, et al.
Pubblicazione: (2024)
di: Tan, Rong-Xi, et al.
Pubblicazione: (2024)
EOE: Evolutionary Optimization of Experts for Training Language Models
di: Chen, Yingshi
Pubblicazione: (2025)
di: Chen, Yingshi
Pubblicazione: (2025)
On Accelerating Edge AI: Optimizing Resource-Constrained Environments
di: Sander, Jacob, et al.
Pubblicazione: (2025)
di: Sander, Jacob, et al.
Pubblicazione: (2025)
Position: Leverage Foundational Models for Black-Box Optimization
di: Song, Xingyou, et al.
Pubblicazione: (2024)
di: Song, Xingyou, et al.
Pubblicazione: (2024)
A Simple and Efficient Approach to Batch Bayesian Optimization
di: Zhan, Dawei, et al.
Pubblicazione: (2024)
di: Zhan, Dawei, et al.
Pubblicazione: (2024)
Task-free Adaptive Meta Black-box Optimization
di: Wang, Chao, et al.
Pubblicazione: (2026)
di: Wang, Chao, et al.
Pubblicazione: (2026)
Multi-scale Topology Optimization using Neural Networks
di: Chen, Hongrui, et al.
Pubblicazione: (2024)
di: Chen, Hongrui, et al.
Pubblicazione: (2024)
Generalized Population-Based Training for Hyperparameter Optimization in Reinforcement Learning
di: Bai, Hui, et al.
Pubblicazione: (2024)
di: Bai, Hui, et al.
Pubblicazione: (2024)
An Improved Grey Wolf Optimization Algorithm for Heart Disease Prediction
di: Niu, Sihan, et al.
Pubblicazione: (2024)
di: Niu, Sihan, et al.
Pubblicazione: (2024)
MO-CAPO: Multi-Objective Cost-Aware Prompt Optimization
di: Büssing, Jan, et al.
Pubblicazione: (2026)
di: Büssing, Jan, et al.
Pubblicazione: (2026)
AutoQD: Automatic Discovery of Diverse Behaviors with Quality-Diversity Optimization
di: Hedayatian, Saeed, et al.
Pubblicazione: (2025)
di: Hedayatian, Saeed, et al.
Pubblicazione: (2025)
An Amortized Efficiency Threshold for Comparing Neural and Heuristic Solvers in Combinatorial Optimization
di: Afifi, Sohaib
Pubblicazione: (2026)
di: Afifi, Sohaib
Pubblicazione: (2026)
CATBench: A Compiler Autotuning Benchmarking Suite for Black-box Optimization
di: Tørring, Jacob O., et al.
Pubblicazione: (2024)
di: Tørring, Jacob O., et al.
Pubblicazione: (2024)
Neural Architecture Search using Particle Swarm and Ant Colony Optimization
di: Lankford, Séamus, et al.
Pubblicazione: (2024)
di: Lankford, Séamus, et al.
Pubblicazione: (2024)
Closing the gap: Optimizing Guidance and Control Networks through Neural ODEs
di: Origer, Sebastien, et al.
Pubblicazione: (2024)
di: Origer, Sebastien, et al.
Pubblicazione: (2024)
Brain-inspired Chaotic Graph Backpropagation for Large-scale Combinatorial Optimization
di: Tao, Peng, et al.
Pubblicazione: (2024)
di: Tao, Peng, et al.
Pubblicazione: (2024)
Beyond Single-Model Optimization: Preserving Plasticity in Continual Reinforcement Learning
di: Lillo, Lute, et al.
Pubblicazione: (2026)
di: Lillo, Lute, et al.
Pubblicazione: (2026)
GigaEvo: An Open Source Optimization Framework Powered By LLMs And Evolution Algorithms
di: Khrulkov, Valentin, et al.
Pubblicazione: (2025)
di: Khrulkov, Valentin, et al.
Pubblicazione: (2025)
Agent-GWO: Collaborative Agents for Dynamic Prompt Optimization in Large Language Models
di: Wang, Xudong, et al.
Pubblicazione: (2026)
di: Wang, Xudong, et al.
Pubblicazione: (2026)
Applications of Nature-Inspired Metaheuristic Algorithms for Tackling Optimization Problems Across Disciplines
di: Cui, Elvis Han, et al.
Pubblicazione: (2023)
di: Cui, Elvis Han, et al.
Pubblicazione: (2023)
A Firefly Algorithm for Mixed-Variable Optimization Based on Hybrid Distance Modeling
di: Bechir, Ousmane Tom, et al.
Pubblicazione: (2026)
di: Bechir, Ousmane Tom, et al.
Pubblicazione: (2026)
Enhancing Cross Entropy with a Linearly Adaptive Loss Function for Optimized Classification Performance
di: Shim, Jae Wan
Pubblicazione: (2025)
di: Shim, Jae Wan
Pubblicazione: (2025)
Documenti analoghi
-
AlphaGrad: Non-Linear Gradient Normalization Optimizer
di: Sane, Soham
Pubblicazione: (2025) -
Proximal Policy Optimization with Evolutionary Mutations
di: Czworkowski, Casimir, et al.
Pubblicazione: (2026) -
AlphaEvolve: A coding agent for scientific and algorithmic discovery
di: Novikov, Alexander, et al.
Pubblicazione: (2025) -
Can We Optimize Deep RL Policy Weights as Trajectory Modeling?
di: Tang, Hongyao
Pubblicazione: (2025) -
The Alpha-Alternator: Dynamic Adaptation To Varying Noise Levels In Sequences Using The Vendi Score For Improved Robustness and Performance
di: Rezaei, Mohammad Reza, et al.
Pubblicazione: (2025)