AdaMemento: Adaptive Memory-Assisted Policy Optimization for Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yan, Renye, Gan, Yaozhong, Wu, You, Xing, Junliang, Liangn, Ling, Zhu, Yeshang, Cai, Yimao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reflective Policy Optimization
di: Gan, Yaozhong, et al.
Pubblicazione: (2024)
di: Gan, Yaozhong, et al.
Pubblicazione: (2024)
The Exploration-Exploitation Dilemma Revisited: An Entropy Perspective
di: Yan, Renye, et al.
Pubblicazione: (2024)
di: Yan, Renye, et al.
Pubblicazione: (2024)
Transductive Off-policy Proximal Policy Optimization
di: Gan, Yaozhong, et al.
Pubblicazione: (2024)
di: Gan, Yaozhong, et al.
Pubblicazione: (2024)
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
di: Wu, Cuiling, et al.
Pubblicazione: (2025)
di: Wu, Cuiling, et al.
Pubblicazione: (2025)
Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?
di: Yan, Renye, et al.
Pubblicazione: (2026)
di: Yan, Renye, et al.
Pubblicazione: (2026)
Memento 2: Learning by Stateful Reflective Memory
di: Wang, Jun
Pubblicazione: (2025)
di: Wang, Jun
Pubblicazione: (2025)
AdaLomo: Low-memory Optimization with Adaptive Learning Rate
di: Lv, Kai, et al.
Pubblicazione: (2023)
di: Lv, Kai, et al.
Pubblicazione: (2023)
AdaMuon: Adaptive Muon Optimizer
di: Si, Chongjie, et al.
Pubblicazione: (2025)
di: Si, Chongjie, et al.
Pubblicazione: (2025)
Synergizing Reinforcement Learning and Genetic Algorithms for Neural Combinatorial Optimization
di: Gu, Shengda, et al.
Pubblicazione: (2025)
di: Gu, Shengda, et al.
Pubblicazione: (2025)
AdaCubic: An Adaptive Cubic Regularization Optimizer for Deep Learning
di: Tsingalis, Ioannis, et al.
Pubblicazione: (2026)
di: Tsingalis, Ioannis, et al.
Pubblicazione: (2026)
A Sanity Check for Multi-In-Domain Face Forgery Detection in the Real World
di: Cheng, Jikang, et al.
Pubblicazione: (2025)
di: Cheng, Jikang, et al.
Pubblicazione: (2025)
AdaFlow: Imitation Learning with Variance-Adaptive Flow-Based Policies
di: Hu, Xixi, et al.
Pubblicazione: (2024)
di: Hu, Xixi, et al.
Pubblicazione: (2024)
Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance
di: He, Jinmin, et al.
Pubblicazione: (2025)
di: He, Jinmin, et al.
Pubblicazione: (2025)
AdaCoT: Pareto-Optimal Adaptive Chain-of-Thought Triggering via Reinforcement Learning
di: Lou, Chenwei, et al.
Pubblicazione: (2025)
di: Lou, Chenwei, et al.
Pubblicazione: (2025)
AdaTKG: Adaptive Memory for Temporal Knowledge Graph Reasoning
di: Lee, Seunghan, et al.
Pubblicazione: (2026)
di: Lee, Seunghan, et al.
Pubblicazione: (2026)
AdaMuS: Adaptive Multi-view Sparsity Learning for Dimensionally Unbalanced Data
di: Xu, Cai, et al.
Pubblicazione: (2026)
di: Xu, Cai, et al.
Pubblicazione: (2026)
AdaFRUGAL: Adaptive Memory-Efficient Training with Dynamic Control
di: Bui, Quang-Hung, et al.
Pubblicazione: (2025)
di: Bui, Quang-Hung, et al.
Pubblicazione: (2025)
AdaCL:Adaptive Continual Learning
di: Yildirim, Elif Ceren Gok, et al.
Pubblicazione: (2023)
di: Yildirim, Elif Ceren Gok, et al.
Pubblicazione: (2023)
Memento-Skills: Let Agents Design Agents
di: Zhou, Huichi, et al.
Pubblicazione: (2026)
di: Zhou, Huichi, et al.
Pubblicazione: (2026)
Ada-MSHyper: Adaptive Multi-Scale Hypergraph Transformer for Time Series Forecasting
di: Shang, Zongjiang, et al.
Pubblicazione: (2024)
di: Shang, Zongjiang, et al.
Pubblicazione: (2024)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
di: Zhou, Huichi, et al.
Pubblicazione: (2025)
di: Zhou, Huichi, et al.
Pubblicazione: (2025)
AdaKernel: Learning Adaptive Kernel Parameters for Spatiotemporal Graph Neural Networks
di: Zhang, Zhongyue, et al.
Pubblicazione: (2026)
di: Zhang, Zhongyue, et al.
Pubblicazione: (2026)
BiBLDR: Bidirectional Behavior Learning for Drug Repositioning
di: Zhang, Renye, et al.
Pubblicazione: (2025)
di: Zhang, Renye, et al.
Pubblicazione: (2025)
Temperature as a Meta-Policy: Adaptive Temperature in LLM Reinforcement Learning
di: Dang, Haoran, et al.
Pubblicazione: (2026)
di: Dang, Haoran, et al.
Pubblicazione: (2026)
AdaCuRL: Adaptive Curriculum Reinforcement Learning with Invalid Sample Mitigation and Historical Revisiting
di: Li, Renda, et al.
Pubblicazione: (2025)
di: Li, Renda, et al.
Pubblicazione: (2025)
AdaMeZO: Adam-style Zeroth-Order Optimizer for LLM Fine-tuning Without Maintaining the Moments
di: Cai, Zhijie, et al.
Pubblicazione: (2026)
di: Cai, Zhijie, et al.
Pubblicazione: (2026)
BAPO: Stabilizing Off-Policy Reinforcement Learning for LLMs via Balanced Policy Optimization with Adaptive Clipping
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
AdaFair-MARL: Enforcing Adaptive Fairness Constraints in Multi-Agent Reinforcement Learning
di: Ekpo, Promise, et al.
Pubblicazione: (2025)
di: Ekpo, Promise, et al.
Pubblicazione: (2025)
AdaFisher: Adaptive Second Order Optimization via Fisher Information
di: Gomes, Damien Martins, et al.
Pubblicazione: (2024)
di: Gomes, Damien Martins, et al.
Pubblicazione: (2024)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2025)
MHPO: Modulated Hazard-aware Policy Optimization for Stable Reinforcement Learning
di: Wang, Hongjun, et al.
Pubblicazione: (2026)
di: Wang, Hongjun, et al.
Pubblicazione: (2026)
AdaRankGrad: Adaptive Gradient-Rank and Moments for Memory-Efficient LLMs Training and Fine-Tuning
di: Refael, Yehonathan, et al.
Pubblicazione: (2024)
di: Refael, Yehonathan, et al.
Pubblicazione: (2024)
Reinforce-Ada: An Adaptive Sampling Framework under Non-linear RL Objectives
di: Xiong, Wei, et al.
Pubblicazione: (2025)
di: Xiong, Wei, et al.
Pubblicazione: (2025)
On the Reuse Bias in Off-Policy Reinforcement Learning
di: Ying, Chengyang, et al.
Pubblicazione: (2022)
di: Ying, Chengyang, et al.
Pubblicazione: (2022)
AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering
di: Cai, Yuzhu, et al.
Pubblicazione: (2026)
di: Cai, Yuzhu, et al.
Pubblicazione: (2026)
Network Topology Optimization via Deep Reinforcement Learning
di: Li, Zhuoran, et al.
Pubblicazione: (2022)
di: Li, Zhuoran, et al.
Pubblicazione: (2022)
Adaptive Policy Synchronization for Scalable Reinforcement Learning
di: Lafuente-Mercado, Rodney
Pubblicazione: (2025)
di: Lafuente-Mercado, Rodney
Pubblicazione: (2025)
AdaER: An Adaptive Experience Replay Approach for Continual Lifelong Learning
di: Li, Xingyu, et al.
Pubblicazione: (2023)
di: Li, Xingyu, et al.
Pubblicazione: (2023)
Adaptive Scaling of Policy Constraints for Offline Reinforcement Learning
di: Jing, Tan, et al.
Pubblicazione: (2025)
di: Jing, Tan, et al.
Pubblicazione: (2025)
MementoGUI: Learning Agentic Multimodal Memory Control for Long-Horizon GUI Agents
di: Zeng, Ziyun, et al.
Pubblicazione: (2026)
di: Zeng, Ziyun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Reflective Policy Optimization
di: Gan, Yaozhong, et al.
Pubblicazione: (2024) -
The Exploration-Exploitation Dilemma Revisited: An Entropy Perspective
di: Yan, Renye, et al.
Pubblicazione: (2024) -
Transductive Off-policy Proximal Policy Optimization
di: Gan, Yaozhong, et al.
Pubblicazione: (2024) -
MARPO: A Reflective Policy Optimization for Multi Agent Reinforcement Learning
di: Wu, Cuiling, et al.
Pubblicazione: (2025) -
Do Less, Achieve More: Do We Need Every-Step Optimization for RL Fine-tuning of Diffusion Models?
di: Yan, Renye, et al.
Pubblicazione: (2026)