Enregistré dans:
| Auteurs principaux: | Su, Zelal, Mustafaoglu, Lee, Sungyoung, Balachandar, Eshan, Miikkulainen, Risto, Pingali, Keshav |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.12596 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evolutionary Policy Optimization
par: Mustafaoglu, Zelal Su "Lain", et autres
Publié: (2025)
par: Mustafaoglu, Zelal Su "Lain", et autres
Publié: (2025)
Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning
par: Lee, Sungyoung, et autres
Publié: (2026)
par: Lee, Sungyoung, et autres
Publié: (2026)
Optimizing the Design of an Artificial Pancreas to Improve Diabetes Management
par: Khanna, Ashok, et autres
Publié: (2024)
par: Khanna, Ashok, et autres
Publié: (2024)
Quantized Evolution Strategies: High-precision Fine-tuning of Quantized LLMs at Low-precision Cost
par: Xu, Yinggan, et autres
Publié: (2026)
par: Xu, Yinggan, et autres
Publié: (2026)
Flashlight: PyTorch Compiler Extensions to Accelerate Attention Variants
par: You, Bozhi, et autres
Publié: (2025)
par: You, Bozhi, et autres
Publié: (2025)
The Depth Delusion: Why Transformers Should Be Wider, Not Deeper
par: Fahim, Md Muhtasim Munif, et autres
Publié: (2026)
par: Fahim, Md Muhtasim Munif, et autres
Publié: (2026)
The Odyssey of the Fittest: Can Agents Survive and Still Be Good?
par: Waldner, Dylan, et autres
Publié: (2025)
par: Waldner, Dylan, et autres
Publié: (2025)
EVOTER: Evolution of Transparent Explainable Rule-sets
par: Shahrzad, Hormoz, et autres
Publié: (2022)
par: Shahrzad, Hormoz, et autres
Publié: (2022)
Overcoming Forgetting in LLM Fine-Tuning with Evolution Strategies
par: Schweighofer, Kajetan, et autres
Publié: (2026)
par: Schweighofer, Kajetan, et autres
Publié: (2026)
Efficient Pre-Training of LLMs through Truncated SVD Layers
par: Kamali, Kaivan, et autres
Publié: (2026)
par: Kamali, Kaivan, et autres
Publié: (2026)
Discovering Effective Policies for Land-Use Planning with Neuroevolution
par: Young, Daniel, et autres
Publié: (2023)
par: Young, Daniel, et autres
Publié: (2023)
NeuroBack: Improving CDCL SAT Solving using Graph Neural Networks
par: Wang, Wenxi, et autres
Publié: (2021)
par: Wang, Wenxi, et autres
Publié: (2021)
The Blessing of Dimensionality in LLM Fine-tuning: A Variance-Curvature Perspective
par: Liang, Qiyao, et autres
Publié: (2026)
par: Liang, Qiyao, et autres
Publié: (2026)
HAEPO: History-Aggregated Exploratory Policy Optimization
par: Trivedi, Gaurish, et autres
Publié: (2025)
par: Trivedi, Gaurish, et autres
Publié: (2025)
Fast Think-on-Graph: Wider, Deeper and Faster Reasoning of Large Language Model on Knowledge Graph
par: Liang, Xujian, et autres
Publié: (2025)
par: Liang, Xujian, et autres
Publié: (2025)
Evolutionary Policy Optimization
par: Wang, Jianren, et autres
Publié: (2025)
par: Wang, Jianren, et autres
Publié: (2025)
SplAgger: Split Aggregation for Meta-Reinforcement Learning
par: Beck, Jacob, et autres
Publié: (2024)
par: Beck, Jacob, et autres
Publié: (2024)
Trust-Region Adaptive Policy Optimization
par: Su, Mingyu, et autres
Publié: (2025)
par: Su, Mingyu, et autres
Publié: (2025)
Semantic Density: Uncertainty Quantification for Large Language Models through Confidence Measurement in Semantic Space
par: Qiu, Xin, et autres
Publié: (2024)
par: Qiu, Xin, et autres
Publié: (2024)
On-Policy Optimization of ANFIS Policies Using Proximal Policy Optimization
par: Shankar, Kaaustaaub, et autres
Publié: (2025)
par: Shankar, Kaaustaaub, et autres
Publié: (2025)
Neural Cellular Automata for ARC-AGI
par: Xu, Kevin, et autres
Publié: (2025)
par: Xu, Kevin, et autres
Publié: (2025)
Orthogonalized Policy Optimization:Policy Optimization as Orthogonal Projection in Hilbert Space
par: Zixian, Wang
Publié: (2026)
par: Zixian, Wang
Publié: (2026)
Wasserstein Policy Optimization
par: Pfau, David, et autres
Publié: (2025)
par: Pfau, David, et autres
Publié: (2025)
Reflective Policy Optimization
par: Gan, Yaozhong, et autres
Publié: (2024)
par: Gan, Yaozhong, et autres
Publié: (2024)
Conformal Constrained Policy Optimization for Cost-Effective LLM Agents
par: Si, Wenwen, et autres
Publié: (2025)
par: Si, Wenwen, et autres
Publié: (2025)
Evolution Strategies at Scale: LLM Fine-Tuning Beyond Reinforcement Learning
par: Qiu, Xin, et autres
Publié: (2025)
par: Qiu, Xin, et autres
Publié: (2025)
Group Orthogonalized Policy Optimization:Group Policy Optimization as Orthogonal Projection in Hilbert Space
par: Zixian, Wang
Publié: (2026)
par: Zixian, Wang
Publié: (2026)
Optimizing Anytime Reasoning via Budget Relative Policy Optimization
par: Qi, Penghui, et autres
Publié: (2025)
par: Qi, Penghui, et autres
Publié: (2025)
Score-Based One-step MeanFlow Policy Optimization
par: Kim, Kyungyoon, et autres
Publié: (2026)
par: Kim, Kyungyoon, et autres
Publié: (2026)
Attractor Geometry of Transformer Memory: From Conflict Arbitration to Confident Hallucination
par: Liang, Qiyao, et autres
Publié: (2026)
par: Liang, Qiyao, et autres
Publié: (2026)
KANITE: Kolmogorov-Arnold Networks for ITE estimation
par: Mehendale, Eshan, et autres
Publié: (2025)
par: Mehendale, Eshan, et autres
Publié: (2025)
Soft Sequence Policy Optimization
par: Glazyrina, Svetlana, et autres
Publié: (2026)
par: Glazyrina, Svetlana, et autres
Publié: (2026)
Reparameterization Flow Policy Optimization
par: Zhong, Hai, et autres
Publié: (2026)
par: Zhong, Hai, et autres
Publié: (2026)
Single-stream Policy Optimization
par: Xu, Zhongwen, et autres
Publié: (2025)
par: Xu, Zhongwen, et autres
Publié: (2025)
Reparameterization Proximal Policy Optimization
par: Zhong, Hai, et autres
Publié: (2025)
par: Zhong, Hai, et autres
Publié: (2025)
Variational Delayed Policy Optimization
par: Wu, Qingyuan, et autres
Publié: (2024)
par: Wu, Qingyuan, et autres
Publié: (2024)
Divergence-Augmented Policy Optimization
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
Decision Flow Policy Optimization
par: Hu, Jifeng, et autres
Publié: (2025)
par: Hu, Jifeng, et autres
Publié: (2025)
Fractal Landscapes in Policy Optimization
par: Wang, Tao, et autres
Publié: (2023)
par: Wang, Tao, et autres
Publié: (2023)
ResNets Are Deeper Than You Think
par: Mehmeti-Göpel, Christian H. X. Ali, et autres
Publié: (2025)
par: Mehmeti-Göpel, Christian H. X. Ali, et autres
Publié: (2025)
Documents similaires
-
Evolutionary Policy Optimization
par: Mustafaoglu, Zelal Su "Lain", et autres
Publié: (2025) -
Towards Efficient and Expressive Offline RL via Flow-Anchored Noise-conditioned Q-Learning
par: Lee, Sungyoung, et autres
Publié: (2026) -
Optimizing the Design of an Artificial Pancreas to Improve Diabetes Management
par: Khanna, Ashok, et autres
Publié: (2024) -
Quantized Evolution Strategies: High-precision Fine-tuning of Quantized LLMs at Low-precision Cost
par: Xu, Yinggan, et autres
Publié: (2026) -
Flashlight: PyTorch Compiler Extensions to Accelerate Attention Variants
par: You, Bozhi, et autres
Publié: (2025)