Revisiting Scalable Hessian Diagonal Approximations for Applications in Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Elsayed, Mohamed, Farrahi, Homayoon, Dangel, Felix, Mahmood, A. Rupam |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning Without Time-Based Embodiment Resets in Soft-Actor Critic
di: Farrahi, Homayoon, et al.
Pubblicazione: (2025)
di: Farrahi, Homayoon, et al.
Pubblicazione: (2025)
Streaming Deep Reinforcement Learning Finally Works
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024)
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024)
Addressing Loss of Plasticity and Catastrophic Forgetting in Continual Learning
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024)
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024)
Weight Clipping for Deep Continual and Reinforcement Learning
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024)
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024)
Intentional Updates for Streaming Reinforcement Learning
di: Sharifnassab, Arsalan, et al.
Pubblicazione: (2026)
di: Sharifnassab, Arsalan, et al.
Pubblicazione: (2026)
Learning to Optimize for Reinforcement Learning
di: Lan, Qingfeng, et al.
Pubblicazione: (2023)
di: Lan, Qingfeng, et al.
Pubblicazione: (2023)
More Efficient Randomized Exploration for Reinforcement Learning via Approximate Sampling
di: Ishfaq, Haque, et al.
Pubblicazione: (2024)
di: Ishfaq, Haque, et al.
Pubblicazione: (2024)
Distributions as Actions: A Unified Framework for Diverse Action Spaces
di: He, Jiamin, et al.
Pubblicazione: (2025)
di: He, Jiamin, et al.
Pubblicazione: (2025)
Deep Policy Gradient Methods Without Batch Updates, Target Networks, or Replay Buffers
di: Vasan, Gautham, et al.
Pubblicazione: (2024)
di: Vasan, Gautham, et al.
Pubblicazione: (2024)
Communication Dynamics Neural Networks: FFT-Diagonalized Layers for Improved Hessian Conditioning at Reduced Parameter Count
di: Pan, Lurong
Pubblicazione: (2026)
di: Pan, Lurong
Pubblicazione: (2026)
Target Networks and Over-parameterization Stabilize Off-policy Bootstrapping with Function Approximation
di: Che, Fengdi, et al.
Pubblicazione: (2024)
di: Che, Fengdi, et al.
Pubblicazione: (2024)
Subspace-based Approximate Hessian Method for Zeroth-Order Optimization
di: Kim, Dongyoon, et al.
Pubblicazione: (2025)
di: Kim, Dongyoon, et al.
Pubblicazione: (2025)
Classification of 24-hour movement behaviors from wrist-worn accelerometer data: from handcrafted features to deep learning techniques
di: Sameh, Alireza, et al.
Pubblicazione: (2025)
di: Sameh, Alireza, et al.
Pubblicazione: (2025)
SASSHA: Sharpness-aware Adaptive Second-order Optimization with Stable Hessian Approximation
di: Shin, Dahun, et al.
Pubblicazione: (2025)
di: Shin, Dahun, et al.
Pubblicazione: (2025)
Revisiting Adam for Streaming Reinforcement Learning
di: Gogianu, Florin, et al.
Pubblicazione: (2026)
di: Gogianu, Florin, et al.
Pubblicazione: (2026)
Principled Approximation Methods for Efficient and Scalable Deep Learning
di: Savarese, Pedro
Pubblicazione: (2025)
di: Savarese, Pedro
Pubblicazione: (2025)
Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX
di: Bonnet, Clément, et al.
Pubblicazione: (2023)
di: Bonnet, Clément, et al.
Pubblicazione: (2023)
Adaptive Policy Synchronization for Scalable Reinforcement Learning
di: Lafuente-Mercado, Rodney
Pubblicazione: (2025)
di: Lafuente-Mercado, Rodney
Pubblicazione: (2025)
Carnatic Raga Identification System using Rigorous Time-Delay Neural Network
di: Natesan, Sanjay, et al.
Pubblicazione: (2024)
di: Natesan, Sanjay, et al.
Pubblicazione: (2024)
Convolutional Neural Networks on Graphs with Chebyshev Approximation, Revisited
di: He, Mingguo, et al.
Pubblicazione: (2022)
di: He, Mingguo, et al.
Pubblicazione: (2022)
Revisiting Generative Policies: A Simpler Reinforcement Learning Algorithmic Perspective
di: Zhang, Jinouwen, et al.
Pubblicazione: (2024)
di: Zhang, Jinouwen, et al.
Pubblicazione: (2024)
Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
di: Ma, Guozheng, et al.
Pubblicazione: (2023)
di: Ma, Guozheng, et al.
Pubblicazione: (2023)
Revisiting Reinforcement Learning with Verifiable Rewards from a Contrastive Perspective
di: Zhang, Feng, et al.
Pubblicazione: (2026)
di: Zhang, Feng, et al.
Pubblicazione: (2026)
ProductAE: Toward Deep Learning Driven Error-Correction Codes of Large Dimensions
di: Jamali, Mohammad Vahid, et al.
Pubblicazione: (2023)
di: Jamali, Mohammad Vahid, et al.
Pubblicazione: (2023)
Reinforcement Learning for Scalable Train Timetable Rescheduling with Graph Representation
di: Yue, Peng, et al.
Pubblicazione: (2024)
di: Yue, Peng, et al.
Pubblicazione: (2024)
Scalable On-Policy Reinforcement Learning via Adaptive Batch Scaling
di: Park, Jongchan
Pubblicazione: (2026)
di: Park, Jongchan
Pubblicazione: (2026)
The ODE Method for Stochastic Approximation and Reinforcement Learning with Markovian Noise
di: Liu, Shuze Daniel, et al.
Pubblicazione: (2024)
di: Liu, Shuze Daniel, et al.
Pubblicazione: (2024)
Stacked Universal Successor Feature Approximators for Safety in Reinforcement Learning
di: Cannon, Ian, et al.
Pubblicazione: (2024)
di: Cannon, Ian, et al.
Pubblicazione: (2024)
Towards Differentially Private Reinforcement Learning with General Function Approximation
di: He, Yi, et al.
Pubblicazione: (2026)
di: He, Yi, et al.
Pubblicazione: (2026)
Approximate Subgraph Matching with Neural Graph Representations and Reinforcement Learning
di: Li, Kaiyang, et al.
Pubblicazione: (2026)
di: Li, Kaiyang, et al.
Pubblicazione: (2026)
Quality-Controlled Multimodal Emotion Recognition in Conversations with Identity-Based Transfer Learning and MAMBA Fusion
di: Wang, Zanxu, et al.
Pubblicazione: (2025)
di: Wang, Zanxu, et al.
Pubblicazione: (2025)
Hessian Aware Low-Rank Perturbation for Order-Robust Continual Learning
di: Li, Jiaqi, et al.
Pubblicazione: (2023)
di: Li, Jiaqi, et al.
Pubblicazione: (2023)
What Does It Mean to Be a Transformer? Insights from a Theoretical Hessian Analysis
di: Ormaniec, Weronika, et al.
Pubblicazione: (2024)
di: Ormaniec, Weronika, et al.
Pubblicazione: (2024)
Revisiting Sparse Rewards for Goal-Reaching Reinforcement Learning
di: Vasan, Gautham, et al.
Pubblicazione: (2024)
di: Vasan, Gautham, et al.
Pubblicazione: (2024)
QF-tuner: Breaking Tradition in Reinforcement Learning
di: Jumaah, Mahmood A., et al.
Pubblicazione: (2024)
di: Jumaah, Mahmood A., et al.
Pubblicazione: (2024)
Hessian-Free Online Certified Unlearning
di: Qiao, Xinbao, et al.
Pubblicazione: (2024)
di: Qiao, Xinbao, et al.
Pubblicazione: (2024)
Scalable Multi-Objective and Meta Reinforcement Learning via Gradient Estimation
di: Zhang, Zhenshuo, et al.
Pubblicazione: (2025)
di: Zhang, Zhenshuo, et al.
Pubblicazione: (2025)
The Cell Must Go On: Agar.io for Continual Reinforcement Learning
di: Mohamed, Mohamed A., et al.
Pubblicazione: (2025)
di: Mohamed, Mohamed A., et al.
Pubblicazione: (2025)
Directed-MAML: Meta Reinforcement Learning Algorithm with Task-directed Approximation
di: Zhang, Yang, et al.
Pubblicazione: (2025)
di: Zhang, Yang, et al.
Pubblicazione: (2025)
Tensor and Matrix Low-Rank Value-Function Approximation in Reinforcement Learning
di: Rozada, Sergio, et al.
Pubblicazione: (2022)
di: Rozada, Sergio, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Learning Without Time-Based Embodiment Resets in Soft-Actor Critic
di: Farrahi, Homayoon, et al.
Pubblicazione: (2025) -
Streaming Deep Reinforcement Learning Finally Works
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024) -
Addressing Loss of Plasticity and Catastrophic Forgetting in Continual Learning
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024) -
Weight Clipping for Deep Continual and Reinforcement Learning
di: Elsayed, Mohamed, et al.
Pubblicazione: (2024) -
Intentional Updates for Streaming Reinforcement Learning
di: Sharifnassab, Arsalan, et al.
Pubblicazione: (2026)