Survival Reinforcement Learning: Toward Scalable Self-Supervised RL
Fuente:
arXiv
Salvato in:
| Autori principali: | Nguimatsia-Tiofack, Franki, Schramm, Fabian, Hellard, Théotime Le, Carpentier, Justin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SVL: Goal-Conditioned Reinforcement Learning as Survival Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2026)
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2026)
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025)
Accelerating trajectory optimization with Sobolev-trained diffusion policies
di: Hellard, Théotime Le, et al.
Pubblicazione: (2026)
di: Hellard, Théotime Le, et al.
Pubblicazione: (2026)
Variance-Reduced Model Predictive Path Integral via Quadratic Model Approximation
di: Schramm, Fabian, et al.
Pubblicazione: (2026)
di: Schramm, Fabian, et al.
Pubblicazione: (2026)
First-order Sobolev Reinforcement Learning
di: Schramm, Fabian, et al.
Pubblicazione: (2025)
di: Schramm, Fabian, et al.
Pubblicazione: (2025)
RoiRL: Efficient, Self-Supervised Reasoning with Offline Iterative Reinforcement Learning
di: Arzhantsev, Aleksei, et al.
Pubblicazione: (2025)
di: Arzhantsev, Aleksei, et al.
Pubblicazione: (2025)
RL-BioAug: Label-Efficient Reinforcement Learning for Self-Supervised EEG Representation Learning
di: Lee, Cheol-Hui, et al.
Pubblicazione: (2026)
di: Lee, Cheol-Hui, et al.
Pubblicazione: (2026)
VendiRL: A Framework for Self-Supervised Reinforcement Learning of Diversely Diverse Skills
di: Lintunen, Erik M.
Pubblicazione: (2025)
di: Lintunen, Erik M.
Pubblicazione: (2025)
Scalable Graph Self-Supervised Learning
di: Pasand, Ali Saheb, et al.
Pubblicazione: (2024)
di: Pasand, Ali Saheb, et al.
Pubblicazione: (2024)
LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics
di: Balestriero, Randall, et al.
Pubblicazione: (2025)
di: Balestriero, Randall, et al.
Pubblicazione: (2025)
Understanding Self-Supervised Learning via Latent Distribution Matching
di: Mikulasch, Fabian A, et al.
Pubblicazione: (2026)
di: Mikulasch, Fabian A, et al.
Pubblicazione: (2026)
Counteractive RL: Rethinking Core Principles for Efficient and Scalable Deep Reinforcement Learning
di: Korkmaz, Ezgi
Pubblicazione: (2026)
di: Korkmaz, Ezgi
Pubblicazione: (2026)
Self-Composing Policies for Scalable Continual Reinforcement Learning
di: Malagón, Mikel, et al.
Pubblicazione: (2025)
di: Malagón, Mikel, et al.
Pubblicazione: (2025)
Human-Level Competitive Pokémon via Scalable Offline Reinforcement Learning with Transformers
di: Grigsby, Jake, et al.
Pubblicazione: (2025)
di: Grigsby, Jake, et al.
Pubblicazione: (2025)
Self-Supervised and Few-Shot Learning for Robust Bioaerosol Monitoring
di: Willi, Adrian, et al.
Pubblicazione: (2024)
di: Willi, Adrian, et al.
Pubblicazione: (2024)
PokeRL: Reinforcement Learning for Pokemon Red
di: Mudireddy, Dheeraj, et al.
Pubblicazione: (2026)
di: Mudireddy, Dheeraj, et al.
Pubblicazione: (2026)
Contrastive UCB: Provably Efficient Contrastive Self-Supervised Learning in Online Reinforcement Learning
di: Qiu, Shuang, et al.
Pubblicazione: (2022)
di: Qiu, Shuang, et al.
Pubblicazione: (2022)
RL$^3$: Boosting Meta Reinforcement Learning via RL inside RL$^2$
di: Bhatia, Abhinav, et al.
Pubblicazione: (2023)
di: Bhatia, Abhinav, et al.
Pubblicazione: (2023)
AutoResearch-RL: Perpetual Self-Evaluating Reinforcement Learning Agents for Autonomous Neural Architecture Discovery
di: Jain, Nilesh, et al.
Pubblicazione: (2026)
di: Jain, Nilesh, et al.
Pubblicazione: (2026)
Self-Supervised Multisensory Pretraining for Contact-Rich Robot Reinforcement Learning
di: Krohn, Rickmer, et al.
Pubblicazione: (2025)
di: Krohn, Rickmer, et al.
Pubblicazione: (2025)
SpikeRL: A Scalable and Energy-efficient Framework for Deep Spiking Reinforcement Learning
di: Tahmid, Tokey, et al.
Pubblicazione: (2025)
di: Tahmid, Tokey, et al.
Pubblicazione: (2025)
RL-STaR: Theoretical Analysis of Reinforcement Learning Frameworks for Self-Taught Reasoner
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
QuRL: Efficient Reinforcement Learning with Quantized Rollout
di: Li, Yuhang, et al.
Pubblicazione: (2026)
di: Li, Yuhang, et al.
Pubblicazione: (2026)
ObjectRL: An Object-Oriented Reinforcement Learning Codebase
di: Baykal, Gulcin, et al.
Pubblicazione: (2025)
di: Baykal, Gulcin, et al.
Pubblicazione: (2025)
Automation and Feature Selection Enhancement with Reinforcement Learning (RL)
di: Nagaraju, Sumana Sanyasipura
Pubblicazione: (2025)
di: Nagaraju, Sumana Sanyasipura
Pubblicazione: (2025)
SOMBRL: Scalable and Optimistic Model-Based RL
di: Sukhija, Bhavya, et al.
Pubblicazione: (2025)
di: Sukhija, Bhavya, et al.
Pubblicazione: (2025)
Towards Minimax Optimality of Model-based Robust Reinforcement Learning
di: Clavier, Pierre, et al.
Pubblicazione: (2023)
di: Clavier, Pierre, et al.
Pubblicazione: (2023)
Self-Supervised Contrastive Learning is Approximately Supervised Contrastive Learning
di: Luthra, Achleshwar, et al.
Pubblicazione: (2025)
di: Luthra, Achleshwar, et al.
Pubblicazione: (2025)
Self-Harmony: Learning to Harmonize Self-Supervision and Self-Play in Test-Time Reinforcement Learning
di: Wang, Ru, et al.
Pubblicazione: (2025)
di: Wang, Ru, et al.
Pubblicazione: (2025)
TriPlay-RL: Tri-Role Self-Play Reinforcement Learning for LLM Safety Alignment
di: Tan, Zhewen, et al.
Pubblicazione: (2026)
di: Tan, Zhewen, et al.
Pubblicazione: (2026)
SwiftRL: Towards Efficient Reinforcement Learning on Real Processing-In-Memory Systems
di: Gogineni, Kailash, et al.
Pubblicazione: (2024)
di: Gogineni, Kailash, et al.
Pubblicazione: (2024)
A simple and improved algorithm for noisy, convex, zeroth-order optimisation
di: Carpentier, Alexandra
Pubblicazione: (2024)
di: Carpentier, Alexandra
Pubblicazione: (2024)
RL's Razor: Why Online Reinforcement Learning Forgets Less
di: Shenfeld, Idan, et al.
Pubblicazione: (2025)
di: Shenfeld, Idan, et al.
Pubblicazione: (2025)
RL as Regressor: A Reinforcement Learning Approach for Function Approximation
di: Huang, Yongchao
Pubblicazione: (2025)
di: Huang, Yongchao
Pubblicazione: (2025)
Open RL Benchmark: Comprehensive Tracked Experiments for Reinforcement Learning
di: Huang, Shengyi, et al.
Pubblicazione: (2024)
di: Huang, Shengyi, et al.
Pubblicazione: (2024)
RL Is Neither a Panacea Nor a Mirage: Understanding Supervised vs. Reinforcement Learning Fine-Tuning for LLMs
di: Jin, Hangzhan, et al.
Pubblicazione: (2025)
di: Jin, Hangzhan, et al.
Pubblicazione: (2025)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
di: Zhang, Wenhao, et al.
Pubblicazione: (2025)
On the Alignment Between Supervised and Self-Supervised Contrastive Learning
di: Luthra, Achleshwar, et al.
Pubblicazione: (2025)
di: Luthra, Achleshwar, et al.
Pubblicazione: (2025)
Survival Kernets: Scalable and Interpretable Deep Kernel Survival Analysis with an Accuracy Guarantee
di: Chen, George H.
Pubblicazione: (2022)
di: Chen, George H.
Pubblicazione: (2022)
WERank: Towards Rank Degradation Prevention for Self-Supervised Learning Using Weight Regularization
di: Pasand, Ali Saheb, et al.
Pubblicazione: (2024)
di: Pasand, Ali Saheb, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SVL: Goal-Conditioned Reinforcement Learning as Survival Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2026) -
Guided Flow Policy: Learning from High-Value Actions in Offline Reinforcement Learning
di: Tiofack, Franki Nguimatsia, et al.
Pubblicazione: (2025) -
Accelerating trajectory optimization with Sobolev-trained diffusion policies
di: Hellard, Théotime Le, et al.
Pubblicazione: (2026) -
Variance-Reduced Model Predictive Path Integral via Quadratic Model Approximation
di: Schramm, Fabian, et al.
Pubblicazione: (2026) -
First-order Sobolev Reinforcement Learning
di: Schramm, Fabian, et al.
Pubblicazione: (2025)