Exploration by Running Away from the Past
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tolguenec, Paul-Antoine Le, Besse, Yann, Teichteil-Koenigsbuch, Florent, Wilson, Dennis G., Rachelson, Emmanuel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploration by Learning Diverse Skills through Successor State Measures
par: Tolguenec, Paul-Antoine Le, et autres
Publié: (2024)
par: Tolguenec, Paul-Antoine Le, et autres
Publié: (2024)
Hybrid Reinforcement Learning and Search for Flight Trajectory Planning
par: Luise, Alberto, et autres
Publié: (2025)
par: Luise, Alberto, et autres
Publié: (2025)
Solving robust MDPs as a sequence of static RL problems
par: Zouitine, Adil, et autres
Publié: (2024)
par: Zouitine, Adil, et autres
Publié: (2024)
Learning to Handle Parameter Perturbations in Combinatorial Optimization: an Application to Facility Location
par: Lodi, Andrea, et autres
Publié: (2019)
par: Lodi, Andrea, et autres
Publié: (2019)
Bootstrapping Expectiles in Reinforcement Learning
par: Clavier, Pierre, et autres
Publié: (2024)
par: Clavier, Pierre, et autres
Publié: (2024)
Genetic Drift Regularization: on preventing Actor Injection from breaking Evolution Strategies
par: Templier, Paul, et autres
Publié: (2024)
par: Templier, Paul, et autres
Publié: (2024)
RRLS : Robust Reinforcement Learning Suite
par: Zouitine, Adil, et autres
Publié: (2024)
par: Zouitine, Adil, et autres
Publié: (2024)
Time-Constrained Robust MDPs
par: Zouitine, Adil, et autres
Publié: (2024)
par: Zouitine, Adil, et autres
Publié: (2024)
A Markov Decision Process for Variable Selection in Branch & Bound
par: Strang, Paul, et autres
Publié: (2025)
par: Strang, Paul, et autres
Publié: (2025)
Influence branching for learning to solve mixed-integer programs online
par: Strang, Paul, et autres
Publié: (2025)
par: Strang, Paul, et autres
Publié: (2025)
Planning in Branch-and-Bound: Model-Based Reinforcement Learning for Exact Combinatorial Optimization
par: Strang, Paul, et autres
Publié: (2025)
par: Strang, Paul, et autres
Publié: (2025)
Quality with Just Enough Diversity in Evolutionary Policy Search
par: Templier, Paul, et autres
Publié: (2024)
par: Templier, Paul, et autres
Publié: (2024)
Learning Abstract World Models with a Group-Structured Latent Space
par: Delliaux, Thomas, et autres
Publié: (2025)
par: Delliaux, Thomas, et autres
Publié: (2025)
Optimal scaling laws in learning hierarchical multi-index models
par: Defilippis, Leonardo, et autres
Publié: (2026)
par: Defilippis, Leonardo, et autres
Publié: (2026)
A Noise Sensitivity Exponent Controls Large Statistical-to-Computational Gaps in Single- and Multi-Index Models
par: Defilippis, Leonardo, et autres
Publié: (2026)
par: Defilippis, Leonardo, et autres
Publié: (2026)
Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning
par: Moulin, Antoine, et autres
Publié: (2025)
par: Moulin, Antoine, et autres
Publié: (2025)
Run LoRA Run: Faster and Lighter LoRA Implementations
par: Cherniuk, Daria, et autres
Publié: (2023)
par: Cherniuk, Daria, et autres
Publié: (2023)
An operator preconditioning perspective on training in physics-informed machine learning
par: De Ryck, Tim, et autres
Publié: (2023)
par: De Ryck, Tim, et autres
Publié: (2023)
Fast and Exact Enumeration of Deep Networks Partitions Regions
par: Balestriero, Randall, et autres
Publié: (2024)
par: Balestriero, Randall, et autres
Publié: (2024)
Beyond R-barycenters: an effective averaging method on Stiefel and Grassmann manifolds
par: Bouchard, Florent, et autres
Publié: (2025)
par: Bouchard, Florent, et autres
Publié: (2025)
Semantic Tube Prediction: Beating LLM Data Efficiency with JEPA
par: Huang, Hai, et autres
Publié: (2026)
par: Huang, Hai, et autres
Publié: (2026)
Variance Covariance Regularization Enforces Pairwise Independence in Self-Supervised Representations
par: Mialon, Grégoire, et autres
Publié: (2022)
par: Mialon, Grégoire, et autres
Publié: (2022)
Preventing Arbitrarily High Confidence on Far-Away Data in Point-Estimated Discriminative Neural Networks
par: Rashid, Ahmad, et autres
Publié: (2023)
par: Rashid, Ahmad, et autres
Publié: (2023)
AMV-L: Lifecycle-Managed Agent Memory for Tail-Latency Control in Long-Running LLM Systems
par: Bamidele, Emmanuel
Publié: (2026)
par: Bamidele, Emmanuel
Publié: (2026)
Remedying uncertainty representations in visual inference through Explaining-Away Variational Autoencoders
par: Catoni, Josefina, et autres
Publié: (2024)
par: Catoni, Josefina, et autres
Publié: (2024)
Just How Flexible are Neural Networks in Practice?
par: Shwartz-Ziv, Ravid, et autres
Publié: (2024)
par: Shwartz-Ziv, Ravid, et autres
Publié: (2024)
Foundation World Models for Agents that Learn, Verify, and Adapt Reliably Beyond Static Environments
par: Delgrange, Florent
Publié: (2026)
par: Delgrange, Florent
Publié: (2026)
Attention Shift: Steering AI Away from Unsafe Content
par: Garg, Shivank, et autres
Publié: (2024)
par: Garg, Shivank, et autres
Publié: (2024)
When Lower-Order Terms Dominate: Adaptive Expert Algorithms for Heavy-Tailed Losses
par: Moulin, Antoine, et autres
Publié: (2025)
par: Moulin, Antoine, et autres
Publié: (2025)
Architectural Exploration of Hybrid Neural Decoders for Neuromorphic Implantable BMI
par: Mohan, Vivek, et autres
Publié: (2025)
par: Mohan, Vivek, et autres
Publié: (2025)
When Can You Get Away with Low Memory Adam?
par: Kalra, Dayal Singh, et autres
Publié: (2025)
par: Kalra, Dayal Singh, et autres
Publié: (2025)
Beyond Surprise: Improving Exploration Through Surprise Novelty
par: Le, Hung, et autres
Publié: (2023)
par: Le, Hung, et autres
Publié: (2023)
High-Dimensional Partial Least Squares: Spectral Analysis and Fundamental Limitations
par: Léger, Victor, et autres
Publié: (2025)
par: Léger, Victor, et autres
Publié: (2025)
Performative Prediction: Past and Future
par: Hardt, Moritz, et autres
Publié: (2023)
par: Hardt, Moritz, et autres
Publié: (2023)
Introduction to Latent Variable Energy-Based Models: A Path Towards Autonomous Machine Intelligence
par: Dawid, Anna, et autres
Publié: (2023)
par: Dawid, Anna, et autres
Publié: (2023)
Tackling the Zero-Shot Reinforcement Learning Loss Directly
par: Ollivier, Yann
Publié: (2025)
par: Ollivier, Yann
Publié: (2025)
Learning from Reward-Free Offline Data: A Case for Planning with Latent Dynamics Models
par: Sobal, Vlad, et autres
Publié: (2025)
par: Sobal, Vlad, et autres
Publié: (2025)
Steer Away From Mode Collisions: Improving Composition In Diffusion Models
par: Dutta, Debottam, et autres
Publié: (2025)
par: Dutta, Debottam, et autres
Publié: (2025)
LeWorldModel: Stable End-to-End Joint-Embedding Predictive Architecture from Pixels
par: Maes, Lucas, et autres
Publié: (2026)
par: Maes, Lucas, et autres
Publié: (2026)
Fundamental Limits of Matrix Sensing: Exact Asymptotics, Universality, and Applications
par: Xu, Yizhou, et autres
Publié: (2025)
par: Xu, Yizhou, et autres
Publié: (2025)
Documents similaires
-
Exploration by Learning Diverse Skills through Successor State Measures
par: Tolguenec, Paul-Antoine Le, et autres
Publié: (2024) -
Hybrid Reinforcement Learning and Search for Flight Trajectory Planning
par: Luise, Alberto, et autres
Publié: (2025) -
Solving robust MDPs as a sequence of static RL problems
par: Zouitine, Adil, et autres
Publié: (2024) -
Learning to Handle Parameter Perturbations in Combinatorial Optimization: an Application to Facility Location
par: Lodi, Andrea, et autres
Publié: (2019) -
Bootstrapping Expectiles in Reinforcement Learning
par: Clavier, Pierre, et autres
Publié: (2024)