iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Scannell, Aidan, Kujanpää, Kalle, Zhao, Yi, Nakhaei, Mohammadreza, Solin, Arno, Pajarinen, Joni |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
par: Nakhaei, Mohammadreza, et autres
Publié: (2024)
par: Nakhaei, Mohammadreza, et autres
Publié: (2024)
Discrete Codebook World Models for Continuous Control
par: Scannell, Aidan, et autres
Publié: (2025)
par: Scannell, Aidan, et autres
Publié: (2025)
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
par: Nakhaei, Mohammadreza, et autres
Publié: (2024)
par: Nakhaei, Mohammadreza, et autres
Publié: (2024)
Contextual Latent World Models for Offline Meta Reinforcement Learning
par: Nakheai, Mohammadreza, et autres
Publié: (2026)
par: Nakheai, Mohammadreza, et autres
Publié: (2026)
Function-space Parameterization of Neural Networks for Sequential Learning
par: Scannell, Aidan, et autres
Publié: (2024)
par: Scannell, Aidan, et autres
Publié: (2024)
Efficient Reinforcement Learning by Guiding Generalist World Models with Non-Curated Data
par: Zhao, Yi, et autres
Publié: (2025)
par: Zhao, Yi, et autres
Publié: (2025)
Continuous Monte Carlo Graph Search
par: Kujanpää, Kalle, et autres
Publié: (2022)
par: Kujanpää, Kalle, et autres
Publié: (2022)
Sparsely Supervised Diffusion
par: Zhao, Wenshuai, et autres
Publié: (2026)
par: Zhao, Wenshuai, et autres
Publié: (2026)
Learning to Staff: Offline Reinforcement Learning and Fine-Tuned LLMs for Warehouse Staffing Optimization
par: Kujanpää, Kalle, et autres
Publié: (2026)
par: Kujanpää, Kalle, et autres
Publié: (2026)
Probabilistic Subgoal Representations for Hierarchical Reinforcement learning
par: Wang, Vivienne Huiling, et autres
Publié: (2024)
par: Wang, Vivienne Huiling, et autres
Publié: (2024)
Hierarchical Reinforcement Learning with Uncertainty-Guided Diffusional Subgoals
par: Wang, Vivienne Huiling, et autres
Publié: (2025)
par: Wang, Vivienne Huiling, et autres
Publié: (2025)
Grouped Discrete Representation for Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2024)
par: Zhao, Rongzhen, et autres
Publié: (2024)
Learning to Approximate Particle Smoothing Trajectories via Diffusion Generative Models
par: Tamir, Ella, et autres
Publié: (2024)
par: Tamir, Ella, et autres
Publié: (2024)
DiVeQ: Differentiable Vector Quantization Using the Reparameterization Trick
par: Vali, Mohammad Hassan, et autres
Publié: (2025)
par: Vali, Mohammad Hassan, et autres
Publié: (2025)
Approximate Bayesian Inference via Bitstring Representations
par: Sladek, Aleksanteri, et autres
Publié: (2025)
par: Sladek, Aleksanteri, et autres
Publié: (2025)
Reachability Weighted Offline Goal-conditioned Resampling
par: Yang, Wenyan, et autres
Publié: (2025)
par: Yang, Wenyan, et autres
Publié: (2025)
On the Benefit of Optimal Transport for Curriculum Reinforcement Learning
par: Klink, Pascal, et autres
Publié: (2023)
par: Klink, Pascal, et autres
Publié: (2023)
An Introduction to Quantum Reinforcement Learning (QRL)
par: Chen, Samuel Yen-Chi
Publié: (2024)
par: Chen, Samuel Yen-Chi
Publié: (2024)
Learning Progress Driven Multi-Agent Curriculum
par: Zhao, Wenshuai, et autres
Publié: (2022)
par: Zhao, Wenshuai, et autres
Publié: (2022)
GCHR : Goal-Conditioned Hindsight Regularization for Sample-Efficient Reinforcement Learning
par: Lei, Xing, et autres
Publié: (2025)
par: Lei, Xing, et autres
Publié: (2025)
Compressing 3D Gaussian Splatting by Noise-Substituted Vector Quantization
par: Wang, Haishan, et autres
Publié: (2025)
par: Wang, Haishan, et autres
Publié: (2025)
Learning Multi-Timescale Abstractions for Hierarchical Combinatorial Planning
par: Wang, Vivienne Huiling, et autres
Publié: (2026)
par: Wang, Vivienne Huiling, et autres
Publié: (2026)
MetaSlot: Break Through the Fixed Number of Slots in Object-Centric Learning
par: Liu, Hongjia, et autres
Publié: (2025)
par: Liu, Hongjia, et autres
Publié: (2025)
Optimistic Multi-Agent Policy Gradient
par: Zhao, Wenshuai, et autres
Publié: (2023)
par: Zhao, Wenshuai, et autres
Publié: (2023)
Efficient Knowledge Injection in LLMs via Self-Distillation
par: Kujanpää, Kalle, et autres
Publié: (2024)
par: Kujanpää, Kalle, et autres
Publié: (2024)
Streamlining Prediction in Bayesian Deep Learning
par: Li, Rui, et autres
Publié: (2024)
par: Li, Rui, et autres
Publié: (2024)
Improving Discrete Diffusion Models via Structured Preferential Generation
par: Rissanen, Severi, et autres
Publié: (2024)
par: Rissanen, Severi, et autres
Publié: (2024)
Free Hunch: Denoiser Covariance Estimation for Diffusion Models Without Extra Costs
par: Rissanen, Severi, et autres
Publié: (2024)
par: Rissanen, Severi, et autres
Publié: (2024)
Physics-Informed Variational State-Space Gaussian Processes
par: Hamelijnck, Oliver, et autres
Publié: (2024)
par: Hamelijnck, Oliver, et autres
Publié: (2024)
Variational Gaussian Process Diffusion Processes
par: Verma, Prakhar, et autres
Publié: (2023)
par: Verma, Prakhar, et autres
Publié: (2023)
Heterophily-informed Message Passing
par: Wang, Haishan, et autres
Publié: (2025)
par: Wang, Haishan, et autres
Publié: (2025)
Learning Future Representation with Synthetic Observations for Sample-efficient Reinforcement Learning
par: Liu, Xin, et autres
Publié: (2024)
par: Liu, Xin, et autres
Publié: (2024)
Subtractive Mixture Models via Squaring: Representation and Learning
par: Loconte, Lorenzo, et autres
Publié: (2023)
par: Loconte, Lorenzo, et autres
Publié: (2023)
Exploiting Hankel-Toeplitz Structures for Fast Computation of Kernel Precision Matrices
par: Viset, Frida, et autres
Publié: (2024)
par: Viset, Frida, et autres
Publié: (2024)
Non-separable Spatio-temporal Graph Kernels via SPDEs
par: Nikitin, Alexander, et autres
Publié: (2021)
par: Nikitin, Alexander, et autres
Publié: (2021)
RGB-Th-Bench: A Dense benchmark for Visual-Thermal Understanding of Vision Language Models
par: Moshtaghi, Mehdi, et autres
Publié: (2025)
par: Moshtaghi, Mehdi, et autres
Publié: (2025)
Rethinking Temporal Consistency in Video Object-Centric Learning: From Prediction to Correspondence
par: Li, Zhiyuan, et autres
Publié: (2026)
par: Li, Zhiyuan, et autres
Publié: (2026)
Discrete Contrastive Learning for Diffusion Policies in Autonomous Driving
par: Kujanpää, Kalle, et autres
Publié: (2025)
par: Kujanpää, Kalle, et autres
Publié: (2025)
Flatness Improves Backbone Generalisation in Few-shot Classification
par: Li, Rui, et autres
Publié: (2024)
par: Li, Rui, et autres
Publié: (2024)
Sources of Uncertainty in 3D Scene Reconstruction
par: Klasson, Marcus, et autres
Publié: (2024)
par: Klasson, Marcus, et autres
Publié: (2024)
Documents similaires
-
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
par: Nakhaei, Mohammadreza, et autres
Publié: (2024) -
Discrete Codebook World Models for Continuous Control
par: Scannell, Aidan, et autres
Publié: (2025) -
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
par: Nakhaei, Mohammadreza, et autres
Publié: (2024) -
Contextual Latent World Models for Offline Meta Reinforcement Learning
par: Nakheai, Mohammadreza, et autres
Publié: (2026) -
Function-space Parameterization of Neural Networks for Sequential Learning
par: Scannell, Aidan, et autres
Publié: (2024)