PcLast: Discovering Plannable Continuous Latent States
Fuente:
arXiv
Salvato in:
| Autori principali: | Koul, Anurag, Sujit, Shivakanth, Chen, Shaoru, Evans, Ben, Wu, Lili, Xu, Byron, Chari, Rajan, Islam, Riashat, Seraj, Raihan, Efroni, Yonathan, Molu, Lekan, Dudik, Miro, Langford, John, Lamb, Alex |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generalizing Multi-Step Inverse Models for Representation Learning to Finite-Memory POMDPs
di: Wu, Lili, et al.
Pubblicazione: (2024)
di: Wu, Lili, et al.
Pubblicazione: (2024)
Verification-Aided Learning of Neural Network Barrier Functions with Termination Guarantees
di: Chen, Shaoru, et al.
Pubblicazione: (2024)
di: Chen, Shaoru, et al.
Pubblicazione: (2024)
LevelSetPy: A GPU-Accelerated Package for Hyperbolic Hamilton-Jacobi Partial Differential Equations
di: Molu, Lekan
Pubblicazione: (2025)
di: Molu, Lekan
Pubblicazione: (2025)
The Python LevelSet Toolbox (LevelSetPy)
di: Molu, Lekan
Pubblicazione: (2024)
di: Molu, Lekan
Pubblicazione: (2024)
Fast Whole-Body Strain Regulation in Continuum Robots
di: Molu, Lekan
Pubblicazione: (2023)
di: Molu, Lekan
Pubblicazione: (2023)
HJ-Gauss: A Monte-Carlo HJ Reachability Scheme
di: Molu, Lekan, et al.
Pubblicazione: (2026)
di: Molu, Lekan, et al.
Pubblicazione: (2026)
Is Bellman Equation Enough for Learning Control?
di: You, Haoxiang, et al.
Pubblicazione: (2025)
di: You, Haoxiang, et al.
Pubblicazione: (2025)
Reinforcement Learning for Sequence Design Leveraging Protein Language Models
di: Subramanian, Jithendaraa, et al.
Pubblicazione: (2024)
di: Subramanian, Jithendaraa, et al.
Pubblicazione: (2024)
Contextual bandits with entropy-based human feedback
di: Seraj, Raihan, et al.
Pubblicazione: (2025)
di: Seraj, Raihan, et al.
Pubblicazione: (2025)
Gradient Free Deep Reinforcement Learning With TabPFN
di: Schiff, David, et al.
Pubblicazione: (2025)
di: Schiff, David, et al.
Pubblicazione: (2025)
Simple Optimizers for Convex Aligned Multi-Objective Optimization
di: Kretzu, Ben, et al.
Pubblicazione: (2025)
di: Kretzu, Ben, et al.
Pubblicazione: (2025)
AdaFair-MARL: Enforcing Adaptive Fairness Constraints in Multi-Agent Reinforcement Learning
di: Ekpo, Promise, et al.
Pubblicazione: (2025)
di: Ekpo, Promise, et al.
Pubblicazione: (2025)
RL in Latent MDPs is Tractable: Online Guarantees via Off-Policy Evaluation
di: Kwon, Jeongyeol, et al.
Pubblicazione: (2024)
di: Kwon, Jeongyeol, et al.
Pubblicazione: (2024)
The Bias of Harmful Label Associations in Vision-Language Models
di: Hazirbas, Caner, et al.
Pubblicazione: (2024)
di: Hazirbas, Caner, et al.
Pubblicazione: (2024)
AutoCast++: Enhancing World Event Prediction with Zero-shot Ranking-based Context Retrieval
di: Yan, Qi, et al.
Pubblicazione: (2023)
di: Yan, Qi, et al.
Pubblicazione: (2023)
Predictive but Not Plannable: RC-aux for Latent World Models
di: Li, Wenyuan, et al.
Pubblicazione: (2026)
di: Li, Wenyuan, et al.
Pubblicazione: (2026)
Hack-Verifiable Environments: Towards Evaluating Reward Hacking at Scale
di: Roth, Amit, et al.
Pubblicazione: (2026)
di: Roth, Amit, et al.
Pubblicazione: (2026)
Improving Nursing Students' Learning Outcomes in Neonatal Resuscitation: A Quasi‐Experimental Study Comparing AI‐Assisted Care Plan Learning With Traditional Instruction
di: Birsel Molu
Pubblicazione: (2024)
di: Birsel Molu
Pubblicazione: (2024)
The Role of Large Language Models in Identifying and Correcting Paediatric Health Misinformation for Parents: A Paediatric Nursing Perspective
di: Birsel Molu
Pubblicazione: (2026)
di: Birsel Molu
Pubblicazione: (2026)
Improving Low-Cost Teleoperation: Augmenting GELLO with Force
di: Sujit, Shivakanth, et al.
Pubblicazione: (2025)
di: Sujit, Shivakanth, et al.
Pubblicazione: (2025)
Heterogeneous Decentralized Diffusion Models
di: Jiang, Zhiying, et al.
Pubblicazione: (2026)
di: Jiang, Zhiying, et al.
Pubblicazione: (2026)
Paris: A Decentralized Trained Open-Weight Diffusion Model
di: Jiang, Zhiying, et al.
Pubblicazione: (2025)
di: Jiang, Zhiying, et al.
Pubblicazione: (2025)
Expert-Data Alignment Governs Generation Quality in Decentralized Diffusion Models
di: Villagra, Marcos, et al.
Pubblicazione: (2026)
di: Villagra, Marcos, et al.
Pubblicazione: (2026)
Aligned Multi Objective Optimization
di: Efroni, Yonathan, et al.
Pubblicazione: (2025)
di: Efroni, Yonathan, et al.
Pubblicazione: (2025)
Efficient Joint Prediction of Multiple Future Tokens
di: Ahn, Kwangjun, et al.
Pubblicazione: (2025)
di: Ahn, Kwangjun, et al.
Pubblicazione: (2025)
Next-Latent Prediction Transformers Learn Compact World Models
di: Teoh, Jayden, et al.
Pubblicazione: (2025)
di: Teoh, Jayden, et al.
Pubblicazione: (2025)
Time After Time: Deep-Q Effect Estimation for Interventions on When and What to do
di: Wald, Yoav, et al.
Pubblicazione: (2025)
di: Wald, Yoav, et al.
Pubblicazione: (2025)
Exploiting Structure in Offline Multi-Agent RL: The Benefits of Low Interaction Rank
di: Zhan, Wenhao, et al.
Pubblicazione: (2024)
di: Zhan, Wenhao, et al.
Pubblicazione: (2024)
Skill-Aligned Fairness in Multi-Agent Learning for Collaboration in Healthcare
di: Ekpo, Promise Osaine, et al.
Pubblicazione: (2025)
di: Ekpo, Promise Osaine, et al.
Pubblicazione: (2025)
Learning to Reason with Curriculum I: Provable Benefits of Autocurriculum
di: Rajaraman, Nived, et al.
Pubblicazione: (2026)
di: Rajaraman, Nived, et al.
Pubblicazione: (2026)
Model output and Data for Decadal biogeochemical predictions for the bottom marine environment of the Northeast U.S. Continental Shelf
di: Koul, Vimal
Pubblicazione: (2025)
di: Koul, Vimal
Pubblicazione: (2025)
Meditation and Neuroscience What Ancient Texts Predicted
di: Koul, Sanjay
Pubblicazione: (2025)
di: Koul, Sanjay
Pubblicazione: (2025)
Rituals of Meaning An Exploration of Samskaras in the Context of Vedic Traditions
di: Koul, Sanjay
Pubblicazione: (2025)
di: Koul, Sanjay
Pubblicazione: (2025)
A systematic review of technology adoption frameworks and their applications
di: Sahil Koul
Pubblicazione: (2017)
di: Sahil Koul
Pubblicazione: (2017)
Does Workplace Spirituality Enhance Employee Well‐Being? The Mediating Role of Workplace Happiness
di: Surabhi Koul
Pubblicazione: (2024)
di: Surabhi Koul
Pubblicazione: (2024)
Utilizing technology acceptance model (TAM) for driverless car technology adoption
di: Sahil Koul
Pubblicazione: (2018)
di: Sahil Koul
Pubblicazione: (2018)
Polymorphic Numbers with Exponential Prefix
di: Seraj, Samer
Pubblicazione: (2025)
di: Seraj, Samer
Pubblicazione: (2025)
Smart Transport Infrastructure Maintenance: A Smart-Contract Blockchain Approach
di: Seraj, Fatjon
Pubblicazione: (2024)
di: Seraj, Fatjon
Pubblicazione: (2024)
Diophantine Analysis of a Digital Anomaly
di: Seraj, Samer
Pubblicazione: (2025)
di: Seraj, Samer
Pubblicazione: (2025)
$P_c(4440)$ and $P_c(4457)$ decay into $\bar{D}Σ_c$ and $\bar{D}Λ_c$ and the spin of the $P_c$ states
di: Yang, Zi-Ying, et al.
Pubblicazione: (2024)
di: Yang, Zi-Ying, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Generalizing Multi-Step Inverse Models for Representation Learning to Finite-Memory POMDPs
di: Wu, Lili, et al.
Pubblicazione: (2024) -
Verification-Aided Learning of Neural Network Barrier Functions with Termination Guarantees
di: Chen, Shaoru, et al.
Pubblicazione: (2024) -
LevelSetPy: A GPU-Accelerated Package for Hyperbolic Hamilton-Jacobi Partial Differential Equations
di: Molu, Lekan
Pubblicazione: (2025) -
The Python LevelSet Toolbox (LevelSetPy)
di: Molu, Lekan
Pubblicazione: (2024) -
Fast Whole-Body Strain Regulation in Continuum Robots
di: Molu, Lekan
Pubblicazione: (2023)