An Idiosyncrasy of Time-discretization in Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | De Asis, Kris, Sutton, Richard S. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
di: Li, Xidong, et al.
Pubblicazione: (2026)
di: Li, Xidong, et al.
Pubblicazione: (2026)
Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning
di: Wang, Zizhao, et al.
Pubblicazione: (2024)
di: Wang, Zizhao, et al.
Pubblicazione: (2024)
Towards a Robust Soft Baby Robot With Rich Interaction Ability for Advanced Machine Learning Algorithms
di: Alhakami, Mohannad, et al.
Pubblicazione: (2024)
di: Alhakami, Mohannad, et al.
Pubblicazione: (2024)
Predictive Traffic Rule Compliance using Reinforcement Learning
di: Huang, Yanliang, et al.
Pubblicazione: (2025)
di: Huang, Yanliang, et al.
Pubblicazione: (2025)
MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from Intervention
di: Chen, Yuxin, et al.
Pubblicazione: (2024)
di: Chen, Yuxin, et al.
Pubblicazione: (2024)
SPACeR: Self-Play Anchoring with Centralized Reference Models
di: Chang, Wei-Jer, et al.
Pubblicazione: (2025)
di: Chang, Wei-Jer, et al.
Pubblicazione: (2025)
SaiVLA-0: Cerebrum--Pons--Cerebellum Tripartite Architecture for Compute-Aware Vision-Language-Action
di: Shi, Xiang, et al.
Pubblicazione: (2026)
di: Shi, Xiang, et al.
Pubblicazione: (2026)
When Does Adaptive Guidance Help? Belief-Aware Privileged Distillation for Autonomous Driving Under Partial Observability
di: Haklidir, Mehmet
Pubblicazione: (2026)
di: Haklidir, Mehmet
Pubblicazione: (2026)
CUPID: Curating Data your Robot Loves with Influence Functions
di: Agia, Christopher, et al.
Pubblicazione: (2025)
di: Agia, Christopher, et al.
Pubblicazione: (2025)
GammaZero: Learning To Guide POMDP Belief Space Search With Graph Representations
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2025)
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2025)
The Shortcomings of Force-from-Motion in Robot Learning
di: Aljalbout, Elie, et al.
Pubblicazione: (2024)
di: Aljalbout, Elie, et al.
Pubblicazione: (2024)
RoboPack: Learning Tactile-Informed Dynamics Models for Dense Packing
di: Ai, Bo, et al.
Pubblicazione: (2024)
di: Ai, Bo, et al.
Pubblicazione: (2024)
Improving Agent Behaviors with RL Fine-tuning for Autonomous Driving
di: Peng, Zhenghao, et al.
Pubblicazione: (2024)
di: Peng, Zhenghao, et al.
Pubblicazione: (2024)
The State of Robot Motion Generation
di: Bekris, Kostas E., et al.
Pubblicazione: (2024)
di: Bekris, Kostas E., et al.
Pubblicazione: (2024)
A Framework for Neurosymbolic Robot Action Planning using Large Language Models
di: Capitanelli, Alessio, et al.
Pubblicazione: (2023)
di: Capitanelli, Alessio, et al.
Pubblicazione: (2023)
The Reality Gap in Robotics: Challenges, Solutions, and Best Practices
di: Aljalbout, Elie, et al.
Pubblicazione: (2025)
di: Aljalbout, Elie, et al.
Pubblicazione: (2025)
Achieving Scalable Robot Autonomy via neurosymbolic planning using lightweight local LLM
di: Attolino, Nicholas, et al.
Pubblicazione: (2025)
di: Attolino, Nicholas, et al.
Pubblicazione: (2025)
Cost-Aware Diffusion Active Search
di: Banerjee, Arundhati, et al.
Pubblicazione: (2026)
di: Banerjee, Arundhati, et al.
Pubblicazione: (2026)
Graph Neural Network Based Action Ranking for Planning
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2024)
di: Mangannavar, Rajesh, et al.
Pubblicazione: (2024)
Conservative Bias in Multi-Teacher Learning: Why Agents Prefer Low-Reward Advisors
di: Mesto, Maher, et al.
Pubblicazione: (2025)
di: Mesto, Maher, et al.
Pubblicazione: (2025)
Sim-to-reality adaptation for Deep Reinforcement Learning applied to an underwater docking application
di: Chaarani, Alaaeddine, et al.
Pubblicazione: (2026)
di: Chaarani, Alaaeddine, et al.
Pubblicazione: (2026)
Adapting Interleaved Encoders with PPO for Language-Guided Reinforcement Learning in BabyAI
di: Mathur, Aryan, et al.
Pubblicazione: (2025)
di: Mathur, Aryan, et al.
Pubblicazione: (2025)
Accelerating Model-Based Reinforcement Learning with State-Space World Models
di: Krinner, Maria, et al.
Pubblicazione: (2025)
di: Krinner, Maria, et al.
Pubblicazione: (2025)
D-Shape: Demonstration-Shaped Reinforcement Learning via Goal Conditioning
di: Wang, Caroline, et al.
Pubblicazione: (2022)
di: Wang, Caroline, et al.
Pubblicazione: (2022)
Robo-CSK-Organizer: Commonsense Knowledge to Organize Detected Objects for Multipurpose Robots
di: Hidalgo, Rafael, et al.
Pubblicazione: (2024)
di: Hidalgo, Rafael, et al.
Pubblicazione: (2024)
Energy-Efficient Quadruped Locomotion with Compliant Feet
di: Pal, Pramod, et al.
Pubblicazione: (2026)
di: Pal, Pramod, et al.
Pubblicazione: (2026)
Atomic-Probe Governance for Skill Updates in Compositional Robot Policies
di: Qin, Xue, et al.
Pubblicazione: (2026)
di: Qin, Xue, et al.
Pubblicazione: (2026)
Closed-Loop Neural Activation Control in Vision-Language-Action Models
di: Babu, Abhijith, et al.
Pubblicazione: (2026)
di: Babu, Abhijith, et al.
Pubblicazione: (2026)
Multi-Agent Pathfinding with Non-Unit Integer Edge Costs via Enhanced Conflict-Based Search and Graph Discretization
di: Fan, Hongkai, et al.
Pubblicazione: (2026)
di: Fan, Hongkai, et al.
Pubblicazione: (2026)
Altered Thoughts, Altered Actions: Probing Chain-of-Thought Vulnerabilities in VLA Robotic Manipulation
di: Trinh, Tuan Duong, et al.
Pubblicazione: (2026)
di: Trinh, Tuan Duong, et al.
Pubblicazione: (2026)
Unpacking Failure Modes of Generative Policies: Runtime Monitoring of Consistency and Progress
di: Agia, Christopher, et al.
Pubblicazione: (2024)
di: Agia, Christopher, et al.
Pubblicazione: (2024)
Failure Prediction at Runtime for Generative Robot Policies
di: Römer, Ralf, et al.
Pubblicazione: (2025)
di: Römer, Ralf, et al.
Pubblicazione: (2025)
Pure Planning to Pure Policies and In Between with a Recursive Tree Planner
di: Redlich, A. Norman
Pubblicazione: (2024)
di: Redlich, A. Norman
Pubblicazione: (2024)
LANGTRAJ: Diffusion Model and Dataset for Language-Conditioned Trajectory Simulation
di: Chang, Wei-Jer, et al.
Pubblicazione: (2025)
di: Chang, Wei-Jer, et al.
Pubblicazione: (2025)
Positive-Only Drifting Policy Optimization
di: Zhang, Qi
Pubblicazione: (2026)
di: Zhang, Qi
Pubblicazione: (2026)
Physics-Informed Policy Optimization via Analytic Dynamics Regularization
di: Chandra, Namai, et al.
Pubblicazione: (2026)
di: Chandra, Namai, et al.
Pubblicazione: (2026)
How VLAs Fail Differently: Black-Box Action Monitoring Reveals Architecture-Specific Failure Signatures
di: Gupta, Krishnam
Pubblicazione: (2026)
di: Gupta, Krishnam
Pubblicazione: (2026)
Tactile-Proprioceptive Sensor Fusion for Contact Wrench Estimation in Whole-Body Physical Human-Robot Interaction
di: Min, Junha, et al.
Pubblicazione: (2026)
di: Min, Junha, et al.
Pubblicazione: (2026)
Reinforcement Learning-Based Energy-Aware Coverage Path Planning for Precision Agriculture
di: Wu, Beining, et al.
Pubblicazione: (2026)
di: Wu, Beining, et al.
Pubblicazione: (2026)
Simulation-Based Counterfactual Causal Discovery on Real World Driver Behaviour
di: Howard, Rhys, et al.
Pubblicazione: (2023)
di: Howard, Rhys, et al.
Pubblicazione: (2023)
Documenti analoghi
-
MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
di: Li, Xidong, et al.
Pubblicazione: (2026) -
Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning
di: Wang, Zizhao, et al.
Pubblicazione: (2024) -
Towards a Robust Soft Baby Robot With Rich Interaction Ability for Advanced Machine Learning Algorithms
di: Alhakami, Mohannad, et al.
Pubblicazione: (2024) -
Predictive Traffic Rule Compliance using Reinforcement Learning
di: Huang, Yanliang, et al.
Pubblicazione: (2025) -
MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from Intervention
di: Chen, Yuxin, et al.
Pubblicazione: (2024)