GammaZero: Learning To Guide POMDP Belief Space Search With Graph Representations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mangannavar, Rajesh, Tadepalli, Prasad |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Graph Neural Network Based Action Ranking for Planning
par: Mangannavar, Rajesh, et autres
Publié: (2024)
par: Mangannavar, Rajesh, et autres
Publié: (2024)
Hierarchical Object-Oriented POMDP Planning for Object Rearrangement
par: Mangannavar, Rajesh, et autres
Publié: (2024)
par: Mangannavar, Rajesh, et autres
Publié: (2024)
Multi-Agent Pathfinding with Non-Unit Integer Edge Costs via Enhanced Conflict-Based Search and Graph Discretization
par: Fan, Hongkai, et autres
Publié: (2026)
par: Fan, Hongkai, et autres
Publié: (2026)
Improving Agent Behaviors with RL Fine-tuning for Autonomous Driving
par: Peng, Zhenghao, et autres
Publié: (2024)
par: Peng, Zhenghao, et autres
Publié: (2024)
Predictive Traffic Rule Compliance using Reinforcement Learning
par: Huang, Yanliang, et autres
Publié: (2025)
par: Huang, Yanliang, et autres
Publié: (2025)
Conservative Bias in Multi-Teacher Learning: Why Agents Prefer Low-Reward Advisors
par: Mesto, Maher, et autres
Publié: (2025)
par: Mesto, Maher, et autres
Publié: (2025)
Energy-Efficient Quadruped Locomotion with Compliant Feet
par: Pal, Pramod, et autres
Publié: (2026)
par: Pal, Pramod, et autres
Publié: (2026)
Robo-CSK-Organizer: Commonsense Knowledge to Organize Detected Objects for Multipurpose Robots
par: Hidalgo, Rafael, et autres
Publié: (2024)
par: Hidalgo, Rafael, et autres
Publié: (2024)
Atomic-Probe Governance for Skill Updates in Compositional Robot Policies
par: Qin, Xue, et autres
Publié: (2026)
par: Qin, Xue, et autres
Publié: (2026)
When Does Adaptive Guidance Help? Belief-Aware Privileged Distillation for Autonomous Driving Under Partial Observability
par: Haklidir, Mehmet
Publié: (2026)
par: Haklidir, Mehmet
Publié: (2026)
Closed-Loop Neural Activation Control in Vision-Language-Action Models
par: Babu, Abhijith, et autres
Publié: (2026)
par: Babu, Abhijith, et autres
Publié: (2026)
An Idiosyncrasy of Time-discretization in Reinforcement Learning
par: De Asis, Kris, et autres
Publié: (2024)
par: De Asis, Kris, et autres
Publié: (2024)
Simulation-Based Counterfactual Causal Discovery on Real World Driver Behaviour
par: Howard, Rhys, et autres
Publié: (2023)
par: Howard, Rhys, et autres
Publié: (2023)
Bimanual Robot Manipulation via Multi-Agent In-Context Learning
par: Palma, Alessio, et autres
Publié: (2026)
par: Palma, Alessio, et autres
Publié: (2026)
Sim-to-reality adaptation for Deep Reinforcement Learning applied to an underwater docking application
par: Chaarani, Alaaeddine, et autres
Publié: (2026)
par: Chaarani, Alaaeddine, et autres
Publié: (2026)
Cost-Aware Diffusion Active Search
par: Banerjee, Arundhati, et autres
Publié: (2026)
par: Banerjee, Arundhati, et autres
Publié: (2026)
Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
par: Aida, Adriana, et autres
Publié: (2026)
par: Aida, Adriana, et autres
Publié: (2026)
Learning Agents With Prioritization and Parameter Noise in Continuous State and Action Space
par: Mangannavar, Rajesh, et autres
Publié: (2024)
par: Mangannavar, Rajesh, et autres
Publié: (2024)
MTDrive: Multi-turn Interactive Reinforcement Learning for Autonomous Driving
par: Li, Xidong, et autres
Publié: (2026)
par: Li, Xidong, et autres
Publié: (2026)
Towards a Robust Soft Baby Robot With Rich Interaction Ability for Advanced Machine Learning Algorithms
par: Alhakami, Mohannad, et autres
Publié: (2024)
par: Alhakami, Mohannad, et autres
Publié: (2024)
FCBV-Net: Category-Level Robotic Garment Smoothing via Feature-Conditioned Bimanual Value Prediction
par: Daba, Mohammed, et autres
Publié: (2025)
par: Daba, Mohammed, et autres
Publié: (2025)
DRAE: Dynamic Retrieval-Augmented Expert Networks for Lifelong Learning and Task Adaptation in Robotics
par: Long, Yayu, et autres
Publié: (2025)
par: Long, Yayu, et autres
Publié: (2025)
ScoRe-Flow: Complete Distributional Control via Score-Based Reinforcement Learning for Flow Matching
par: Qiu, Xiaotian, et autres
Publié: (2026)
par: Qiu, Xiaotian, et autres
Publié: (2026)
CaMeRL: Collision-Aware and Memory-Enhanced Reinforcement Learning for UAV Navigation in Multi-Scale Obstacle Environments
par: Hong, Hong, et autres
Publié: (2026)
par: Hong, Hong, et autres
Publié: (2026)
The Shortcomings of Force-from-Motion in Robot Learning
par: Aljalbout, Elie, et autres
Publié: (2024)
par: Aljalbout, Elie, et autres
Publié: (2024)
Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning
par: Wang, Zizhao, et autres
Publié: (2024)
par: Wang, Zizhao, et autres
Publié: (2024)
VITA: Zero-Shot Value Functions via Test-Time Adaptation of Vision-Language Models
par: Ziakas, Christos, et autres
Publié: (2025)
par: Ziakas, Christos, et autres
Publié: (2025)
SPACeR: Self-Play Anchoring with Centralized Reference Models
par: Chang, Wei-Jer, et autres
Publié: (2025)
par: Chang, Wei-Jer, et autres
Publié: (2025)
CUPID: Curating Data your Robot Loves with Influence Functions
par: Agia, Christopher, et autres
Publié: (2025)
par: Agia, Christopher, et autres
Publié: (2025)
SaiVLA-0: Cerebrum--Pons--Cerebellum Tripartite Architecture for Compute-Aware Vision-Language-Action
par: Shi, Xiang, et autres
Publié: (2026)
par: Shi, Xiang, et autres
Publié: (2026)
Evaluating Temporal Observation-Based Causal Discovery Techniques Applied to Road Driver Behaviour
par: Howard, Rhys, et autres
Publié: (2023)
par: Howard, Rhys, et autres
Publié: (2023)
MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from Intervention
par: Chen, Yuxin, et autres
Publié: (2024)
par: Chen, Yuxin, et autres
Publié: (2024)
RoboPack: Learning Tactile-Informed Dynamics Models for Dense Packing
par: Ai, Bo, et autres
Publié: (2024)
par: Ai, Bo, et autres
Publié: (2024)
Decentralized Aerial Manipulation of a Cable-Suspended Load using Multi-Agent Reinforcement Learning
par: Zeng, Jack, et autres
Publié: (2025)
par: Zeng, Jack, et autres
Publié: (2025)
LiloDriver: A Lifelong Learning Framework for Closed-loop Motion Planning in Long-tail Autonomous Driving Scenarios
par: Yao, Huaiyuan, et autres
Publié: (2025)
par: Yao, Huaiyuan, et autres
Publié: (2025)
RoboGrind: Intuitive and Interactive Surface Treatment with Industrial Robots
par: Alt, Benjamin, et autres
Publié: (2024)
par: Alt, Benjamin, et autres
Publié: (2024)
Preventing Robotic Jailbreaking via Multimodal Domain Adaptation
par: Marchiori, Francesco, et autres
Publié: (2025)
par: Marchiori, Francesco, et autres
Publié: (2025)
Magnet-Based Soft Robotic Skin Using a 3D-Printed Multi-Lattice Structure and CNN-Based Tactile Super-Resolution
par: Bang, Yunseong, et autres
Publié: (2026)
par: Bang, Yunseong, et autres
Publié: (2026)
Affordance-Aware Interactive Decision-Making and Execution for Ambiguous Instructions
par: Xu, Hengxuan, et autres
Publié: (2026)
par: Xu, Hengxuan, et autres
Publié: (2026)
The Reality Gap in Robotics: Challenges, Solutions, and Best Practices
par: Aljalbout, Elie, et autres
Publié: (2025)
par: Aljalbout, Elie, et autres
Publié: (2025)
Documents similaires
-
Graph Neural Network Based Action Ranking for Planning
par: Mangannavar, Rajesh, et autres
Publié: (2024) -
Hierarchical Object-Oriented POMDP Planning for Object Rearrangement
par: Mangannavar, Rajesh, et autres
Publié: (2024) -
Multi-Agent Pathfinding with Non-Unit Integer Edge Costs via Enhanced Conflict-Based Search and Graph Discretization
par: Fan, Hongkai, et autres
Publié: (2026) -
Improving Agent Behaviors with RL Fine-tuning for Autonomous Driving
par: Peng, Zhenghao, et autres
Publié: (2024) -
Predictive Traffic Rule Compliance using Reinforcement Learning
par: Huang, Yanliang, et autres
Publié: (2025)