Value-Decomposed Reinforcement Learning Framework for Taxiway Routing with Hierarchical Conflict-Aware Observations
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Shizhong, Liu, Haifeng, Zhang, Zheng, Zhang, Shiyu, Yang, Bo, Lin, Yi |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
POST: Prior-Observation Adversarial Learning of Spatio-Temporal Associations for Multivariate Time Series Anomaly Detection
by: Zhang, Suofei, et al.
Published: (2026)
by: Zhang, Suofei, et al.
Published: (2026)
SeqRoute: Global Budget-Aware Sequential LLM Routing via Offline Reinforcement Learning
by: Xu, Zhongling, et al.
Published: (2026)
by: Xu, Zhongling, et al.
Published: (2026)
Reward-Decomposed Reinforcement Learning for Immersive Video Role-Playing
by: Wang, Miao, et al.
Published: (2026)
by: Wang, Miao, et al.
Published: (2026)
CARE-RL: Capability-Aware Reinforcement Learning for Mitigating Cross-Domain Conflicts
by: Zhang, Rui, et al.
Published: (2026)
by: Zhang, Rui, et al.
Published: (2026)
Union of Experts: Adapting Hierarchical Routing to Equivalently Decomposed Transformer
by: Yang, Yujiao, et al.
Published: (2025)
by: Yang, Yujiao, et al.
Published: (2025)
Bridging Values and Behavior: A Hierarchical Framework for Proactive Embodied Agents
by: Zhang, Chunhui, et al.
Published: (2026)
by: Zhang, Chunhui, et al.
Published: (2026)
HGFormer: A Hierarchical Graph Transformer Framework for Two-Stage Colonel Blotto Games via Reinforcement Learning
by: Lv, Yang, et al.
Published: (2025)
by: Lv, Yang, et al.
Published: (2025)
Decomposing and Measuring Evaluation Awareness
by: Li, Changling, et al.
Published: (2026)
by: Li, Changling, et al.
Published: (2026)
An Overlay Multicast Routing Method Based on Network Situational Awareness and Hierarchical Multi-Agent Reinforcement Learning
by: Ye, Miao, et al.
Published: (2026)
by: Ye, Miao, et al.
Published: (2026)
TreeMIL: A Multi-instance Learning Framework for Time Series Anomaly Detection with Inexact Supervision
by: Liu, Chen, et al.
Published: (2024)
by: Liu, Chen, et al.
Published: (2024)
AHBid: An Adaptable Hierarchical Bidding Framework for Cross-Channel Advertising
by: Yang, Xinxin, et al.
Published: (2026)
by: Yang, Xinxin, et al.
Published: (2026)
Hierarchical Reinforcement Learning and Value Optimization for Challenging Quadruped Locomotion
by: Coholich, Jeremiah, et al.
Published: (2025)
by: Coholich, Jeremiah, et al.
Published: (2025)
A Theoretical Understanding of Gradient Bias in Meta-Reinforcement Learning
by: Feng, Xidong, et al.
Published: (2021)
by: Feng, Xidong, et al.
Published: (2021)
TimeMixer: Decomposable Multiscale Mixing for Time Series Forecasting
by: Wang, Shiyu, et al.
Published: (2024)
by: Wang, Shiyu, et al.
Published: (2024)
Optimal-Agent-Selection: State-Aware Routing Framework for Efficient Multi-Agent Collaboration
by: Wang, Jingbo, et al.
Published: (2025)
by: Wang, Jingbo, et al.
Published: (2025)
CaDA: Cross-Problem Routing Solver with Constraint-Aware Dual-Attention
by: Li, Han, et al.
Published: (2024)
by: Li, Han, et al.
Published: (2024)
Multi-Stakeholder LLM Alignment: Decomposing Estimation from Aggregation
by: Zheng, Lulu, et al.
Published: (2026)
by: Zheng, Lulu, et al.
Published: (2026)
Explaining Reinforcement Learning: A Counterfactual Shapley Values Approach
by: Shi, Yiwei, et al.
Published: (2024)
by: Shi, Yiwei, et al.
Published: (2024)
Attention-Driven Hierarchical Reinforcement Learning with Particle Filtering for Source Localization in Dynamic Fields
by: Shi, Yiwei, et al.
Published: (2025)
by: Shi, Yiwei, et al.
Published: (2025)
AllSpark: A Multimodal Spatio-Temporal General Intelligence Model with Ten Modalities via Language as a Reference Framework
by: Shao, Run, et al.
Published: (2023)
by: Shao, Run, et al.
Published: (2023)
Think, Speak, Decide: Language-Augmented Multi-Agent Reinforcement Learning for Economic Decision-Making
by: Ma, Heyang, et al.
Published: (2025)
by: Ma, Heyang, et al.
Published: (2025)
PairVDN - Pair-wise Decomposed Value Functions
by: Buzzard, Zak
Published: (2025)
by: Buzzard, Zak
Published: (2025)
Multi-Task Vehicle Routing Solver via Mixture of Specialized Experts under State-Decomposable MDP
by: Pan, Yuxin, et al.
Published: (2025)
by: Pan, Yuxin, et al.
Published: (2025)
StepOPSD: Step-Aware Online Preference Distillation for Agent Reinforcement Learning
by: Zhang, Yanfei, et al.
Published: (2026)
by: Zhang, Yanfei, et al.
Published: (2026)
Constraint-Aware Route Recommendation from Natural Language via Hierarchical LLM Agents
by: Zhe, Tao, et al.
Published: (2025)
by: Zhe, Tao, et al.
Published: (2025)
From Observations to Events: Event-Aware World Model for Reinforcement Learning
by: Peng, Zhao-Han, et al.
Published: (2026)
by: Peng, Zhao-Han, et al.
Published: (2026)
Hierarchical Learning-based Graph Partition for Large-scale Vehicle Routing Problems
by: Pan, Yuxin, et al.
Published: (2025)
by: Pan, Yuxin, et al.
Published: (2025)
Learning by Doing: An Online Causal Reinforcement Learning Framework with Causal-Aware Policy
by: Cai, Ruichu, et al.
Published: (2024)
by: Cai, Ruichu, et al.
Published: (2024)
Towards Large-Scale In-Context Reinforcement Learning by Meta-Training in Randomized Worlds
by: Wang, Fan, et al.
Published: (2025)
by: Wang, Fan, et al.
Published: (2025)
An Agentic Framework with LLMs for Solving Complex Vehicle Routing Problems
by: Zhang, Ni, et al.
Published: (2025)
by: Zhang, Ni, et al.
Published: (2025)
Sketch Then Paint: Hierarchical Reinforcement Learning for Diffusion Multi-Modal Large Language Models
by: Luo, Siqi, et al.
Published: (2026)
by: Luo, Siqi, et al.
Published: (2026)
Hierarchical Reinforcement Learning for Temporal Abstraction of Listwise Recommendation
by: Ji, Luo, et al.
Published: (2024)
by: Ji, Luo, et al.
Published: (2024)
ConsRoute:Consistency-Aware Adaptive Query Routing for Cloud-Edge-Device Large Language Models
by: Qiao, Haoyu, et al.
Published: (2026)
by: Qiao, Haoyu, et al.
Published: (2026)
Know When to Explore: Difficulty-Aware Certainty as a Guide for LLM Reinforcement Learning
by: Li, Ang, et al.
Published: (2025)
by: Li, Ang, et al.
Published: (2025)
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
by: Huang, Sili, et al.
Published: (2024)
by: Huang, Sili, et al.
Published: (2024)
Learning Hierarchical and Geometry-Aware Graph Representations for Text-to-CAD
by: Gong, Shengjie, et al.
Published: (2026)
by: Gong, Shengjie, et al.
Published: (2026)
ECon: On the Detection and Resolution of Evidence Conflicts
by: Jiayang, Cheng, et al.
Published: (2024)
by: Jiayang, Cheng, et al.
Published: (2024)
Cross-Problem Learning for Solving Vehicle Routing Problems
by: Lin, Zhuoyi, et al.
Published: (2024)
by: Lin, Zhuoyi, et al.
Published: (2024)
LAMARL: LLM-Aided Multi-Agent Reinforcement Learning for Cooperative Policy Generation
by: Zhu, Guobin, et al.
Published: (2025)
by: Zhu, Guobin, et al.
Published: (2025)
Preserve Support, Not Correspondence: Dynamic Routing for Offline Reinforcement Learning
by: Mu, Zhancun, et al.
Published: (2026)
by: Mu, Zhancun, et al.
Published: (2026)
Similar Items
-
POST: Prior-Observation Adversarial Learning of Spatio-Temporal Associations for Multivariate Time Series Anomaly Detection
by: Zhang, Suofei, et al.
Published: (2026) -
SeqRoute: Global Budget-Aware Sequential LLM Routing via Offline Reinforcement Learning
by: Xu, Zhongling, et al.
Published: (2026) -
Reward-Decomposed Reinforcement Learning for Immersive Video Role-Playing
by: Wang, Miao, et al.
Published: (2026) -
CARE-RL: Capability-Aware Reinforcement Learning for Mitigating Cross-Domain Conflicts
by: Zhang, Rui, et al.
Published: (2026) -
Union of Experts: Adapting Hierarchical Routing to Equivalently Decomposed Transformer
by: Yang, Yujiao, et al.
Published: (2025)