Structuring Value Representations via Geometric Coherence in Markov Decision Processes
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Zuyuan, Fang, Zeyu, Lan, Tian |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Manifold-Constrained Energy-Based Transition Models for Offline Reinforcement Learning
by: Fang, Zeyu, et al.
Published: (2026)
by: Fang, Zeyu, et al.
Published: (2026)
Cochain Perspectives on Temporal-Difference Signals for Learning Beyond Markov Dynamics
by: Zhang, Zuyuan, et al.
Published: (2026)
by: Zhang, Zuyuan, et al.
Published: (2026)
Lipschitz Lifelong Monte Carlo Tree Search for Mastering Non-Stationary Tasks
by: Zhang, Zuyuan, et al.
Published: (2025)
by: Zhang, Zuyuan, et al.
Published: (2025)
Geometry of Drifting MDPs with Path-Integral Stability Certificates
by: Zhang, Zuyuan, et al.
Published: (2026)
by: Zhang, Zuyuan, et al.
Published: (2026)
Tail-Risk-Safe Monte Carlo Tree Search under PAC-Level Guarantees
by: Zhang, Zuyuan, et al.
Published: (2025)
by: Zhang, Zuyuan, et al.
Published: (2025)
Network Diffuser for Placing-Scheduling Service Function Chains with Inverse Demonstration
by: Zhang, Zuyuan, et al.
Published: (2025)
by: Zhang, Zuyuan, et al.
Published: (2025)
Value Iteration with Guessing for Markov Chains and Markov Decision Processes
by: Chatterjee, Krishnendu, et al.
Published: (2025)
by: Chatterjee, Krishnendu, et al.
Published: (2025)
Operator-Guided Invariance Learning for Continuous Reinforcement Learning
by: Zhang, Zuyuan, et al.
Published: (2026)
by: Zhang, Zuyuan, et al.
Published: (2026)
Matrix-Space Reinforcement Learning for Reusing Local Transition Geometry
by: Zhang, Zuyuan, et al.
Published: (2026)
by: Zhang, Zuyuan, et al.
Published: (2026)
Collaborative AI Teaming in Unknown Environments via Active Goal Deduction
by: Zhang, Zuyuan, et al.
Published: (2024)
by: Zhang, Zuyuan, et al.
Published: (2024)
Metric-Gradient Projection for Stable Multi-Agent Policy Learning
by: Zhang, Zuyuan, et al.
Published: (2026)
by: Zhang, Zuyuan, et al.
Published: (2026)
Interactive Critique-Revision Training for Reliable Structured LLM Generation
by: Yu, Fei Xu, et al.
Published: (2026)
by: Yu, Fei Xu, et al.
Published: (2026)
Quantile Markov Decision Process
by: Li, Xiaocheng, et al.
Published: (2017)
by: Li, Xiaocheng, et al.
Published: (2017)
Creativity and Markov Decision Processes
by: Lahikainen, Joonas, et al.
Published: (2024)
by: Lahikainen, Joonas, et al.
Published: (2024)
Homomorphic Mappings for Value-Preserving State Aggregation in Markov Decision Processes
by: Zhao, Shuo, et al.
Published: (2025)
by: Zhao, Shuo, et al.
Published: (2025)
REValueD: Regularised Ensemble Value-Decomposition for Factorisable Markov Decision Processes
by: Ireland, David, et al.
Published: (2024)
by: Ireland, David, et al.
Published: (2024)
Counterfactual Influence in Markov Decision Processes
by: Kazemi, Milad, et al.
Published: (2024)
by: Kazemi, Milad, et al.
Published: (2024)
Sharpe Ratio Optimization in Markov Decision Processes
by: Ma, Shuai, et al.
Published: (2025)
by: Ma, Shuai, et al.
Published: (2025)
Robust Counterfactual Inference in Markov Decision Processes
by: Lally, Jessica, et al.
Published: (2025)
by: Lally, Jessica, et al.
Published: (2025)
Optimal Decision Tree Policies for Markov Decision Processes
by: Vos, Daniël, et al.
Published: (2023)
by: Vos, Daniël, et al.
Published: (2023)
MINT: Minimal Information Neuro-Symbolic Tree for Objective-Driven Knowledge-Gap Reasoning and Active Elicitation
by: Fang, Zeyu, et al.
Published: (2026)
by: Fang, Zeyu, et al.
Published: (2026)
Global Optimization on Graph-Structured Data via Gaussian Processes with Spectral Representations
by: Hong, Shu, et al.
Published: (2025)
by: Hong, Shu, et al.
Published: (2025)
Intermittently Observable Markov Decision Processes
by: Chen, Gongpu, et al.
Published: (2023)
by: Chen, Gongpu, et al.
Published: (2023)
Generalization in Monitored Markov Decision Processes (Mon-MDPs)
by: Mohammedalamen, Montaser, et al.
Published: (2025)
by: Mohammedalamen, Montaser, et al.
Published: (2025)
Markov Decision Processes under External Temporal Processes
by: Ayyagari, Ranga Shaarad, et al.
Published: (2023)
by: Ayyagari, Ranga Shaarad, et al.
Published: (2023)
On Decision-Valued Maps and Representational Dependence
by: Raitses, Gil
Published: (2026)
by: Raitses, Gil
Published: (2026)
Counterfactual Strategies for Markov Decision Processes
by: Kobialka, Paul, et al.
Published: (2025)
by: Kobialka, Paul, et al.
Published: (2025)
Causal Temporal Reasoning for Markov Decision Processes
by: Kazemi, Milad, et al.
Published: (2022)
by: Kazemi, Milad, et al.
Published: (2022)
Policy Gradient for Robust Markov Decision Processes
by: Wang, Qiuhao, et al.
Published: (2024)
by: Wang, Qiuhao, et al.
Published: (2024)
Recursively-Constrained Partially Observable Markov Decision Processes
by: Ho, Qi Heng, et al.
Published: (2023)
by: Ho, Qi Heng, et al.
Published: (2023)
Act as You Learn: Adaptive Decision-Making in Non-Stationary Markov Decision Processes
by: Luo, Baiting, et al.
Published: (2024)
by: Luo, Baiting, et al.
Published: (2024)
Observation Adaptation via Annealed Importance Resampling for Partially Observable Markov Decision Processes
by: Zhang, Yunuo, et al.
Published: (2025)
by: Zhang, Yunuo, et al.
Published: (2025)
Attribution-based Explanations for Markov Decision Processes
by: Kobialka, Paul, et al.
Published: (2026)
by: Kobialka, Paul, et al.
Published: (2026)
Beyond Average Return in Markov Decision Processes
by: Marthe, Alexandre, et al.
Published: (2023)
by: Marthe, Alexandre, et al.
Published: (2023)
Interval Markov Decision Processes with Continuous Action-Spaces
by: Delimpaltadakis, Giannis, et al.
Published: (2022)
by: Delimpaltadakis, Giannis, et al.
Published: (2022)
Improved Monte Carlo Planning via Causal Disentanglement for Structurally-Decomposed Markov Decision Processes
by: Liu, Larkin, et al.
Published: (2024)
by: Liu, Larkin, et al.
Published: (2024)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
by: Vora, Kevin, et al.
Published: (2025)
by: Vora, Kevin, et al.
Published: (2025)
OCMDP: Observation-Constrained Markov Decision Process
by: Wang, Taiyi, et al.
Published: (2024)
by: Wang, Taiyi, et al.
Published: (2024)
Deep Hierarchical Reinforcement Learning Algorithm in Partially Observable Markov Decision Processes
by: Tuyen, Le Pham, et al.
Published: (2018)
by: Tuyen, Le Pham, et al.
Published: (2018)
FactorSmith: Agentic Simulation Generation via Markov Decision Process Decomposition with Planner-Designer-Critic Refinement
by: Shamsaddinlou, Ali, et al.
Published: (2026)
by: Shamsaddinlou, Ali, et al.
Published: (2026)
Similar Items
-
Manifold-Constrained Energy-Based Transition Models for Offline Reinforcement Learning
by: Fang, Zeyu, et al.
Published: (2026) -
Cochain Perspectives on Temporal-Difference Signals for Learning Beyond Markov Dynamics
by: Zhang, Zuyuan, et al.
Published: (2026) -
Lipschitz Lifelong Monte Carlo Tree Search for Mastering Non-Stationary Tasks
by: Zhang, Zuyuan, et al.
Published: (2025) -
Geometry of Drifting MDPs with Path-Integral Stability Certificates
by: Zhang, Zuyuan, et al.
Published: (2026) -
Tail-Risk-Safe Monte Carlo Tree Search under PAC-Level Guarantees
by: Zhang, Zuyuan, et al.
Published: (2025)