Enregistré dans:
| Auteurs principaux: | Zhang, Zuyuan, Lan, Tian |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.00633 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tail-Risk-Safe Monte Carlo Tree Search under PAC-Level Guarantees
par: Zhang, Zuyuan, et autres
Publié: (2025)
par: Zhang, Zuyuan, et autres
Publié: (2025)
Structuring Value Representations via Geometric Coherence in Markov Decision Processes
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
LiSFC-Search: Lifelong Search for Network SFC Optimization under Non-stationary Drifts
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
NonZero: Interaction-Guided Exploration for Multi-Agent Monte Carlo Tree Search
par: Tang, Sizhe, et autres
Publié: (2026)
par: Tang, Sizhe, et autres
Publié: (2026)
Geometry of Drifting MDPs with Path-Integral Stability Certificates
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
Cochain Perspectives on Temporal-Difference Signals for Learning Beyond Markov Dynamics
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
Network Diffuser for Placing-Scheduling Service Function Chains with Inverse Demonstration
par: Zhang, Zuyuan, et autres
Publié: (2025)
par: Zhang, Zuyuan, et autres
Publié: (2025)
Operator-Guided Invariance Learning for Continuous Reinforcement Learning
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
Matrix-Space Reinforcement Learning for Reusing Local Transition Geometry
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
Metric-Gradient Projection for Stable Multi-Agent Policy Learning
par: Zhang, Zuyuan, et autres
Publié: (2026)
par: Zhang, Zuyuan, et autres
Publié: (2026)
Manifold-Constrained Energy-Based Transition Models for Offline Reinforcement Learning
par: Fang, Zeyu, et autres
Publié: (2026)
par: Fang, Zeyu, et autres
Publié: (2026)
Monte Carlo Search Algorithms Discovering Monte Carlo Tree Search Exploration Terms
par: Cazenave, Tristan
Publié: (2024)
par: Cazenave, Tristan
Publié: (2024)
Collaborative AI Teaming in Unknown Environments via Active Goal Deduction
par: Zhang, Zuyuan, et autres
Publié: (2024)
par: Zhang, Zuyuan, et autres
Publié: (2024)
Epistemic Monte Carlo Tree Search
par: Oren, Yaniv, et autres
Publié: (2022)
par: Oren, Yaniv, et autres
Publié: (2022)
Action-Gradient Monte Carlo Tree Search for Non-Parametric Continuous (PO)MDPs
par: Lev-Yehudi, Idan, et autres
Publié: (2025)
par: Lev-Yehudi, Idan, et autres
Publié: (2025)
Monte Carlo Tree Search in the Presence of Transition Uncertainty
par: Kohankhaki, Farnaz, et autres
Publié: (2023)
par: Kohankhaki, Farnaz, et autres
Publié: (2023)
Generalized Proof-Number Monte-Carlo Tree Search
par: Kowalski, Jakub, et autres
Publié: (2025)
par: Kowalski, Jakub, et autres
Publié: (2025)
Proof Number Based Monte-Carlo Tree Search
par: Kowalski, Jakub, et autres
Publié: (2023)
par: Kowalski, Jakub, et autres
Publié: (2023)
Array-Based Monte Carlo Tree Search
par: Ragan, James, et autres
Publié: (2025)
par: Ragan, James, et autres
Publié: (2025)
Twice Sequential Monte Carlo for Tree Search
par: Oren, Yaniv, et autres
Publié: (2025)
par: Oren, Yaniv, et autres
Publié: (2025)
Doubly Robust Monte Carlo Tree Search
par: Liu, Manqing, et autres
Publié: (2025)
par: Liu, Manqing, et autres
Publié: (2025)
SWE-Search: Enhancing Software Agents with Monte Carlo Tree Search and Iterative Refinement
par: Antoniades, Antonis, et autres
Publié: (2024)
par: Antoniades, Antonis, et autres
Publié: (2024)
Lookahead Pathology in Monte-Carlo Tree Search
par: Nguyen, Khoi P. N., et autres
Publié: (2022)
par: Nguyen, Khoi P. N., et autres
Publié: (2022)
Monte Carlo Tree Search with Boltzmann Exploration
par: Painter, Michael, et autres
Publié: (2024)
par: Painter, Michael, et autres
Publié: (2024)
Bilevel Optimization of Agent Skills via Monte Carlo Tree Search
par: Huang, Chenyi, et autres
Publié: (2026)
par: Huang, Chenyi, et autres
Publié: (2026)
MALinZero: Efficient Low-Dimensional Search for Mastering Complex Multi-Agent Planning
par: Tang, Sizhe, et autres
Publié: (2025)
par: Tang, Sizhe, et autres
Publié: (2025)
Interactive Critique-Revision Training for Reliable Structured LLM Generation
par: Yu, Fei Xu, et autres
Publié: (2026)
par: Yu, Fei Xu, et autres
Publié: (2026)
Combining Monte Carlo Tree Search and Heuristic Search for Weighted Vertex Coloring
par: Grelier, Cyril, et autres
Publié: (2023)
par: Grelier, Cyril, et autres
Publié: (2023)
Monte Carlo Permutation Search
par: Cazenave, Tristan
Publié: (2025)
par: Cazenave, Tristan
Publié: (2025)
Amplifying Exploration in Monte-Carlo Tree Search by Focusing on the Unknown
par: Derstroff, Cedric, et autres
Publié: (2024)
par: Derstroff, Cedric, et autres
Publié: (2024)
Surrogate Assisted Monte Carlo Tree Search in Combinatorial Optimization
par: Amiri, Saeid, et autres
Publié: (2024)
par: Amiri, Saeid, et autres
Publié: (2024)
Power Mean Estimation in Stochastic Monte-Carlo Tree_Search
par: Dam, Tuan, et autres
Publié: (2024)
par: Dam, Tuan, et autres
Publié: (2024)
Extreme Value Monte Carlo Tree Search for Classical Planning
par: Asai, Masataro, et autres
Publié: (2024)
par: Asai, Masataro, et autres
Publié: (2024)
Exploration and Adaptation in Non-Stationary Tasks with Diffusion Policies
par: Baveja, Gunbir Singh
Publié: (2025)
par: Baveja, Gunbir Singh
Publié: (2025)
Anytime Sequential Halving in Monte-Carlo Tree Search
par: Sagers, Dominic, et autres
Publié: (2024)
par: Sagers, Dominic, et autres
Publié: (2024)
Interpretable Contrastive Monte Carlo Tree Search Reasoning
par: Gao, Zitian, et autres
Publié: (2024)
par: Gao, Zitian, et autres
Publié: (2024)
Improving GFlowNets with Monte Carlo Tree Search
par: Morozov, Nikita, et autres
Publié: (2024)
par: Morozov, Nikita, et autres
Publié: (2024)
Toward Template-Free Explainability for Monte Carlo Tree Search
par: Lu, Siqi, et autres
Publié: (2026)
par: Lu, Siqi, et autres
Publié: (2026)
Towards Explaining Monte-Carlo Tree Search by Using Its Enhancements
par: Kowalski, Jakub, et autres
Publié: (2025)
par: Kowalski, Jakub, et autres
Publié: (2025)
Decision Making in Non-Stationary Environments with Policy-Augmented Search
par: Pettet, Ava, et autres
Publié: (2024)
par: Pettet, Ava, et autres
Publié: (2024)
Documents similaires
-
Tail-Risk-Safe Monte Carlo Tree Search under PAC-Level Guarantees
par: Zhang, Zuyuan, et autres
Publié: (2025) -
Structuring Value Representations via Geometric Coherence in Markov Decision Processes
par: Zhang, Zuyuan, et autres
Publié: (2026) -
LiSFC-Search: Lifelong Search for Network SFC Optimization under Non-stationary Drifts
par: Zhang, Zuyuan, et autres
Publié: (2026) -
NonZero: Interaction-Guided Exploration for Multi-Agent Monte Carlo Tree Search
par: Tang, Sizhe, et autres
Publié: (2026) -
Geometry of Drifting MDPs with Path-Integral Stability Certificates
par: Zhang, Zuyuan, et autres
Publié: (2026)