Artifact for "Deductive Synthesis of Reinforcement Learning Agents for Infinite Horizon Tasks"
Fuente:
Zenodo
Enregistré dans:
| Auteurs principaux: | Wang, Yuning, Zhu, He |
|---|---|
| Format: | Recurso digital |
| Publié: |
Zenodo
2025
|
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Artifact for "Deductive Synthesis of Reinforcement Learning Agents for Infinite Horizon Tasks"
par: Wang, Yuning, et autres
Publié: (2025)
par: Wang, Yuning, et autres
Publié: (2025)
Infinite-Horizon Reinforcement Learning with Multinomial Logistic Function Approximation
par: Park, Jaehyun, et autres
Publié: (2024)
par: Park, Jaehyun, et autres
Publié: (2024)
FGeo-DRL: Deductive Reasoning for Geometric Problems through Deep Reinforcement Learning
par: Zou, Jia, et autres
Publié: (2024)
par: Zou, Jia, et autres
Publié: (2024)
Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning
par: Sarkar, Bidipta, et autres
Publié: (2025)
par: Sarkar, Bidipta, et autres
Publié: (2025)
InfiAgent: An Infinite-Horizon Framework for General-Purpose Autonomous Agents
par: Yu, Chenglin, et autres
Publié: (2026)
par: Yu, Chenglin, et autres
Publié: (2026)
Statistical Inference of the Value Function for Reinforcement Learning in Infinite Horizon Settings
par: Shi, C., et autres
Publié: (2020)
par: Shi, C., et autres
Publié: (2020)
Reinforcement Learning Method for Zero-Sum Linear-Quadratic Stochastic Differential Games in Infinite Horizons
par: Wang, Yiyuan
Publié: (2026)
par: Wang, Yiyuan
Publié: (2026)
An Infinite Needle in a Finite Haystack: Finding Infinite Counter-Models in Deductive Verification
par: Elad, Neta, et autres
Publié: (2023)
par: Elad, Neta, et autres
Publié: (2023)
Optimistically Optimistic Exploration for Provably Efficient Infinite-Horizon Reinforcement and Imitation Learning
par: Moulin, Antoine, et autres
Publié: (2025)
par: Moulin, Antoine, et autres
Publié: (2025)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
par: Yan, Yuchen, et autres
Publié: (2026)
par: Yan, Yuchen, et autres
Publié: (2026)
Deep Reinforcement Learning for Infinite Horizon Mean Field Problems in Continuous Spaces
par: Angiuli, Andrea, et autres
Publié: (2023)
par: Angiuli, Andrea, et autres
Publié: (2023)
TRIAD: Automated Traceability Recovery based on Biterm-enhanced Deduction of Transitive Links among Artifacts
par: Gao, Hui, et autres
Publié: (2023)
par: Gao, Hui, et autres
Publié: (2023)
Policy Zooming: Adaptive Discretization-based Infinite-Horizon Average-Reward Reinforcement Learning
par: Kar, Avik, et autres
Publié: (2024)
par: Kar, Avik, et autres
Publié: (2024)
Infinite-Horizon Reach-Avoid Zero-Sum Games via Deep Reinforcement Learning
par: Li, Jingqi, et autres
Publié: (2022)
par: Li, Jingqi, et autres
Publié: (2022)
Provably Efficient Infinite-Horizon Average-Reward Reinforcement Learning with Linear Function Approximation
par: Chae, Woojin, et autres
Publié: (2024)
par: Chae, Woojin, et autres
Publié: (2024)
Reinforcement Learning for Long-Horizon Interactive LLM Agents
par: Chen, Kevin, et autres
Publié: (2025)
par: Chen, Kevin, et autres
Publié: (2025)
Learning Agent-Compatible Context Management for Long-Horizon Tasks
par: Yi, Lu, et autres
Publié: (2026)
par: Yi, Lu, et autres
Publié: (2026)
Infinite Horizon Markov Economies
par: Goktas, Denizalp, et autres
Publié: (2025)
par: Goktas, Denizalp, et autres
Publié: (2025)
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
par: Hong, Kihyuk, et autres
Publié: (2024)
par: Hong, Kihyuk, et autres
Publié: (2024)
A Mathematical Programming Approach to Computing and Learning Berk--Nash Equilibria in Infinite-Horizon MDPs
par: Zhu, Quanyan, et autres
Publié: (2026)
par: Zhu, Quanyan, et autres
Publié: (2026)
EvolvingAgent: Curriculum Self-evolving Agent with Continual World Model for Long-Horizon Tasks
par: Feng, Tongtong, et autres
Publié: (2025)
par: Feng, Tongtong, et autres
Publié: (2025)
Reinforcement Learning with Anticipation: A Hierarchical Approach for Long-Horizon Tasks
par: Yu, Yang
Publié: (2025)
par: Yu, Yang
Publié: (2025)
ProActor: Timing-Aware Reinforcement Learning for Proactive Task Scheduling Agents
par: Ding, Lei, et autres
Publié: (2026)
par: Ding, Lei, et autres
Publié: (2026)
Reinforcement Learning for Long-Horizon Multi-Turn Search Agents
par: Kalyan, Vivek, et autres
Publié: (2025)
par: Kalyan, Vivek, et autres
Publié: (2025)
DVM: Towards Controllable LLM Agents in Social Deduction Games
par: Zhang, Zheng, et autres
Publié: (2025)
par: Zhang, Zheng, et autres
Publié: (2025)
Multi-Task Multi-Agent Reinforcement Learning via Skill Graphs
par: Zhu, Guobin, et autres
Publié: (2025)
par: Zhu, Guobin, et autres
Publié: (2025)
Small Decision Trees for MDPs with Deductive Synthesis
par: Andriushchenko, Roman, et autres
Publié: (2025)
par: Andriushchenko, Roman, et autres
Publié: (2025)
The Distributionally Robust Infinite-Horizon LQR
par: Hajar, Joudi, et autres
Publié: (2024)
par: Hajar, Joudi, et autres
Publié: (2024)
Revac: A Social Deduction Reasoning Agent
par: Mihir S Arya, et autres
Publié: (2026)
par: Mihir S Arya, et autres
Publié: (2026)
Revac: A Social Deduction Reasoning Agent
par: Arya, Mihir Shriniwas, et autres
Publié: (2026)
par: Arya, Mihir Shriniwas, et autres
Publié: (2026)
When Robots Do the Chores: A Benchmark and Agent for Long-Horizon Household Task Execution
par: Zhu, Zilin, et autres
Publié: (2026)
par: Zhu, Zilin, et autres
Publié: (2026)
IDEA: Enhancing the Rule Learning Ability of Large Language Model Agent through Induction, Deduction, and Abduction
par: He, Kaiyu, et autres
Publié: (2024)
par: He, Kaiyu, et autres
Publié: (2024)
VSearcher: Long-Horizon Multimodal Search Agent via Reinforcement Learning
par: Zhang, Ruiyang, et autres
Publié: (2026)
par: Zhang, Ruiyang, et autres
Publié: (2026)
R3R: Decentralized Multi-Agent Collision Avoidance with Infinite-Horizon Safety
par: Vielmetti, Thomas Marshall, et autres
Publié: (2025)
par: Vielmetti, Thomas Marshall, et autres
Publié: (2025)
Learning from Demonstrations via Capability-Aware Goal Sampling
par: Duan, Yuanlin, et autres
Publié: (2026)
par: Duan, Yuanlin, et autres
Publié: (2026)
AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning
par: Hu, Yuyang, et autres
Publié: (2026)
par: Hu, Yuyang, et autres
Publié: (2026)
Learning on the Job: An Experience-Driven Self-Evolving Agent for Long-Horizon Tasks
par: Yang, Cheng, et autres
Publié: (2025)
par: Yang, Cheng, et autres
Publié: (2025)
OS-Marathon: Benchmarking Computer-Use Agents on Long-Horizon Repetitive Tasks
par: Wu, Jing, et autres
Publié: (2026)
par: Wu, Jing, et autres
Publié: (2026)
Artifacts for "WebCQ: Cooperative Multi-Agent Reinforcement Learning for Scalable Web GUI Testing"
par: Anonymous Authors
Publié: (2026)
par: Anonymous Authors
Publié: (2026)
Reinforcement Learning for Long-Horizon Unordered Tasks: From Boolean to Coupled Reward Machines
par: Levina, Kristina, et autres
Publié: (2025)
par: Levina, Kristina, et autres
Publié: (2025)
Documents similaires
-
Artifact for "Deductive Synthesis of Reinforcement Learning Agents for Infinite Horizon Tasks"
par: Wang, Yuning, et autres
Publié: (2025) -
Infinite-Horizon Reinforcement Learning with Multinomial Logistic Function Approximation
par: Park, Jaehyun, et autres
Publié: (2024) -
FGeo-DRL: Deductive Reasoning for Geometric Problems through Deep Reinforcement Learning
par: Zou, Jia, et autres
Publié: (2024) -
Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning
par: Sarkar, Bidipta, et autres
Publié: (2025) -
InfiAgent: An Infinite-Horizon Framework for General-Purpose Autonomous Agents
par: Yu, Chenglin, et autres
Publié: (2026)