Agentick: A Unified Benchmark for General Sequential Decision-Making Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Castanyer, Roger Creus, Castro, Pablo Samuel, Berseth, Glen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Intrinsic Exploration by Creating Stationary Objectives
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2023)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2023)
ARM-FM: Automated Reward Machines via Foundation Models for Compositional Reinforcement Learning
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
Surprise-Adaptive Intrinsic Motivation for Unsupervised Reinforcement Learning
di: Hugessen, Adriana, et al.
Pubblicazione: (2024)
di: Hugessen, Adriana, et al.
Pubblicazione: (2024)
Align and Filter: Improving Performance in Asynchronous On-Policy RL
di: Honari, Homayoun, et al.
Pubblicazione: (2026)
di: Honari, Homayoun, et al.
Pubblicazione: (2026)
Is Exploration or Optimization the Problem for Deep Reinforcement Learning?
di: Berseth, Glen
Pubblicazione: (2025)
di: Berseth, Glen
Pubblicazione: (2025)
BuilderBench: The Building Blocks of Intelligent Agents
di: Ghugare, Raj, et al.
Pubblicazione: (2025)
di: Ghugare, Raj, et al.
Pubblicazione: (2025)
xgenius: LLM-Oriented Autonomous Research Platform for SLURM Clusters
di: Creus Castanyer, Roger
Pubblicazione: (2026)
di: Creus Castanyer, Roger
Pubblicazione: (2026)
Improving Deep Reinforcement Learning by Reducing the Chain Effect of Value and Policy Churn
di: Tang, Hongyao, et al.
Pubblicazione: (2024)
di: Tang, Hongyao, et al.
Pubblicazione: (2024)
SegDAC: Visual Generalization in Reinforcement Learning via Dynamic Object Tokens
di: Brown, Alexandre, et al.
Pubblicazione: (2025)
di: Brown, Alexandre, et al.
Pubblicazione: (2025)
Towards a Unified Framework for Sequential Decision Making
di: Núñez-Molina, Carlos, et al.
Pubblicazione: (2023)
di: Núñez-Molina, Carlos, et al.
Pubblicazione: (2023)
Mitigating Plasticity Loss in Continual Reinforcement Learning by Reducing Churn
di: Tang, Hongyao, et al.
Pubblicazione: (2025)
di: Tang, Hongyao, et al.
Pubblicazione: (2025)
DLM: Unified Decision Language Models for Offline Multi-Agent Sequential Decision Making
di: Zhang, Zhuohui, et al.
Pubblicazione: (2026)
di: Zhang, Zhuohui, et al.
Pubblicazione: (2026)
RLeXplore: Accelerating Research in Intrinsically-Motivated Reinforcement Learning
di: Yuan, Mingqi, et al.
Pubblicazione: (2024)
di: Yuan, Mingqi, et al.
Pubblicazione: (2024)
Stable Gradients for Stable Learning at Scale in Deep Reinforcement Learning
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
PopuLoRA: Co-Evolving LLM Populations for Reasoning Self-Play
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2026)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2026)
KellyBench: A Benchmark for Long-Horizon Sequential Decision Making
di: Grady, Thomas, et al.
Pubblicazione: (2026)
di: Grady, Thomas, et al.
Pubblicazione: (2026)
Unifying and Optimizing Data Values for Selection via Sequential Decision-Making
di: Chi, Hongliang, et al.
Pubblicazione: (2025)
di: Chi, Hongliang, et al.
Pubblicazione: (2025)
MoralityGym: A Benchmark for Evaluating Hierarchical Moral Alignment in Sequential Decision-Making Agents
di: Rosen, Simon, et al.
Pubblicazione: (2026)
di: Rosen, Simon, et al.
Pubblicazione: (2026)
unix-ctf: Procedural Environments for Unix-Competence Reinforcement Learning
di: Bradway, Geoffrey, et al.
Pubblicazione: (2026)
di: Bradway, Geoffrey, et al.
Pubblicazione: (2026)
MazeEval: A Benchmark for Testing Sequential Decision-Making in Language Models
di: Einarsson, Hafsteinn
Pubblicazione: (2025)
di: Einarsson, Hafsteinn
Pubblicazione: (2025)
MTBBench: A Multimodal Sequential Clinical Decision-Making Benchmark in Oncology
di: Vasilev, Kiril, et al.
Pubblicazione: (2025)
di: Vasilev, Kiril, et al.
Pubblicazione: (2025)
Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning
di: Lawson, Daniel, et al.
Pubblicazione: (2025)
di: Lawson, Daniel, et al.
Pubblicazione: (2025)
Counterfactual Effect Decomposition in Multi-Agent Sequential Decision Making
di: Triantafyllou, Stelios, et al.
Pubblicazione: (2024)
di: Triantafyllou, Stelios, et al.
Pubblicazione: (2024)
Temporal Representations for Exploration: Learning Complex Exploratory Behavior without Extrinsic Rewards
di: Mohamed, Faisal, et al.
Pubblicazione: (2026)
di: Mohamed, Faisal, et al.
Pubblicazione: (2026)
Intelligent Switching for Reset-Free RL
di: Patil, Darshan, et al.
Pubblicazione: (2024)
di: Patil, Darshan, et al.
Pubblicazione: (2024)
Enabling Realtime Reinforcement Learning at Scale with Staggered Asynchronous Inference
di: Riemer, Matthew, et al.
Pubblicazione: (2024)
di: Riemer, Matthew, et al.
Pubblicazione: (2024)
Enhancing Agent Learning through World Dynamics Modeling
di: Sun, Zhiyuan, et al.
Pubblicazione: (2024)
di: Sun, Zhiyuan, et al.
Pubblicazione: (2024)
A Sequential Decision-Making Model for Perimeter Identification
di: Taitler, Ayal
Pubblicazione: (2024)
di: Taitler, Ayal
Pubblicazione: (2024)
Causal Explanations for Sequential Decision-Making in Multi-Agent Systems
di: Gyevnar, Balint, et al.
Pubblicazione: (2023)
di: Gyevnar, Balint, et al.
Pubblicazione: (2023)
Understanding the Training and Generalization of Pretrained Transformer for Sequential Decision Making
di: Wang, Hanzhao, et al.
Pubblicazione: (2024)
di: Wang, Hanzhao, et al.
Pubblicazione: (2024)
M^4olGen: Multi-Agent, Multi-Stage Molecular Generation under Precise Multi-Property Constraints
di: Li, Yizhan, et al.
Pubblicazione: (2026)
di: Li, Yizhan, et al.
Pubblicazione: (2026)
PRISM: Perception Reasoning Interleaved for Sequential Decision Making
di: Aissi, Mohamed Salim, et al.
Pubblicazione: (2026)
di: Aissi, Mohamed Salim, et al.
Pubblicazione: (2026)
Responsibility Gap and Diffusion in Sequential Decision-Making Mechanisms
di: Jiang, Junli, et al.
Pubblicazione: (2025)
di: Jiang, Junli, et al.
Pubblicazione: (2025)
Online Sequential Decision-Making with Unknown Delays
di: Wu, Ping, et al.
Pubblicazione: (2024)
di: Wu, Ping, et al.
Pubblicazione: (2024)
Reward Design for Justifiable Sequential Decision-Making
di: Sukovic, Aleksa, et al.
Pubblicazione: (2024)
di: Sukovic, Aleksa, et al.
Pubblicazione: (2024)
On the Modeling Capabilities of Large Language Models for Sequential Decision Making
di: Klissarov, Martin, et al.
Pubblicazione: (2024)
di: Klissarov, Martin, et al.
Pubblicazione: (2024)
Improving Pre-Trained Vision-Language-Action Policies with Model-Based Search
di: Neary, Cyrus, et al.
Pubblicazione: (2025)
di: Neary, Cyrus, et al.
Pubblicazione: (2025)
Bayesian Orchestration of Multi-LLM Agents for Cost-Aware Sequential Decision-Making
di: Amin, Danial
Pubblicazione: (2026)
di: Amin, Danial
Pubblicazione: (2026)
Translating the Rashomon Effect to Sequential Decision-Making Tasks
di: Gross, Dennis, et al.
Pubblicazione: (2025)
di: Gross, Dennis, et al.
Pubblicazione: (2025)
SkillGen: Learning Domain Skills for In-Context Sequential Decision Making
di: Ding, Ruomeng, et al.
Pubblicazione: (2025)
di: Ding, Ruomeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Improving Intrinsic Exploration by Creating Stationary Objectives
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2023) -
ARM-FM: Automated Reward Machines via Foundation Models for Compositional Reinforcement Learning
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025) -
Surprise-Adaptive Intrinsic Motivation for Unsupervised Reinforcement Learning
di: Hugessen, Adriana, et al.
Pubblicazione: (2024) -
Align and Filter: Improving Performance in Asynchronous On-Policy RL
di: Honari, Homayoun, et al.
Pubblicazione: (2026) -
Is Exploration or Optimization the Problem for Deep Reinforcement Learning?
di: Berseth, Glen
Pubblicazione: (2025)