A Survey of Temporal Credit Assignment in Deep Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Pignatelli, Eduardo, Ferret, Johan, Geist, Matthieu, Mesnard, Thomas, van Hasselt, Hado, Pietquin, Olivier, Toni, Laura |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The impact of intrinsic rewards on exploration in Reinforcement Learning
di: Kayal, Aya, et al.
Pubblicazione: (2025)
di: Kayal, Aya, et al.
Pubblicazione: (2025)
Assessing the Zero-Shot Capabilities of LLMs for Action Evaluation in RL
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2024)
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2024)
General Uncertainty Estimation with Delta Variances
di: Schmitt, Simon, et al.
Pubblicazione: (2025)
di: Schmitt, Simon, et al.
Pubblicazione: (2025)
Bench-MFG: A Benchmark Suite for Learning in Stationary Mean Field Games
di: Magnino, Lorenzo, et al.
Pubblicazione: (2026)
di: Magnino, Lorenzo, et al.
Pubblicazione: (2026)
Learning in Mean Field Games: A Survey
di: Laurière, Mathieu, et al.
Pubblicazione: (2022)
di: Laurière, Mathieu, et al.
Pubblicazione: (2022)
Scalable Meta-Learning via Mixed-Mode Differentiation
di: Kemaev, Iurii, et al.
Pubblicazione: (2025)
di: Kemaev, Iurii, et al.
Pubblicazione: (2025)
Self-Improving Robust Preference Optimization
di: Choi, Eugene, et al.
Pubblicazione: (2024)
di: Choi, Eugene, et al.
Pubblicazione: (2024)
Normalization and effective learning rates in reinforcement learning
di: Lyle, Clare, et al.
Pubblicazione: (2024)
di: Lyle, Clare, et al.
Pubblicazione: (2024)
DRIFT: Deep Reinforcement Learning for Intelligent Floating Platforms Trajectories
di: El-Hariry, Matteo, et al.
Pubblicazione: (2023)
di: El-Hariry, Matteo, et al.
Pubblicazione: (2023)
Wasserstein Policy Optimization
di: Pfau, David, et al.
Pubblicazione: (2025)
di: Pfau, David, et al.
Pubblicazione: (2025)
RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback
di: Lee, Harrison, et al.
Pubblicazione: (2023)
di: Lee, Harrison, et al.
Pubblicazione: (2023)
Population-aware Online Mirror Descent for Mean-Field Games with Common Noise by Deep Reinforcement Learning
di: Wu, Zida, et al.
Pubblicazione: (2025)
di: Wu, Zida, et al.
Pubblicazione: (2025)
Bootstrapping Expectiles in Reinforcement Learning
di: Clavier, Pierre, et al.
Pubblicazione: (2024)
di: Clavier, Pierre, et al.
Pubblicazione: (2024)
Sequence Compression Speeds Up Credit Assignment in Reinforcement Learning
di: Ramesh, Aditya A., et al.
Pubblicazione: (2024)
di: Ramesh, Aditya A., et al.
Pubblicazione: (2024)
PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning
di: Liu, Dongyi, et al.
Pubblicazione: (2026)
di: Liu, Dongyi, et al.
Pubblicazione: (2026)
Multi-level Advantage Credit Assignment for Cooperative Multi-Agent Reinforcement Learning
di: Zhao, Xutong, et al.
Pubblicazione: (2025)
di: Zhao, Xutong, et al.
Pubblicazione: (2025)
Nucleolus Credit Assignment for Effective Coalitions in Multi-agent Reinforcement Learning
di: Li, Yugu, et al.
Pubblicazione: (2025)
di: Li, Yugu, et al.
Pubblicazione: (2025)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
di: Gao, Xiancheng, et al.
Pubblicazione: (2025)
di: Gao, Xiancheng, et al.
Pubblicazione: (2025)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
di: Qu, Yun, et al.
Pubblicazione: (2024)
di: Qu, Yun, et al.
Pubblicazione: (2024)
Pinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement Learning
di: Yin, Junxi, et al.
Pubblicazione: (2025)
di: Yin, Junxi, et al.
Pubblicazione: (2025)
NatureLM-audio: an Audio-Language Foundation Model for Bioacoustics
di: Robinson, David, et al.
Pubblicazione: (2024)
di: Robinson, David, et al.
Pubblicazione: (2024)
Agent-Temporal Credit Assignment for Optimal Policy Preservation in Sparse Multi-Agent Reinforcement Learning
di: Kapoor, Aditya, et al.
Pubblicazione: (2024)
di: Kapoor, Aditya, et al.
Pubblicazione: (2024)
Challenges in Credit Assignment for Multi-Agent Reinforcement Learning in Open Agent Systems
di: Abadi, Alireza Saleh, et al.
Pubblicazione: (2025)
di: Abadi, Alireza Saleh, et al.
Pubblicazione: (2025)
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2026)
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2026)
NAVIX: Scaling MiniGrid Environments with JAX
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2024)
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2024)
Credit Assignment with Resets in Language Model Reasoning
di: Samanta, Ankur, et al.
Pubblicazione: (2026)
di: Samanta, Ankur, et al.
Pubblicazione: (2026)
DACA-GRPO: Denoising-Aware Credit Assignment for Reinforcement Learning in Diffusion Language Models
di: Monsefi, Amin Karimi, et al.
Pubblicazione: (2026)
di: Monsefi, Amin Karimi, et al.
Pubblicazione: (2026)
Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimization
di: Li, Wenwu, et al.
Pubblicazione: (2026)
di: Li, Wenwu, et al.
Pubblicazione: (2026)
Population-aware Online Mirror Descent for Mean-Field Games by Deep Reinforcement Learning
di: Wu, Zida, et al.
Pubblicazione: (2024)
di: Wu, Zida, et al.
Pubblicazione: (2024)
SCAR: Shapley Credit Assignment for More Efficient RLHF
di: Cao, Meng, et al.
Pubblicazione: (2025)
di: Cao, Meng, et al.
Pubblicazione: (2025)
QLLM: Do We Really Need a Mixing Network for Credit Assignment in Multi-Agent Reinforcement Learning?
di: Li, Yuanjun, et al.
Pubblicazione: (2025)
di: Li, Yuanjun, et al.
Pubblicazione: (2025)
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
di: Khandoga, Mykola, et al.
Pubblicazione: (2026)
di: Khandoga, Mykola, et al.
Pubblicazione: (2026)
Intrinsic Credit Assignment for Long Horizon Interaction
di: Auzina, Ilze Amanda, et al.
Pubblicazione: (2026)
di: Auzina, Ilze Amanda, et al.
Pubblicazione: (2026)
SKILLC: Learning Autonomous Skill Internalization in LLM Agents via Contrastive Credit Assignment
di: Lin, Hongxiang, et al.
Pubblicazione: (2026)
di: Lin, Hongxiang, et al.
Pubblicazione: (2026)
From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
BAGEL: Benchmarking Animal Knowledge Expertise in Language Models
di: Shen, Jiacheng, et al.
Pubblicazione: (2026)
di: Shen, Jiacheng, et al.
Pubblicazione: (2026)
GRPO-$λ$: Credit Assignment improves LLM Reasoning
di: Parthasarathi, Prasanna, et al.
Pubblicazione: (2025)
di: Parthasarathi, Prasanna, et al.
Pubblicazione: (2025)
Hindsight Credit Assignment for Long-Horizon LLM Agents
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026)
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026)
Exact Is Easier: Credit Assignment for Cooperative LLM Agents
di: Chen, Yanjun, et al.
Pubblicazione: (2026)
di: Chen, Yanjun, et al.
Pubblicazione: (2026)
Space Robotics Bench: Robot Learning Beyond Earth
di: Orsula, Andrej, et al.
Pubblicazione: (2025)
di: Orsula, Andrej, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The impact of intrinsic rewards on exploration in Reinforcement Learning
di: Kayal, Aya, et al.
Pubblicazione: (2025) -
Assessing the Zero-Shot Capabilities of LLMs for Action Evaluation in RL
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2024) -
General Uncertainty Estimation with Delta Variances
di: Schmitt, Simon, et al.
Pubblicazione: (2025) -
Bench-MFG: A Benchmark Suite for Learning in Stationary Mean Field Games
di: Magnino, Lorenzo, et al.
Pubblicazione: (2026) -
Learning in Mean Field Games: A Survey
di: Laurière, Mathieu, et al.
Pubblicazione: (2022)