HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Peng, Jiangweizhi, Liu, Yuanxin, Zhou, Ruida, Fleming, Charles, Wang, Zhaoran, Garcia, Alfredo, Hong, Mingyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Silica final lens performance in laser fusion facilities: HiPER and LIFE
di: Garoz, David, et al.
Pubblicazione: (2024)
di: Garoz, David, et al.
Pubblicazione: (2024)
Safeguarding Text-to-Image Generation via Inference-Time Prompt-Noise Optimization
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2024)
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2024)
Thermo-mechanical behaviour of a tungsten first wall in HiPER laser fusion scenarios
di: Garoz, D, et al.
Pubblicazione: (2024)
di: Garoz, D, et al.
Pubblicazione: (2024)
DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning
di: Karaman, Batuhan K., et al.
Pubblicazione: (2026)
di: Karaman, Batuhan K., et al.
Pubblicazione: (2026)
Explicit Credit Assignment through Local Rewards and Dependence Graphs in Multi-Agent Reinforcement Learning
di: Le, Bang Giang, et al.
Pubblicazione: (2026)
di: Le, Bang Giang, et al.
Pubblicazione: (2026)
From Reasoning to Agentic: Credit Assignment in Reinforcement Learning for Large Language Models
di: Zhang, Chenchen
Pubblicazione: (2026)
di: Zhang, Chenchen
Pubblicazione: (2026)
Asynchronous Credit Assignment for Multi-Agent Reinforcement Learning
di: Liang, Yongheng, et al.
Pubblicazione: (2024)
di: Liang, Yongheng, et al.
Pubblicazione: (2024)
Inference-Time Alignment of Diffusion Models with Direct Noise Optimization
di: Tang, Zhiwei, et al.
Pubblicazione: (2024)
di: Tang, Zhiwei, et al.
Pubblicazione: (2024)
Speaking the Language of Teamwork: LLM-Guided Credit Assignment in Multi-Agent Reinforcement Learning
di: Lin, Muhan, et al.
Pubblicazione: (2025)
di: Lin, Muhan, et al.
Pubblicazione: (2025)
Challenges in Credit Assignment for Multi-Agent Reinforcement Learning in Open Agent Systems
di: Abadi, Alireza Saleh, et al.
Pubblicazione: (2025)
di: Abadi, Alireza Saleh, et al.
Pubblicazione: (2025)
Leveraging Large Language Models for Effective and Explainable Multi-Agent Credit Assignment
di: Nagpal, Kartik, et al.
Pubblicazione: (2025)
di: Nagpal, Kartik, et al.
Pubblicazione: (2025)
Retrospective In-Context Learning for Temporal Credit Assignment with Large Language Models
di: Chen, Wen-Tse, et al.
Pubblicazione: (2026)
di: Chen, Wen-Tse, et al.
Pubblicazione: (2026)
Multi-level Advantage Credit Assignment for Cooperative Multi-Agent Reinforcement Learning
di: Zhao, Xutong, et al.
Pubblicazione: (2025)
di: Zhao, Xutong, et al.
Pubblicazione: (2025)
BRiTE: Bootstrapping Reinforced Thinking Process to Enhance Language Model Reasoning
di: Zhong, Han, et al.
Pubblicazione: (2025)
di: Zhong, Han, et al.
Pubblicazione: (2025)
DACA-GRPO: Denoising-Aware Credit Assignment for Reinforcement Learning in Diffusion Language Models
di: Monsefi, Amin Karimi, et al.
Pubblicazione: (2026)
di: Monsefi, Amin Karimi, et al.
Pubblicazione: (2026)
Advancing Language Multi-Agent Learning with Credit Re-Assignment for Interactive Environment Generalization
di: He, Zhitao, et al.
Pubblicazione: (2025)
di: He, Zhitao, et al.
Pubblicazione: (2025)
When Demonstrations Meet Generative World Models: A Maximum Likelihood Framework for Offline Inverse Reinforcement Learning
di: Zeng, Siliang, et al.
Pubblicazione: (2023)
di: Zeng, Siliang, et al.
Pubblicazione: (2023)
Agent-Temporal Credit Assignment for Optimal Policy Preservation in Sparse Multi-Agent Reinforcement Learning
di: Kapoor, Aditya, et al.
Pubblicazione: (2024)
di: Kapoor, Aditya, et al.
Pubblicazione: (2024)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
di: Gao, Xiancheng, et al.
Pubblicazione: (2025)
di: Gao, Xiancheng, et al.
Pubblicazione: (2025)
Credit Assignment with Resets in Language Model Reasoning
di: Samanta, Ankur, et al.
Pubblicazione: (2026)
di: Samanta, Ankur, et al.
Pubblicazione: (2026)
Sequence Compression Speeds Up Credit Assignment in Reinforcement Learning
di: Ramesh, Aditya A., et al.
Pubblicazione: (2024)
di: Ramesh, Aditya A., et al.
Pubblicazione: (2024)
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2023)
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2023)
HiEdit: Lifelong Model Editing with Hierarchical Reinforcement Learning
di: Wang, Yangfan, et al.
Pubblicazione: (2026)
di: Wang, Yangfan, et al.
Pubblicazione: (2026)
Tree-based Credit Assignment for Multi-Agent Memory System
di: Mao, Marina, et al.
Pubblicazione: (2026)
di: Mao, Marina, et al.
Pubblicazione: (2026)
CodeVisionary: An Agent-based Framework for Evaluating Large Language Models in Code Generation
di: Wang, Xinchen, et al.
Pubblicazione: (2025)
di: Wang, Xinchen, et al.
Pubblicazione: (2025)
Nucleolus Credit Assignment for Effective Coalitions in Multi-agent Reinforcement Learning
di: Li, Yugu, et al.
Pubblicazione: (2025)
di: Li, Yugu, et al.
Pubblicazione: (2025)
MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment
di: Wang, Ziyan, et al.
Pubblicazione: (2023)
di: Wang, Ziyan, et al.
Pubblicazione: (2023)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
di: Qu, Yun, et al.
Pubblicazione: (2024)
di: Qu, Yun, et al.
Pubblicazione: (2024)
HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
di: Hu, Mengkang, et al.
Pubblicazione: (2024)
Hi-DARTS: Hierarchical Dynamically Adapting Reinforcement Trading System
di: Sagong, Hoon, et al.
Pubblicazione: (2025)
di: Sagong, Hoon, et al.
Pubblicazione: (2025)
HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models
di: Zhou, Ziqin, et al.
Pubblicazione: (2025)
di: Zhou, Ziqin, et al.
Pubblicazione: (2025)
LangMARL: Natural Language Multi-Agent Reinforcement Learning
di: Yao, Huaiyuan, et al.
Pubblicazione: (2026)
di: Yao, Huaiyuan, et al.
Pubblicazione: (2026)
Understanding Inverse Reinforcement Learning under Overparameterization: Non-Asymptotic Analysis and Global Optimality
di: Zhang, Ruijia, et al.
Pubblicazione: (2025)
di: Zhang, Ruijia, et al.
Pubblicazione: (2025)
QLLM: Do We Really Need a Mixing Network for Credit Assignment in Multi-Agent Reinforcement Learning?
di: Li, Yuanjun, et al.
Pubblicazione: (2025)
di: Li, Yuanjun, et al.
Pubblicazione: (2025)
Hindsight Credit Assignment for Long-Horizon LLM Agents
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026)
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026)
Exact Is Easier: Credit Assignment for Cooperative LLM Agents
di: Chen, Yanjun, et al.
Pubblicazione: (2026)
di: Chen, Yanjun, et al.
Pubblicazione: (2026)
Hi-Agent: Hierarchical Vision-Language Agents for Mobile Device Control
di: Wu, Zhe, et al.
Pubblicazione: (2025)
di: Wu, Zhe, et al.
Pubblicazione: (2025)
PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning
di: Liu, Dongyi, et al.
Pubblicazione: (2026)
di: Liu, Dongyi, et al.
Pubblicazione: (2026)
Pinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement Learning
di: Yin, Junxi, et al.
Pubblicazione: (2025)
di: Yin, Junxi, et al.
Pubblicazione: (2025)
Segment Policy Optimization: Effective Segment-Level Credit Assignment in RL for Large Language Models
di: Guo, Yiran, et al.
Pubblicazione: (2025)
di: Guo, Yiran, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Silica final lens performance in laser fusion facilities: HiPER and LIFE
di: Garoz, David, et al.
Pubblicazione: (2024) -
Safeguarding Text-to-Image Generation via Inference-Time Prompt-Noise Optimization
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2024) -
Thermo-mechanical behaviour of a tungsten first wall in HiPER laser fusion scenarios
di: Garoz, D, et al.
Pubblicazione: (2024) -
DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning
di: Karaman, Batuhan K., et al.
Pubblicazione: (2026) -
Explicit Credit Assignment through Local Rewards and Dependence Graphs in Multi-Agent Reinforcement Learning
di: Le, Bang Giang, et al.
Pubblicazione: (2026)