PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Dongyi, Niu, Yifan, Wang, Qinwen, Xiao, Han, Li, Jia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
di: Gao, Xiancheng, et al.
Pubblicazione: (2025)
di: Gao, Xiancheng, et al.
Pubblicazione: (2025)
Beyond Trajectory Rewards: Step-level Credit Assignment for Agentic Search via Graph Modeling
di: Liu, Yuchen, et al.
Pubblicazione: (2026)
di: Liu, Yuchen, et al.
Pubblicazione: (2026)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
di: Qu, Yun, et al.
Pubblicazione: (2024)
di: Qu, Yun, et al.
Pubblicazione: (2024)
Pinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement Learning
di: Yin, Junxi, et al.
Pubblicazione: (2025)
di: Yin, Junxi, et al.
Pubblicazione: (2025)
Nucleolus Credit Assignment for Effective Coalitions in Multi-agent Reinforcement Learning
di: Li, Yugu, et al.
Pubblicazione: (2025)
di: Li, Yugu, et al.
Pubblicazione: (2025)
Sequence Compression Speeds Up Credit Assignment in Reinforcement Learning
di: Ramesh, Aditya A., et al.
Pubblicazione: (2024)
di: Ramesh, Aditya A., et al.
Pubblicazione: (2024)
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2023)
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2023)
Multi-level Advantage Credit Assignment for Cooperative Multi-Agent Reinforcement Learning
di: Zhao, Xutong, et al.
Pubblicazione: (2025)
di: Zhao, Xutong, et al.
Pubblicazione: (2025)
R$^3$L: Reflect-then-Retry Reinforcement Learning with Language-Guided Exploration, Pivotal Credit, and Positive Amplification
di: Shi, Weijie, et al.
Pubblicazione: (2026)
di: Shi, Weijie, et al.
Pubblicazione: (2026)
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2026)
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2026)
APEX-Searcher: Refining Credit Assignment with Subgoaling for Agentic Retrieval-Augmented Generation
di: Chen, Kun, et al.
Pubblicazione: (2026)
di: Chen, Kun, et al.
Pubblicazione: (2026)
SCAR: Shapley Credit Assignment for More Efficient RLHF
di: Cao, Meng, et al.
Pubblicazione: (2025)
di: Cao, Meng, et al.
Pubblicazione: (2025)
Pi-SQL: Enhancing Text-to-SQL with Fine-Grained Guidance from Pivot Programming Languages
di: chi, Yongdong, et al.
Pubblicazione: (2025)
di: chi, Yongdong, et al.
Pubblicazione: (2025)
Challenges in Credit Assignment for Multi-Agent Reinforcement Learning in Open Agent Systems
di: Abadi, Alireza Saleh, et al.
Pubblicazione: (2025)
di: Abadi, Alireza Saleh, et al.
Pubblicazione: (2025)
Rethinking Agentic Search with Pi-Serini: Is Lexical Retrieval Sufficient?
di: Hsu, Tz-Huan, et al.
Pubblicazione: (2026)
di: Hsu, Tz-Huan, et al.
Pubblicazione: (2026)
Exact Is Easier: Credit Assignment for Cooperative LLM Agents
di: Chen, Yanjun, et al.
Pubblicazione: (2026)
di: Chen, Yanjun, et al.
Pubblicazione: (2026)
Credit Assignment with Resets in Language Model Reasoning
di: Samanta, Ankur, et al.
Pubblicazione: (2026)
di: Samanta, Ankur, et al.
Pubblicazione: (2026)
Hindsight Credit Assignment for Long-Horizon LLM Agents
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026)
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026)
QLLM: Do We Really Need a Mixing Network for Credit Assignment in Multi-Agent Reinforcement Learning?
di: Li, Yuanjun, et al.
Pubblicazione: (2025)
di: Li, Yuanjun, et al.
Pubblicazione: (2025)
DACA-GRPO: Denoising-Aware Credit Assignment for Reinforcement Learning in Diffusion Language Models
di: Monsefi, Amin Karimi, et al.
Pubblicazione: (2026)
di: Monsefi, Amin Karimi, et al.
Pubblicazione: (2026)
Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training
di: Fang, Yangyi, et al.
Pubblicazione: (2026)
di: Fang, Yangyi, et al.
Pubblicazione: (2026)
EGL-SCA: Structural Credit Assignment for Co-Evolving Instructions and Tools in Graph Reasoning Agents
di: Yuan, Zike, et al.
Pubblicazione: (2026)
di: Yuan, Zike, et al.
Pubblicazione: (2026)
SKILLC: Learning Autonomous Skill Internalization in LLM Agents via Contrastive Credit Assignment
di: Lin, Hongxiang, et al.
Pubblicazione: (2026)
di: Lin, Hongxiang, et al.
Pubblicazione: (2026)
From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
di: Sun, Jingbo, et al.
Pubblicazione: (2026)
di: Sun, Jingbo, et al.
Pubblicazione: (2026)
Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimization
di: Li, Wenwu, et al.
Pubblicazione: (2026)
di: Li, Wenwu, et al.
Pubblicazione: (2026)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
di: Xu, Yifan, et al.
Pubblicazione: (2025)
di: Xu, Yifan, et al.
Pubblicazione: (2025)
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
di: Khandoga, Mykola, et al.
Pubblicazione: (2026)
di: Khandoga, Mykola, et al.
Pubblicazione: (2026)
SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning
di: Wang, Jichao, et al.
Pubblicazione: (2026)
di: Wang, Jichao, et al.
Pubblicazione: (2026)
Intrinsic Credit Assignment for Long Horizon Interaction
di: Auzina, Ilze Amanda, et al.
Pubblicazione: (2026)
di: Auzina, Ilze Amanda, et al.
Pubblicazione: (2026)
RTMC: Step-Level Credit Assignment via Rollout Trees
di: Wang, Tao, et al.
Pubblicazione: (2026)
di: Wang, Tao, et al.
Pubblicazione: (2026)
Not All Turns Matter: Credit Assignment for Multi-Turn Jailbreaking
di: He, Zhida, et al.
Pubblicazione: (2026)
di: He, Zhida, et al.
Pubblicazione: (2026)
Shapley-Coop: Credit Assignment for Emergent Cooperation in Self-Interested LLM Agents
di: Hua, Yun, et al.
Pubblicazione: (2025)
di: Hua, Yun, et al.
Pubblicazione: (2025)
PivotRL: High Accuracy Agentic Post-Training at Low Compute Cost
di: Yi, Junkeun, et al.
Pubblicazione: (2026)
di: Yi, Junkeun, et al.
Pubblicazione: (2026)
Score Broadcast and Decorrelation: A General Framework for Broadcast-Based Credit Assignment
di: Uzun, Mustafa, et al.
Pubblicazione: (2026)
di: Uzun, Mustafa, et al.
Pubblicazione: (2026)
TraCeS: Trajectory Based Credit Assignment From Sparse Safety Feedback
di: Low, Siow Meng, et al.
Pubblicazione: (2025)
di: Low, Siow Meng, et al.
Pubblicazione: (2025)
ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning
di: Wang, Xiaoxuan, et al.
Pubblicazione: (2026)
di: Wang, Xiaoxuan, et al.
Pubblicazione: (2026)
Self-Distilled Agentic Reinforcement Learning
di: Lu, Zhengxi, et al.
Pubblicazione: (2026)
di: Lu, Zhengxi, et al.
Pubblicazione: (2026)
GRPO-$λ$: Credit Assignment improves LLM Reasoning
di: Parthasarathi, Prasanna, et al.
Pubblicazione: (2025)
di: Parthasarathi, Prasanna, et al.
Pubblicazione: (2025)
CAPO: Towards Enhancing LLM Reasoning through Generative Credit Assignment
di: Xie, Guofu, et al.
Pubblicazione: (2025)
di: Xie, Guofu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
di: Gao, Xiancheng, et al.
Pubblicazione: (2025) -
Beyond Trajectory Rewards: Step-level Credit Assignment for Agentic Search via Graph Modeling
di: Liu, Yuchen, et al.
Pubblicazione: (2026) -
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
di: Qu, Yun, et al.
Pubblicazione: (2024) -
Pinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement Learning
di: Yin, Junxi, et al.
Pubblicazione: (2025) -
Nucleolus Credit Assignment for Effective Coalitions in Multi-agent Reinforcement Learning
di: Li, Yugu, et al.
Pubblicazione: (2025)