SKILLC: Learning Autonomous Skill Internalization in LLM Agents via Contrastive Credit Assignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Hongxiang, Kuai, Zhirui, Xue, Erpeng, Wang, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting
di: Lin, Hongxiang, et al.
Pubblicazione: (2026)
di: Lin, Hongxiang, et al.
Pubblicazione: (2026)
Exact Is Easier: Credit Assignment for Cooperative LLM Agents
di: Chen, Yanjun, et al.
Pubblicazione: (2026)
di: Chen, Yanjun, et al.
Pubblicazione: (2026)
MTmixAtt: Integrating Mixture-of-Experts with Multi-Mix Attention for Large-Scale Recommendation
di: Qi, Xianyang, et al.
Pubblicazione: (2025)
di: Qi, Xianyang, et al.
Pubblicazione: (2025)
Hindsight Credit Assignment for Long-Horizon LLM Agents
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026)
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026)
Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training
di: Fang, Yangyi, et al.
Pubblicazione: (2026)
di: Fang, Yangyi, et al.
Pubblicazione: (2026)
Shapley-Coop: Credit Assignment for Emergent Cooperation in Self-Interested LLM Agents
di: Hua, Yun, et al.
Pubblicazione: (2025)
di: Hua, Yun, et al.
Pubblicazione: (2025)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
di: Qu, Yun, et al.
Pubblicazione: (2024)
di: Qu, Yun, et al.
Pubblicazione: (2024)
Multi-level Advantage Credit Assignment for Cooperative Multi-Agent Reinforcement Learning
di: Zhao, Xutong, et al.
Pubblicazione: (2025)
di: Zhao, Xutong, et al.
Pubblicazione: (2025)
Dynamic Forgetting and Spatio-Temporal Periodic Interest Modeling for Local-Life Service Recommendation
di: Hu, Zhaoyu, et al.
Pubblicazione: (2025)
di: Hu, Zhaoyu, et al.
Pubblicazione: (2025)
SkillMaster: Toward Autonomous Skill Mastery in LLM Agents
di: Yang, Min, et al.
Pubblicazione: (2026)
di: Yang, Min, et al.
Pubblicazione: (2026)
Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimization
di: Li, Wenwu, et al.
Pubblicazione: (2026)
di: Li, Wenwu, et al.
Pubblicazione: (2026)
When Relevance Meets Novelty: Dual-Stable Periodic Optimization for Serendipitous Recommendation
di: Lin, Hongxiang, et al.
Pubblicazione: (2025)
di: Lin, Hongxiang, et al.
Pubblicazione: (2025)
GRPO-$λ$: Credit Assignment improves LLM Reasoning
di: Parthasarathi, Prasanna, et al.
Pubblicazione: (2025)
di: Parthasarathi, Prasanna, et al.
Pubblicazione: (2025)
Challenges in Credit Assignment for Multi-Agent Reinforcement Learning in Open Agent Systems
di: Abadi, Alireza Saleh, et al.
Pubblicazione: (2025)
di: Abadi, Alireza Saleh, et al.
Pubblicazione: (2025)
SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Training
di: He, Zhongyu, et al.
Pubblicazione: (2026)
di: He, Zhongyu, et al.
Pubblicazione: (2026)
From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
RTMC: Step-Level Credit Assignment via Rollout Trees
di: Wang, Tao, et al.
Pubblicazione: (2026)
di: Wang, Tao, et al.
Pubblicazione: (2026)
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2026)
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2026)
PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning
di: Liu, Dongyi, et al.
Pubblicazione: (2026)
di: Liu, Dongyi, et al.
Pubblicazione: (2026)
In-Context Credit Assignment via the Core
di: Harris, Keegan, et al.
Pubblicazione: (2026)
di: Harris, Keegan, et al.
Pubblicazione: (2026)
EGL-SCA: Structural Credit Assignment for Co-Evolving Instructions and Tools in Graph Reasoning Agents
di: Yuan, Zike, et al.
Pubblicazione: (2026)
di: Yuan, Zike, et al.
Pubblicazione: (2026)
Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents
di: Mi, Qirui, et al.
Pubblicazione: (2026)
di: Mi, Qirui, et al.
Pubblicazione: (2026)
Credit Assignment with Resets in Language Model Reasoning
di: Samanta, Ankur, et al.
Pubblicazione: (2026)
di: Samanta, Ankur, et al.
Pubblicazione: (2026)
RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents
di: Xiao, Wenjie, et al.
Pubblicazione: (2026)
di: Xiao, Wenjie, et al.
Pubblicazione: (2026)
WebXSkill: Skill Learning for Autonomous Web Agents
di: Wang, Zhaoyang, et al.
Pubblicazione: (2026)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2026)
Reducing Credit Assignment Variance via Counterfactual Reasoning Paths
di: Ding, Fei, et al.
Pubblicazione: (2026)
di: Ding, Fei, et al.
Pubblicazione: (2026)
OPPO: Bayesian Value Recursion for Token-Level Credit Assignment in LLM Reasoning
di: Li, Yu, et al.
Pubblicazione: (2026)
di: Li, Yu, et al.
Pubblicazione: (2026)
Sequence Compression Speeds Up Credit Assignment in Reinforcement Learning
di: Ramesh, Aditya A., et al.
Pubblicazione: (2024)
di: Ramesh, Aditya A., et al.
Pubblicazione: (2024)
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2023)
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2023)
Credit Assignment via Neural Manifold Noise Correlation
di: Kang, Byungwoo, et al.
Pubblicazione: (2026)
di: Kang, Byungwoo, et al.
Pubblicazione: (2026)
SCAR: Shapley Credit Assignment for More Efficient RLHF
di: Cao, Meng, et al.
Pubblicazione: (2025)
di: Cao, Meng, et al.
Pubblicazione: (2025)
InT: Self-Proposed Interventions Enable Credit Assignment in LLM Reasoning
di: Yang, Matthew Y. R., et al.
Pubblicazione: (2026)
di: Yang, Matthew Y. R., et al.
Pubblicazione: (2026)
CAPO: Towards Enhancing LLM Reasoning through Generative Credit Assignment
di: Xie, Guofu, et al.
Pubblicazione: (2025)
di: Xie, Guofu, et al.
Pubblicazione: (2025)
Harmonizing Dense and Sparse Signals in Multi-turn RL: Dual-Horizon Credit Assignment for Industrial Sales Agents
di: Yang, Haojin, et al.
Pubblicazione: (2026)
di: Yang, Haojin, et al.
Pubblicazione: (2026)
SkillFlow:Benchmarking Lifelong Skill Discovery and Evolution for Autonomous Agents
di: Zhang, Ziao, et al.
Pubblicazione: (2026)
di: Zhang, Ziao, et al.
Pubblicazione: (2026)
AMR-SD: Asymmetric Meta-Reflective Self-Distillation for Token-Level Credit Assignment
di: Wei, Zhenlin, et al.
Pubblicazione: (2026)
di: Wei, Zhenlin, et al.
Pubblicazione: (2026)
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
di: Khandoga, Mykola, et al.
Pubblicazione: (2026)
di: Khandoga, Mykola, et al.
Pubblicazione: (2026)
Intrinsic Credit Assignment for Long Horizon Interaction
di: Auzina, Ilze Amanda, et al.
Pubblicazione: (2026)
di: Auzina, Ilze Amanda, et al.
Pubblicazione: (2026)
QLLM: Do We Really Need a Mixing Network for Credit Assignment in Multi-Agent Reinforcement Learning?
di: Li, Yuanjun, et al.
Pubblicazione: (2025)
di: Li, Yuanjun, et al.
Pubblicazione: (2025)
Nucleolus Credit Assignment for Effective Coalitions in Multi-agent Reinforcement Learning
di: Li, Yugu, et al.
Pubblicazione: (2025)
di: Li, Yugu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting
di: Lin, Hongxiang, et al.
Pubblicazione: (2026) -
Exact Is Easier: Credit Assignment for Cooperative LLM Agents
di: Chen, Yanjun, et al.
Pubblicazione: (2026) -
MTmixAtt: Integrating Mixture-of-Experts with Multi-Mix Attention for Large-Scale Recommendation
di: Qi, Xianyang, et al.
Pubblicazione: (2025) -
Hindsight Credit Assignment for Long-Horizon LLM Agents
di: Tan, Hui-Ze, et al.
Pubblicazione: (2026) -
Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training
di: Fang, Yangyi, et al.
Pubblicazione: (2026)