Salvato in:
| Autori principali: | Wang, Prince Zizhuang, Jiang, Shuli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.18079 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AgentSocialBench: Evaluating Privacy Risks in Human-Centered Agentic Social Networks
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2026)
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2026)
PRIME: Training Free Proactive Reasoning via Iterative Memory Evolution for User-Centric Agent
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2026)
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2026)
Hierarchical Reinforcement Learning with Augmented Step-Level Transitions for LLM Agents
di: Zhen, Shuai, et al.
Pubblicazione: (2026)
di: Zhen, Shuai, et al.
Pubblicazione: (2026)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
di: Xu, Yifan, et al.
Pubblicazione: (2025)
di: Xu, Yifan, et al.
Pubblicazione: (2025)
RLFactory: A Plug-and-Play Reinforcement Learning Post-Training Framework for LLM Multi-Turn Tool-Use
di: Chai, Jiajun, et al.
Pubblicazione: (2025)
di: Chai, Jiajun, et al.
Pubblicazione: (2025)
On Effectiveness and Efficiency of Agentic Tool-calling and RL Training
di: Liu, Tong, et al.
Pubblicazione: (2026)
di: Liu, Tong, et al.
Pubblicazione: (2026)
ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL
di: Zhou, Yifei, et al.
Pubblicazione: (2024)
di: Zhou, Yifei, et al.
Pubblicazione: (2024)
POLO: Preference-Guided Multi-Turn Reinforcement Learning for Lead Optimization
di: Wang, Ziqing, et al.
Pubblicazione: (2025)
di: Wang, Ziqing, et al.
Pubblicazione: (2025)
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
di: Zeng, Xingshan, et al.
Pubblicazione: (2025)
di: Zeng, Xingshan, et al.
Pubblicazione: (2025)
Empowering Multi-Turn Tool-Integrated Agentic Reasoning with Group Turn Policy Optimization
di: Ding, Yifeng, et al.
Pubblicazione: (2025)
di: Ding, Yifeng, et al.
Pubblicazione: (2025)
Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory
di: Li, Sijia, et al.
Pubblicazione: (2025)
di: Li, Sijia, et al.
Pubblicazione: (2025)
Kevin: Multi-Turn RL for Generating CUDA Kernels
di: Baronio, Carlo, et al.
Pubblicazione: (2025)
di: Baronio, Carlo, et al.
Pubblicazione: (2025)
MTSQL-R1: Towards Long-Horizon Multi-Turn Text-to-SQL via Agentic Training
di: Guo, Taicheng, et al.
Pubblicazione: (2025)
di: Guo, Taicheng, et al.
Pubblicazione: (2025)
Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning
di: Li, Junsong, et al.
Pubblicazione: (2025)
di: Li, Junsong, et al.
Pubblicazione: (2025)
RL$^3$: Boosting Meta Reinforcement Learning via RL inside RL$^2$
di: Bhatia, Abhinav, et al.
Pubblicazione: (2023)
di: Bhatia, Abhinav, et al.
Pubblicazione: (2023)
Skill Reuse as Compression in Agentic RL
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
Investigating the Treacherous Turn in Deep Reinforcement Learning
di: Ashcraft, Chace, et al.
Pubblicazione: (2025)
di: Ashcraft, Chace, et al.
Pubblicazione: (2025)
A Practitioner's Guide to Multi-turn Agentic Reinforcement Learning
di: Wang, Ruiyi, et al.
Pubblicazione: (2025)
di: Wang, Ruiyi, et al.
Pubblicazione: (2025)
TSR: Trajectory-Search Rollouts for Multi-Turn RL of LLM Agents
di: Djuhera, Aladin, et al.
Pubblicazione: (2026)
di: Djuhera, Aladin, et al.
Pubblicazione: (2026)
Offline Reinforcement Learning for LLM Multi-Step Reasoning
di: Wang, Huaijie, et al.
Pubblicazione: (2024)
di: Wang, Huaijie, et al.
Pubblicazione: (2024)
TIPS: Turn-Level Information-Potential Reward Shaping for Search-Augmented LLMs
di: Xie, Yutao, et al.
Pubblicazione: (2026)
di: Xie, Yutao, et al.
Pubblicazione: (2026)
LlamaRL: A Distributed Asynchronous Reinforcement Learning Framework for Efficient Large-scale LLM Training
di: Wu, Bo, et al.
Pubblicazione: (2025)
di: Wu, Bo, et al.
Pubblicazione: (2025)
Turn-based Multi-Agent Reinforcement Learning Model Checking
di: Gross, Dennis
Pubblicazione: (2025)
di: Gross, Dennis
Pubblicazione: (2025)
UserRL: Training Interactive User-Centric Agent via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
di: Li, Haozhan, et al.
Pubblicazione: (2025)
di: Li, Haozhan, et al.
Pubblicazione: (2025)
Multi-Turn Code Generation Through Single-Step Rewards
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2025)
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2025)
Human-Inspired Multi-Level Reinforcement Learning
di: Wu, Mingkang, et al.
Pubblicazione: (2025)
di: Wu, Mingkang, et al.
Pubblicazione: (2025)
Tool Zero: Training Tool-Augmented LLMs via Pure RL from Scratch
di: Zeng, Yirong, et al.
Pubblicazione: (2025)
di: Zeng, Yirong, et al.
Pubblicazione: (2025)
MolMem: Memory-Augmented Agentic Reinforcement Learning for Sample-Efficient Molecular Optimization
di: Wang, Ziqing, et al.
Pubblicazione: (2026)
di: Wang, Ziqing, et al.
Pubblicazione: (2026)
Augmenting Offline RL with Unlabeled Data
di: Wang, Zhao, et al.
Pubblicazione: (2024)
di: Wang, Zhao, et al.
Pubblicazione: (2024)
Which Experiences Are Influential for RL Agents? Efficiently Estimating The Influence of Experiences
di: Hiraoka, Takuya, et al.
Pubblicazione: (2024)
di: Hiraoka, Takuya, et al.
Pubblicazione: (2024)
RollArt: Scaling Agentic RL Training via Disaggregated Infrastructure
di: Gao, Wei, et al.
Pubblicazione: (2025)
di: Gao, Wei, et al.
Pubblicazione: (2025)
Multi-Step Likelihood-Ratio Correction for Reinforcement Learning with Verifiable Rewards
di: Yoon, Deokgyu, et al.
Pubblicazione: (2026)
di: Yoon, Deokgyu, et al.
Pubblicazione: (2026)
EchoRL: Reinforcement Learning via Rollout Echoing
di: Bi, Jinhe, et al.
Pubblicazione: (2026)
di: Bi, Jinhe, et al.
Pubblicazione: (2026)
FBOS-RL: Feedback-Driven Bi-Objective Synergistic Reinforcement Learning
di: Zhang, Xikai, et al.
Pubblicazione: (2026)
di: Zhang, Xikai, et al.
Pubblicazione: (2026)
RL-100: Performant Robotic Manipulation with Real-World Reinforcement Learning
di: Lei, Kun, et al.
Pubblicazione: (2025)
di: Lei, Kun, et al.
Pubblicazione: (2025)
RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
RL-MSA: a Reinforcement Learning-based Multi-line bus Scheduling Approach
di: Liu, Yingzhuo
Pubblicazione: (2024)
di: Liu, Yingzhuo
Pubblicazione: (2024)
SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning
di: Wang, Jichao, et al.
Pubblicazione: (2026)
di: Wang, Jichao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
AgentSocialBench: Evaluating Privacy Risks in Human-Centered Agentic Social Networks
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2026) -
PRIME: Training Free Proactive Reasoning via Iterative Memory Evolution for User-Centric Agent
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2026) -
Hierarchical Reinforcement Learning with Augmented Step-Level Transitions for LLM Agents
di: Zhen, Shuai, et al.
Pubblicazione: (2026) -
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2025) -
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
di: Xu, Yifan, et al.
Pubblicazione: (2025)