WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wei, Zhepei, Yao, Wenlin, Liu, Yao, Zhang, Weizhi, Lu, Qin, Qiu, Liang, Yu, Changlong, Xu, Puyang, Zhang, Chao, Yin, Bing, Yun, Hyokun, Li, Lihong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models
di: He, Hongliang, et al.
Pubblicazione: (2024)
di: He, Hongliang, et al.
Pubblicazione: (2024)
Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse
di: Zhang, Yuheng, et al.
Pubblicazione: (2025)
di: Zhang, Yuheng, et al.
Pubblicazione: (2025)
MM-WebAgent: A Hierarchical Multimodal Web Agent for Webpage Generation
di: Li, Yan, et al.
Pubblicazione: (2026)
di: Li, Yan, et al.
Pubblicazione: (2026)
Agentic Test-Time Scaling for WebAgents
di: Lee, Nicholas, et al.
Pubblicazione: (2026)
di: Lee, Nicholas, et al.
Pubblicazione: (2026)
WebLeaper: Empowering Efficiency and Efficacy in WebAgent via Enabling Info-Rich Seeking
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
Evaluating Long-Context Reasoning in LLM-Based WebAgents
di: Chung, Andy, et al.
Pubblicazione: (2025)
di: Chung, Andy, et al.
Pubblicazione: (2025)
A Survey of WebAgents: Towards Next-Generation AI Agents for Web Automation with Large Foundation Models
di: Ning, Liangbo, et al.
Pubblicazione: (2025)
di: Ning, Liangbo, et al.
Pubblicazione: (2025)
VISTA: An End-to-End Benchmark for Visual Spec-to-Web-App Coding Agents
di: Guo, JunJia, et al.
Pubblicazione: (2026)
di: Guo, JunJia, et al.
Pubblicazione: (2026)
Ask a Strong LLM Judge when Your Reward Model is Uncertain
di: Xu, Zhenghao, et al.
Pubblicazione: (2025)
di: Xu, Zhenghao, et al.
Pubblicazione: (2025)
WebXSkill: Skill Learning for Autonomous Web Agents
di: Wang, Zhaoyang, et al.
Pubblicazione: (2026)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2026)
OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents
di: Yang, Rui, et al.
Pubblicazione: (2026)
di: Yang, Rui, et al.
Pubblicazione: (2026)
WebTestBench: Evaluating Computer-Use Agents towards End-to-End Automated Web Testing
di: Kong, Fanheng, et al.
Pubblicazione: (2026)
di: Kong, Fanheng, et al.
Pubblicazione: (2026)
A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis
di: Gur, Izzeddin, et al.
Pubblicazione: (2023)
di: Gur, Izzeddin, et al.
Pubblicazione: (2023)
The Tool Illusion: Rethinking Tool Use in Web Agents
di: Lou, Renze, et al.
Pubblicazione: (2026)
di: Lou, Renze, et al.
Pubblicazione: (2026)
EVA: Efficient Reinforcement Learning for End-to-End Video Agent
di: Zhang, Yaolun, et al.
Pubblicazione: (2026)
di: Zhang, Yaolun, et al.
Pubblicazione: (2026)
OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization
di: He, Hongliang, et al.
Pubblicazione: (2024)
di: He, Hongliang, et al.
Pubblicazione: (2024)
WebGraphEval: Multi-Turn Trajectory Evaluation for Web Agents using Graph Representation
di: Qian, Yaoyao, et al.
Pubblicazione: (2025)
di: Qian, Yaoyao, et al.
Pubblicazione: (2025)
Training Multi-Image Vision Agents via End2End Reinforcement Learning
di: Dong, Chengqi, et al.
Pubblicazione: (2025)
di: Dong, Chengqi, et al.
Pubblicazione: (2025)
InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training
di: Zhang, Ziyun, et al.
Pubblicazione: (2026)
di: Zhang, Ziyun, et al.
Pubblicazione: (2026)
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
di: Qi, Zehan, et al.
Pubblicazione: (2024)
di: Qi, Zehan, et al.
Pubblicazione: (2024)
ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents
di: Lai, Hanyu, et al.
Pubblicazione: (2025)
di: Lai, Hanyu, et al.
Pubblicazione: (2025)
WebDS: An End-to-End Benchmark for Web-based Data Science
di: Hsu, Ethan, et al.
Pubblicazione: (2025)
di: Hsu, Ethan, et al.
Pubblicazione: (2025)
WebTestPilot: Agentic End-to-End Web Testing against Natural Language Specification by Inferring Oracles with Symbolized GUI Elements
di: Teoh, Xiwen, et al.
Pubblicazione: (2026)
di: Teoh, Xiwen, et al.
Pubblicazione: (2026)
DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping
di: Fan, Wei, et al.
Pubblicazione: (2025)
di: Fan, Wei, et al.
Pubblicazione: (2025)
RealWebAssist: A Benchmark for Long-Horizon Web Assistance with Real-World Users
di: Ye, Suyu, et al.
Pubblicazione: (2025)
di: Ye, Suyu, et al.
Pubblicazione: (2025)
WebAnchor: Anchoring Agent Planning to Stabilize Long-Horizon Web Reasoning
di: Yu, Xinmiao, et al.
Pubblicazione: (2026)
di: Yu, Xinmiao, et al.
Pubblicazione: (2026)
Chain-of-Agents: End-to-End Agent Foundation Models via Multi-Agent Distillation and Agentic RL
di: Li, Weizhen, et al.
Pubblicazione: (2025)
di: Li, Weizhen, et al.
Pubblicazione: (2025)
WebArbiter: A Principle-Guided Reasoning Process Reward Model for Web Agents
di: Zhang, Yao, et al.
Pubblicazione: (2026)
di: Zhang, Yao, et al.
Pubblicazione: (2026)
HabitatAgent: An End-to-End Multi-Agent System for Housing Consultation
di: Yang, Hongyang, et al.
Pubblicazione: (2026)
di: Yang, Hongyang, et al.
Pubblicazione: (2026)
WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
DynaWeb: Model-Based Reinforcement Learning of Web Agents
di: Ding, Hang, et al.
Pubblicazione: (2026)
di: Ding, Hang, et al.
Pubblicazione: (2026)
SynthAgent: Adapting Web Agents with Synthetic Supervision
di: Wang, Zhaoyang, et al.
Pubblicazione: (2025)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2025)
Learning to Remember: End-to-End Training of Memory Agents for Long-Context Reasoning
di: Zhang, Kehao, et al.
Pubblicazione: (2026)
di: Zhang, Kehao, et al.
Pubblicazione: (2026)
AlphaQuanter: An End-to-End Tool-Augmented Agentic Reinforcement Learning Framework for Stock Trading
di: Deng, Zheye, et al.
Pubblicazione: (2025)
di: Deng, Zheye, et al.
Pubblicazione: (2025)
Web-Shepherd: Advancing PRMs for Reinforcing Web Agents
di: Chae, Hyungjoo, et al.
Pubblicazione: (2025)
di: Chae, Hyungjoo, et al.
Pubblicazione: (2025)
UCAgent: An End-to-End Agent for Block-Level Functional Verification
di: Wang, Junyue, et al.
Pubblicazione: (2026)
di: Wang, Junyue, et al.
Pubblicazione: (2026)
Evolving-RL: End-to-End Optimization of Experience-Driven Self-Evolving Capability within Agents
di: Fan, Zhiyuan, et al.
Pubblicazione: (2026)
di: Fan, Zhiyuan, et al.
Pubblicazione: (2026)
WebGym: Scaling Training Environments for Visual Web Agents with Realistic Tasks
di: Bai, Hao, et al.
Pubblicazione: (2026)
di: Bai, Hao, et al.
Pubblicazione: (2026)
WebSailor: Navigating Super-human Reasoning for Web Agent
di: Li, Kuan, et al.
Pubblicazione: (2025)
di: Li, Kuan, et al.
Pubblicazione: (2025)
SoK: Web Authentication in the Age of End-to-End Encryption
di: Blessing, Jenny, et al.
Pubblicazione: (2024)
di: Blessing, Jenny, et al.
Pubblicazione: (2024)
Documenti analoghi
-
WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models
di: He, Hongliang, et al.
Pubblicazione: (2024) -
Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse
di: Zhang, Yuheng, et al.
Pubblicazione: (2025) -
MM-WebAgent: A Hierarchical Multimodal Web Agent for Webpage Generation
di: Li, Yan, et al.
Pubblicazione: (2026) -
Agentic Test-Time Scaling for WebAgents
di: Lee, Nicholas, et al.
Pubblicazione: (2026) -
WebLeaper: Empowering Efficiency and Efficacy in WebAgent via Enabling Info-Rich Seeking
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)