AutoForge: Automated Environment Synthesis for Agentic Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Cai, Shihao, Fang, Runnan, Wu, Jialong, Li, Baixuan, Wang, Xinyu, Jiang, Yong, Su, Liangcai, Zhang, Liwen, Yin, Wenbiao, Zhang, Zhen, Feng, Fuli, Xie, Pengjun, Wang, Xiaobin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards General Agentic Intelligence via Environment Scaling
di: Fang, Runnan, et al.
Pubblicazione: (2025)
di: Fang, Runnan, et al.
Pubblicazione: (2025)
ParallelMuse: Agentic Parallel Thinking for Deep Information Seeking
di: Li, Baixuan, et al.
Pubblicazione: (2025)
di: Li, Baixuan, et al.
Pubblicazione: (2025)
Nested Browser-Use Learning for Agentic Information Seeking
di: Li, Baixuan, et al.
Pubblicazione: (2025)
di: Li, Baixuan, et al.
Pubblicazione: (2025)
WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
SynWorld: Virtual Scenario Synthesis for Agentic Action Knowledge Refinement
di: Fang, Runnan, et al.
Pubblicazione: (2025)
di: Fang, Runnan, et al.
Pubblicazione: (2025)
WebDancer: Towards Autonomous Information Seeking Agency
di: Wu, Jialong, et al.
Pubblicazione: (2025)
di: Wu, Jialong, et al.
Pubblicazione: (2025)
AgentSwing: Adaptive Parallel Context Management Routing for Long-Horizon Web Agents
di: Feng, Zhaopeng, et al.
Pubblicazione: (2026)
di: Feng, Zhaopeng, et al.
Pubblicazione: (2026)
U-Fold: Dynamic Intent-Aware Context Folding for User-Centric Agents
di: Su, Jin, et al.
Pubblicazione: (2026)
di: Su, Jin, et al.
Pubblicazione: (2026)
EvolveSearch: An Iterative Self-Evolving Search Agent
di: Zhang, Dingchu, et al.
Pubblicazione: (2025)
di: Zhang, Dingchu, et al.
Pubblicazione: (2025)
WebLeaper: Empowering Efficiency and Efficacy in WebAgent via Enabling Info-Rich Seeking
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
Benchmarking Agentic Workflow Generation
di: Qiao, Shuofei, et al.
Pubblicazione: (2024)
di: Qiao, Shuofei, et al.
Pubblicazione: (2024)
Scaling Agents via Continual Pre-training
di: Su, Liangcai, et al.
Pubblicazione: (2025)
di: Su, Liangcai, et al.
Pubblicazione: (2025)
AgentFrontier: Expanding the Capability Frontier of LLM Agents with ZPD-Guided Data Synthesis
di: Chen, Xuanzhong, et al.
Pubblicazione: (2025)
di: Chen, Xuanzhong, et al.
Pubblicazione: (2025)
OmniThink: Expanding Knowledge Boundaries in Machine Writing through Thinking
di: Xi, Zekun, et al.
Pubblicazione: (2025)
di: Xi, Zekun, et al.
Pubblicazione: (2025)
WebWalker: Benchmarking LLMs in Web Traversal
di: Wu, Jialong, et al.
Pubblicazione: (2025)
di: Wu, Jialong, et al.
Pubblicazione: (2025)
Memp: Exploring Agent Procedural Memory
di: Fang, Runnan, et al.
Pubblicazione: (2025)
di: Fang, Runnan, et al.
Pubblicazione: (2025)
WebSailor: Navigating Super-human Reasoning for Web Agent
di: Li, Kuan, et al.
Pubblicazione: (2025)
di: Li, Kuan, et al.
Pubblicazione: (2025)
Agentic Feedback Loop Modeling Improves Recommendation and User Simulation
di: Cai, Shihao, et al.
Pubblicazione: (2024)
di: Cai, Shihao, et al.
Pubblicazione: (2024)
Klear-AgentForge: Forging Agentic Intelligence through Posttraining Scaling
di: Wang, Qi, et al.
Pubblicazione: (2025)
di: Wang, Qi, et al.
Pubblicazione: (2025)
WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Scalable Reinforcement Learning
di: Li, Kuan, et al.
Pubblicazione: (2025)
di: Li, Kuan, et al.
Pubblicazione: (2025)
Repurposing Synthetic Data for Fine-grained Search Agent Supervision
di: Zhao, Yida, et al.
Pubblicazione: (2025)
di: Zhao, Yida, et al.
Pubblicazione: (2025)
ARES: Automated Rubric Synthesis for Scalable LLM Reinforcement Learning
di: Li, Xiaoyuan, et al.
Pubblicazione: (2026)
di: Li, Xiaoyuan, et al.
Pubblicazione: (2026)
AutoTestForge: A Multidimensional Automated Testing Framework for Natural Language Processing Models
di: Xing, Hengrui, et al.
Pubblicazione: (2025)
di: Xing, Hengrui, et al.
Pubblicazione: (2025)
DocDancer: Towards Agentic Document-Grounded Information Seeking
di: Zhang, Qintong, et al.
Pubblicazione: (2026)
di: Zhang, Qintong, et al.
Pubblicazione: (2026)
Agentic Knowledgeable Self-awareness
di: Qiao, Shuofei, et al.
Pubblicazione: (2025)
di: Qiao, Shuofei, et al.
Pubblicazione: (2025)
RAGShaper: Eliciting Sophisticated Agentic RAG Skills via Automated Data Synthesis
di: Tao, Zhengwei, et al.
Pubblicazione: (2026)
di: Tao, Zhengwei, et al.
Pubblicazione: (2026)
WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents
di: Qiao, Zile, et al.
Pubblicazione: (2025)
di: Qiao, Zile, et al.
Pubblicazione: (2025)
Efficient Multimodal Planning Agent for Visual Question-Answering
di: Chen, Zhuo, et al.
Pubblicazione: (2026)
di: Chen, Zhuo, et al.
Pubblicazione: (2026)
Unsupervised Query Routing for Retrieval Augmented Generation
di: Mu, Feiteng, et al.
Pubblicazione: (2025)
di: Mu, Feiteng, et al.
Pubblicazione: (2025)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
di: Ye, Rui, et al.
Pubblicazione: (2025)
di: Ye, Rui, et al.
Pubblicazione: (2025)
DeltaMem: Towards Agentic Memory Management via Reinforcement Learning
di: Zhang, Qi, et al.
Pubblicazione: (2026)
di: Zhang, Qi, et al.
Pubblicazione: (2026)
Detecting Knowledge Boundary of Vision Large Language Models by Sampling-Based Inference
di: Chen, Zhuo, et al.
Pubblicazione: (2025)
di: Chen, Zhuo, et al.
Pubblicazione: (2025)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
Effective Demonstration Annotation for In-Context Learning via Language Model-Based Determinantal Point Process
di: Wang, Peng, et al.
Pubblicazione: (2024)
di: Wang, Peng, et al.
Pubblicazione: (2024)
LaRA: Benchmarking Retrieval-Augmented Generation and Long-Context LLMs -- No Silver Bullet for LC or RAG Routing
di: Li, Kuan, et al.
Pubblicazione: (2025)
di: Li, Kuan, et al.
Pubblicazione: (2025)
WebWatcher: Breaking New Frontier of Vision-Language Deep Research Agent
di: Geng, Xinyu, et al.
Pubblicazione: (2025)
di: Geng, Xinyu, et al.
Pubblicazione: (2025)
Tongyi DeepResearch Technical Report
di: Tongyi DeepResearch Team, et al.
Pubblicazione: (2025)
di: Tongyi DeepResearch Team, et al.
Pubblicazione: (2025)
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
di: Sun, Jingbo, et al.
Pubblicazione: (2026)
di: Sun, Jingbo, et al.
Pubblicazione: (2026)
MGFRec: Towards Reinforced Reasoning Recommendation with Multiple Groundings and Feedback
di: Cai, Shihao, et al.
Pubblicazione: (2025)
di: Cai, Shihao, et al.
Pubblicazione: (2025)
AutoVerifier: An Agentic Automated Verification Framework Using Large Language Models
di: Du, Yuntao, et al.
Pubblicazione: (2026)
di: Du, Yuntao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Towards General Agentic Intelligence via Environment Scaling
di: Fang, Runnan, et al.
Pubblicazione: (2025) -
ParallelMuse: Agentic Parallel Thinking for Deep Information Seeking
di: Li, Baixuan, et al.
Pubblicazione: (2025) -
Nested Browser-Use Learning for Agentic Information Seeking
di: Li, Baixuan, et al.
Pubblicazione: (2025) -
WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization
di: Tao, Zhengwei, et al.
Pubblicazione: (2025) -
SynWorld: Virtual Scenario Synthesis for Agentic Action Knowledge Refinement
di: Fang, Runnan, et al.
Pubblicazione: (2025)