IterResearch: Rethinking Long-Horizon Agents with Interaction Scaling
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Guoxin, Qiao, Zile, Chen, Xuanzhong, Yu, Donglei, Xu, Haotian, Zhao, Wayne Xin, Song, Ruihua, Yin, Wenbiao, Yin, Huifeng, Zhang, Liwen, Li, Kuan, Liao, Minpeng, Jiang, Yong, Xie, Pengjun, Huang, Fei, Zhou, Jingren |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents
di: Qiao, Zile, et al.
Pubblicazione: (2025)
di: Qiao, Zile, et al.
Pubblicazione: (2025)
MARS: Co-evolving Dual-System Deep Research via Multi-Agent Reinforcement Learning
di: Chen, Guoxin, et al.
Pubblicazione: (2025)
di: Chen, Guoxin, et al.
Pubblicazione: (2025)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
di: Ye, Rui, et al.
Pubblicazione: (2025)
di: Ye, Rui, et al.
Pubblicazione: (2025)
AgentFrontier: Expanding the Capability Frontier of LLM Agents with ZPD-Guided Data Synthesis
di: Chen, Xuanzhong, et al.
Pubblicazione: (2025)
di: Chen, Xuanzhong, et al.
Pubblicazione: (2025)
BrowseConf: Confidence-Guided Test-Time Scaling for Web Agents
di: Ou, Litu, et al.
Pubblicazione: (2025)
di: Ou, Litu, et al.
Pubblicazione: (2025)
Nested Browser-Use Learning for Agentic Information Seeking
di: Li, Baixuan, et al.
Pubblicazione: (2025)
di: Li, Baixuan, et al.
Pubblicazione: (2025)
ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization
di: Wu, Xixi, et al.
Pubblicazione: (2025)
di: Wu, Xixi, et al.
Pubblicazione: (2025)
Scaling Agents via Continual Pre-training
di: Su, Liangcai, et al.
Pubblicazione: (2025)
di: Su, Liangcai, et al.
Pubblicazione: (2025)
C-3PO: Compact Plug-and-Play Proxy Optimization to Achieve Human-like Retrieval-Augmented Generation
di: Chen, Guoxin, et al.
Pubblicazione: (2025)
di: Chen, Guoxin, et al.
Pubblicazione: (2025)
WebLeaper: Empowering Efficiency and Efficacy in WebAgent via Enabling Info-Rich Seeking
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
WebAnchor: Anchoring Agent Planning to Stabilize Long-Horizon Web Reasoning
di: Yu, Xinmiao, et al.
Pubblicazione: (2026)
di: Yu, Xinmiao, et al.
Pubblicazione: (2026)
Toward Autonomous Long-Horizon Engineering for ML Research
di: Chen, Guoxin, et al.
Pubblicazione: (2026)
di: Chen, Guoxin, et al.
Pubblicazione: (2026)
ReForm: Reflective Autoformalization with Prospective Bounded Sequence Optimization
di: Chen, Guoxin, et al.
Pubblicazione: (2025)
di: Chen, Guoxin, et al.
Pubblicazione: (2025)
AlphaMath Almost Zero: Process Supervision without Process
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
Step-level Value Preference Optimization for Mathematical Reasoning
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Scalable Reinforcement Learning
di: Li, Kuan, et al.
Pubblicazione: (2025)
di: Li, Kuan, et al.
Pubblicazione: (2025)
WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
di: Tao, Zhengwei, et al.
Pubblicazione: (2025)
DecoupleSearch: Decouple Planning and Search via Hierarchical Reward Modeling
di: Sun, Hao, et al.
Pubblicazione: (2025)
di: Sun, Hao, et al.
Pubblicazione: (2025)
WebSailor: Navigating Super-human Reasoning for Web Agent
di: Li, Kuan, et al.
Pubblicazione: (2025)
di: Li, Kuan, et al.
Pubblicazione: (2025)
WebDancer: Towards Autonomous Information Seeking Agency
di: Wu, Jialong, et al.
Pubblicazione: (2025)
di: Wu, Jialong, et al.
Pubblicazione: (2025)
LaRA: Benchmarking Retrieval-Augmented Generation and Long-Context LLMs -- No Silver Bullet for LC or RAG Routing
di: Li, Kuan, et al.
Pubblicazione: (2025)
di: Li, Kuan, et al.
Pubblicazione: (2025)
ParallelMuse: Agentic Parallel Thinking for Deep Information Seeking
di: Li, Baixuan, et al.
Pubblicazione: (2025)
di: Li, Baixuan, et al.
Pubblicazione: (2025)
ZeroSearch: Incentivize the Search Capability of LLMs without Searching
di: Sun, Hao, et al.
Pubblicazione: (2025)
di: Sun, Hao, et al.
Pubblicazione: (2025)
Efficient and Adaptive Simultaneous Speech Translation with Fully Unidirectional Architecture
di: Fu, Biao, et al.
Pubblicazione: (2025)
di: Fu, Biao, et al.
Pubblicazione: (2025)
IterAlign: Iterative Constitutional Alignment of Large Language Models
di: Chen, Xiusi, et al.
Pubblicazione: (2024)
di: Chen, Xiusi, et al.
Pubblicazione: (2024)
JURY-RL: Votes Propose, Proofs Dispose for Label-Free RLVR
di: Chen, Xinjie, et al.
Pubblicazione: (2026)
di: Chen, Xinjie, et al.
Pubblicazione: (2026)
From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization
di: Chen, Xinjie, et al.
Pubblicazione: (2025)
di: Chen, Xinjie, et al.
Pubblicazione: (2025)
Tongyi DeepResearch Technical Report
di: Tongyi DeepResearch Team, et al.
Pubblicazione: (2025)
di: Tongyi DeepResearch Team, et al.
Pubblicazione: (2025)
EvolveSearch: An Iterative Self-Evolving Search Agent
di: Zhang, Dingchu, et al.
Pubblicazione: (2025)
di: Zhang, Dingchu, et al.
Pubblicazione: (2025)
Small‐Molecule Fluorescent Probes for Butyrylcholinesterase
di: Zibo Lin, et al.
Pubblicazione: (2025)
di: Zibo Lin, et al.
Pubblicazione: (2025)
EcomBench: Towards Holistic Evaluation of Foundation Agents in E-commerce
di: Min, Rui, et al.
Pubblicazione: (2025)
di: Min, Rui, et al.
Pubblicazione: (2025)
Iter Criminis
Pubblicazione: (2004)
Pubblicazione: (2004)
RoadmapBench: Evaluating Long-Horizon Agentic Software Development Across Version Upgrades
di: Xu, Xinbo, et al.
Pubblicazione: (2026)
di: Xu, Xinbo, et al.
Pubblicazione: (2026)
DynamicBench: Evaluating Real-Time Report Generation in Large Language Models
di: Li, Jingyao, et al.
Pubblicazione: (2025)
di: Li, Jingyao, et al.
Pubblicazione: (2025)
Supportiveness-based Knowledge Rewriting for Retrieval-augmented Language Modeling
di: Qiao, Zile, et al.
Pubblicazione: (2024)
di: Qiao, Zile, et al.
Pubblicazione: (2024)
OmniThink: Expanding Knowledge Boundaries in Machine Writing through Thinking
di: Xi, Zekun, et al.
Pubblicazione: (2025)
di: Xi, Zekun, et al.
Pubblicazione: (2025)
Lungfish‐like antero‐labial tooth addition and amphibian‐like enameloid‐enamel transition in the coronoid of a Devonian stem actinopterygian
di: Donglei Chen
Pubblicazione: (2025)
di: Donglei Chen
Pubblicazione: (2025)
Do Multimodal Agents Really Benefit from Tool Use? A Systematic Study of Capability Gains
di: Guo, Garvin, et al.
Pubblicazione: (2026)
di: Guo, Garvin, et al.
Pubblicazione: (2026)
BLSP-KD: Bootstrapping Language-Speech Pre-training via Knowledge Distillation
di: Wang, Chen, et al.
Pubblicazione: (2024)
di: Wang, Chen, et al.
Pubblicazione: (2024)
Evidence-Augmented Policy Optimization with Reward Co-Evolution for Long-Context Reasoning
di: Guan, Xin, et al.
Pubblicazione: (2026)
di: Guan, Xin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents
di: Qiao, Zile, et al.
Pubblicazione: (2025) -
MARS: Co-evolving Dual-System Deep Research via Multi-Agent Reinforcement Learning
di: Chen, Guoxin, et al.
Pubblicazione: (2025) -
AgentFold: Long-Horizon Web Agents with Proactive Context Management
di: Ye, Rui, et al.
Pubblicazione: (2025) -
AgentFrontier: Expanding the Capability Frontier of LLM Agents with ZPD-Guided Data Synthesis
di: Chen, Xuanzhong, et al.
Pubblicazione: (2025) -
BrowseConf: Confidence-Guided Test-Time Scaling for Web Agents
di: Ou, Litu, et al.
Pubblicazione: (2025)