WebWalker: Benchmarking LLMs in Web Traversal
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Jialong, Yin, Wenbiao, Jiang, Yong, Wang, Zhenglin, Xi, Zekun, Fang, Runnan, Zhang, Linhai, He, Yulan, Zhou, Deyu, Xie, Pengjun, Huang, Fei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
WebDancer: Towards Autonomous Information Seeking Agency
por: Wu, Jialong, et al.
Publicado: (2025)
por: Wu, Jialong, et al.
Publicado: (2025)
OmniThink: Expanding Knowledge Boundaries in Machine Writing through Thinking
por: Xi, Zekun, et al.
Publicado: (2025)
por: Xi, Zekun, et al.
Publicado: (2025)
SCOPE: Optimizing Key-Value Cache Compression in Long-context Generation
por: Wu, Jialong, et al.
Publicado: (2024)
por: Wu, Jialong, et al.
Publicado: (2024)
PROPER: A Progressive Learning Framework for Personalized Large Language Models with Group-Level Adaptation
por: Zhang, Linhai, et al.
Publicado: (2025)
por: Zhang, Linhai, et al.
Publicado: (2025)
Causal Prompting: Debiasing Large Language Model Prompting based on Front-Door Adjustment
por: Zhang, Congzhi, et al.
Publicado: (2024)
por: Zhang, Congzhi, et al.
Publicado: (2024)
WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization
por: Tao, Zhengwei, et al.
Publicado: (2025)
por: Tao, Zhengwei, et al.
Publicado: (2025)
Benchmarking Temporal Reasoning and Alignment Across Chinese Dynasties
por: Wang, Zhenglin, et al.
Publicado: (2025)
por: Wang, Zhenglin, et al.
Publicado: (2025)
WebLeaper: Empowering Efficiency and Efficacy in WebAgent via Enabling Info-Rich Seeking
por: Tao, Zhengwei, et al.
Publicado: (2025)
por: Tao, Zhengwei, et al.
Publicado: (2025)
WebSailor: Navigating Super-human Reasoning for Web Agent
por: Li, Kuan, et al.
Publicado: (2025)
por: Li, Kuan, et al.
Publicado: (2025)
SynWorld: Virtual Scenario Synthesis for Agentic Action Knowledge Refinement
por: Fang, Runnan, et al.
Publicado: (2025)
por: Fang, Runnan, et al.
Publicado: (2025)
Explainable Depression Detection in Clinical Interviews with Personalized Retrieval-Augmented Generation
por: Zhang, Linhai, et al.
Publicado: (2025)
por: Zhang, Linhai, et al.
Publicado: (2025)
ParallelMuse: Agentic Parallel Thinking for Deep Information Seeking
por: Li, Baixuan, et al.
Publicado: (2025)
por: Li, Baixuan, et al.
Publicado: (2025)
DINER: Debiasing Aspect-based Sentiment Analysis with Multi-variable Causal Inference
por: Wu, Jialong, et al.
Publicado: (2024)
por: Wu, Jialong, et al.
Publicado: (2024)
STAR: Constraint LoRA with Dynamic Active Learning for Data-Efficient Fine-Tuning of Large Language Models
por: Zhang, Linhai, et al.
Publicado: (2024)
por: Zhang, Linhai, et al.
Publicado: (2024)
Benchmarking Agentic Workflow Generation
por: Qiao, Shuofei, et al.
Publicado: (2024)
por: Qiao, Shuofei, et al.
Publicado: (2024)
WebAnchor: Anchoring Agent Planning to Stabilize Long-Horizon Web Reasoning
por: Yu, Xinmiao, et al.
Publicado: (2026)
por: Yu, Xinmiao, et al.
Publicado: (2026)
Beyond Meta-Reasoning: Metacognitive Consolidation for Self-Improving LLM Reasoning
por: Zhuang, Ziqing, et al.
Publicado: (2026)
por: Zhuang, Ziqing, et al.
Publicado: (2026)
WebResearcher: Unleashing unbounded reasoning capability in Long-Horizon Agents
por: Qiao, Zile, et al.
Publicado: (2025)
por: Qiao, Zile, et al.
Publicado: (2025)
WebWeaver: Structuring Web-Scale Evidence with Dynamic Outlines for Open-Ended Deep Research
por: Li, Zijian, et al.
Publicado: (2025)
por: Li, Zijian, et al.
Publicado: (2025)
AdaRewriter: Unleashing the Power of Prompting-based Conversational Query Reformulation via Test-Time Adaptation
por: Lai, Yilong, et al.
Publicado: (2025)
por: Lai, Yilong, et al.
Publicado: (2025)
Test-Time Personalization: A Diagnostic Framework and Probabilistic Fix for Scaling Failures
por: Zhang, Linhai, et al.
Publicado: (2026)
por: Zhang, Linhai, et al.
Publicado: (2026)
AutoForge: Automated Environment Synthesis for Agentic Reinforcement Learning
por: Cai, Shihao, et al.
Publicado: (2025)
por: Cai, Shihao, et al.
Publicado: (2025)
Towards General Agentic Intelligence via Environment Scaling
por: Fang, Runnan, et al.
Publicado: (2025)
por: Fang, Runnan, et al.
Publicado: (2025)
WebWatcher: Breaking New Frontier of Vision-Language Deep Research Agent
por: Geng, Xinyu, et al.
Publicado: (2025)
por: Geng, Xinyu, et al.
Publicado: (2025)
RGAR: Recurrence Generation-augmented Retrieval for Factual-aware Medical Question Answering
por: Liang, Sichu, et al.
Publicado: (2025)
por: Liang, Sichu, et al.
Publicado: (2025)
EvolveSearch: An Iterative Self-Evolving Search Agent
por: Zhang, Dingchu, et al.
Publicado: (2025)
por: Zhang, Dingchu, et al.
Publicado: (2025)
Memp: Exploring Agent Procedural Memory
por: Fang, Runnan, et al.
Publicado: (2025)
por: Fang, Runnan, et al.
Publicado: (2025)
SEED: Accelerating Reasoning Tree Construction via Scheduled Speculative Decoding
por: Wang, Zhenglin, et al.
Publicado: (2024)
por: Wang, Zhenglin, et al.
Publicado: (2024)
Nested Browser-Use Learning for Agentic Information Seeking
por: Li, Baixuan, et al.
Publicado: (2025)
por: Li, Baixuan, et al.
Publicado: (2025)
LaRA: Benchmarking Retrieval-Augmented Generation and Long-Context LLMs -- No Silver Bullet for LC or RAG Routing
por: Li, Kuan, et al.
Publicado: (2025)
por: Li, Kuan, et al.
Publicado: (2025)
WebSailor-V2: Bridging the Chasm to Proprietary Agents via Synthetic Data and Scalable Reinforcement Learning
por: Li, Kuan, et al.
Publicado: (2025)
por: Li, Kuan, et al.
Publicado: (2025)
Causal Walk: Debiasing Multi-Hop Fact Verification with Front-Door Adjustment
por: Zhang, Congzhi, et al.
Publicado: (2024)
por: Zhang, Congzhi, et al.
Publicado: (2024)
BrowseConf: Confidence-Guided Test-Time Scaling for Web Agents
por: Ou, Litu, et al.
Publicado: (2025)
por: Ou, Litu, et al.
Publicado: (2025)
AgentFold: Long-Horizon Web Agents with Proactive Context Management
por: Ye, Rui, et al.
Publicado: (2025)
por: Ye, Rui, et al.
Publicado: (2025)
Rehearse With User: Personalized Opinion Summarization via Role-Playing based on Large Language Models
por: Zhang, Yanyue, et al.
Publicado: (2025)
por: Zhang, Yanyue, et al.
Publicado: (2025)
See and Remember: A Multimodal Agent for Web Traversal
por: Wang, Xinjun, et al.
Publicado: (2026)
por: Wang, Xinjun, et al.
Publicado: (2026)
AgentSwing: Adaptive Parallel Context Management Routing for Long-Horizon Web Agents
por: Feng, Zhaopeng, et al.
Publicado: (2026)
por: Feng, Zhaopeng, et al.
Publicado: (2026)
Agent Planning with World Knowledge Model
por: Qiao, Shuofei, et al.
Publicado: (2024)
por: Qiao, Shuofei, et al.
Publicado: (2024)
WebCanvas: Benchmarking Web Agents in Online Environments
por: Pan, Yichen, et al.
Publicado: (2024)
por: Pan, Yichen, et al.
Publicado: (2024)
VeriWeb: Verifiable Long-Chain Web Benchmark for Agentic Information-Seeking
por: Liu, Shunyu, et al.
Publicado: (2025)
por: Liu, Shunyu, et al.
Publicado: (2025)
Ejemplares similares
-
WebDancer: Towards Autonomous Information Seeking Agency
por: Wu, Jialong, et al.
Publicado: (2025) -
OmniThink: Expanding Knowledge Boundaries in Machine Writing through Thinking
por: Xi, Zekun, et al.
Publicado: (2025) -
SCOPE: Optimizing Key-Value Cache Compression in Long-context Generation
por: Wu, Jialong, et al.
Publicado: (2024) -
PROPER: A Progressive Learning Framework for Personalized Large Language Models with Group-Level Adaptation
por: Zhang, Linhai, et al.
Publicado: (2025) -
Causal Prompting: Debiasing Large Language Model Prompting based on Front-Door Adjustment
por: Zhang, Congzhi, et al.
Publicado: (2024)