DeepWideSearch: Benchmarking Depth and Width in Agentic Information Seeking
Fuente:
arXiv
Salvato in:
| Autori principali: | Lan, Tian, Zhu, Bin, Jia, Qianghuai, Ren, Junyang, Li, Haijun, Wang, Longyue, Xu, Zhao, Luo, Weihua, Zhang, Kaifu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Table-as-Search: Formulate Long-Horizon Agentic Information Seeking as Table Completion
di: Lan, Tian, et al.
Pubblicazione: (2026)
di: Lan, Tian, et al.
Pubblicazione: (2026)
HSCodeComp: A Realistic and Expert-level Benchmark for Deep Search Agents in Hierarchical Rule Application
di: Yang, Yiqian, et al.
Pubblicazione: (2025)
di: Yang, Yiqian, et al.
Pubblicazione: (2025)
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
di: Zhu, Bin, et al.
Pubblicazione: (2026)
di: Zhu, Bin, et al.
Pubblicazione: (2026)
WideSearch: Benchmarking Agentic Broad Info-Seeking
di: Wong, Ryan, et al.
Pubblicazione: (2025)
di: Wong, Ryan, et al.
Pubblicazione: (2025)
Challenging Multilingual LLMs: A New Taxonomy and Benchmark for Unraveling Hallucination in Translation
di: Wu, Xinwei, et al.
Pubblicazione: (2025)
di: Wu, Xinwei, et al.
Pubblicazione: (2025)
UMEM: Unified Memory Extraction and Management Framework for Generalizable Memory
di: Ye, Yongshi, et al.
Pubblicazione: (2026)
di: Ye, Yongshi, et al.
Pubblicazione: (2026)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
di: Xu, Zelai, et al.
Pubblicazione: (2026)
di: Xu, Zelai, et al.
Pubblicazione: (2026)
A Unified Agentic Framework for Evaluating Conditional Image Generation
di: Wang, Jifang, et al.
Pubblicazione: (2025)
di: Wang, Jifang, et al.
Pubblicazione: (2025)
InfoDeepSeek: Benchmarking Agentic Information Seeking for Retrieval-Augmented Generation
di: Xi, Yunjia, et al.
Pubblicazione: (2025)
di: Xi, Yunjia, et al.
Pubblicazione: (2025)
Marco-Voice Technical Report
di: Tian, Fengping, et al.
Pubblicazione: (2025)
di: Tian, Fengping, et al.
Pubblicazione: (2025)
A State-Transition Framework for Efficient LLM Reasoning
di: Zhang, Liang, et al.
Pubblicazione: (2026)
di: Zhang, Liang, et al.
Pubblicazione: (2026)
(Perhaps) Beyond Human Translation: Harnessing Multi-Agent Collaboration for Translating Ultra-Long Literary Texts
di: Wu, Minghao, et al.
Pubblicazione: (2024)
di: Wu, Minghao, et al.
Pubblicazione: (2024)
Finding the Translation Switch: Discovering and Exploiting the Task-Initiation Features in LLMs
di: Wu, Xinwei, et al.
Pubblicazione: (2026)
di: Wu, Xinwei, et al.
Pubblicazione: (2026)
The Affective Bridge: Preserving Speech Representations while Enhancing Deepfake Detection vian emotional Constraints
di: Li, Yupei, et al.
Pubblicazione: (2025)
di: Li, Yupei, et al.
Pubblicazione: (2025)
The Bitter Lesson Learned from 2,000+ Multilingual Benchmarks
di: Wu, Minghao, et al.
Pubblicazione: (2025)
di: Wu, Minghao, et al.
Pubblicazione: (2025)
TransBench: Benchmarking Machine Translation for Industrial-Scale Applications
di: Li, Haijun, et al.
Pubblicazione: (2025)
di: Li, Haijun, et al.
Pubblicazione: (2025)
Vectra: A New Metric, Dataset, and Model for Visual Quality Assessment in E-Commerce In-Image Machine Translation
di: Wu, Qingyu, et al.
Pubblicazione: (2026)
di: Wu, Qingyu, et al.
Pubblicazione: (2026)
New Trends for Modern Machine Translation with Large Reasoning Models
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
Towards Lightweight, Adaptive and Attribute-Aware Multi-Aspect Controllable Text Generation with Large Language Models
di: Zhu, Chenyu, et al.
Pubblicazione: (2025)
di: Zhu, Chenyu, et al.
Pubblicazione: (2025)
LayAlign: Enhancing Multilingual Reasoning in Large Language Models via Layer-Wise Adaptive Fusion and Alignment Strategy
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
ComfyUI-R1: Exploring Reasoning Models for Workflow Generation
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
LongSpeech: A Scalable Benchmark for Transcription, Translation and Understanding in Long Speech
di: Yang, Fei, et al.
Pubblicazione: (2026)
di: Yang, Fei, et al.
Pubblicazione: (2026)
Marco-ASR: A Principled and Metric-Driven Framework for Fine-Tuning Large-Scale ASR Models for Domain Adaptation
di: Ni, Xuanfan, et al.
Pubblicazione: (2025)
di: Ni, Xuanfan, et al.
Pubblicazione: (2025)
Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions
di: Zhao, Yu, et al.
Pubblicazione: (2024)
di: Zhao, Yu, et al.
Pubblicazione: (2024)
Beyond Single-Reward: Multi-Pair, Multi-Perspective Preference Optimization for Machine Translation
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
ParallelMuse: Agentic Parallel Thinking for Deep Information Seeking
di: Li, Baixuan, et al.
Pubblicazione: (2025)
di: Li, Baixuan, et al.
Pubblicazione: (2025)
WideSeek: Advancing Wide Research via Multi-Agent Scaling
di: Huang, Ziyang, et al.
Pubblicazione: (2026)
di: Huang, Ziyang, et al.
Pubblicazione: (2026)
VeriWeb: Verifiable Long-Chain Web Benchmark for Agentic Information-Seeking
di: Liu, Shunyu, et al.
Pubblicazione: (2025)
di: Liu, Shunyu, et al.
Pubblicazione: (2025)
DeepRead: Document Structure-Aware Reasoning to Enhance Agentic Search
di: Li, Zhanli, et al.
Pubblicazione: (2026)
di: Li, Zhanli, et al.
Pubblicazione: (2026)
ComfyUI-Copilot: An Intelligent Assistant for Automated Workflow Development
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
Rethinking Multilingual Vision-Language Translation: Dataset, Evaluation, and Adaptation
di: Wang, Xintong, et al.
Pubblicazione: (2025)
di: Wang, Xintong, et al.
Pubblicazione: (2025)
Building Autonomous GUI Navigation via Agentic-Q Estimation and Step-Wise Policy Optimization
di: Wang, Yibo, et al.
Pubblicazione: (2026)
di: Wang, Yibo, et al.
Pubblicazione: (2026)
DocDancer: Towards Agentic Document-Grounded Information Seeking
di: Zhang, Qintong, et al.
Pubblicazione: (2026)
di: Zhang, Qintong, et al.
Pubblicazione: (2026)
Constraining Dark Matter Density Profiles in UFDs with Wide Binaries: Forecast for the Chinese Space Station Survey Telescope
di: Tao, Yixi, et al.
Pubblicazione: (2026)
di: Tao, Yixi, et al.
Pubblicazione: (2026)
SPACE: Noise Contrastive Estimation Stabilizes Self-Play Fine-Tuning for Large Language Models
di: Wang, Yibo, et al.
Pubblicazione: (2025)
di: Wang, Yibo, et al.
Pubblicazione: (2025)
Ovis: Structural Embedding Alignment for Multimodal Large Language Model
di: Lu, Shiyin, et al.
Pubblicazione: (2024)
di: Lu, Shiyin, et al.
Pubblicazione: (2024)
The Role of Depth, Width, and Tree Size in Expressiveness of Deep Forest
di: Lyu, Shen-Huan, et al.
Pubblicazione: (2024)
di: Lyu, Shen-Huan, et al.
Pubblicazione: (2024)
StarBench: A Turn-Based RPG Benchmark for Agentic Multimodal Decision-Making and Information Seeking
di: Zhang, Haoran, et al.
Pubblicazione: (2025)
di: Zhang, Haoran, et al.
Pubblicazione: (2025)
DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints
di: Zhang, Yinger, et al.
Pubblicazione: (2026)
di: Zhang, Yinger, et al.
Pubblicazione: (2026)
CuSearch: Curriculum Rollout Sampling via Search Depth for Agentic RAG
di: Shen, Jianghan, et al.
Pubblicazione: (2026)
di: Shen, Jianghan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Table-as-Search: Formulate Long-Horizon Agentic Information Seeking as Table Completion
di: Lan, Tian, et al.
Pubblicazione: (2026) -
HSCodeComp: A Realistic and Expert-level Benchmark for Deep Search Agents in Hierarchical Rule Application
di: Yang, Yiqian, et al.
Pubblicazione: (2025) -
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
di: Zhu, Bin, et al.
Pubblicazione: (2026) -
WideSearch: Benchmarking Agentic Broad Info-Seeking
di: Wong, Ryan, et al.
Pubblicazione: (2025) -
Challenging Multilingual LLMs: A New Taxonomy and Benchmark for Unraveling Hallucination in Translation
di: Wu, Xinwei, et al.
Pubblicazione: (2025)