Gespeichert in:
| Hauptverfasser: | Wan, Haiyuan, Yang, Chen, Yu, Junchi, Tu, Meiqi, Lu, Jiaxuan, Yu, Di, Cao, Jianbao, Gao, Ben, Xie, Jiaqing, Wang, Aoran, Zhang, Wenlong, Torr, Philip, Zhou, Dongzhan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2509.01396 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Reasoning via Video: The First Evaluation of Video Models' Reasoning Abilities through Maze-Solving Tasks
von: Yang, Cheng, et al.
Veröffentlicht: (2025)
von: Yang, Cheng, et al.
Veröffentlicht: (2025)
From What to Why: A Multi-Agent System for Evidence-based Chemical Reaction Condition Reasoning
von: Yang, Cheng, et al.
Veröffentlicht: (2025)
von: Yang, Cheng, et al.
Veröffentlicht: (2025)
Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models
von: Huang, Wenxuan, et al.
Veröffentlicht: (2026)
von: Huang, Wenxuan, et al.
Veröffentlicht: (2026)
Can Knowledge-Graph-based Retrieval Augmented Generation Really Retrieve What You Need?
von: Yu, Junchi, et al.
Veröffentlicht: (2025)
von: Yu, Junchi, et al.
Veröffentlicht: (2025)
Scientists' First Exam: Probing Cognitive Abilities of MLLM via Perception, Understanding, and Reasoning
von: Zhou, Yuhao, et al.
Veröffentlicht: (2025)
von: Zhou, Yuhao, et al.
Veröffentlicht: (2025)
Tongyi DeepResearch Technical Report
von: Tongyi DeepResearch Team, et al.
Veröffentlicht: (2025)
von: Tongyi DeepResearch Team, et al.
Veröffentlicht: (2025)
Yunque DeepResearch Technical Report
von: Cai, Yuxuan, et al.
Veröffentlicht: (2026)
von: Cai, Yuxuan, et al.
Veröffentlicht: (2026)
Understanding DeepResearch via Reports
von: Fan, Tianyu, et al.
Veröffentlicht: (2025)
von: Fan, Tianyu, et al.
Veröffentlicht: (2025)
Step-DeepResearch Technical Report
von: Hu, Chen, et al.
Veröffentlicht: (2025)
von: Hu, Chen, et al.
Veröffentlicht: (2025)
Mind DeepResearch Technical Report
von: MindDR Team, et al.
Veröffentlicht: (2026)
von: MindDR Team, et al.
Veröffentlicht: (2026)
Vision-DeepResearch Benchmark: Rethinking Visual and Textual Search for Multimodal Large Language Models
von: Zeng, Yu, et al.
Veröffentlicht: (2026)
von: Zeng, Yu, et al.
Veröffentlicht: (2026)
LabBuilder: Protocol-Grounded 3D Layout Generation for Interactable and Safe Laboratory
von: Cao, Jianbao, et al.
Veröffentlicht: (2026)
von: Cao, Jianbao, et al.
Veröffentlicht: (2026)
ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition
von: Liu, Yujie, et al.
Veröffentlicht: (2025)
von: Liu, Yujie, et al.
Veröffentlicht: (2025)
DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents
von: Du, Mingxuan, et al.
Veröffentlicht: (2025)
von: Du, Mingxuan, et al.
Veröffentlicht: (2025)
SELT: Self-Evaluation Tree Search for LLMs with Task Decomposition
von: Wu, Mengsong, et al.
Veröffentlicht: (2025)
von: Wu, Mengsong, et al.
Veröffentlicht: (2025)
TDGNet: Hallucination Detection in Diffusion Language Models via Temporal Dynamic Graphs
von: Hemmat, Arshia, et al.
Veröffentlicht: (2026)
von: Hemmat, Arshia, et al.
Veröffentlicht: (2026)
HiPhO: How Far Are (M)LLMs from Humans in the Latest High School Physics Olympiad Benchmark?
von: Yu, Fangchen, et al.
Veröffentlicht: (2025)
von: Yu, Fangchen, et al.
Veröffentlicht: (2025)
Grounding and Enhancing Grid-based Models for Neural Fields
von: Zhao, Zelin, et al.
Veröffentlicht: (2024)
von: Zhao, Zelin, et al.
Veröffentlicht: (2024)
ResearchArcade: Graph Interface for Academic Tasks
von: Xu, Jingjun, et al.
Veröffentlicht: (2025)
von: Xu, Jingjun, et al.
Veröffentlicht: (2025)
PhysicsMinions: Winning Gold Medals in the Latest Physics Olympiads with a Coevolutionary Multimodal Multi-Agent System
von: Yu, Fangchen, et al.
Veröffentlicht: (2025)
von: Yu, Fangchen, et al.
Veröffentlicht: (2025)
DeepResearch-9K: A Challenging Benchmark Dataset of Deep-Research Agent
von: Wu, Tongzhou, et al.
Veröffentlicht: (2026)
von: Wu, Tongzhou, et al.
Veröffentlicht: (2026)
DeepResearcher: Scaling Deep Research via Reinforcement Learning in Real-world Environments
von: Zheng, Yuxiang, et al.
Veröffentlicht: (2025)
von: Zheng, Yuxiang, et al.
Veröffentlicht: (2025)
ResearchArena: Benchmarking Large Language Models' Ability to Collect and Organize Information as Research Agents
von: Kang, Hao, et al.
Veröffentlicht: (2024)
von: Kang, Hao, et al.
Veröffentlicht: (2024)
QCBench: Evaluating Large Language Models on Domain-Specific Quantitative Chemistry
von: Xie, Jiaqing, et al.
Veröffentlicht: (2025)
von: Xie, Jiaqing, et al.
Veröffentlicht: (2025)
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
von: Zhu, Bin, et al.
Veröffentlicht: (2026)
von: Zhu, Bin, et al.
Veröffentlicht: (2026)
MM-DeepResearch: A Simple and Effective Multimodal Agentic Search Baseline
von: Yao, Huanjin, et al.
Veröffentlicht: (2026)
von: Yao, Huanjin, et al.
Veröffentlicht: (2026)
Fathom-DeepResearch: Unlocking Long Horizon Information Retrieval and Synthesis for SLMs
von: Singh, Shreyas, et al.
Veröffentlicht: (2025)
von: Singh, Shreyas, et al.
Veröffentlicht: (2025)
DeepResearch Bench II: Diagnosing Deep Research Agents via Rubrics from Expert Report
von: Li, Ruizhe, et al.
Veröffentlicht: (2026)
von: Li, Ruizhe, et al.
Veröffentlicht: (2026)
SFR-DeepResearch: Towards Effective Reinforcement Learning for Autonomously Reasoning Single Agents
von: Nguyen, Xuan-Phi, et al.
Veröffentlicht: (2025)
von: Nguyen, Xuan-Phi, et al.
Veröffentlicht: (2025)
DeepResearch-Slice: Bridging the Retrieval-Utilization Gap via Explicit Text Slicing
von: Lu, Shuo, et al.
Veröffentlicht: (2025)
von: Lu, Shuo, et al.
Veröffentlicht: (2025)
Learning Query-Specific Rubrics from Human Preferences for DeepResearch Report Generation
von: Lv, Changze, et al.
Veröffentlicht: (2026)
von: Lv, Changze, et al.
Veröffentlicht: (2026)
MokA: Multimodal Low-Rank Adaptation for MLLMs
von: Wei, Yake, et al.
Veröffentlicht: (2025)
von: Wei, Yake, et al.
Veröffentlicht: (2025)
GeoERM: Geometry-Aware Multi-Task Representation Learning on Riemannian Manifolds
von: Chen, Aoran, et al.
Veröffentlicht: (2025)
von: Chen, Aoran, et al.
Veröffentlicht: (2025)
Beyond Static Tools: Test-Time Tool Evolution for Scientific Reasoning
von: Lu, Jiaxuan, et al.
Veröffentlicht: (2026)
von: Lu, Jiaxuan, et al.
Veröffentlicht: (2026)
Multimodal DeepResearcher: Generating Text-Chart Interleaved Reports From Scratch with Agentic Framework
von: Yang, Zhaorui, et al.
Veröffentlicht: (2025)
von: Yang, Zhaorui, et al.
Veröffentlicht: (2025)
Dingtalk DeepResearch: A Unified Multi Agent Framework for Adaptive Intelligence in Enterprise Environments
von: Chen, Mengyuan, et al.
Veröffentlicht: (2025)
von: Chen, Mengyuan, et al.
Veröffentlicht: (2025)
Distinguishable Deletion: Unifying Knowledge Erasure and Refusal for Large Language Model Unlearning
von: Yang, Puning, et al.
Veröffentlicht: (2026)
von: Yang, Puning, et al.
Veröffentlicht: (2026)
TraceDet: Hallucination Detection from the Decoding Trace of Diffusion Large Language Models
von: Chang, Shenxu, et al.
Veröffentlicht: (2025)
von: Chang, Shenxu, et al.
Veröffentlicht: (2025)
Epilepsy and systemic autoimmune diseases: A bidirectional two‐sample Mendelian randomization study
von: Ruoshi Tian, et al.
Veröffentlicht: (2025)
von: Ruoshi Tian, et al.
Veröffentlicht: (2025)
DeepResearch$^{\text{Eco}}$: A Recursive Agentic Workflow for Complex Scientific Question Answering in Ecology
von: D'Souza, Jennifer, et al.
Veröffentlicht: (2025)
von: D'Souza, Jennifer, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Reasoning via Video: The First Evaluation of Video Models' Reasoning Abilities through Maze-Solving Tasks
von: Yang, Cheng, et al.
Veröffentlicht: (2025) -
From What to Why: A Multi-Agent System for Evidence-based Chemical Reaction Condition Reasoning
von: Yang, Cheng, et al.
Veröffentlicht: (2025) -
Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models
von: Huang, Wenxuan, et al.
Veröffentlicht: (2026) -
Can Knowledge-Graph-based Retrieval Augmented Generation Really Retrieve What You Need?
von: Yu, Junchi, et al.
Veröffentlicht: (2025) -
Scientists' First Exam: Probing Cognitive Abilities of MLLM via Perception, Understanding, and Reasoning
von: Zhou, Yuhao, et al.
Veröffentlicht: (2025)