FinDeepResearch: Evaluating Deep Research Agents in Rigorous Financial Analysis
Fuente:
arXiv
Saved in:
| Main Authors: | Zhu, Fengbin, Ng, Xiang Yao, Liu, Ziyang, Liu, Chang, Zeng, Xianwei, Wang, Chao, Tan, Tianhui, Yao, Xuan, Shao, Pengyang, Xu, Min, Wang, Zixuan, Wang, Jing, Lin, Xin, Li, Junfeng, Zhu, Jingxian, Zhang, Yang, Wang, Wenjie, Feng, Fuli, Hong, Richang, Luan, Huanbo, Huang, Ke-Wei, Chua, Tat-Seng |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Towards Temporal-Aware Multi-Modal Retrieval Augmented Generation in Finance
by: Zhu, Fengbin, et al.
Published: (2025)
by: Zhu, Fengbin, et al.
Published: (2025)
MMDocBench: Benchmarking Large Vision-Language Models for Fine-Grained Visual Document Understanding
by: Zhu, Fengbin, et al.
Published: (2024)
by: Zhu, Fengbin, et al.
Published: (2024)
FinDeepForecast: A Live Multi-Agent System for Benchmarking Deep Research Agents in Financial Forecasting
by: Li, Xiangyu, et al.
Published: (2026)
by: Li, Xiangyu, et al.
Published: (2026)
MURE: Hierarchical Multi-Resolution Encoding via Vision-Language Models for Visual Document Retrieval
by: Zhu, Fengbin, et al.
Published: (2026)
by: Zhu, Fengbin, et al.
Published: (2026)
TAT-LLM: A Specialized Language Model for Discrete Reasoning over Tabular and Textual Data
by: Zhu, Fengbin, et al.
Published: (2024)
by: Zhu, Fengbin, et al.
Published: (2024)
Think Twice Before Trusting: Self-Detection for Large Language Models through Comprehensive Answer Reflection
by: Li, Moxin, et al.
Published: (2024)
by: Li, Moxin, et al.
Published: (2024)
Heterogeneous User Modeling for LLM-based Recommendation
by: Bao, Honghui, et al.
Published: (2025)
by: Bao, Honghui, et al.
Published: (2025)
Doc2SoarGraph: Discrete Reasoning over Visually-Rich Table-Text Documents via Semantic-Oriented Hierarchical Graphs
by: Zhu, Fengbin, et al.
Published: (2023)
by: Zhu, Fengbin, et al.
Published: (2023)
Optimizing Knowledge Integration in Retrieval-Augmented Generation with Self-Selection
by: Weng, Yan, et al.
Published: (2025)
by: Weng, Yan, et al.
Published: (2025)
DRC: Enhancing Personalized Image Generation via Disentangled Representation Composition
by: Xu, Yiyan, et al.
Published: (2025)
by: Xu, Yiyan, et al.
Published: (2025)
Large Language Models Empowered Personalized Web Agents
by: Cai, Hongru, et al.
Published: (2024)
by: Cai, Hongru, et al.
Published: (2024)
IGD: Token Decisiveness Modeling via Information Gain in LLMs for Personalized Recommendation
by: Lin, Zijie, et al.
Published: (2025)
by: Lin, Zijie, et al.
Published: (2025)
Suppressing Forgery-Specific Shortcuts for Generalizable Deepfake Detection
by: Wang, Yihui, et al.
Published: (2026)
by: Wang, Yihui, et al.
Published: (2026)
Generative Recommendation: Towards Next-generation Recommender Paradigm
by: Wang, Wenjie, et al.
Published: (2023)
by: Wang, Wenjie, et al.
Published: (2023)
Controllable Value Alignment in Large Language Models through Neuron-Level Editing
by: Yang, Yonghui, et al.
Published: (2026)
by: Yang, Yonghui, et al.
Published: (2026)
SafeNeuron: Neuron-Level Safety Alignment for Large Language Models
by: Wang, Zhaoxin, et al.
Published: (2026)
by: Wang, Zhaoxin, et al.
Published: (2026)
Uplift Modeling for Target User Attacks on Recommender Systems
by: Wang, Wenjie, et al.
Published: (2024)
by: Wang, Wenjie, et al.
Published: (2024)
Contrastive Pre-training for Deep Session Data Understanding
by: Li, Zixuan, et al.
Published: (2024)
by: Li, Zixuan, et al.
Published: (2024)
CrAM: Credibility-Aware Attention Modification in LLMs for Combating Misinformation in RAG
by: Deng, Boyi, et al.
Published: (2024)
by: Deng, Boyi, et al.
Published: (2024)
We Should Identify and Mitigate Third-Party Safety Risks in MCP-Powered Agent Systems
by: Fang, Junfeng, et al.
Published: (2025)
by: Fang, Junfeng, et al.
Published: (2025)
Denoising Diffusion Recommender Model
by: Zhao, Jujia, et al.
Published: (2024)
by: Zhao, Jujia, et al.
Published: (2024)
Diffusion Recommender Model
by: Wang, Wenjie, et al.
Published: (2023)
by: Wang, Wenjie, et al.
Published: (2023)
Temporally and Distributionally Robust Optimization for Cold-Start Recommendation
by: Lin, Xinyu, et al.
Published: (2023)
by: Lin, Xinyu, et al.
Published: (2023)
Robust Prompt Optimization for Large Language Models Against Distribution Shifts
by: Li, Moxin, et al.
Published: (2023)
by: Li, Moxin, et al.
Published: (2023)
TTOM: Test-Time Optimization and Memorization for Compositional Video Generation
by: Qu, Leigang, et al.
Published: (2025)
by: Qu, Leigang, et al.
Published: (2025)
Self-Improvement Towards Pareto Optimality: Mitigating Preference Conflicts in Multi-Objective Alignment
by: Li, Moxin, et al.
Published: (2025)
by: Li, Moxin, et al.
Published: (2025)
Think-While-Generating: On-the-Fly Reasoning for Personalized Long-Form Generation
by: Wang, Chengbing, et al.
Published: (2025)
by: Wang, Chengbing, et al.
Published: (2025)
Bringing Reasoning to Generative Recommendation Through the Lens of Cascaded Ranking
by: Lin, Xinyu, et al.
Published: (2026)
by: Lin, Xinyu, et al.
Published: (2026)
Bridging Items and Language: A Transition Paradigm for Large Language Model-Based Recommendation
by: Lin, Xinyu, et al.
Published: (2023)
by: Lin, Xinyu, et al.
Published: (2023)
SafeMLRM: Demystifying Safety in Multi-modal Large Reasoning Models
by: Fang, Junfeng, et al.
Published: (2025)
by: Fang, Junfeng, et al.
Published: (2025)
MiniRec: Data-Efficient Reinforcement Learning for LLM-based Recommendation
by: Wang, Lin, et al.
Published: (2026)
by: Wang, Lin, et al.
Published: (2026)
Order-agnostic Identifier for Large Language Model-based Generative Recommendation
by: Lin, Xinyu, et al.
Published: (2025)
by: Lin, Xinyu, et al.
Published: (2025)
Towards Knowledgeable Deep Research: Framework and Benchmark
by: Liu, Wenxuan, et al.
Published: (2026)
by: Liu, Wenxuan, et al.
Published: (2026)
Reinforced Latent Reasoning for LLM-based Recommendation
by: Zhang, Yang, et al.
Published: (2025)
by: Zhang, Yang, et al.
Published: (2025)
Data-efficient Fine-tuning for LLM-based Recommendation
by: Lin, Xinyu, et al.
Published: (2024)
by: Lin, Xinyu, et al.
Published: (2024)
Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery
by: Yang, Chaoqun, et al.
Published: (2026)
by: Yang, Chaoqun, et al.
Published: (2026)
Learning to Ask Critical Questions for Assisting Product Search
by: Li, Zixuan, et al.
Published: (2024)
by: Li, Zixuan, et al.
Published: (2024)
CAPSUL: A Comprehensive Human Protein Benchmark for Subcellular Localization
by: Hu, Yicheng, et al.
Published: (2026)
by: Hu, Yicheng, et al.
Published: (2026)
NextAds: Towards Next-generation Personalized Video Advertising
by: Xu, Yiyan, et al.
Published: (2026)
by: Xu, Yiyan, et al.
Published: (2026)
One Adapts to Any: Meta Reward Modeling for Personalized LLM Alignment
by: Cai, Hongru, et al.
Published: (2026)
by: Cai, Hongru, et al.
Published: (2026)
Similar Items
-
Towards Temporal-Aware Multi-Modal Retrieval Augmented Generation in Finance
by: Zhu, Fengbin, et al.
Published: (2025) -
MMDocBench: Benchmarking Large Vision-Language Models for Fine-Grained Visual Document Understanding
by: Zhu, Fengbin, et al.
Published: (2024) -
FinDeepForecast: A Live Multi-Agent System for Benchmarking Deep Research Agents in Financial Forecasting
by: Li, Xiangyu, et al.
Published: (2026) -
MURE: Hierarchical Multi-Resolution Encoding via Vision-Language Models for Visual Document Retrieval
by: Zhu, Fengbin, et al.
Published: (2026) -
TAT-LLM: A Specialized Language Model for Discrete Reasoning over Tabular and Textual Data
by: Zhu, Fengbin, et al.
Published: (2024)