From Intent to Evidence: A Categorical Approach for Structural Evaluation of Deep Research Agents
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Shuoling, Tan, Zhiquan, Yi, Kun, Wu, Hui, Li, Yihan, Yan, Jiangpeng, Chen, Liyuan, Chen, Kai, Yang, Qiang |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CN-Buzz2Portfolio: A Chinese-Market Dataset and Benchmark for LLM-Based Macro and Sector Asset Allocation from Daily Trending Financial News
by: Chen, Liyuan, et al.
Published: (2026)
by: Chen, Liyuan, et al.
Published: (2026)
The Label Horizon Paradox: Rethinking Supervision Targets in Financial Forecasting
by: Song, Chen-Hui, et al.
Published: (2026)
by: Song, Chen-Hui, et al.
Published: (2026)
Can ChatGPT Overcome Behavioral Biases in the Financial Sector? Classify-and-Rethink: Multi-Step Zero-Shot Reasoning in the Gold Investment
by: Liu, Shuoling, et al.
Published: (2024)
by: Liu, Shuoling, et al.
Published: (2024)
Advancing Financial Engineering with Foundation Models: Progress, Applications, and Challenges
by: Chen, Liyuan, et al.
Published: (2025)
by: Chen, Liyuan, et al.
Published: (2025)
Federated Co-tuning Framework for Large and Small Language Models
by: Fan, Tao, et al.
Published: (2024)
by: Fan, Tao, et al.
Published: (2024)
IntentScore: Intent-Conditioned Action Evaluation for Computer-Use Agents
by: Chen, Rongqian, et al.
Published: (2026)
by: Chen, Rongqian, et al.
Published: (2026)
From Intents to Conversations: Generating Intent-Driven Dialogues with Contrastive Learning for Multi-Turn Classification
by: Liu, Junhua, et al.
Published: (2024)
by: Liu, Junhua, et al.
Published: (2024)
Argus: Evidence Assembly for Scalable Deep Research Agents
by: Zhang, Zhen, et al.
Published: (2026)
by: Zhang, Zhen, et al.
Published: (2026)
Inference-Cost-Aware Dynamic Tree Construction for Efficient Inference in Large Language Models
by: Hong, Yinrong, et al.
Published: (2025)
by: Hong, Yinrong, et al.
Published: (2025)
Multimodal Fusion of Skeleton Dynamics and Clinical Gait Features for Video-Based Cerebral Palsy Severity Assessment
by: Yang, Kaiyuan, et al.
Published: (2026)
by: Yang, Kaiyuan, et al.
Published: (2026)
LLM-Powered Intent-Based Categorization of Phishing Emails
by: Eilertsen, Even, et al.
Published: (2025)
by: Eilertsen, Even, et al.
Published: (2025)
Categorical Continuous Symmetry
by: Jia, Qiang, et al.
Published: (2025)
by: Jia, Qiang, et al.
Published: (2025)
From Shallow to Deep: Pinning Semantic Intent via Causal GRPO
by: Zhou, Shuyi, et al.
Published: (2026)
by: Zhou, Shuyi, et al.
Published: (2026)
SpectraFlow: Unifying Structural Pretraining and Frequency Adaptation for Medical Image Segmentation
by: Chen, Zhiquan, et al.
Published: (2026)
by: Chen, Zhiquan, et al.
Published: (2026)
ResearchLoop: An Evidence-Gated Control Plane for AI-Assisted Research
by: Xia, Yihan, et al.
Published: (2026)
by: Xia, Yihan, et al.
Published: (2026)
Statistical Mechanics and Categorical Entropy
by: Wu, Haiqi, et al.
Published: (2025)
by: Wu, Haiqi, et al.
Published: (2025)
DeepThink: Aligning Language Models with Domain-Specific User Intents
by: Li, Yang, et al.
Published: (2025)
by: Li, Yang, et al.
Published: (2025)
Know Your Intent: An Autonomous Multi-Perspective LLM Agent Framework for DeFi User Transaction Intent Mining
by: Mao, Qian'ang, et al.
Published: (2025)
by: Mao, Qian'ang, et al.
Published: (2025)
Dr. Bench: A Multidimensional Evaluation for Deep Research Agents, from Answers to Reports
by: Yao, Yang, et al.
Published: (2025)
by: Yao, Yang, et al.
Published: (2025)
Categorical Symmetries via Operator Algebras
by: Jia, Qiang, et al.
Published: (2026)
by: Jia, Qiang, et al.
Published: (2026)
DeepPsy-Agent: A Stage-Aware and Deep-Thinking Emotional Support Agent System
by: Chen, Kai, et al.
Published: (2025)
by: Chen, Kai, et al.
Published: (2025)
A Theoretical Lens for RL-Tuned Language Models via Energy-Based Models
by: Tan, Zhiquan, et al.
Published: (2025)
by: Tan, Zhiquan, et al.
Published: (2025)
PAINT: Partial-Solution Adaptive Interpolated Training for Self-Distilled Reasoners
by: Tan, Zhiquan, et al.
Published: (2026)
by: Tan, Zhiquan, et al.
Published: (2026)
Understanding Grokking Through A Robustness Viewpoint
by: Tan, Zhiquan, et al.
Published: (2023)
by: Tan, Zhiquan, et al.
Published: (2023)
Self-Supervised On-Policy Distillation for Reasoning Language Models
by: Tan, Zhiquan, et al.
Published: (2026)
by: Tan, Zhiquan, et al.
Published: (2026)
Information-Theoretic Perspectives on Optimizers
by: Tan, Zhiquan, et al.
Published: (2025)
by: Tan, Zhiquan, et al.
Published: (2025)
Scientific Algorithm Discovery by Augmenting AlphaEvolve with Deep Research
by: Liu, Gang, et al.
Published: (2025)
by: Liu, Gang, et al.
Published: (2025)
Deep Learning Approaches for Multimodal Intent Recognition: A Survey
by: Zhao, Jingwei, et al.
Published: (2025)
by: Zhao, Jingwei, et al.
Published: (2025)
Exploring Information-Theoretic Metrics Associated with Neural Collapse in Supervised Training
by: Song, Kun, et al.
Published: (2024)
by: Song, Kun, et al.
Published: (2024)
Exploring the Interplay of Motivation, Engagement and Critical Thinking Among EFL Learners: Evidence From Structural Equation Modelling
by: Jijia Yang, et al.
Published: (2025)
by: Jijia Yang, et al.
Published: (2025)
You Only Anonymize What Is Not Intent-Relevant: Suppressing Non-Intent Privacy Evidence
by: Shen, Weihao, et al.
Published: (2026)
by: Shen, Weihao, et al.
Published: (2026)
FinDeepResearch: Evaluating Deep Research Agents in Rigorous Financial Analysis
by: Zhu, Fengbin, et al.
Published: (2025)
by: Zhu, Fengbin, et al.
Published: (2025)
Enhancing Zeroth-order Fine-tuning for Language Models with Low-rank Structures
by: Chen, Yiming, et al.
Published: (2024)
by: Chen, Yiming, et al.
Published: (2024)
Evaluating Deep Clustering Algorithms on Non-Categorical 3D CAD Models
by: Xiang, Siyuan, et al.
Published: (2024)
by: Xiang, Siyuan, et al.
Published: (2024)
IntentVLA: Short-Horizon Intent Modeling for Aliased Robot Manipulation
by: Lian, Shijie, et al.
Published: (2026)
by: Lian, Shijie, et al.
Published: (2026)
From Evidence to Impact: Bridging the Implementation Gap in Geriatric Deprescribing
by: Songhe Chen, et al.
Published: (2025)
by: Songhe Chen, et al.
Published: (2025)
From Spots to Pixels: Dense Spatial Gene Expression Prediction from Histology Images
by: Zhang, Ruikun, et al.
Published: (2025)
by: Zhang, Ruikun, et al.
Published: (2025)
Dimension-Level Intent Fidelity Evaluation for Large Language Models: Evidence from Structured Prompt Ablation
by: Peng, GAng
Published: (2026)
by: Peng, GAng
Published: (2026)
TRACE: Trajectory-Aware Comprehensive Evaluation for Deep Research Agents
by: Chen, Yanyu, et al.
Published: (2026)
by: Chen, Yanyu, et al.
Published: (2026)
DeepShop: A Benchmark for Deep Research Shopping Agents
by: Lyu, Yougang, et al.
Published: (2025)
by: Lyu, Yougang, et al.
Published: (2025)
Similar Items
-
CN-Buzz2Portfolio: A Chinese-Market Dataset and Benchmark for LLM-Based Macro and Sector Asset Allocation from Daily Trending Financial News
by: Chen, Liyuan, et al.
Published: (2026) -
The Label Horizon Paradox: Rethinking Supervision Targets in Financial Forecasting
by: Song, Chen-Hui, et al.
Published: (2026) -
Can ChatGPT Overcome Behavioral Biases in the Financial Sector? Classify-and-Rethink: Multi-Step Zero-Shot Reasoning in the Gold Investment
by: Liu, Shuoling, et al.
Published: (2024) -
Advancing Financial Engineering with Foundation Models: Progress, Applications, and Challenges
by: Chen, Liyuan, et al.
Published: (2025) -
Federated Co-tuning Framework for Large and Small Language Models
by: Fan, Tao, et al.
Published: (2024)