FinTrace: Holistic Trajectory-Level Evaluation of LLM Tool Calling for Long-Horizon Financial Tasks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cao, Yupeng, Li, Haohang, Liu, Weijin, Cao, Wenbo, Xu, Anke, Qian, Lingfei, Peng, Xueqing, Tang, Minxue, Yao, Zhiyuan, Huang, Jimin, Subbalakshmi, K. P., Zhu, Zining, Suchow, Jordan W., Yu, Yangyang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
par: Cao, Yupeng, et autres
Publié: (2025)
par: Cao, Yupeng, et autres
Publié: (2025)
Truth Neurons
par: Li, Haohang, et autres
Publié: (2025)
par: Li, Haohang, et autres
Publié: (2025)
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
par: Li, Haohang, et autres
Publié: (2024)
par: Li, Haohang, et autres
Publié: (2024)
FinCon: A Synthesized LLM Multi-Agent System with Conceptual Verbal Reinforcement for Enhanced Financial Decision Making
par: Yu, Yangyang, et autres
Publié: (2024)
par: Yu, Yangyang, et autres
Publié: (2024)
FinCall-Surprise: A Large Scale Multi-modal Benchmark for Earning Surprise Prediction
par: Shu, Dong, et autres
Publié: (2025)
par: Shu, Dong, et autres
Publié: (2025)
Diffusion Model-Based Size Variable Virtual Try-On Technology and Evaluation Method
par: Zhang, Shufang, et autres
Publié: (2025)
par: Zhang, Shufang, et autres
Publié: (2025)
Automated Radiology Report Generation Based on Topic-Keyword Semantic Guidance
par: Xiao, Jing, et autres
Publié: (2025)
par: Xiao, Jing, et autres
Publié: (2025)
FinCap: Topic-Aligned Captions for Short-Form Financial YouTube Videos
par: Sukhani, Siddhant, et autres
Publié: (2025)
par: Sukhani, Siddhant, et autres
Publié: (2025)
Fast Visual Tracking with Enhanced and Gradient‐Guide Network
par: Dun Cao, et autres
Publié: (2024)
par: Dun Cao, et autres
Publié: (2024)
ForestHG-Trace: Traceable Long-Horizon Ecological Reasoning over Large-Scale Forest Scenes
par: Cheng, Zihang, et autres
Publié: (2026)
par: Cheng, Zihang, et autres
Publié: (2026)
Multi-source Knowledge Enhanced Graph Attention Networks for Multimodal Fact Verification
par: Cao, Han, et autres
Publié: (2024)
par: Cao, Han, et autres
Publié: (2024)
Orthogonal Disentanglement with Projected Feature Alignment for Multimodal Emotion Recognition in Conversation
par: Che, Xinyi, et autres
Publié: (2025)
par: Che, Xinyi, et autres
Publié: (2025)
Voices, Faces, and Feelings: Multi-modal Emotion-Cognition Captioning for Mental Health Understanding
par: Zhou, Zhiyuan, et autres
Publié: (2026)
par: Zhou, Zhiyuan, et autres
Publié: (2026)
FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR
par: He, Yueru, et autres
Publié: (2025)
par: He, Yueru, et autres
Publié: (2025)
Adaptive 3D Mesh Steganography Based on Feature-Preserving Distortion
par: Zhang, Yushu, et autres
Publié: (2022)
par: Zhang, Yushu, et autres
Publié: (2022)
MolCA: Molecular Graph-Language Modeling with Cross-Modal Projector and Uni-Modal Adapter
par: Liu, Zhiyuan, et autres
Publié: (2023)
par: Liu, Zhiyuan, et autres
Publié: (2023)
Augmenting Intra-Modal Understanding in MLLMs for Robust Multimodal Keyphrase Generation
par: Cao, Jiajun, et autres
Publié: (2025)
par: Cao, Jiajun, et autres
Publié: (2025)
Ges-QA: A Multidimensional Quality Assessment Dataset for Audio-to-3D Gesture Generation
par: Gao, Zhilin, et autres
Publié: (2025)
par: Gao, Zhilin, et autres
Publié: (2025)
Multimodal Emotion Recognition with Large Language Models
par: Zhang, Hongrui, et autres
Publié: (2026)
par: Zhang, Hongrui, et autres
Publié: (2026)
Exploring Transferability of Multimodal Adversarial Samples for Vision-Language Pre-training Models with Contrastive Learning
par: Wang, Youze, et autres
Publié: (2023)
par: Wang, Youze, et autres
Publié: (2023)
Angle-Optimized Partial Disentanglement for Multimodal Emotion Recognition in Conversation
par: Che, Xinyi, et autres
Publié: (2025)
par: Che, Xinyi, et autres
Publié: (2025)
Holistic Visual-Textual Sentiment Analysis with Prior Models
par: Chen, Junyu, et autres
Publié: (2022)
par: Chen, Junyu, et autres
Publié: (2022)
EyEar: Learning Audio Synchronized Human Gaze Trajectory Based on Physics-Informed Dynamics
par: Liu, Xiaochuan, et autres
Publié: (2025)
par: Liu, Xiaochuan, et autres
Publié: (2025)
PTSBench: A Comprehensive Post-Training Sparsity Benchmark Towards Algorithms and Models
par: Wnag, Zining, et autres
Publié: (2024)
par: Wnag, Zining, et autres
Publié: (2024)
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
par: Zhang, Meishan, et autres
Publié: (2024)
par: Zhang, Meishan, et autres
Publié: (2024)
Short-Form Video Viewing Behavior Analysis and Multi-Step Viewing Time Prediction
par: Yen, Vu Thi Hai, et autres
Publié: (2026)
par: Yen, Vu Thi Hai, et autres
Publié: (2026)
RoboKA: KAN Informed Multimodal Learning for RoboCall Surveillance System
par: Choudhury, Nitin, et autres
Publié: (2026)
par: Choudhury, Nitin, et autres
Publié: (2026)
Towards Multimodal Emotional Support Conversation Systems
par: Chu, Yuqi, et autres
Publié: (2024)
par: Chu, Yuqi, et autres
Publié: (2024)
Contestable Multi-Agent Debate with Arena-based Argumentative Computation for Multimedia Verification
par: Nguyen, Truong Thanh Hung, et autres
Publié: (2026)
par: Nguyen, Truong Thanh Hung, et autres
Publié: (2026)
Sentiment-enhanced Graph-based Sarcasm Explanation in Dialogue
par: Ouyang, Kun, et autres
Publié: (2024)
par: Ouyang, Kun, et autres
Publié: (2024)
Lightweight Call Signaling and Peer-to-Peer Control of WebRTC Video Conferencing
par: Singh, Kundan
Publié: (2026)
par: Singh, Kundan
Publié: (2026)
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
par: Li, Xiaojie, et autres
Publié: (2025)
par: Li, Xiaojie, et autres
Publié: (2025)
MMBench-Video: A Long-Form Multi-Shot Benchmark for Holistic Video Understanding
par: Fang, Xinyu, et autres
Publié: (2024)
par: Fang, Xinyu, et autres
Publié: (2024)
Modularized Zero-shot VQA with Pre-trained Models
par: Cao, Rui, et autres
Publié: (2023)
par: Cao, Rui, et autres
Publié: (2023)
XGC-AVis: Towards Audio-Visual Content Understanding with a Multi-Agent Collaborative System
par: Cao, Yuqin, et autres
Publié: (2025)
par: Cao, Yuqin, et autres
Publié: (2025)
Dual-Stream Decoupled Learning for Temporal Consistency and Speaker Interaction in AVSD
par: Xiao, Junhao, et autres
Publié: (2025)
par: Xiao, Junhao, et autres
Publié: (2025)
AIM: Let Any Multi-modal Large Language Models Embrace Efficient In-Context Learning
par: Gao, Jun, et autres
Publié: (2024)
par: Gao, Jun, et autres
Publié: (2024)
Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
par: Liu, Xinwei, et autres
Publié: (2024)
par: Liu, Xinwei, et autres
Publié: (2024)
Signal: Selective Interaction and Global-local Alignment for Multi-Modal Object Re-Identification
par: Liu, Yangyang, et autres
Publié: (2025)
par: Liu, Yangyang, et autres
Publié: (2025)
OmniSonic: Towards Universal and Holistic Audio Generation from Video and Text
par: Pian, Weiguo, et autres
Publié: (2026)
par: Pian, Weiguo, et autres
Publié: (2026)
Documents similaires
-
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
par: Cao, Yupeng, et autres
Publié: (2025) -
Truth Neurons
par: Li, Haohang, et autres
Publié: (2025) -
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
par: Li, Haohang, et autres
Publié: (2024) -
FinCon: A Synthesized LLM Multi-Agent System with Conceptual Verbal Reinforcement for Enhanced Financial Decision Making
par: Yu, Yangyang, et autres
Publié: (2024) -
FinCall-Surprise: A Large Scale Multi-modal Benchmark for Earning Surprise Prediction
par: Shu, Dong, et autres
Publié: (2025)