FinTrace: Holistic Trajectory-Level Evaluation of LLM Tool Calling for Long-Horizon Financial Tasks
Fuente:
arXiv
Guardado en:
| Autores principales: | Cao, Yupeng, Li, Haohang, Liu, Weijin, Cao, Wenbo, Xu, Anke, Qian, Lingfei, Peng, Xueqing, Tang, Minxue, Yao, Zhiyuan, Huang, Jimin, Subbalakshmi, K. P., Zhu, Zining, Suchow, Jordan W., Yu, Yangyang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
por: Cao, Yupeng, et al.
Publicado: (2025)
por: Cao, Yupeng, et al.
Publicado: (2025)
Truth Neurons
por: Li, Haohang, et al.
Publicado: (2025)
por: Li, Haohang, et al.
Publicado: (2025)
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
por: Li, Haohang, et al.
Publicado: (2024)
por: Li, Haohang, et al.
Publicado: (2024)
FinCon: A Synthesized LLM Multi-Agent System with Conceptual Verbal Reinforcement for Enhanced Financial Decision Making
por: Yu, Yangyang, et al.
Publicado: (2024)
por: Yu, Yangyang, et al.
Publicado: (2024)
FinCall-Surprise: A Large Scale Multi-modal Benchmark for Earning Surprise Prediction
por: Shu, Dong, et al.
Publicado: (2025)
por: Shu, Dong, et al.
Publicado: (2025)
Diffusion Model-Based Size Variable Virtual Try-On Technology and Evaluation Method
por: Zhang, Shufang, et al.
Publicado: (2025)
por: Zhang, Shufang, et al.
Publicado: (2025)
Automated Radiology Report Generation Based on Topic-Keyword Semantic Guidance
por: Xiao, Jing, et al.
Publicado: (2025)
por: Xiao, Jing, et al.
Publicado: (2025)
FinCap: Topic-Aligned Captions for Short-Form Financial YouTube Videos
por: Sukhani, Siddhant, et al.
Publicado: (2025)
por: Sukhani, Siddhant, et al.
Publicado: (2025)
Fast Visual Tracking with Enhanced and Gradient‐Guide Network
por: Dun Cao, et al.
Publicado: (2024)
por: Dun Cao, et al.
Publicado: (2024)
ForestHG-Trace: Traceable Long-Horizon Ecological Reasoning over Large-Scale Forest Scenes
por: Cheng, Zihang, et al.
Publicado: (2026)
por: Cheng, Zihang, et al.
Publicado: (2026)
Multi-source Knowledge Enhanced Graph Attention Networks for Multimodal Fact Verification
por: Cao, Han, et al.
Publicado: (2024)
por: Cao, Han, et al.
Publicado: (2024)
Orthogonal Disentanglement with Projected Feature Alignment for Multimodal Emotion Recognition in Conversation
por: Che, Xinyi, et al.
Publicado: (2025)
por: Che, Xinyi, et al.
Publicado: (2025)
Voices, Faces, and Feelings: Multi-modal Emotion-Cognition Captioning for Mental Health Understanding
por: Zhou, Zhiyuan, et al.
Publicado: (2026)
por: Zhou, Zhiyuan, et al.
Publicado: (2026)
FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR
por: He, Yueru, et al.
Publicado: (2025)
por: He, Yueru, et al.
Publicado: (2025)
Adaptive 3D Mesh Steganography Based on Feature-Preserving Distortion
por: Zhang, Yushu, et al.
Publicado: (2022)
por: Zhang, Yushu, et al.
Publicado: (2022)
MolCA: Molecular Graph-Language Modeling with Cross-Modal Projector and Uni-Modal Adapter
por: Liu, Zhiyuan, et al.
Publicado: (2023)
por: Liu, Zhiyuan, et al.
Publicado: (2023)
Augmenting Intra-Modal Understanding in MLLMs for Robust Multimodal Keyphrase Generation
por: Cao, Jiajun, et al.
Publicado: (2025)
por: Cao, Jiajun, et al.
Publicado: (2025)
Ges-QA: A Multidimensional Quality Assessment Dataset for Audio-to-3D Gesture Generation
por: Gao, Zhilin, et al.
Publicado: (2025)
por: Gao, Zhilin, et al.
Publicado: (2025)
Multimodal Emotion Recognition with Large Language Models
por: Zhang, Hongrui, et al.
Publicado: (2026)
por: Zhang, Hongrui, et al.
Publicado: (2026)
Exploring Transferability of Multimodal Adversarial Samples for Vision-Language Pre-training Models with Contrastive Learning
por: Wang, Youze, et al.
Publicado: (2023)
por: Wang, Youze, et al.
Publicado: (2023)
Angle-Optimized Partial Disentanglement for Multimodal Emotion Recognition in Conversation
por: Che, Xinyi, et al.
Publicado: (2025)
por: Che, Xinyi, et al.
Publicado: (2025)
Holistic Visual-Textual Sentiment Analysis with Prior Models
por: Chen, Junyu, et al.
Publicado: (2022)
por: Chen, Junyu, et al.
Publicado: (2022)
EyEar: Learning Audio Synchronized Human Gaze Trajectory Based on Physics-Informed Dynamics
por: Liu, Xiaochuan, et al.
Publicado: (2025)
por: Liu, Xiaochuan, et al.
Publicado: (2025)
PTSBench: A Comprehensive Post-Training Sparsity Benchmark Towards Algorithms and Models
por: Wnag, Zining, et al.
Publicado: (2024)
por: Wnag, Zining, et al.
Publicado: (2024)
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
por: Zhang, Meishan, et al.
Publicado: (2024)
por: Zhang, Meishan, et al.
Publicado: (2024)
Short-Form Video Viewing Behavior Analysis and Multi-Step Viewing Time Prediction
por: Yen, Vu Thi Hai, et al.
Publicado: (2026)
por: Yen, Vu Thi Hai, et al.
Publicado: (2026)
RoboKA: KAN Informed Multimodal Learning for RoboCall Surveillance System
por: Choudhury, Nitin, et al.
Publicado: (2026)
por: Choudhury, Nitin, et al.
Publicado: (2026)
Towards Multimodal Emotional Support Conversation Systems
por: Chu, Yuqi, et al.
Publicado: (2024)
por: Chu, Yuqi, et al.
Publicado: (2024)
Contestable Multi-Agent Debate with Arena-based Argumentative Computation for Multimedia Verification
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2026)
por: Nguyen, Truong Thanh Hung, et al.
Publicado: (2026)
Sentiment-enhanced Graph-based Sarcasm Explanation in Dialogue
por: Ouyang, Kun, et al.
Publicado: (2024)
por: Ouyang, Kun, et al.
Publicado: (2024)
Lightweight Call Signaling and Peer-to-Peer Control of WebRTC Video Conferencing
por: Singh, Kundan
Publicado: (2026)
por: Singh, Kundan
Publicado: (2026)
Music-Aligned Holistic 3D Dance Generation via Hierarchical Motion Modeling
por: Li, Xiaojie, et al.
Publicado: (2025)
por: Li, Xiaojie, et al.
Publicado: (2025)
MMBench-Video: A Long-Form Multi-Shot Benchmark for Holistic Video Understanding
por: Fang, Xinyu, et al.
Publicado: (2024)
por: Fang, Xinyu, et al.
Publicado: (2024)
Modularized Zero-shot VQA with Pre-trained Models
por: Cao, Rui, et al.
Publicado: (2023)
por: Cao, Rui, et al.
Publicado: (2023)
XGC-AVis: Towards Audio-Visual Content Understanding with a Multi-Agent Collaborative System
por: Cao, Yuqin, et al.
Publicado: (2025)
por: Cao, Yuqin, et al.
Publicado: (2025)
Dual-Stream Decoupled Learning for Temporal Consistency and Speaker Interaction in AVSD
por: Xiao, Junhao, et al.
Publicado: (2025)
por: Xiao, Junhao, et al.
Publicado: (2025)
AIM: Let Any Multi-modal Large Language Models Embrace Efficient In-Context Learning
por: Gao, Jun, et al.
Publicado: (2024)
por: Gao, Jun, et al.
Publicado: (2024)
Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
por: Liu, Xinwei, et al.
Publicado: (2024)
por: Liu, Xinwei, et al.
Publicado: (2024)
Signal: Selective Interaction and Global-local Alignment for Multi-Modal Object Re-Identification
por: Liu, Yangyang, et al.
Publicado: (2025)
por: Liu, Yangyang, et al.
Publicado: (2025)
OmniSonic: Towards Universal and Holistic Audio Generation from Video and Text
por: Pian, Weiguo, et al.
Publicado: (2026)
por: Pian, Weiguo, et al.
Publicado: (2026)
Ejemplares similares
-
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
por: Cao, Yupeng, et al.
Publicado: (2025) -
Truth Neurons
por: Li, Haohang, et al.
Publicado: (2025) -
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
por: Li, Haohang, et al.
Publicado: (2024) -
FinCon: A Synthesized LLM Multi-Agent System with Conceptual Verbal Reinforcement for Enhanced Financial Decision Making
por: Yu, Yangyang, et al.
Publicado: (2024) -
FinCall-Surprise: A Large Scale Multi-modal Benchmark for Earning Surprise Prediction
por: Shu, Dong, et al.
Publicado: (2025)