FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
Fuente:
arXiv
Salvato in:
| Autori principali: | Cao, Yupeng, Li, Haohang, Yu, Yangyang, Javaji, Shashidhar Reddy, He, Yueru, Huang, Jimin, Xie, Qianqian, Dimino, Fabrizio, Liu, Xiao-yang, Subbalakshmi, K. P., Qiu, Meikang, Ananiadou, Sophia, Nie, Jian-Yun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FinTrace: Holistic Trajectory-Level Evaluation of LLM Tool Calling for Long-Horizon Financial Tasks
di: Cao, Yupeng, et al.
Pubblicazione: (2026)
di: Cao, Yupeng, et al.
Pubblicazione: (2026)
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
di: Li, Haohang, et al.
Pubblicazione: (2024)
di: Li, Haohang, et al.
Pubblicazione: (2024)
Can AI Validate Science? Benchmarking LLMs for Accurate Scientific Claim $\rightarrow$ Evidence Reasoning
di: Javaji, Shashidhar Reddy, et al.
Pubblicazione: (2025)
di: Javaji, Shashidhar Reddy, et al.
Pubblicazione: (2025)
MixFake: Benchmarking and Enhancing Audio Deepfake Detection in Diverse Real-world Mixed Audio
di: Li, Qingcao, et al.
Pubblicazione: (2026)
di: Li, Qingcao, et al.
Pubblicazione: (2026)
Audio Matters Too! Enhancing Markerless Motion Capture with Audio Signals for String Performance Capture
di: Jin, Yitong, et al.
Pubblicazione: (2024)
di: Jin, Yitong, et al.
Pubblicazione: (2024)
MusiCRS: Benchmarking Audio-Centric Conversational Recommendation
di: Surana, Rohan, et al.
Pubblicazione: (2025)
di: Surana, Rohan, et al.
Pubblicazione: (2025)
Appear2Meaning: A Cross-Cultural Benchmark for Structured Cultural Metadata Inference from Images
di: Jiang, Yuechen, et al.
Pubblicazione: (2026)
di: Jiang, Yuechen, et al.
Pubblicazione: (2026)
AVID: A Benchmark for Omni-Modal Audio-Visual Inconsistency Understanding via Agent-Driven Construction
di: Chen, Zixuan, et al.
Pubblicazione: (2026)
di: Chen, Zixuan, et al.
Pubblicazione: (2026)
Generative Audio Extension and Morphing
di: Seetharaman, Prem, et al.
Pubblicazione: (2026)
di: Seetharaman, Prem, et al.
Pubblicazione: (2026)
Exploring the Role of Audio in Multimodal Misinformation Detection
di: Liu, Moyang, et al.
Pubblicazione: (2024)
di: Liu, Moyang, et al.
Pubblicazione: (2024)
MTAVG-Bench: A Diagnostic Benchmark for Multi-Talker Dialogue-Centric Audio-Video Generation
di: Zhou, Yang-Hao, et al.
Pubblicazione: (2026)
di: Zhou, Yang-Hao, et al.
Pubblicazione: (2026)
SAVGBench: Benchmarking Spatially Aligned Audio-Video Generation
di: Shimada, Kazuki, et al.
Pubblicazione: (2024)
di: Shimada, Kazuki, et al.
Pubblicazione: (2024)
EMID: An Emotional Aligned Dataset in Audio-Visual Modality
di: Zou, Jialing, et al.
Pubblicazione: (2023)
di: Zou, Jialing, et al.
Pubblicazione: (2023)
AV-EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Omni-modal LLMS with Audio-visual Cues
di: Zhou, Dingkun, et al.
Pubblicazione: (2025)
di: Zhou, Dingkun, et al.
Pubblicazione: (2025)
Multimodal Semantic Communication for Generative Audio-Driven Video Conferencing
di: Tong, Haonan, et al.
Pubblicazione: (2024)
di: Tong, Haonan, et al.
Pubblicazione: (2024)
FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR
di: He, Yueru, et al.
Pubblicazione: (2025)
di: He, Yueru, et al.
Pubblicazione: (2025)
Draw an Audio: Leveraging Multi-Instruction for Video-to-Audio Synthesis
di: Yang, Qi, et al.
Pubblicazione: (2024)
di: Yang, Qi, et al.
Pubblicazione: (2024)
Enhancing Video Music Recommendation with Transformer-Driven Audio-Visual Embeddings
di: Liu, Shimiao, et al.
Pubblicazione: (2025)
di: Liu, Shimiao, et al.
Pubblicazione: (2025)
JointAVBench: A Benchmark for Joint Audio-Visual Reasoning Evaluation
di: Chao, Jianghan, et al.
Pubblicazione: (2025)
di: Chao, Jianghan, et al.
Pubblicazione: (2025)
Coherent Audio-Visual Editing via Conditional Audio Generation Following Video Edits
di: Ishii, Masato, et al.
Pubblicazione: (2025)
di: Ishii, Masato, et al.
Pubblicazione: (2025)
Audio-Visual Separation with Hierarchical Fusion and Representation Alignment
di: Hu, Han, et al.
Pubblicazione: (2025)
di: Hu, Han, et al.
Pubblicazione: (2025)
Audio-Language Models for Audio-Centric Tasks: A Systematic Survey
di: Su, Yi, et al.
Pubblicazione: (2025)
di: Su, Yi, et al.
Pubblicazione: (2025)
Look, Listen and Segment: Towards Weakly Supervised Audio-visual Semantic Segmentation
di: Li, Chengzhi, et al.
Pubblicazione: (2026)
di: Li, Chengzhi, et al.
Pubblicazione: (2026)
Cross-Modality and Within-Modality Regularization for Audio-Visual DeepFake Detection
di: Zou, Heqing, et al.
Pubblicazione: (2024)
di: Zou, Heqing, et al.
Pubblicazione: (2024)
FinCall-Surprise: A Large Scale Multi-modal Benchmark for Earning Surprise Prediction
di: Shu, Dong, et al.
Pubblicazione: (2025)
di: Shu, Dong, et al.
Pubblicazione: (2025)
Variable-Length Audio Fingerprinting
di: Chen, Hongjie, et al.
Pubblicazione: (2026)
di: Chen, Hongjie, et al.
Pubblicazione: (2026)
Unveiling Visual Biases in Audio-Visual Localization Benchmarks
di: Chen, Liangyu, et al.
Pubblicazione: (2024)
di: Chen, Liangyu, et al.
Pubblicazione: (2024)
Manipulated Regions Localization For Partially Deepfake Audio: A Survey
di: He, Jiayi, et al.
Pubblicazione: (2025)
di: He, Jiayi, et al.
Pubblicazione: (2025)
Open-Vocabulary Audio-Visual Semantic Segmentation
di: Guo, Ruohao, et al.
Pubblicazione: (2024)
di: Guo, Ruohao, et al.
Pubblicazione: (2024)
RVCBench: Benchmarking the Robustness of Voice Cloning Across Modern Audio Generation Models
di: Jin, Ruinan, et al.
Pubblicazione: (2026)
di: Jin, Ruinan, et al.
Pubblicazione: (2026)
Audio ControlNet for Fine-Grained Audio Generation and Editing
di: Zhu, Haina, et al.
Pubblicazione: (2026)
di: Zhu, Haina, et al.
Pubblicazione: (2026)
Generalizing Video DeepFake Detection by Self-generated Audio-Visual Pseudo-Fakes
di: Wei, Zihe, et al.
Pubblicazione: (2026)
di: Wei, Zihe, et al.
Pubblicazione: (2026)
MAR3: Multi-Agent Recognition, Reasoning, and Reflection for Reference Audio-Visual Segmentation
di: Zhao, Yuan, et al.
Pubblicazione: (2026)
di: Zhao, Yuan, et al.
Pubblicazione: (2026)
The Interspeech 2026 Audio Reasoning Challenge: Evaluating Reasoning Process Quality for Audio Reasoning Models and Agents
di: Ma, Ziyang, et al.
Pubblicazione: (2026)
di: Ma, Ziyang, et al.
Pubblicazione: (2026)
Rhythmic Foley: A Framework For Seamless Audio-Visual Alignment In Video-to-Audio Synthesis
di: Huang, Zhiqi, et al.
Pubblicazione: (2024)
di: Huang, Zhiqi, et al.
Pubblicazione: (2024)
Delayed Commitment for Representation Readiness in Stage-wise Audio-Visual Learning
di: Xu, Xinmeng, et al.
Pubblicazione: (2026)
di: Xu, Xinmeng, et al.
Pubblicazione: (2026)
DreamFoley: Scalable VLMs for High-Fidelity Video-to-Audio Generation
di: Li, Fu, et al.
Pubblicazione: (2025)
di: Li, Fu, et al.
Pubblicazione: (2025)
EyEar: Learning Audio Synchronized Human Gaze Trajectory Based on Physics-Informed Dynamics
di: Liu, Xiaochuan, et al.
Pubblicazione: (2025)
di: Liu, Xiaochuan, et al.
Pubblicazione: (2025)
Ges-QA: A Multidimensional Quality Assessment Dataset for Audio-to-3D Gesture Generation
di: Gao, Zhilin, et al.
Pubblicazione: (2025)
di: Gao, Zhilin, et al.
Pubblicazione: (2025)
Fast Audio Codec Identification Using Overlapping LCS
di: Jafari, Farzane
Pubblicazione: (2025)
di: Jafari, Farzane
Pubblicazione: (2025)
Documenti analoghi
-
FinTrace: Holistic Trajectory-Level Evaluation of LLM Tool Calling for Long-Horizon Financial Tasks
di: Cao, Yupeng, et al.
Pubblicazione: (2026) -
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
di: Li, Haohang, et al.
Pubblicazione: (2024) -
Can AI Validate Science? Benchmarking LLMs for Accurate Scientific Claim $\rightarrow$ Evidence Reasoning
di: Javaji, Shashidhar Reddy, et al.
Pubblicazione: (2025) -
MixFake: Benchmarking and Enhancing Audio Deepfake Detection in Diverse Real-world Mixed Audio
di: Li, Qingcao, et al.
Pubblicazione: (2026) -
Audio Matters Too! Enhancing Markerless Motion Capture with Audio Signals for String Performance Capture
di: Jin, Yitong, et al.
Pubblicazione: (2024)