Conv-FinRe: A Conversational and Longitudinal Benchmark for Utility-Grounded Financial Recommendation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yan, Han, Yi, Qian, Lingfei, He, Yueru, Peng, Xueqing, Feng, Dongji, Xie, Zhuohan, Zhang, Vincent Jim, Guo, Rosie, Mo, Fengran, Huang, Jimin, Chen, Yankai, Liu, Xue, Nie, Jian-Yun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FinAuditing: A Financial Taxonomy-Structured Multi-Document Benchmark for Evaluating LLMs
par: Wang, Yan, et autres
Publié: (2025)
par: Wang, Yan, et autres
Publié: (2025)
FinTagging: Benchmarking LLMs for Extracting and Structuring Financial Information
par: Wang, Yan, et autres
Publié: (2025)
par: Wang, Yan, et autres
Publié: (2025)
OrdRankBen: A Novel Ranking Benchmark for Ordinal Relevance in NLP
par: Wang, Yan, et autres
Publié: (2025)
par: Wang, Yan, et autres
Publié: (2025)
FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR
par: He, Yueru, et autres
Publié: (2025)
par: He, Yueru, et autres
Publié: (2025)
ConvSDG: Session Data Generation for Conversational Search
par: Mo, Fengran, et autres
Publié: (2024)
par: Mo, Fengran, et autres
Publié: (2024)
ConvGQR: Generative Query Reformulation for Conversational Search
par: Mo, Fengran, et autres
Publié: (2023)
par: Mo, Fengran, et autres
Publié: (2023)
Can LLM Agents Be CFOs? Benchmarking Long-Horizon Resource Allocation in an Uncertain Enterprise Environment
par: Han, Yi, et autres
Publié: (2026)
par: Han, Yi, et autres
Publié: (2026)
ConvMix: A Mixed-Criteria Data Augmentation Framework for Conversational Dense Retrieval
par: Mo, Fengran, et autres
Publié: (2025)
par: Mo, Fengran, et autres
Publié: (2025)
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
par: Cao, Yupeng, et autres
Publié: (2025)
par: Cao, Yupeng, et autres
Publié: (2025)
FinReporting: An Agentic Workflow for Localized Reporting of Cross-Jurisdiction Financial Disclosures
par: Zhang, Fan, et autres
Publié: (2026)
par: Zhang, Fan, et autres
Publié: (2026)
The CLEF-2026 FinMMEval Lab: Multilingual and Multimodal Evaluation of Financial AI Systems
par: Xie, Zhuohan, et autres
Publié: (2026)
par: Xie, Zhuohan, et autres
Publié: (2026)
Conversational Search: From Fundamentals to Frontiers in the LLM Era
par: Mo, Fengran, et autres
Publié: (2025)
par: Mo, Fengran, et autres
Publié: (2025)
ReAttn: Improving Attention-based Re-ranking via Attention Re-weighting
par: Tian, Yuxing, et autres
Publié: (2026)
par: Tian, Yuxing, et autres
Publié: (2026)
FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning
par: Xie, Zhuohan, et autres
Publié: (2025)
par: Xie, Zhuohan, et autres
Publié: (2025)
RALI@TREC iKAT 2024: Achieving Personalization via Retrieval Fusion in Conversational Search
par: Hui, Yuchen, et autres
Publié: (2024)
par: Hui, Yuchen, et autres
Publié: (2024)
MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application
par: Peng, Xueqing, et autres
Publié: (2025)
par: Peng, Xueqing, et autres
Publié: (2025)
Learning to Route Queries to Heads for Attention-based Re-ranking with Large Language Models
par: Tian, Yuxing, et autres
Publié: (2026)
par: Tian, Yuxing, et autres
Publié: (2026)
Boosting Biomedical Concept Extraction by Rule-Based Data Augmentation
par: Shao, Qiwei, et autres
Publié: (2024)
par: Shao, Qiwei, et autres
Publié: (2024)
When Agents Trade: Live Multi-Market Trading Benchmark for LLM Agents
par: Qian, Lingfei, et autres
Publié: (2025)
par: Qian, Lingfei, et autres
Publié: (2025)
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
par: Li, Haohang, et autres
Publié: (2024)
par: Li, Haohang, et autres
Publié: (2024)
How to Leverage Personal Textual Knowledge for Personalized Conversational Information Retrieval
par: Mo, Fengran, et autres
Publié: (2024)
par: Mo, Fengran, et autres
Publié: (2024)
History-Aware Conversational Dense Retrieval
par: Mo, Fengran, et autres
Publié: (2024)
par: Mo, Fengran, et autres
Publié: (2024)
FinTrace: Holistic Trajectory-Level Evaluation of LLM Tool Calling for Long-Horizon Financial Tasks
par: Cao, Yupeng, et autres
Publié: (2026)
par: Cao, Yupeng, et autres
Publié: (2026)
UniConv: Unifying Retrieval and Response Generation for Large Language Models in Conversations
par: Mo, Fengran, et autres
Publié: (2025)
par: Mo, Fengran, et autres
Publié: (2025)
Measuring the Impact of Lexical Training Data Coverage on Hallucination Detection in Large Language Models
par: Zhang, Shuo, et autres
Publié: (2025)
par: Zhang, Shuo, et autres
Publié: (2025)
A User-Centric Multi-Intent Benchmark for Evaluating Large Language Models
par: Wang, Jiayin, et autres
Publié: (2024)
par: Wang, Jiayin, et autres
Publié: (2024)
FinVault: Benchmarking Financial Agent Safety in Execution-Grounded Environments
par: Yang, Zhi, et autres
Publié: (2026)
par: Yang, Zhi, et autres
Publié: (2026)
CHIQ: Contextual History Enhancement for Improving Query Rewriting in Conversational Search
par: Mo, Fengran, et autres
Publié: (2024)
par: Mo, Fengran, et autres
Publié: (2024)
Aligning Query Representation with Rewritten Query and Relevance Judgments in Conversational Search
par: Mo, Fengran, et autres
Publié: (2024)
par: Mo, Fengran, et autres
Publié: (2024)
FinBen: A Holistic Financial Benchmark for Large Language Models
par: Xie, Qianqian, et autres
Publié: (2024)
par: Xie, Qianqian, et autres
Publié: (2024)
ConvApparel: A Benchmark Dataset and Validation Framework for User Simulators in Conversational Recommenders
par: Meshi, Ofer, et autres
Publié: (2026)
par: Meshi, Ofer, et autres
Publié: (2026)
Adaptive Personalized Conversational Information Retrieval
par: Mo, Fengran, et autres
Publié: (2025)
par: Mo, Fengran, et autres
Publié: (2025)
MM-Conv: A Multi-modal Conversational Dataset for Virtual Humans
par: Deichler, Anna, et autres
Publié: (2024)
par: Deichler, Anna, et autres
Publié: (2024)
Open-FinLLMs: Open Multimodal Large Language Models for Financial Applications
par: Huang, Jimin, et autres
Publié: (2024)
par: Huang, Jimin, et autres
Publié: (2024)
FinCARDS: Card-Based Analyst Reranking for Financial Document Question Answering
par: Zhou, Yixi, et autres
Publié: (2026)
par: Zhou, Yixi, et autres
Publié: (2026)
MM-Conv: A Multimodal Dataset and Benchmark for Context-Aware Grounding in 3D Dialogue
par: Deichler, Anna, et autres
Publié: (2026)
par: Deichler, Anna, et autres
Publié: (2026)
SAHM: A Benchmark for Arabic Financial and Shari'ah-Compliant Reasoning
par: Elbadry, Rania, et autres
Publié: (2026)
par: Elbadry, Rania, et autres
Publié: (2026)
A Survey of Conversational Search
par: Mo, Fengran, et autres
Publié: (2024)
par: Mo, Fengran, et autres
Publié: (2024)
MobileConvRec: A Conversational Dataset for Mobile Apps Recommendations
par: Maji, Srijata, et autres
Publié: (2024)
par: Maji, Srijata, et autres
Publié: (2024)
Retrieval-augmented Large Language Models for Financial Time Series Forecasting
par: Xiao, Mengxi, et autres
Publié: (2025)
par: Xiao, Mengxi, et autres
Publié: (2025)
Documents similaires
-
FinAuditing: A Financial Taxonomy-Structured Multi-Document Benchmark for Evaluating LLMs
par: Wang, Yan, et autres
Publié: (2025) -
FinTagging: Benchmarking LLMs for Extracting and Structuring Financial Information
par: Wang, Yan, et autres
Publié: (2025) -
OrdRankBen: A Novel Ranking Benchmark for Ordinal Relevance in NLP
par: Wang, Yan, et autres
Publié: (2025) -
FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR
par: He, Yueru, et autres
Publié: (2025) -
ConvSDG: Session Data Generation for Conversational Search
par: Mo, Fengran, et autres
Publié: (2024)