Saved in:
| Main Authors: | Huang, Yu-Shiang, Wang, Chuan-Ju, Chen, Chung-Chi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2507.01923 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FinNuE: Exposing the Risks of Using BERTScore for Numerical Semantic Evaluation in Finance
by: Huang, Yu-Shiang, et al.
Published: (2025)
by: Huang, Yu-Shiang, et al.
Published: (2025)
Financial Risk Relation Identification through Dual-view Adaptation
by: Chiu, Wei-Ning, et al.
Published: (2025)
by: Chiu, Wei-Ning, et al.
Published: (2025)
Reliable Decision Support with LLMs: A Framework for Evaluating Consistency in Binary Text Classification Applications
by: Megahed, Fadel M., et al.
Published: (2025)
by: Megahed, Fadel M., et al.
Published: (2025)
Evaluating Large Language Models as Expert Annotators
by: Tseng, Yu-Min, et al.
Published: (2025)
by: Tseng, Yu-Min, et al.
Published: (2025)
The Impact and Feasibility of Self-Confidence Shaping for AI-Assisted Decision-Making
by: Takayanagi, Takehiro, et al.
Published: (2025)
by: Takayanagi, Takehiro, et al.
Published: (2025)
Beyond Turing Test: Can GPT-4 Sway Experts' Decisions?
by: Takayanagi, Takehiro, et al.
Published: (2024)
by: Takayanagi, Takehiro, et al.
Published: (2024)
GADFA: Generator-Assisted Decision-Focused Approach for Opinion Expressing Timing Identification
by: Chen, Chung-Chi, et al.
Published: (2024)
by: Chen, Chung-Chi, et al.
Published: (2024)
From Facts to Insights: A Study on the Generation and Evaluation of Analytical Reports for Deciphering Earnings Calls
by: Goldsack, Tomas, et al.
Published: (2024)
by: Goldsack, Tomas, et al.
Published: (2024)
Distilling Analysis from Generative Models for Investment Decisions
by: Chen, Chung-Chi, et al.
Published: (2024)
by: Chen, Chung-Chi, et al.
Published: (2024)
AgentEHR: Advancing Autonomous Clinical Decision-Making via Retrospective Summarization
by: Liao, Yusheng, et al.
Published: (2026)
by: Liao, Yusheng, et al.
Published: (2026)
Text2MDT: Extracting Medical Decision Trees from Medical Texts
by: Zhu, Wei, et al.
Published: (2024)
by: Zhu, Wei, et al.
Published: (2024)
Decision-Oriented Dialogue for Human-AI Collaboration
by: Lin, Jessy, et al.
Published: (2023)
by: Lin, Jessy, et al.
Published: (2023)
Modeling Professionalism in Expert Questioning through Linguistic Differentiation
by: D'Agostino, Giulia, et al.
Published: (2025)
by: D'Agostino, Giulia, et al.
Published: (2025)
RAVEL: Reasoning Agents for Validating and Evaluating LLM Text Synthesis
by: Feng, Andrew Zhuoer, et al.
Published: (2026)
by: Feng, Andrew Zhuoer, et al.
Published: (2026)
Commitment Checklist: Auditing Author Commitments in Peer Review
by: Chen, Chung-Chi, et al.
Published: (2026)
by: Chen, Chung-Chi, et al.
Published: (2026)
DEE: Dual-stage Explainable Evaluation Method for Text Generation
by: Zhang, Shenyu, et al.
Published: (2024)
by: Zhang, Shenyu, et al.
Published: (2024)
FineWeb-zhtw: Scalable Curation of Traditional Chinese Text Data from the Web
by: Lin, Cheng-Wei, et al.
Published: (2024)
by: Lin, Cheng-Wei, et al.
Published: (2024)
Co-Trained Retriever-Generator Framework for Question Generation in Earnings Calls
by: Juan, Yining, et al.
Published: (2024)
by: Juan, Yining, et al.
Published: (2024)
Why Expert Alignment Is Hard: Evidence from Subjective Evaluation
by: Lin, Tzu-Mi, et al.
Published: (2026)
by: Lin, Tzu-Mi, et al.
Published: (2026)
Wizard of Shopping: Target-Oriented E-commerce Dialogue Generation with Decision Tree Branching
by: Li, Xiangci, et al.
Published: (2025)
by: Li, Xiangci, et al.
Published: (2025)
AMONGAGENTS: Evaluating Large Language Models in the Interactive Text-Based Social Deduction Game
by: Chi, Yizhou, et al.
Published: (2024)
by: Chi, Yizhou, et al.
Published: (2024)
From Legal Text to Executable Decision Models: Evaluating Structured Representations for Legal Decision Model Generation
by: Graus, David
Published: (2026)
by: Graus, David
Published: (2026)
TextBandit: Evaluating Probabilistic Reasoning in LLMs Through Language-Only Decision Tasks
by: Lim, Jimin, et al.
Published: (2025)
by: Lim, Jimin, et al.
Published: (2025)
Writing Like the Best: Exemplar-Based Expository Text Generation
by: Liu, Yuxiang, et al.
Published: (2025)
by: Liu, Yuxiang, et al.
Published: (2025)
Are Expert-Level Language Models Expert-Level Annotators?
by: Tseng, Yu-Min, et al.
Published: (2024)
by: Tseng, Yu-Min, et al.
Published: (2024)
Diagnosing Model Editing via Knowledge Spectrum
by: Pan, Tsung-Hsuan, et al.
Published: (2025)
by: Pan, Tsung-Hsuan, et al.
Published: (2025)
Pre-Finetuning with Impact Duration Awareness for Stock Movement Prediction
by: Chiu, Chr-Jr, et al.
Published: (2024)
by: Chiu, Chr-Jr, et al.
Published: (2024)
"Why" Has the Least Side Effect on Model Editing
by: Pan, Tsung-Hsuan, et al.
Published: (2024)
by: Pan, Tsung-Hsuan, et al.
Published: (2024)
Refining Financial Consumer Complaints through Multi-Scale Model Interaction
by: Chen, Bo-Wei, et al.
Published: (2025)
by: Chen, Bo-Wei, et al.
Published: (2025)
Confidence-Driven Multi-Scale Model Selection for Cost-Efficient Inference
by: Chen, Bo-Wei, et al.
Published: (2026)
by: Chen, Bo-Wei, et al.
Published: (2026)
Paraphrase-Aligned Machine Translation
by: Chang, Ke-Ching, et al.
Published: (2024)
by: Chang, Ke-Ching, et al.
Published: (2024)
Rehearsing Answers to Probable Questions with Perspective-Taking
by: Shih, Yung-Yu, et al.
Published: (2024)
by: Shih, Yung-Yu, et al.
Published: (2024)
First Activations Matter: Training-Free Methods for Dynamic Activation in Large Language Models
by: Ma, Chi, et al.
Published: (2024)
by: Ma, Chi, et al.
Published: (2024)
Enhancing Short-Text Topic Modeling with LLM-Driven Context Expansion and Prefix-Tuned VAEs
by: Akash, Pritom Saha, et al.
Published: (2024)
by: Akash, Pritom Saha, et al.
Published: (2024)
OOP: Object-Oriented Programming Evaluation Benchmark for Large Language Models
by: Wang, Shuai, et al.
Published: (2024)
by: Wang, Shuai, et al.
Published: (2024)
Evaluating Large Language Model with Knowledge Oriented Language Specific Simple Question Answering
by: Jiang, Bowen, et al.
Published: (2025)
by: Jiang, Bowen, et al.
Published: (2025)
Hierarchical Organization Simulacra in the Investment Sector
by: Chen, Chung-Chi, et al.
Published: (2024)
by: Chen, Chung-Chi, et al.
Published: (2024)
Enhancing Financial Sentiment Analysis with Expert-Designed Hint
by: Chen, Chung-Chi, et al.
Published: (2024)
by: Chen, Chung-Chi, et al.
Published: (2024)
Safety-Oriented Evaluation of Language Understanding Systems for Air Traffic Control
by: Chang, Yujing, et al.
Published: (2026)
by: Chang, Yujing, et al.
Published: (2026)
Enhancing Investment Opinion Ranking through Argument-Based Sentiment Analysis
by: Chen, Chung-Chi, et al.
Published: (2024)
by: Chen, Chung-Chi, et al.
Published: (2024)
Similar Items
-
FinNuE: Exposing the Risks of Using BERTScore for Numerical Semantic Evaluation in Finance
by: Huang, Yu-Shiang, et al.
Published: (2025) -
Financial Risk Relation Identification through Dual-view Adaptation
by: Chiu, Wei-Ning, et al.
Published: (2025) -
Reliable Decision Support with LLMs: A Framework for Evaluating Consistency in Binary Text Classification Applications
by: Megahed, Fadel M., et al.
Published: (2025) -
Evaluating Large Language Models as Expert Annotators
by: Tseng, Yu-Min, et al.
Published: (2025) -
The Impact and Feasibility of Self-Confidence Shaping for AI-Assisted Decision-Making
by: Takayanagi, Takehiro, et al.
Published: (2025)