Beyond Knowledge to Agency: Evaluating Expertise, Autonomy, and Integrity in Finance with CNFinBench
Fuente:
arXiv
Saved in:
| Main Authors: | Ding, Jinru, Ding, Chao, Jiang, Yidong, Pang, Wenrao, Xiao, Boyi, Liu, Zhiqiang, Chen, Jiayuan, Zhong, Yun, Yuan, Tiantian, Guan, Junming, Cheng, Dawei, Xu, Jie |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MedBench v4: A Robust and Scalable Benchmark for Evaluating Chinese Medical Language Models, Multimodal Models, and Intelligent Agents
by: Ding, Jinru, et al.
Published: (2025)
by: Ding, Jinru, et al.
Published: (2025)
FinReasoning: A Hierarchical Benchmark for Reliable Financial Research Reporting
by: Zhu, Yiyun, et al.
Published: (2026)
by: Zhu, Yiyun, et al.
Published: (2026)
RETRACTED: Dual drivers of plant invasions: Enemy release and enhanced mutualisms
by: Luwei Wang, et al.
Published: (2025)
by: Luwei Wang, et al.
Published: (2025)
FinDocMRE: A Benchmark for Document-Level Financial Multimodal Reasoning Evaluation
by: Zhu, Jiayong, et al.
Published: (2026)
by: Zhu, Jiayong, et al.
Published: (2026)
EpiPlanAgent: Agentic Automated Epidemic Response Planning
by: Mao, Kangkun, et al.
Published: (2025)
by: Mao, Kangkun, et al.
Published: (2025)
The Importance of Teacher Agency and Expertise in Education Reform and Policymaking
by: Ken Zeichner
Published: (2019)
by: Ken Zeichner
Published: (2019)
Editorial – 2026 Jan: A Year of Expanded Expertise and Sustained Growth
by: Yidong Wu, et al.
Published: (2025)
by: Yidong Wu, et al.
Published: (2025)
VOILA: Complexity-Aware Universal Segmentation of CT images by Voxel Interacting with Language
by: Wan, Zishuo, et al.
Published: (2025)
by: Wan, Zishuo, et al.
Published: (2025)
TimeMKG: Knowledge-Infused Causal Reasoning for Multivariate Time Series Modeling
by: Sun, Yifei, et al.
Published: (2025)
by: Sun, Yifei, et al.
Published: (2025)
The Sense of Agency in Assistive Robotics Using Shared Autonomy
by: Collier, Maggie A., et al.
Published: (2025)
by: Collier, Maggie A., et al.
Published: (2025)
Climate Finance Bench
by: Mankour, Rafik, et al.
Published: (2025)
by: Mankour, Rafik, et al.
Published: (2025)
SommBench: Assessing Sommelier Expertise of Language Models
by: Brach, William, et al.
Published: (2026)
by: Brach, William, et al.
Published: (2026)
Long-Short Term Agents for Pure-Vision Bronchoscopy Robotic Autonomy
by: Wu, Junyang, et al.
Published: (2026)
by: Wu, Junyang, et al.
Published: (2026)
MedCalc-Eval and MedCalc-Env: Advancing Medical Calculation Capabilities of Large Language Models
by: Mao, Kangkun, et al.
Published: (2025)
by: Mao, Kangkun, et al.
Published: (2025)
Autonomy and Agency in Agentic AI: Architectural Tactics for Regulated Contexts
by: Safin, Damir, et al.
Published: (2026)
by: Safin, Damir, et al.
Published: (2026)
Consumer Autonomy or Illusion? Rethinking Consumer Agency in the Age of Algorithms
by: Nokhiz, Pegah, et al.
Published: (2025)
by: Nokhiz, Pegah, et al.
Published: (2025)
Incremental Learning for Robot Shared Autonomy
by: Tao, Yiran, et al.
Published: (2024)
by: Tao, Yiran, et al.
Published: (2024)
MBTSAD: Mitigating Backdoors in Language Models Based on Token Splitting and Attention Distillation
by: Ding, Yidong, et al.
Published: (2025)
by: Ding, Yidong, et al.
Published: (2025)
5‐ ALA Exacerbates Maize ( Zea mays L. ) Energy Depletion Under Severe Drought‐Flood Abrupt Alternation by Activating Energy‐Costly Phenylpropanoid Metabolism
by: Yun Gao, et al.
Published: (2026)
by: Yun Gao, et al.
Published: (2026)
Safe and Stable Teleoperation of Quadrotor UAVs under Haptic Shared Autonomy
by: Zhang, Dawei, et al.
Published: (2024)
by: Zhang, Dawei, et al.
Published: (2024)
Causal Inference in Finance: An Expertise-Driven Model for Instrument Variables Identification and Interpretation
by: Chen, Ying, et al.
Published: (2024)
by: Chen, Ying, et al.
Published: (2024)
Coordinating Decisions via Quantum Telepathy
by: Ding, Dawei, et al.
Published: (2024)
by: Ding, Dawei, et al.
Published: (2024)
Irregularity Inspection using Neural Radiance Field
by: Ding, Tianqi, et al.
Published: (2024)
by: Ding, Tianqi, et al.
Published: (2024)
Quantum Telepathy: A Quantum Technology with Near-Term Applications
by: Ding, Dawei, et al.
Published: (2026)
by: Ding, Dawei, et al.
Published: (2026)
SciIntegrity-Bench: A Benchmark for Evaluating Academic Integrity in AI Scientist Systems
by: Yang, Zonglin, et al.
Published: (2026)
by: Yang, Zonglin, et al.
Published: (2026)
From Assistance to Agency: Rethinking Autonomy and Control in CI/CD Pipelines
by: Barnes, Marcus Emmanuel, et al.
Published: (2026)
by: Barnes, Marcus Emmanuel, et al.
Published: (2026)
Artificial Intelligence (AI) and the Relationship between Agency, Autonomy, and Moral Patiency
by: Formosa, Paul, et al.
Published: (2025)
by: Formosa, Paul, et al.
Published: (2025)
Alignment, Agency and Autonomy in Frontier AI: A Systems Engineering Perspective
by: Tallam, Krti
Published: (2025)
by: Tallam, Krti
Published: (2025)
HumanAgencyBench: Scalable Evaluation of Human Agency Support in AI Assistants
by: Sturgeon, Benjamin, et al.
Published: (2025)
by: Sturgeon, Benjamin, et al.
Published: (2025)
Leveraging Open Knowledge for Advancing Task Expertise in Large Language Models
by: Yang, Yuncheng, et al.
Published: (2024)
by: Yang, Yuncheng, et al.
Published: (2024)
Metabolic growth differences between Gymnocypris przewalskii and Gymnocypris eckloni: A quantitative proteomic perspective
by: Junming Zhou, et al.
Published: (2025)
by: Junming Zhou, et al.
Published: (2025)
When EU Agencies Set Up Advisory Committees: All About Autonomy?
by: Torbjørg Jevnaker
Published: (2024)
by: Torbjørg Jevnaker
Published: (2024)
Beyond Symbolism: Examining the Impact of Sustainable Finance on Product Responsibility and the Moderating Role of Board Environmental Expertise—Evidence From UK Non‐Financial Firms
by: Bright Akwasi Gyamfi, et al.
Published: (2026)
by: Bright Akwasi Gyamfi, et al.
Published: (2026)
AccidentBench: Benchmarking Multimodal Understanding and Reasoning in Vehicle Accidents and Beyond
by: Gu, Shangding, et al.
Published: (2025)
by: Gu, Shangding, et al.
Published: (2025)
New Interdisciplinary Perspectives On and Beyond Autonomy
Published: (2022)
Published: (2022)
Controllable suppression of Non-Hermitian skin effects
by: Chao, Xu, et al.
Published: (2024)
by: Chao, Xu, et al.
Published: (2024)
Professional Learning Networks to Support School Librarians' Development of Instructional Technology Expertise
by: Deissler, Christa Harrelson, et al.
Published: (2015)
by: Deissler, Christa Harrelson, et al.
Published: (2015)
Validation of the Coffee Knowledge Test for Assessing Expertise in Coffee
by: Jonas Yde Junge, et al.
Published: (2025)
by: Jonas Yde Junge, et al.
Published: (2025)
BAGEL: Benchmarking Animal Knowledge Expertise in Language Models
by: Shen, Jiacheng, et al.
Published: (2026)
by: Shen, Jiacheng, et al.
Published: (2026)
Human Autonomy and Sense of Agency in Human-Robot Interaction: A Systematic Literature Review
by: Glawe, Felix, et al.
Published: (2025)
by: Glawe, Felix, et al.
Published: (2025)
Similar Items
-
MedBench v4: A Robust and Scalable Benchmark for Evaluating Chinese Medical Language Models, Multimodal Models, and Intelligent Agents
by: Ding, Jinru, et al.
Published: (2025) -
FinReasoning: A Hierarchical Benchmark for Reliable Financial Research Reporting
by: Zhu, Yiyun, et al.
Published: (2026) -
RETRACTED: Dual drivers of plant invasions: Enemy release and enhanced mutualisms
by: Luwei Wang, et al.
Published: (2025) -
FinDocMRE: A Benchmark for Document-Level Financial Multimodal Reasoning Evaluation
by: Zhu, Jiayong, et al.
Published: (2026) -
EpiPlanAgent: Agentic Automated Epidemic Response Planning
by: Mao, Kangkun, et al.
Published: (2025)