LAiW: A Chinese Legal Large Language Models Benchmark
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Dai, Yongfu, Feng, Duanyu, Huang, Jimin, Jia, Haochen, Xie, Qianqian, Zhang, Yifang, Han, Weiguang, Tian, Wei, Wang, Hao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Empowering Many, Biasing a Few: Generalist Credit Scoring through Large Language Models
von: Feng, Duanyu, et al.
Veröffentlicht: (2023)
von: Feng, Duanyu, et al.
Veröffentlicht: (2023)
HARMONIC: Harnessing LLMs for Tabular Data Synthesis and Privacy Protection
von: Wang, Yuxin, et al.
Veröffentlicht: (2024)
von: Wang, Yuxin, et al.
Veröffentlicht: (2024)
Dólares or Dollars? Unraveling the Bilingual Prowess of Financial LLMs Between Spanish and English
von: Zhang, Xiao, et al.
Veröffentlicht: (2024)
von: Zhang, Xiao, et al.
Veröffentlicht: (2024)
HealMe: Harnessing Cognitive Reframing in Large Language Models for Psychotherapy
von: Xiao, Mengxi, et al.
Veröffentlicht: (2024)
von: Xiao, Mengxi, et al.
Veröffentlicht: (2024)
No Language is an Island: Unifying Chinese and English in Financial Large Language Models, Instruction Data, and Benchmarks
von: Hu, Gang, et al.
Veröffentlicht: (2024)
von: Hu, Gang, et al.
Veröffentlicht: (2024)
FinBen: A Holistic Financial Benchmark for Large Language Models
von: Xie, Qianqian, et al.
Veröffentlicht: (2024)
von: Xie, Qianqian, et al.
Veröffentlicht: (2024)
FMDLlama: Financial Misinformation Detection based on Large Language Models
von: Liu, Zhiwei, et al.
Veröffentlicht: (2024)
von: Liu, Zhiwei, et al.
Veröffentlicht: (2024)
Cross-model Transferability among Large Language Models on the Platonic Representations of Concepts
von: Huang, Youcheng, et al.
Veröffentlicht: (2025)
von: Huang, Youcheng, et al.
Veröffentlicht: (2025)
Plutus: Benchmarking Large Language Models in Low-Resource Greek Finance
von: Peng, Xueqing, et al.
Veröffentlicht: (2025)
von: Peng, Xueqing, et al.
Veröffentlicht: (2025)
AuditWen:An Open-Source Large Language Model for Audit
von: Huang, Jiajia, et al.
Veröffentlicht: (2024)
von: Huang, Jiajia, et al.
Veröffentlicht: (2024)
MentaLLaMA: Interpretable Mental Health Analysis on Social Media with Large Language Models
von: Yang, Kailai, et al.
Veröffentlicht: (2023)
von: Yang, Kailai, et al.
Veröffentlicht: (2023)
AMaPO: Adaptive Margin-attached Preference Optimization for Language Model Alignment
von: Deng, Ruibo, et al.
Veröffentlicht: (2025)
von: Deng, Ruibo, et al.
Veröffentlicht: (2025)
MMAFFBen: A Multilingual and Multimodal Affective Analysis Benchmark for Evaluating LLMs and VLMs
von: Liu, Zhiwei, et al.
Veröffentlicht: (2025)
von: Liu, Zhiwei, et al.
Veröffentlicht: (2025)
LexEval: A Comprehensive Chinese Legal Benchmark for Evaluating Large Language Models
von: Li, Haitao, et al.
Veröffentlicht: (2024)
von: Li, Haitao, et al.
Veröffentlicht: (2024)
Evaluating Chinese Ambiguity Understanding in Large Language Models
von: Mo, Junwen, et al.
Veröffentlicht: (2026)
von: Mo, Junwen, et al.
Veröffentlicht: (2026)
Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use
von: Fu, Yicheng, et al.
Veröffentlicht: (2025)
von: Fu, Yicheng, et al.
Veröffentlicht: (2025)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
von: Ding, Jing, et al.
Veröffentlicht: (2025)
von: Ding, Jing, et al.
Veröffentlicht: (2025)
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
von: Xu, Xinzhe, et al.
Veröffentlicht: (2025)
von: Xu, Xinzhe, et al.
Veröffentlicht: (2025)
LexRel: Benchmarking Legal Relation Extraction for Chinese Civil Cases
von: Cai, Yida, et al.
Veröffentlicht: (2025)
von: Cai, Yida, et al.
Veröffentlicht: (2025)
MetaAligner: Towards Generalizable Multi-Objective Alignment of Language Models
von: Yang, Kailai, et al.
Veröffentlicht: (2024)
von: Yang, Kailai, et al.
Veröffentlicht: (2024)
LegalDrill: Diagnosis-Driven Synthesis for Legal Reasoning in Small Language Models
von: Li, Tianchun, et al.
Veröffentlicht: (2026)
von: Li, Tianchun, et al.
Veröffentlicht: (2026)
LawGPT: A Chinese Legal Knowledge-Enhanced Large Language Model
von: Zhou, Zhi, et al.
Veröffentlicht: (2024)
von: Zhou, Zhi, et al.
Veröffentlicht: (2024)
ChineseSafe: A Chinese Benchmark for Evaluating Safety in Large Language Models
von: Zhang, Hengxiang, et al.
Veröffentlicht: (2024)
von: Zhang, Hengxiang, et al.
Veröffentlicht: (2024)
DeliLaw: A Chinese Legal Counselling System Based on a Large Language Model
von: Xie, Nan, et al.
Veröffentlicht: (2024)
von: Xie, Nan, et al.
Veröffentlicht: (2024)
DREditor: An Time-efficient Approach for Building a Domain-specific Dense Retrieval Model
von: Huang, Chen, et al.
Veröffentlicht: (2024)
von: Huang, Chen, et al.
Veröffentlicht: (2024)
Are Large Language Models True Healthcare Jacks-of-All-Trades? Benchmarking Across Health Professions Beyond Physician Exams
von: Luo, Zheheng, et al.
Veröffentlicht: (2024)
von: Luo, Zheheng, et al.
Veröffentlicht: (2024)
Towards Understanding the Influence of Reward Margin on Preference Model Performance
von: Qin, Bowen, et al.
Veröffentlicht: (2024)
von: Qin, Bowen, et al.
Veröffentlicht: (2024)
UCFE: A User-Centric Financial Expertise Benchmark for Large Language Models
von: Yang, Yuzhe, et al.
Veröffentlicht: (2024)
von: Yang, Yuzhe, et al.
Veröffentlicht: (2024)
MentraSuite: Post-Training Large Language Models for Mental Health Reasoning and Assessment
von: Xiao, Mengxi, et al.
Veröffentlicht: (2025)
von: Xiao, Mengxi, et al.
Veröffentlicht: (2025)
CFinBench: A Comprehensive Chinese Financial Benchmark for Large Language Models
von: Nie, Ying, et al.
Veröffentlicht: (2024)
von: Nie, Ying, et al.
Veröffentlicht: (2024)
Beyond Solving Math Quiz: Evaluating the Ability of Large Reasoning Models to Ask for Information
von: Huang, Youcheng, et al.
Veröffentlicht: (2025)
von: Huang, Youcheng, et al.
Veröffentlicht: (2025)
InternLM-Law: An Open Source Chinese Legal Large Language Model
von: Fei, Zhiwei, et al.
Veröffentlicht: (2024)
von: Fei, Zhiwei, et al.
Veröffentlicht: (2024)
LexGenius: An Expert-Level Benchmark for Large Language Models in Legal General Intelligence
von: Liu, Wenjin, et al.
Veröffentlicht: (2025)
von: Liu, Wenjin, et al.
Veröffentlicht: (2025)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
von: Liu, Xiao, et al.
Veröffentlicht: (2023)
von: Liu, Xiao, et al.
Veröffentlicht: (2023)
The Lay Person's Guide to Biomedicine: Orchestrating Large Language Models
von: Luo, Zheheng, et al.
Veröffentlicht: (2024)
von: Luo, Zheheng, et al.
Veröffentlicht: (2024)
McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models
von: Lan, Tian, et al.
Veröffentlicht: (2025)
von: Lan, Tian, et al.
Veröffentlicht: (2025)
HSKBenchmark: Modeling and Benchmarking Chinese Second Language Acquisition in Large Language Models through Curriculum Tuning
von: Yang, Qihao, et al.
Veröffentlicht: (2025)
von: Yang, Qihao, et al.
Veröffentlicht: (2025)
OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology
von: Zhou, Chengfeng, et al.
Veröffentlicht: (2025)
von: Zhou, Chengfeng, et al.
Veröffentlicht: (2025)
TaxPraBen: A Scalable Benchmark for Structured Evaluation of LLMs in Chinese Real-World Tax Practice
von: Hu, Gang, et al.
Veröffentlicht: (2026)
von: Hu, Gang, et al.
Veröffentlicht: (2026)
OmniEduBench: A Comprehensive Chinese Benchmark for Evaluating Large Language Models in Education
von: Zhang, Min, et al.
Veröffentlicht: (2025)
von: Zhang, Min, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Empowering Many, Biasing a Few: Generalist Credit Scoring through Large Language Models
von: Feng, Duanyu, et al.
Veröffentlicht: (2023) -
HARMONIC: Harnessing LLMs for Tabular Data Synthesis and Privacy Protection
von: Wang, Yuxin, et al.
Veröffentlicht: (2024) -
Dólares or Dollars? Unraveling the Bilingual Prowess of Financial LLMs Between Spanish and English
von: Zhang, Xiao, et al.
Veröffentlicht: (2024) -
HealMe: Harnessing Cognitive Reframing in Large Language Models for Psychotherapy
von: Xiao, Mengxi, et al.
Veröffentlicht: (2024) -
No Language is an Island: Unifying Chinese and English in Financial Large Language Models, Instruction Data, and Benchmarks
von: Hu, Gang, et al.
Veröffentlicht: (2024)