LegalCiteBench: Evaluating Citation Reliability in Legal Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Sijia, Yin, Hang, Zhou, Shunfan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Magis-Bench: Evaluating LLMs on Magistrate-Level Legal Tasks
par: Pires, Ramon, et autres
Publié: (2026)
par: Pires, Ramon, et autres
Publié: (2026)
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning
par: Ovcharov, Volodymyr
Publié: (2026)
par: Ovcharov, Volodymyr
Publié: (2026)
CALRK-Bench: Evaluating Context-Aware Legal Reasoning in Korean Law
par: Jung, JiHyeok, et autres
Publié: (2026)
par: Jung, JiHyeok, et autres
Publié: (2026)
CiteEval: Principle-Driven Citation Evaluation for Source Attribution
par: Xu, Yumo, et autres
Publié: (2025)
par: Xu, Yumo, et autres
Publié: (2025)
VLegal-Bench: Cognitively Grounded Benchmark for Vietnamese Legal Reasoning of Large Language Models
par: Dong, Nguyen Tien, et autres
Publié: (2025)
par: Dong, Nguyen Tien, et autres
Publié: (2025)
IslamicLegalBench: Evaluating LLMs Knowledge and Reasoning of Islamic Law Across 1,200 Years of Islamic Pluralist Legal Traditions
par: Elmahjub, Ezieddin, et autres
Publié: (2026)
par: Elmahjub, Ezieddin, et autres
Publié: (2026)
Evaluating the Role of Large Language Models in Legal Practice in India
par: Hemrajani, Rahul
Publié: (2025)
par: Hemrajani, Rahul
Publié: (2025)
Evaluating Legal Reasoning Traces with Legal Issue Tree Rubrics
par: Lee, Jinu, et autres
Publié: (2025)
par: Lee, Jinu, et autres
Publié: (2025)
Large Legal Fictions: Profiling Legal Hallucinations in Large Language Models
par: Dahl, Matthew, et autres
Publié: (2024)
par: Dahl, Matthew, et autres
Publié: (2024)
CiteBART: Learning to Generate Citations for Local Citation Recommendation
par: Çelik, Ege Yiğit, et autres
Publié: (2024)
par: Çelik, Ege Yiğit, et autres
Publié: (2024)
From Legal Text to Executable Decision Models: Evaluating Structured Representations for Legal Decision Model Generation
par: Graus, David
Publié: (2026)
par: Graus, David
Publié: (2026)
CogniBench: A Legal-inspired Framework and Dataset for Assessing Cognitive Faithfulness of Large Language Models
par: Tang, Xiaqiang, et autres
Publié: (2025)
par: Tang, Xiaqiang, et autres
Publié: (2025)
Legal Evalutions and Challenges of Large Language Models
par: Wang, Jiaqi, et autres
Publié: (2024)
par: Wang, Jiaqi, et autres
Publié: (2024)
LegalGraphRAG: Multi-Agent Graph Retrieval-Augmented Generation for Reliable Legal Reasoning
par: Chen, Zerui, et autres
Publié: (2026)
par: Chen, Zerui, et autres
Publié: (2026)
LegalMidm: Use-Case-Driven Legal Domain Specialization for Korean Large Language Model
par: Jang, Youngjoon, et autres
Publié: (2026)
par: Jang, Youngjoon, et autres
Publié: (2026)
PLawBench: A Rubric-Based Benchmark for Evaluating LLMs in Real-World Legal Practice
par: Shi, Yuzhen, et autres
Publié: (2026)
par: Shi, Yuzhen, et autres
Publié: (2026)
LeMAJ (Legal LLM-as-a-Judge): Bridging Legal Reasoning and LLM Evaluation
par: Enguehard, Joseph, et autres
Publié: (2025)
par: Enguehard, Joseph, et autres
Publié: (2025)
MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning
par: Jing, Huihao, et autres
Publié: (2025)
par: Jing, Huihao, et autres
Publié: (2025)
Athena: Retrieval-augmented Legal Judgment Prediction with Large Language Models
par: Peng, Xiao, et autres
Publié: (2024)
par: Peng, Xiao, et autres
Publié: (2024)
Automatic Legal Writing Evaluation of LLMs
par: Pires, Ramon, et autres
Publié: (2025)
par: Pires, Ramon, et autres
Publié: (2025)
Evaluation Ethics of LLMs in Legal Domain
par: Zhang, Ruizhe, et autres
Publié: (2024)
par: Zhang, Ruizhe, et autres
Publié: (2024)
Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning
par: Ioannou, Antreas, et autres
Publié: (2025)
par: Ioannou, Antreas, et autres
Publié: (2025)
Evaluation of Large Language Models in Legal Applications: Challenges, Methods, and Future Directions
par: Hu, Yiran, et autres
Publié: (2026)
par: Hu, Yiran, et autres
Publié: (2026)
ArabLegalEval: A Multitask Benchmark for Assessing Arabic Legal Knowledge in Large Language Models
par: Hijazi, Faris, et autres
Publié: (2024)
par: Hijazi, Faris, et autres
Publié: (2024)
Natural Language Processing in the Legal Domain
par: Hartung, Dirk, et autres
Publié: (2023)
par: Hartung, Dirk, et autres
Publié: (2023)
LawGPT: A Chinese Legal Knowledge-Enhanced Large Language Model
par: Zhou, Zhi, et autres
Publié: (2024)
par: Zhou, Zhi, et autres
Publié: (2024)
ViLegalNLI: Natural Language Inference for Vietnamese Legal Texts
par: Duong, Nhung Thi-Hong, et autres
Publié: (2026)
par: Duong, Nhung Thi-Hong, et autres
Publié: (2026)
The Right Model for the Job: An Evaluation of Legal Multi-Label Classification Baselines
par: Forster, Martina, et autres
Publié: (2024)
par: Forster, Martina, et autres
Publié: (2024)
CausalCite: A Causal Formulation of Paper Citations
par: Kumar, Ishan, et autres
Publié: (2023)
par: Kumar, Ishan, et autres
Publié: (2023)
LegalCore: A Dataset for Event Coreference Resolution in Legal Documents
par: Wei, Kangda, et autres
Publié: (2025)
par: Wei, Kangda, et autres
Publié: (2025)
Automating Legal Interpretation with LLMs: Retrieval, Generation, and Evaluation
par: Luo, Kangcheng, et autres
Publié: (2025)
par: Luo, Kangcheng, et autres
Publié: (2025)
Large Language Models Meet Legal Artificial Intelligence: A Survey
par: Hou, Zhitian, et autres
Publié: (2025)
par: Hou, Zhitian, et autres
Publié: (2025)
Multi-Agent Simulator Drives Language Models for Legal Intensive Interaction
par: Yue, Shengbin, et autres
Publié: (2025)
par: Yue, Shengbin, et autres
Publié: (2025)
Juru: Legal Brazilian Large Language Model from Reputable Sources
par: Junior, Roseval Malaquias, et autres
Publié: (2024)
par: Junior, Roseval Malaquias, et autres
Publié: (2024)
Applicability of Large Language Models and Generative Models for Legal Case Judgement Summarization
par: Deroy, Aniket, et autres
Publié: (2024)
par: Deroy, Aniket, et autres
Publié: (2024)
MILPaC: A Novel Benchmark for Evaluating Translation of Legal Text to Indian Languages
par: Mahapatra, Sayan, et autres
Publié: (2023)
par: Mahapatra, Sayan, et autres
Publié: (2023)
PILOT-Bench: A Benchmark for Legal Reasoning in the Patent Domain with IRAC-Aligned Classification Tasks
par: Jang, Yehoon, et autres
Publié: (2026)
par: Jang, Yehoon, et autres
Publié: (2026)
WisdomInterrogatory (LuWen): An Open-Source Legal Large Language Model Technical Report
par: Wu, Yiquan, et autres
Publié: (2026)
par: Wu, Yiquan, et autres
Publié: (2026)
Legal Fact Prediction: The Missing Piece in Legal Judgment Prediction
par: Liu, Junkai, et autres
Publié: (2024)
par: Liu, Junkai, et autres
Publié: (2024)
CiteME: Can Language Models Accurately Cite Scientific Claims?
par: Press, Ori, et autres
Publié: (2024)
par: Press, Ori, et autres
Publié: (2024)
Documents similaires
-
Magis-Bench: Evaluating LLMs on Magistrate-Level Legal Tasks
par: Pires, Ramon, et autres
Publié: (2026) -
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning
par: Ovcharov, Volodymyr
Publié: (2026) -
CALRK-Bench: Evaluating Context-Aware Legal Reasoning in Korean Law
par: Jung, JiHyeok, et autres
Publié: (2026) -
CiteEval: Principle-Driven Citation Evaluation for Source Attribution
par: Xu, Yumo, et autres
Publié: (2025) -
VLegal-Bench: Cognitively Grounded Benchmark for Vietnamese Legal Reasoning of Large Language Models
par: Dong, Nguyen Tien, et autres
Publié: (2025)