MAWARITH: A Dataset and Benchmark for Legal Inheritance Reasoning with LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bouchekif, Abdessalam, Gaben, Shahd, Rashwani, Samer, Eltanbouly, Somaya, Al-Khatib, Mutaz, Sbahi, Heba, Ghaly, Mohammed, Mohamed, Emad |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Assessing Large Language Models on Islamic Legal Reasoning: Evidence from Inheritance Law Evaluation
par: Bouchekif, Abdessalam, et autres
Publié: (2025)
par: Bouchekif, Abdessalam, et autres
Publié: (2025)
QIAS 2025: Overview of the Shared Task on Islamic Inheritance Reasoning and Knowledge Assessment
par: BOUCHEKIF, Abdessalam, et autres
Publié: (2026)
par: BOUCHEKIF, Abdessalam, et autres
Publié: (2026)
Grounding Arabic LLMs in the Doha Historical Dictionary: Retrieval-Augmented Understanding of Quran and Hadith
par: Eltanbouly, Somaya, et autres
Publié: (2026)
par: Eltanbouly, Somaya, et autres
Publié: (2026)
Benchmarking the Legal Reasoning of LLMs in Arabic Islamic Inheritance Cases
par: AlDahoul, Nouar, et autres
Publié: (2025)
par: AlDahoul, Nouar, et autres
Publié: (2025)
From Benchmarking to Reasoning: A Dual-Aspect, Large-Scale Evaluation of LLMs on Vietnamese Legal Text
par: Le, Van-Truong
Publié: (2026)
par: Le, Van-Truong
Publié: (2026)
LeCoDe: A Benchmark Dataset for Interactive Legal Consultation Dialogue Evaluation
par: Yuan, Weikang, et autres
Publié: (2025)
par: Yuan, Weikang, et autres
Publié: (2025)
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning
par: Ovcharov, Volodymyr
Publié: (2026)
par: Ovcharov, Volodymyr
Publié: (2026)
Cultural Benchmarking of LLMs in Standard and Dialectal Arabic Dialogues
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2026)
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2026)
LLMs for Legal Subsumption in German Employment Contracts
par: Wardas, Oliver, et autres
Publié: (2025)
par: Wardas, Oliver, et autres
Publié: (2025)
ARGUS: Seeing the Influence of Narrative Features on Persuasion in Argumentative Texts
par: Nabhani, Sara, et autres
Publié: (2026)
par: Nabhani, Sara, et autres
Publié: (2026)
EduAdapt: A Question Answer Benchmark Dataset for Evaluating Grade-Level Adaptability in LLMs
par: Naeem, Numaan, et autres
Publié: (2025)
par: Naeem, Numaan, et autres
Publié: (2025)
Current LLMs still cannot 'talk much' about grammar modules: Evidence from syntax
par: Shormani, Mohammed Q., et autres
Publié: (2026)
par: Shormani, Mohammed Q., et autres
Publié: (2026)
MORABLES: A Benchmark for Assessing Abstract Moral Reasoning in LLMs with Fables
par: Marcuzzo, Matteo, et autres
Publié: (2025)
par: Marcuzzo, Matteo, et autres
Publié: (2025)
LegalBench-BR: A Benchmark for Evaluating Large Language Models on Brazilian Legal Decision Classification
par: Neto, Pedro Barbosa de Carvalho
Publié: (2026)
par: Neto, Pedro Barbosa de Carvalho
Publié: (2026)
Can Large Language Models Grasp Legal Theories? Enhance Legal Reasoning with Insights from Multi-Agent Collaboration
par: Yuan, Weikang, et autres
Publié: (2024)
par: Yuan, Weikang, et autres
Publié: (2024)
Evaluating Relational Reasoning in LLMs with REL
par: Fesser, Lukas, et autres
Publié: (2026)
par: Fesser, Lukas, et autres
Publié: (2026)
Positional Failures in Long-Context LLMs: A Blind Spot in Reasoning Benchmarks
par: Zhang, Chuyifei, et autres
Publié: (2026)
par: Zhang, Chuyifei, et autres
Publié: (2026)
Constructing Benchmarks and Interventions for Combating Hallucinations in LLMs
par: Simhi, Adi, et autres
Publié: (2024)
par: Simhi, Adi, et autres
Publié: (2024)
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025)
par: Palit, Sayon, et autres
Publié: (2025)
Can LLMs Compute with Reasons?
par: Sandilya, Harshit, et autres
Publié: (2024)
par: Sandilya, Harshit, et autres
Publié: (2024)
LCFO: Long Context and Long Form Output Dataset and Benchmarking
par: Costa-jussà, Marta R., et autres
Publié: (2024)
par: Costa-jussà, Marta R., et autres
Publié: (2024)
Scaling Synthetic Logical Reasoning Datasets with Context-Sensitive Declarative Grammars
par: Sileo, Damien
Publié: (2024)
par: Sileo, Damien
Publié: (2024)
TituLLMs: A Family of Bangla LLMs with Comprehensive Benchmarking
par: Nahin, Shahriar Kabir, et autres
Publié: (2025)
par: Nahin, Shahriar Kabir, et autres
Publié: (2025)
Neither Valid nor Reliable? Investigating the Use of LLMs as Judges
par: Chehbouni, Khaoula, et autres
Publié: (2025)
par: Chehbouni, Khaoula, et autres
Publié: (2025)
Islamic Ethics and Incidental Findings
par: Ghaly, Mohammed
Publié: (2024)
par: Ghaly, Mohammed
Publié: (2024)
On the Validity of Traditional Vulnerability Scoring Systems for Adversarial Attacks against LLMs
par: Bahar, Atmane Ayoub Mansour, et autres
Publié: (2024)
par: Bahar, Atmane Ayoub Mansour, et autres
Publié: (2024)
A Multi-Perspective Benchmark and Moderation Model for Evaluating Safety and Adversarial Robustness
par: Machlovi, Naseem, et autres
Publié: (2025)
par: Machlovi, Naseem, et autres
Publié: (2025)
Introducing Three New Benchmark Datasets for Hierarchical Text Classification
par: Toit, Jaco du, et autres
Publié: (2024)
par: Toit, Jaco du, et autres
Publié: (2024)
The Translation Tax Is Not a Scalar: A Counterfactual Audit of English-Source Cue Inheritance in Chinese Multilingual Benchmarks
par: Lin, Zezheng, et autres
Publié: (2026)
par: Lin, Zezheng, et autres
Publié: (2026)
Thinking Longer, Not Always Smarter: Evaluating LLM Capabilities in Hierarchical Legal Reasoning
par: Zhang, Li, et autres
Publié: (2025)
par: Zhang, Li, et autres
Publié: (2025)
A Benchmark for Audio Reasoning Capabilities of Multimodal Large Language Models
par: Christop, Iwona, et autres
Publié: (2026)
par: Christop, Iwona, et autres
Publié: (2026)
Towards Reliable Retrieval in RAG Systems for Large Legal Datasets
par: Reuter, Markus, et autres
Publié: (2025)
par: Reuter, Markus, et autres
Publié: (2025)
LLAMADRS: Evaluating Open-Source LLMs on Real Clinical Interviews--To Reason or Not to Reason?
par: Kebe, Gaoussou Youssouf, et autres
Publié: (2025)
par: Kebe, Gaoussou Youssouf, et autres
Publié: (2025)
Auditing Meta-Cognitive Hallucinations in Reasoning Large Language Models
par: Lu, Haolang, et autres
Publié: (2025)
par: Lu, Haolang, et autres
Publié: (2025)
Exploiting LLM-as-a-Judge Disposition on Free Text Legal QA via Prompt Optimization
par: Elganayni, Mohamed Hesham, et autres
Publié: (2026)
par: Elganayni, Mohamed Hesham, et autres
Publié: (2026)
AI-assisted German Employment Contract Review: A Benchmark Dataset
par: Wardas, Oliver, et autres
Publié: (2025)
par: Wardas, Oliver, et autres
Publié: (2025)
Measuring Reasoning Utility in LLMs via Conditional Entropy Reduction
par: Guo, Xu
Publié: (2025)
par: Guo, Xu
Publié: (2025)
OpenFactCheck: Building, Benchmarking Customized Fact-Checking Systems and Evaluating the Factuality of Claims and LLMs
par: Wang, Yuxia, et autres
Publié: (2024)
par: Wang, Yuxia, et autres
Publié: (2024)
MicroRemed: Benchmarking LLMs in Microservices Remediation
par: Zhang, Lingzhe, et autres
Publié: (2025)
par: Zhang, Lingzhe, et autres
Publié: (2025)
Benchmarking the Performance of Pre-trained LLMs across Urdu NLP Tasks
par: Tahir, Munief Hassan, et autres
Publié: (2024)
par: Tahir, Munief Hassan, et autres
Publié: (2024)
Documents similaires
-
Assessing Large Language Models on Islamic Legal Reasoning: Evidence from Inheritance Law Evaluation
par: Bouchekif, Abdessalam, et autres
Publié: (2025) -
QIAS 2025: Overview of the Shared Task on Islamic Inheritance Reasoning and Knowledge Assessment
par: BOUCHEKIF, Abdessalam, et autres
Publié: (2026) -
Grounding Arabic LLMs in the Doha Historical Dictionary: Retrieval-Augmented Understanding of Quran and Hadith
par: Eltanbouly, Somaya, et autres
Publié: (2026) -
Benchmarking the Legal Reasoning of LLMs in Arabic Islamic Inheritance Cases
par: AlDahoul, Nouar, et autres
Publié: (2025) -
From Benchmarking to Reasoning: A Dual-Aspect, Large-Scale Evaluation of LLMs on Vietnamese Legal Text
par: Le, Van-Truong
Publié: (2026)