LegalAgentBench: Evaluating LLM Agents in Legal Domain
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Haitao, Chen, Junjie, Yang, Jingli, Ai, Qingyao, Jia, Wei, Liu, Youfeng, Lin, Kai, Wu, Yueyue, Yuan, Guozhi, Hu, Yiran, Wang, Wuyue, Liu, Yiqun, Huang, Minlie |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Enhancing LLM-Based Agents via Global Planning and Hierarchical Execution
by: Chen, Junjie, et al.
Published: (2025)
by: Chen, Junjie, et al.
Published: (2025)
LexRAG: Benchmarking Retrieval-Augmented Generation in Multi-Turn Legal Consultation Conversation
by: Li, Haitao, et al.
Published: (2025)
by: Li, Haitao, et al.
Published: (2025)
Improving Legal Case Retrieval with Brain Signals
by: Zhang, Ruizhe, et al.
Published: (2024)
by: Zhang, Ruizhe, et al.
Published: (2024)
Simulating Dispute Mediation with LLM-Based Agents for Legal Research
by: Chen, Junjie, et al.
Published: (2025)
by: Chen, Junjie, et al.
Published: (2025)
Caseformer: Pre-training for Legal Case Retrieval Based on Inter-Case Distinctions
by: Su, Weihang, et al.
Published: (2023)
by: Su, Weihang, et al.
Published: (2023)
Gender Biased Legal Case Retrieval System on Users' Decision Process
by: Zhang, Ruizhe, et al.
Published: (2024)
by: Zhang, Ruizhe, et al.
Published: (2024)
Enhancing Judgment Document Generation via Agentic Legal Information Collection and Rubric-Guided Optimization
by: Su, Weihang, et al.
Published: (2026)
by: Su, Weihang, et al.
Published: (2026)
JuDGE: Benchmarking Judgment Document Generation for Chinese Legal System
by: Su, Weihang, et al.
Published: (2025)
by: Su, Weihang, et al.
Published: (2025)
Towards an In-Depth Comprehension of Case Relevance for Better Legal Retrieval
by: Li, Haitao, et al.
Published: (2024)
by: Li, Haitao, et al.
Published: (2024)
Multi-Source Retrieval and Reasoning for Legal Sentencing Prediction
by: Chen, Junjie, et al.
Published: (2026)
by: Chen, Junjie, et al.
Published: (2026)
Evaluation Ethics of LLMs in Legal Domain
by: Zhang, Ruizhe, et al.
Published: (2024)
by: Zhang, Ruizhe, et al.
Published: (2024)
DELTA: Pre-train a Discriminative Encoder for Legal Case Retrieval via Structural Word Alignment
by: Li, Haitao, et al.
Published: (2024)
by: Li, Haitao, et al.
Published: (2024)
LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods
by: Li, Haitao, et al.
Published: (2024)
by: Li, Haitao, et al.
Published: (2024)
PRE: A Peer Review Based Large Language Model Evaluator
by: Chu, Zhumin, et al.
Published: (2024)
by: Chu, Zhumin, et al.
Published: (2024)
LexEval: A Comprehensive Chinese Legal Benchmark for Evaluating Large Language Models
by: Li, Haitao, et al.
Published: (2024)
by: Li, Haitao, et al.
Published: (2024)
MemoryBench: A Benchmark for Memory and Continual Learning in LLM Systems
by: Ai, Qingyao, et al.
Published: (2025)
by: Ai, Qingyao, et al.
Published: (2025)
Foundations of GenIR
by: Ai, Qingyao, et al.
Published: (2025)
by: Ai, Qingyao, et al.
Published: (2025)
CaseGen: A Benchmark for Multi-Stage Legal Case Documents Generation
by: Li, Haitao, et al.
Published: (2025)
by: Li, Haitao, et al.
Published: (2025)
SelfRACG: Enabling LLMs to Self-Express and Retrieve for Code Generation
by: Dong, Qian, et al.
Published: (2025)
by: Dong, Qian, et al.
Published: (2025)
Multi-Field Tool Retrieval
by: Tang, Yichen, et al.
Published: (2026)
by: Tang, Yichen, et al.
Published: (2026)
I^3 Retriever: Incorporating Implicit Interaction in Pre-trained Language Models for Passage Retrieval
by: Dong, Qian, et al.
Published: (2023)
by: Dong, Qian, et al.
Published: (2023)
LegalOne: A Family of Foundation Models for Reliable Legal Reasoning
by: Li, Haitao, et al.
Published: (2026)
by: Li, Haitao, et al.
Published: (2026)
CrossPT-EEG: A Benchmark for Cross-Participant and Cross-Time Generalization of EEG-based Visual Decoding
by: Zhu, Shuqi, et al.
Published: (2024)
by: Zhu, Shuqi, et al.
Published: (2024)
Equity vs. Equality: Optimizing Ranking Fairness for Tailored Provider Needs
by: Tu, Yiteng, et al.
Published: (2026)
by: Tu, Yiteng, et al.
Published: (2026)
Beyond Exposure: Optimizing Ranking Fairness with Non-linear Time-Income Functions
by: Li, Xuancheng, et al.
Published: (2026)
by: Li, Xuancheng, et al.
Published: (2026)
JustEva: A Toolkit to Evaluate LLM Fairness in Legal Knowledge Inference
by: Xue, Zongyue, et al.
Published: (2025)
by: Xue, Zongyue, et al.
Published: (2025)
Towards Better Understanding of User Satisfaction in Open-Domain Conversational Search
by: Chu, Zhumin, et al.
Published: (2022)
by: Chu, Zhumin, et al.
Published: (2022)
LeKUBE: A Legal Knowledge Update BEnchmark
by: Wang, Changyue, et al.
Published: (2024)
by: Wang, Changyue, et al.
Published: (2024)
Unsupervised dense retrieval with conterfactual contrastive learning
by: Chen, Haitian, et al.
Published: (2024)
by: Chen, Haitian, et al.
Published: (2024)
STARD: A Chinese Statute Retrieval Dataset with Real Queries Issued by Non-professionals
by: Su, Weihang, et al.
Published: (2024)
by: Su, Weihang, et al.
Published: (2024)
Unsupervised Large Language Model Alignment for Information Retrieval via Contrastive Feedback
by: Dong, Qian, et al.
Published: (2023)
by: Dong, Qian, et al.
Published: (2023)
RbFT: Robust Fine-tuning for Retrieval-Augmented Generation against Retrieval Defects
by: Tu, Yiteng, et al.
Published: (2025)
by: Tu, Yiteng, et al.
Published: (2025)
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
by: Su, Weihang, et al.
Published: (2024)
by: Su, Weihang, et al.
Published: (2024)
Dynamic and Parametric Retrieval-Augmented Generation
by: Su, Weihang, et al.
Published: (2025)
by: Su, Weihang, et al.
Published: (2025)
PoAct: Policy and Action Dual-Control Agent for Generalized Applications
by: Yuan, Guozhi, et al.
Published: (2025)
by: Yuan, Guozhi, et al.
Published: (2025)
Capability-aware Prompt Reformulation Learning for Text-to-Image Generation
by: Zhan, Jingtao, et al.
Published: (2024)
by: Zhan, Jingtao, et al.
Published: (2024)
Generalized Pseudo-Relevance Feedback
by: Tu, Yiteng, et al.
Published: (2025)
by: Tu, Yiteng, et al.
Published: (2025)
Analytical Search
by: Tu, Yiteng, et al.
Published: (2026)
by: Tu, Yiteng, et al.
Published: (2026)
LegalMALR:Multi-Agent Query Understanding and LLM-Based Reranking for Chinese Statute Retrieval
by: Li, Yunhan, et al.
Published: (2026)
by: Li, Yunhan, et al.
Published: (2026)
Wikiformer: Pre-training with Structured Information of Wikipedia for Ad-hoc Retrieval
by: Su, Weihang, et al.
Published: (2023)
by: Su, Weihang, et al.
Published: (2023)
Similar Items
-
Enhancing LLM-Based Agents via Global Planning and Hierarchical Execution
by: Chen, Junjie, et al.
Published: (2025) -
LexRAG: Benchmarking Retrieval-Augmented Generation in Multi-Turn Legal Consultation Conversation
by: Li, Haitao, et al.
Published: (2025) -
Improving Legal Case Retrieval with Brain Signals
by: Zhang, Ruizhe, et al.
Published: (2024) -
Simulating Dispute Mediation with LLM-Based Agents for Legal Research
by: Chen, Junjie, et al.
Published: (2025) -
Caseformer: Pre-training for Legal Case Retrieval Based on Inter-Case Distinctions
by: Su, Weihang, et al.
Published: (2023)