Guardado en:
| Autores principales: | Li, Haitao, Ai, Qingyao, Chen, Jia, Dong, Qian, Wu, Zhijing, Liu, Yiqun, Chen, Chong, Tian, Qi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2403.18365 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
por: Su, Weihang, et al.
Publicado: (2024)
por: Su, Weihang, et al.
Publicado: (2024)
DELTA: Pre-train a Discriminative Encoder for Legal Case Retrieval via Structural Word Alignment
por: Li, Haitao, et al.
Publicado: (2024)
por: Li, Haitao, et al.
Publicado: (2024)
Mitigating Entity-Level Hallucination in Large Language Models
por: Su, Weihang, et al.
Publicado: (2024)
por: Su, Weihang, et al.
Publicado: (2024)
LexEval: A Comprehensive Chinese Legal Benchmark for Evaluating Large Language Models
por: Li, Haitao, et al.
Publicado: (2024)
por: Li, Haitao, et al.
Publicado: (2024)
PRE: A Peer Review Based Large Language Model Evaluator
por: Chu, Zhumin, et al.
Publicado: (2024)
por: Chu, Zhumin, et al.
Publicado: (2024)
Unsupervised Real-Time Hallucination Detection based on the Internal States of Large Language Models
por: Su, Weihang, et al.
Publicado: (2024)
por: Su, Weihang, et al.
Publicado: (2024)
Improve Large Language Model Systems with User Logs
por: Wang, Changyue, et al.
Publicado: (2026)
por: Wang, Changyue, et al.
Publicado: (2026)
Overview of the NTCIR-18 Automatic Evaluation of LLMs (AEOLLM) Task
por: Chen, Junjie, et al.
Publicado: (2025)
por: Chen, Junjie, et al.
Publicado: (2025)
CalibraEval: Calibrating Prediction Distribution to Mitigate Selection Bias in LLMs-as-Judges
por: Li, Haitao, et al.
Publicado: (2024)
por: Li, Haitao, et al.
Publicado: (2024)
Unsupervised Large Language Model Alignment for Information Retrieval via Contrastive Feedback
por: Dong, Qian, et al.
Publicado: (2023)
por: Dong, Qian, et al.
Publicado: (2023)
Joint Evaluation of Answer and Reasoning Consistency for Hallucination Detection in Large Reasoning Models
por: Wang, Changyue, et al.
Publicado: (2025)
por: Wang, Changyue, et al.
Publicado: (2025)
Evaluation Ethics of LLMs in Legal Domain
por: Zhang, Ruizhe, et al.
Publicado: (2024)
por: Zhang, Ruizhe, et al.
Publicado: (2024)
ValueSim: Generating Backstories to Model Individual Value Systems
por: Du, Bangde, et al.
Publicado: (2025)
por: Du, Bangde, et al.
Publicado: (2025)
LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods
por: Li, Haitao, et al.
Publicado: (2024)
por: Li, Haitao, et al.
Publicado: (2024)
Enhancing Judgment Document Generation via Agentic Legal Information Collection and Rubric-Guided Optimization
por: Su, Weihang, et al.
Publicado: (2026)
por: Su, Weihang, et al.
Publicado: (2026)
ATACompressor: Adaptive Task-Aware Compression for Efficient Long-Context Processing in LLMs
por: Li, Xuancheng, et al.
Publicado: (2026)
por: Li, Xuancheng, et al.
Publicado: (2026)
Dynamic and Parametric Retrieval-Augmented Generation
por: Su, Weihang, et al.
Publicado: (2025)
por: Su, Weihang, et al.
Publicado: (2025)
LLMs on Trial: Evaluating Judicial Fairness for Large Language Models
por: Hu, Yiran, et al.
Publicado: (2025)
por: Hu, Yiran, et al.
Publicado: (2025)
Capability-aware Prompt Reformulation Learning for Text-to-Image Generation
por: Zhan, Jingtao, et al.
Publicado: (2024)
por: Zhan, Jingtao, et al.
Publicado: (2024)
Relative-Based Scaling Law for Neural Language Models
por: Yue, Baoqing, et al.
Publicado: (2025)
por: Yue, Baoqing, et al.
Publicado: (2025)
Qilin: A Multimodal Information Retrieval Dataset with APP-level User Sessions
por: Chen, Jia, et al.
Publicado: (2025)
por: Chen, Jia, et al.
Publicado: (2025)
Towards Unification of Hallucination Detection and Fact Verification for Large Language Models
por: Su, Weihang, et al.
Publicado: (2025)
por: Su, Weihang, et al.
Publicado: (2025)
LegalOne: A Family of Foundation Models for Reliable Legal Reasoning
por: Li, Haitao, et al.
Publicado: (2026)
por: Li, Haitao, et al.
Publicado: (2026)
LegalAgentBench: Evaluating LLM Agents in Legal Domain
por: Li, Haitao, et al.
Publicado: (2024)
por: Li, Haitao, et al.
Publicado: (2024)
TEC: A Collection of Human Trial-and-error Trajectories for Problem Solving
por: Zhang, Xinkai, et al.
Publicado: (2026)
por: Zhang, Xinkai, et al.
Publicado: (2026)
Decoupling Knowledge and Task Subspaces for Composable Parametric Retrieval Augmented Generation
por: Su, Weihang, et al.
Publicado: (2026)
por: Su, Weihang, et al.
Publicado: (2026)
CaseGen: A Benchmark for Multi-Stage Legal Case Documents Generation
por: Li, Haitao, et al.
Publicado: (2025)
por: Li, Haitao, et al.
Publicado: (2025)
Multi-Field Tool Retrieval
por: Tang, Yichen, et al.
Publicado: (2026)
por: Tang, Yichen, et al.
Publicado: (2026)
Option-ID Based Elimination For Multiple Choice Questions
por: Zhu, Zhenhao, et al.
Publicado: (2025)
por: Zhu, Zhenhao, et al.
Publicado: (2025)
LexRAG: Benchmarking Retrieval-Augmented Generation in Multi-Turn Legal Consultation Conversation
por: Li, Haitao, et al.
Publicado: (2025)
por: Li, Haitao, et al.
Publicado: (2025)
Enhancing LLM-Based Agents via Global Planning and Hierarchical Execution
por: Chen, Junjie, et al.
Publicado: (2025)
por: Chen, Junjie, et al.
Publicado: (2025)
Scaling Laws For Dense Retrieval
por: Fang, Yan, et al.
Publicado: (2024)
por: Fang, Yan, et al.
Publicado: (2024)
BLADE: Benchmarking Language Model Agents for Data-Driven Science
por: Gu, Ken, et al.
Publicado: (2024)
por: Gu, Ken, et al.
Publicado: (2024)
Evaluation of Large Language Models in Legal Applications: Challenges, Methods, and Future Directions
por: Hu, Yiran, et al.
Publicado: (2026)
por: Hu, Yiran, et al.
Publicado: (2026)
Knowledge Editing on Black-box Large Language Models
por: Song, Xiaoshuai, et al.
Publicado: (2024)
por: Song, Xiaoshuai, et al.
Publicado: (2024)
Knowledge Editing through Chain-of-Thought
por: Wang, Changyue, et al.
Publicado: (2024)
por: Wang, Changyue, et al.
Publicado: (2024)
RbFT: Robust Fine-tuning for Retrieval-Augmented Generation against Retrieval Defects
por: Tu, Yiteng, et al.
Publicado: (2025)
por: Tu, Yiteng, et al.
Publicado: (2025)
Decoupling Reasoning and Knowledge Injection for In-Context Knowledge Editing
por: Wang, Changyue, et al.
Publicado: (2025)
por: Wang, Changyue, et al.
Publicado: (2025)
I^3 Retriever: Incorporating Implicit Interaction in Pre-trained Language Models for Passage Retrieval
por: Dong, Qian, et al.
Publicado: (2023)
por: Dong, Qian, et al.
Publicado: (2023)
Evaluating Large Language Models for Evidence-Based Clinical Question Answering
por: Wang, Can, et al.
Publicado: (2025)
por: Wang, Can, et al.
Publicado: (2025)
Ejemplares similares
-
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
por: Su, Weihang, et al.
Publicado: (2024) -
DELTA: Pre-train a Discriminative Encoder for Legal Case Retrieval via Structural Word Alignment
por: Li, Haitao, et al.
Publicado: (2024) -
Mitigating Entity-Level Hallucination in Large Language Models
por: Su, Weihang, et al.
Publicado: (2024) -
LexEval: A Comprehensive Chinese Legal Benchmark for Evaluating Large Language Models
por: Li, Haitao, et al.
Publicado: (2024) -
PRE: A Peer Review Based Large Language Model Evaluator
por: Chu, Zhumin, et al.
Publicado: (2024)