BLADE: Enhancing Black-box Large Language Models with Small Domain-Specific Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Haitao, Ai, Qingyao, Chen, Jia, Dong, Qian, Wu, Zhijing, Liu, Yiqun, Chen, Chong, Tian, Qi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
Mitigating Entity-Level Hallucination in Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
DELTA: Pre-train a Discriminative Encoder for Legal Case Retrieval via Structural Word Alignment
di: Li, Haitao, et al.
Pubblicazione: (2024)
di: Li, Haitao, et al.
Pubblicazione: (2024)
LexEval: A Comprehensive Chinese Legal Benchmark for Evaluating Large Language Models
di: Li, Haitao, et al.
Pubblicazione: (2024)
di: Li, Haitao, et al.
Pubblicazione: (2024)
PRE: A Peer Review Based Large Language Model Evaluator
di: Chu, Zhumin, et al.
Pubblicazione: (2024)
di: Chu, Zhumin, et al.
Pubblicazione: (2024)
Unsupervised Real-Time Hallucination Detection based on the Internal States of Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
Improve Large Language Model Systems with User Logs
di: Wang, Changyue, et al.
Pubblicazione: (2026)
di: Wang, Changyue, et al.
Pubblicazione: (2026)
Joint Evaluation of Answer and Reasoning Consistency for Hallucination Detection in Large Reasoning Models
di: Wang, Changyue, et al.
Pubblicazione: (2025)
di: Wang, Changyue, et al.
Pubblicazione: (2025)
Overview of the NTCIR-18 Automatic Evaluation of LLMs (AEOLLM) Task
di: Chen, Junjie, et al.
Pubblicazione: (2025)
di: Chen, Junjie, et al.
Pubblicazione: (2025)
CalibraEval: Calibrating Prediction Distribution to Mitigate Selection Bias in LLMs-as-Judges
di: Li, Haitao, et al.
Pubblicazione: (2024)
di: Li, Haitao, et al.
Pubblicazione: (2024)
Unsupervised Large Language Model Alignment for Information Retrieval via Contrastive Feedback
di: Dong, Qian, et al.
Pubblicazione: (2023)
di: Dong, Qian, et al.
Pubblicazione: (2023)
Evaluation Ethics of LLMs in Legal Domain
di: Zhang, Ruizhe, et al.
Pubblicazione: (2024)
di: Zhang, Ruizhe, et al.
Pubblicazione: (2024)
ValueSim: Generating Backstories to Model Individual Value Systems
di: Du, Bangde, et al.
Pubblicazione: (2025)
di: Du, Bangde, et al.
Pubblicazione: (2025)
Enhancing Judgment Document Generation via Agentic Legal Information Collection and Rubric-Guided Optimization
di: Su, Weihang, et al.
Pubblicazione: (2026)
di: Su, Weihang, et al.
Pubblicazione: (2026)
LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods
di: Li, Haitao, et al.
Pubblicazione: (2024)
di: Li, Haitao, et al.
Pubblicazione: (2024)
ATACompressor: Adaptive Task-Aware Compression for Efficient Long-Context Processing in LLMs
di: Li, Xuancheng, et al.
Pubblicazione: (2026)
di: Li, Xuancheng, et al.
Pubblicazione: (2026)
Dynamic and Parametric Retrieval-Augmented Generation
di: Su, Weihang, et al.
Pubblicazione: (2025)
di: Su, Weihang, et al.
Pubblicazione: (2025)
LLMs on Trial: Evaluating Judicial Fairness for Large Language Models
di: Hu, Yiran, et al.
Pubblicazione: (2025)
di: Hu, Yiran, et al.
Pubblicazione: (2025)
Towards Unification of Hallucination Detection and Fact Verification for Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2025)
di: Su, Weihang, et al.
Pubblicazione: (2025)
Relative-Based Scaling Law for Neural Language Models
di: Yue, Baoqing, et al.
Pubblicazione: (2025)
di: Yue, Baoqing, et al.
Pubblicazione: (2025)
Capability-aware Prompt Reformulation Learning for Text-to-Image Generation
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
LegalOne: A Family of Foundation Models for Reliable Legal Reasoning
di: Li, Haitao, et al.
Pubblicazione: (2026)
di: Li, Haitao, et al.
Pubblicazione: (2026)
TEC: A Collection of Human Trial-and-error Trajectories for Problem Solving
di: Zhang, Xinkai, et al.
Pubblicazione: (2026)
di: Zhang, Xinkai, et al.
Pubblicazione: (2026)
Decoupling Knowledge and Task Subspaces for Composable Parametric Retrieval Augmented Generation
di: Su, Weihang, et al.
Pubblicazione: (2026)
di: Su, Weihang, et al.
Pubblicazione: (2026)
Qilin: A Multimodal Information Retrieval Dataset with APP-level User Sessions
di: Chen, Jia, et al.
Pubblicazione: (2025)
di: Chen, Jia, et al.
Pubblicazione: (2025)
LegalAgentBench: Evaluating LLM Agents in Legal Domain
di: Li, Haitao, et al.
Pubblicazione: (2024)
di: Li, Haitao, et al.
Pubblicazione: (2024)
BLADE: Benchmarking Language Model Agents for Data-Driven Science
di: Gu, Ken, et al.
Pubblicazione: (2024)
di: Gu, Ken, et al.
Pubblicazione: (2024)
CaseGen: A Benchmark for Multi-Stage Legal Case Documents Generation
di: Li, Haitao, et al.
Pubblicazione: (2025)
di: Li, Haitao, et al.
Pubblicazione: (2025)
Knowledge Editing on Black-box Large Language Models
di: Song, Xiaoshuai, et al.
Pubblicazione: (2024)
di: Song, Xiaoshuai, et al.
Pubblicazione: (2024)
Multi-Field Tool Retrieval
di: Tang, Yichen, et al.
Pubblicazione: (2026)
di: Tang, Yichen, et al.
Pubblicazione: (2026)
Option-ID Based Elimination For Multiple Choice Questions
di: Zhu, Zhenhao, et al.
Pubblicazione: (2025)
di: Zhu, Zhenhao, et al.
Pubblicazione: (2025)
Evaluating Large Language Models for Evidence-Based Clinical Question Answering
di: Wang, Can, et al.
Pubblicazione: (2025)
di: Wang, Can, et al.
Pubblicazione: (2025)
MIST: Jailbreaking Black-box Large Language Models via Iterative Semantic Tuning
di: Zheng, Muyang, et al.
Pubblicazione: (2025)
di: Zheng, Muyang, et al.
Pubblicazione: (2025)
LexRAG: Benchmarking Retrieval-Augmented Generation in Multi-Turn Legal Consultation Conversation
di: Li, Haitao, et al.
Pubblicazione: (2025)
di: Li, Haitao, et al.
Pubblicazione: (2025)
Enhancing LLM-Based Agents via Global Planning and Hierarchical Execution
di: Chen, Junjie, et al.
Pubblicazione: (2025)
di: Chen, Junjie, et al.
Pubblicazione: (2025)
Scaling Laws For Dense Retrieval
di: Fang, Yan, et al.
Pubblicazione: (2024)
di: Fang, Yan, et al.
Pubblicazione: (2024)
Evaluation of Large Language Models in Legal Applications: Challenges, Methods, and Future Directions
di: Hu, Yiran, et al.
Pubblicazione: (2026)
di: Hu, Yiran, et al.
Pubblicazione: (2026)
Knowledge Editing through Chain-of-Thought
di: Wang, Changyue, et al.
Pubblicazione: (2024)
di: Wang, Changyue, et al.
Pubblicazione: (2024)
CBP-Tuning: Efficient Local Customization for Black-box Large Language Models
di: Zhao, Jiaxuan, et al.
Pubblicazione: (2025)
di: Zhao, Jiaxuan, et al.
Pubblicazione: (2025)
Cross-Domain Content Generation with Domain-Specific Small Language Models
di: Maloo, Ankit, et al.
Pubblicazione: (2024)
di: Maloo, Ankit, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024) -
Mitigating Entity-Level Hallucination in Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024) -
DELTA: Pre-train a Discriminative Encoder for Legal Case Retrieval via Structural Word Alignment
di: Li, Haitao, et al.
Pubblicazione: (2024) -
LexEval: A Comprehensive Chinese Legal Benchmark for Evaluating Large Language Models
di: Li, Haitao, et al.
Pubblicazione: (2024) -
PRE: A Peer Review Based Large Language Model Evaluator
di: Chu, Zhumin, et al.
Pubblicazione: (2024)