Better Bill GPT: Comparing Large Language Models against Legal Invoice Reviewers
Fuente:
arXiv
Saved in:
| Main Authors: | Whitehouse, Nick, Lincoln, Nicole, Yiu, Stephanie, Catterson, Lizzie, Perera, Rivindu |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Better Call GPT, Comparing Large Language Models Against Lawyers
by: Martin, Lauren, et al.
Published: (2024)
by: Martin, Lauren, et al.
Published: (2024)
A Few Good Clauses: Comparing LLMs vs Domain-Trained Small Language Models on Structured Contract Extraction
by: Lincoln, Nicole, et al.
Published: (2026)
by: Lincoln, Nicole, et al.
Published: (2026)
Information Extraction from Electricity Invoices with General-Purpose Large Language Models
by: Gómez, Javier, et al.
Published: (2026)
by: Gómez, Javier, et al.
Published: (2026)
ChatGPT Alternative Solutions: Large Language Models Survey
by: Alipour, Hanieh, et al.
Published: (2024)
by: Alipour, Hanieh, et al.
Published: (2024)
AnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators
by: He, Xingwei, et al.
Published: (2023)
by: He, Xingwei, et al.
Published: (2023)
Towards Knowledge-Grounded Natural Language Understanding and Generation
by: Whitehouse, Chenxi
Published: (2024)
by: Whitehouse, Chenxi
Published: (2024)
LawGPT: A Chinese Legal Knowledge-Enhanced Large Language Model
by: Zhou, Zhi, et al.
Published: (2024)
by: Zhou, Zhi, et al.
Published: (2024)
HumanEval on Latest GPT Models -- 2024
by: Li, Daniel, et al.
Published: (2024)
by: Li, Daniel, et al.
Published: (2024)
TimeBill: Time-Budgeted Inference for Large Language Models
by: Fan, Qi, et al.
Published: (2025)
by: Fan, Qi, et al.
Published: (2025)
Large Legal Fictions: Profiling Legal Hallucinations in Large Language Models
by: Dahl, Matthew, et al.
Published: (2024)
by: Dahl, Matthew, et al.
Published: (2024)
ChiMed-GPT: A Chinese Medical Large Language Model with Full Training Regime and Better Alignment to Human Preferences
by: Tian, Yuanhe, et al.
Published: (2023)
by: Tian, Yuanhe, et al.
Published: (2023)
Enhancing Systematic Reviews with Large Language Models: Using GPT-4 and Kimi
by: Kaptur, Dandan Chen, et al.
Published: (2025)
by: Kaptur, Dandan Chen, et al.
Published: (2025)
Evaluating Telugu Proficiency in Large Language Models_ A Comparative Analysis of ChatGPT and Gemini
by: Kishore, Katikela Sreeharsha, et al.
Published: (2024)
by: Kishore, Katikela Sreeharsha, et al.
Published: (2024)
FedJudge: Federated Legal Large Language Model
by: Yue, Linan, et al.
Published: (2023)
by: Yue, Linan, et al.
Published: (2023)
Caveat Lector: Large Language Models in Legal Practice
by: Mik, Eliza
Published: (2024)
by: Mik, Eliza
Published: (2024)
Jointly Fine-Tuning "BERT-like" Self Supervised Models to Improve Multimodal Speech Emotion Recognition
by: Siriwardhana, Shamane, et al.
Published: (2020)
by: Siriwardhana, Shamane, et al.
Published: (2020)
Comparing GPT-4 and Open-Source Language Models in Misinformation Mitigation
by: Vergho, Tyler, et al.
Published: (2024)
by: Vergho, Tyler, et al.
Published: (2024)
Legal Evalutions and Challenges of Large Language Models
by: Wang, Jiaqi, et al.
Published: (2024)
by: Wang, Jiaqi, et al.
Published: (2024)
AceGPT, Localizing Large Language Models in Arabic
by: Huang, Huang, et al.
Published: (2023)
by: Huang, Huang, et al.
Published: (2023)
An Explicit Syllogistic Legal Reasoning Framework for Large Language Models
by: Zhang, Kepu, et al.
Published: (2025)
by: Zhang, Kepu, et al.
Published: (2025)
PoliLegalLM: A Technical Report on a Large Language Model for Political and Legal Affairs
by: Huang, Yuting, et al.
Published: (2026)
by: Huang, Yuting, et al.
Published: (2026)
Fine-tune the Entire RAG Architecture (including DPR retriever) for Question-Answering
by: Siriwardhana, Shamane, et al.
Published: (2021)
by: Siriwardhana, Shamane, et al.
Published: (2021)
Rethinking Tokenization: Crafting Better Tokenizers for Large Language Models
by: Yang, Jinbiao
Published: (2024)
by: Yang, Jinbiao
Published: (2024)
PRobELM: Plausibility Ranking Evaluation for Language Models
by: Yuan, Zhangdie, et al.
Published: (2024)
by: Yuan, Zhangdie, et al.
Published: (2024)
Assessing the Reliability of Large Language Models for Deductive Qualitative Coding: A Comparative Study of ChatGPT Interventions
by: Hila, Angjelin, et al.
Published: (2025)
by: Hila, Angjelin, et al.
Published: (2025)
Interpreting and Improving Large Language Models in Arithmetic Calculation
by: Zhang, Wei, et al.
Published: (2024)
by: Zhang, Wei, et al.
Published: (2024)
Comparing the Efficacy of GPT-4 and Chat-GPT in Mental Health Care: A Blind Assessment of Large Language Models for Psychological Support
by: Moell, Birger
Published: (2024)
by: Moell, Birger
Published: (2024)
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
by: Bethany, Mazal, et al.
Published: (2024)
by: Bethany, Mazal, et al.
Published: (2024)
LAiW: A Chinese Legal Large Language Models Benchmark
by: Dai, Yongfu, et al.
Published: (2023)
by: Dai, Yongfu, et al.
Published: (2023)
The Large Language Model GreekLegalRoBERTa
by: Saketos, Vasileios, et al.
Published: (2024)
by: Saketos, Vasileios, et al.
Published: (2024)
Making Large Language Models Better Reasoners with Orchestrated Streaming Experiences
by: Liu, Xiangyang, et al.
Published: (2025)
by: Liu, Xiangyang, et al.
Published: (2025)
Advantageous Parameter Expansion Training Makes Better Large Language Models
by: Gu, Naibin, et al.
Published: (2025)
by: Gu, Naibin, et al.
Published: (2025)
PclGPT: A Large Language Model for Patronizing and Condescending Language Detection
by: Wang, Hongbo, et al.
Published: (2024)
by: Wang, Hongbo, et al.
Published: (2024)
Making Large Language Models Perform Better in Knowledge Graph Completion
by: Zhang, Yichi, et al.
Published: (2023)
by: Zhang, Yichi, et al.
Published: (2023)
Better & Faster Large Language Models via Multi-token Prediction
by: Gloeckle, Fabian, et al.
Published: (2024)
by: Gloeckle, Fabian, et al.
Published: (2024)
Large Language Models and Book Summarization: Reading or Remembering, Which Is Better?
by: Fu, Tairan, et al.
Published: (2026)
by: Fu, Tairan, et al.
Published: (2026)
GPT-Fathom: Benchmarking Large Language Models to Decipher the Evolutionary Path towards GPT-4 and Beyond
by: Zheng, Shen, et al.
Published: (2023)
by: Zheng, Shen, et al.
Published: (2023)
Beyond Scale: Small Language Models are Comparable to GPT-4 in Mental Health Understanding
by: Jia, Hong, et al.
Published: (2025)
by: Jia, Hong, et al.
Published: (2025)
Multi-Modal Vision vs. Text-Based Parsing: Benchmarking LLM Strategies for Invoice Processing
by: Berghaus, David, et al.
Published: (2025)
by: Berghaus, David, et al.
Published: (2025)
LegalMidm: Use-Case-Driven Legal Domain Specialization for Korean Large Language Model
by: Jang, Youngjoon, et al.
Published: (2026)
by: Jang, Youngjoon, et al.
Published: (2026)
Similar Items
-
Better Call GPT, Comparing Large Language Models Against Lawyers
by: Martin, Lauren, et al.
Published: (2024) -
A Few Good Clauses: Comparing LLMs vs Domain-Trained Small Language Models on Structured Contract Extraction
by: Lincoln, Nicole, et al.
Published: (2026) -
Information Extraction from Electricity Invoices with General-Purpose Large Language Models
by: Gómez, Javier, et al.
Published: (2026) -
ChatGPT Alternative Solutions: Large Language Models Survey
by: Alipour, Hanieh, et al.
Published: (2024) -
AnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators
by: He, Xingwei, et al.
Published: (2023)