Benchmarking Large Language Models for Quebec Insurance: From Closed-Book to Retrieval-Augmented Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Beauchemin, David, Khoury, Richard |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Quebec Automobile Insurance Question-Answering With Retrieval-Augmented Generation
by: Beauchemin, David, et al.
Published: (2024)
by: Beauchemin, David, et al.
Published: (2024)
QFrCoLA: a Quebec-French Corpus of Linguistic Acceptability Judgments
by: Beauchemin, David, et al.
Published: (2025)
by: Beauchemin, David, et al.
Published: (2025)
QFrBLiMP: a Quebec-French Benchmark of Linguistic Minimal Pairs
by: Beauchemin, David, et al.
Published: (2025)
by: Beauchemin, David, et al.
Published: (2025)
COLE: a Comprehensive Benchmark for French Language Understanding Evaluation
by: Beauchemin, David, et al.
Published: (2025)
by: Beauchemin, David, et al.
Published: (2025)
Idiom Understanding as a Tool to Measure the Dialect Gap
by: Beauchemin, David, et al.
Published: (2025)
by: Beauchemin, David, et al.
Published: (2025)
JUDGEBERT: Assessing Legal Meaning Preservation Between Sentences
by: Beauchemin, David, et al.
Published: (2025)
by: Beauchemin, David, et al.
Published: (2025)
LIT-RAGBench: Benchmarking Generator Capabilities of Large Language Models in Retrieval-Augmented Generation
by: Itai, Koki, et al.
Published: (2026)
by: Itai, Koki, et al.
Published: (2026)
Experiments with Large Language Models on Retrieval-Augmented Generation for Closed-Source Simulation Software
by: Baumann, Andreas, et al.
Published: (2025)
by: Baumann, Andreas, et al.
Published: (2025)
CRUD-RAG: A Comprehensive Chinese Benchmark for Retrieval-Augmented Generation of Large Language Models
by: Lyu, Yuanjie, et al.
Published: (2024)
by: Lyu, Yuanjie, et al.
Published: (2024)
INSEva: A Comprehensive Chinese Benchmark for Large Language Models in Insurance
by: Chen, Shisong, et al.
Published: (2025)
by: Chen, Shisong, et al.
Published: (2025)
Auto-RAG: Autonomous Retrieval-Augmented Generation for Large Language Models
by: Yu, Tian, et al.
Published: (2024)
by: Yu, Tian, et al.
Published: (2024)
Retrieval Augmented Generation based Large Language Models for Causality Mining
by: Naduvilakandy, Thushara Manjari, et al.
Published: (2025)
by: Naduvilakandy, Thushara Manjari, et al.
Published: (2025)
A Survey on Retrieval And Structuring Augmented Generation with Large Language Models
by: Jiang, Pengcheng, et al.
Published: (2025)
by: Jiang, Pengcheng, et al.
Published: (2025)
Adapting Large Language Models for Multi-Domain Retrieval-Augmented-Generation
by: Misrahi, Alexandre, et al.
Published: (2025)
by: Misrahi, Alexandre, et al.
Published: (2025)
Towards Comprehensive Vietnamese Retrieval-Augmented Generation and Large Language Models
by: Duc, Nguyen Quang, et al.
Published: (2024)
by: Duc, Nguyen Quang, et al.
Published: (2024)
Evaluating Cultural Knowledge Processing in Large Language Models: A Cognitive Benchmarking Framework Integrating Retrieval-Augmented Generation
by: Lee, Hung-Shin, et al.
Published: (2025)
by: Lee, Hung-Shin, et al.
Published: (2025)
Benchmarking Retrieval-Augmented Large Language Models in Biomedical NLP: Application, Robustness, and Self-Awareness
by: Li, Mingchen, et al.
Published: (2024)
by: Li, Mingchen, et al.
Published: (2024)
Retrieval-Augmented Generation for Large Language Models: A Survey
by: Gao, Yunfan, et al.
Published: (2023)
by: Gao, Yunfan, et al.
Published: (2023)
Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models
by: Li, Jiatao, et al.
Published: (2024)
by: Li, Jiatao, et al.
Published: (2024)
Rethinking Retrieval: From Traditional Retrieval Augmented Generation to Agentic and Non-Vector Reasoning Systems in the Financial Domain for Large Language Models
by: Lumer, Elias, et al.
Published: (2025)
by: Lumer, Elias, et al.
Published: (2025)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
by: Abolghasemi, Amin, et al.
Published: (2024)
by: Abolghasemi, Amin, et al.
Published: (2024)
Design, Results and Industry Implications of the World's First Insurance Large Language Model Evaluation Benchmark
by: Zhou, Hua, et al.
Published: (2025)
by: Zhou, Hua, et al.
Published: (2025)
TP-RAG: Benchmarking Retrieval-Augmented Large Language Model Agents for Spatiotemporal-Aware Travel Planning
by: Ni, Hang, et al.
Published: (2025)
by: Ni, Hang, et al.
Published: (2025)
Neural Machine Translation for Coptic-French: Strategies for Low-Resource Ancient Languages
by: Chaoui, Nasma, et al.
Published: (2025)
by: Chaoui, Nasma, et al.
Published: (2025)
Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models
by: Huang, Chengkai, et al.
Published: (2024)
by: Huang, Chengkai, et al.
Published: (2024)
URAG: A Benchmark for Uncertainty Quantification in Retrieval-Augmented Large Language Models
by: Nguyen, Vinh, et al.
Published: (2026)
by: Nguyen, Vinh, et al.
Published: (2026)
Coordinated Semantic Alignment and Evidence Constraints for Retrieval-Augmented Generation with Large Language Models
by: Chen, Xin, et al.
Published: (2026)
by: Chen, Xin, et al.
Published: (2026)
After Retrieval, Before Generation: Enhancing the Trustworthiness of Large Language Models in Retrieval-Augmented Generation
by: Dai, Xinbang, et al.
Published: (2025)
by: Dai, Xinbang, et al.
Published: (2025)
Enhancing Pancreatic Cancer Staging with Large Language Models: The Role of Retrieval-Augmented Generation
by: Johno, Hisashi, et al.
Published: (2025)
by: Johno, Hisashi, et al.
Published: (2025)
Retrieval Augmented Generation Evaluation in the Era of Large Language Models: A Comprehensive Survey
by: Gan, Aoran, et al.
Published: (2025)
by: Gan, Aoran, et al.
Published: (2025)
Metacognitive Retrieval-Augmented Large Language Models
by: Zhou, Yujia, et al.
Published: (2024)
by: Zhou, Yujia, et al.
Published: (2024)
Benchmarking Retrieval-Augmented Generation for Medicine
by: Xiong, Guangzhi, et al.
Published: (2024)
by: Xiong, Guangzhi, et al.
Published: (2024)
Comparison of Text-Based and Image-Based Retrieval in Multimodal Retrieval Augmented Generation Large Language Model Systems
by: Lumer, Elias, et al.
Published: (2025)
by: Lumer, Elias, et al.
Published: (2025)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
by: Ding, Jing, et al.
Published: (2025)
by: Ding, Jing, et al.
Published: (2025)
Advancing Retrieval-Augmented Generation for Persian: Development of Language Models, Comprehensive Benchmarks, and Best Practices for Optimization
by: Hosseinbeigi, Sara Bourbour, et al.
Published: (2025)
by: Hosseinbeigi, Sara Bourbour, et al.
Published: (2025)
BERGEN: A Benchmarking Library for Retrieval-Augmented Generation
by: Rau, David, et al.
Published: (2024)
by: Rau, David, et al.
Published: (2024)
RARE: Retrieval-Augmented Reasoning Enhancement for Large Language Models
by: Tran, Hieu, et al.
Published: (2024)
by: Tran, Hieu, et al.
Published: (2024)
Entropy-Based Decoding for Retrieval-Augmented Large Language Models
by: Qiu, Zexuan, et al.
Published: (2024)
by: Qiu, Zexuan, et al.
Published: (2024)
Multimodal Retrieval-Augmented Generation with Large Language Models for Medical VQA
by: Karim, A H M Rezaul, et al.
Published: (2025)
by: Karim, A H M Rezaul, et al.
Published: (2025)
Contextual Compression in Retrieval-Augmented Generation for Large Language Models: A Survey
by: Verma, Sourav
Published: (2024)
by: Verma, Sourav
Published: (2024)
Similar Items
-
Quebec Automobile Insurance Question-Answering With Retrieval-Augmented Generation
by: Beauchemin, David, et al.
Published: (2024) -
QFrCoLA: a Quebec-French Corpus of Linguistic Acceptability Judgments
by: Beauchemin, David, et al.
Published: (2025) -
QFrBLiMP: a Quebec-French Benchmark of Linguistic Minimal Pairs
by: Beauchemin, David, et al.
Published: (2025) -
COLE: a Comprehensive Benchmark for French Language Understanding Evaluation
by: Beauchemin, David, et al.
Published: (2025) -
Idiom Understanding as a Tool to Measure the Dialect Gap
by: Beauchemin, David, et al.
Published: (2025)