Benchmarking Local LLMs for Natural-Language-to-SQL Querying in Biopharmaceutical Manufacturing: An Empirical Benchmark on Consumer-Grade Hardware
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bhetwal, Sagar, Bastakoti, Rajan, Acharya, Nirajan, Gupta, Gaurav Kumar |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM-Based Support for Diabetes Diagnosis: Opportunities, Scenarios, and Challenges with GPT-5
par: Gupta, Gaurav Kumar, et autres
Publié: (2025)
par: Gupta, Gaurav Kumar, et autres
Publié: (2025)
LLMs in Disease Diagnosis: A Comparative Study of DeepSeek-R1 and O3 Mini Across Chronic Health Conditions
par: Gupta, Gaurav Kumar, et autres
Publié: (2025)
par: Gupta, Gaurav Kumar, et autres
Publié: (2025)
MultiTEND: A Multilingual Benchmark for Natural Language to NoSQL Query Translation
par: Qin, Zhiqian, et autres
Publié: (2025)
par: Qin, Zhiqian, et autres
Publié: (2025)
GraphRAG on Consumer Hardware: Benchmarking Local LLMs for Healthcare EHR Schema Retrieval
par: Fernandes, Peter, et autres
Publié: (2026)
par: Fernandes, Peter, et autres
Publié: (2026)
A Formal Security Framework for MCP-Based AI Agents: Threat Taxonomy, Verification Models, and Defense Mechanisms
par: Acharya, Nirajan, et autres
Publié: (2026)
par: Acharya, Nirajan, et autres
Publié: (2026)
Falcon: A Comprehensive Chinese Text-to-SQL Benchmark for Enterprise-Grade Evaluation
par: Luo, Wenzhen, et autres
Publié: (2025)
par: Luo, Wenzhen, et autres
Publié: (2025)
Do LLMs Understand Social Knowledge? Evaluating the Sociability of Large Language Models with SocKET Benchmark
par: Choi, Minje, et autres
Publié: (2023)
par: Choi, Minje, et autres
Publié: (2023)
Memory Architectures for Multi-Turn Text-to-SQL: A Benchmark and Empirical Study
par: Tummalapenta, Ravi Kumar, et autres
Publié: (2026)
par: Tummalapenta, Ravi Kumar, et autres
Publié: (2026)
IndicDB -- Benchmarking Multilingual Text-to-SQL Capabilities in Indian Languages
par: Dawar, Aviral, et autres
Publié: (2026)
par: Dawar, Aviral, et autres
Publié: (2026)
A Dataset and Benchmark for Consumer Healthcare Question Summarization
par: Basu, Abhishek, et autres
Publié: (2025)
par: Basu, Abhishek, et autres
Publié: (2025)
Do LLMs Overthink Basic Math Reasoning? Benchmarking the Accuracy-Efficiency Tradeoff in Language Models
par: Srivastava, Gaurav, et autres
Publié: (2025)
par: Srivastava, Gaurav, et autres
Publié: (2025)
NATURAL PLAN: Benchmarking LLMs on Natural Language Planning
par: Zheng, Huaixiu Steven, et autres
Publié: (2024)
par: Zheng, Huaixiu Steven, et autres
Publié: (2024)
Bridging the Gap: Transforming Natural Language Questions into SQL Queries via Abstract Query Pattern and Contextual Schema Markup
par: Kong, Yonghui, et autres
Publié: (2025)
par: Kong, Yonghui, et autres
Publié: (2025)
Contextual Spelling Correction with Language Model for Low-resource Setting
par: Luitel, Nishant, et autres
Publié: (2024)
par: Luitel, Nishant, et autres
Publié: (2024)
Decoupling SQL Query Hardness Parsing for Text-to-SQL
par: Yi, Jiawen, et autres
Publié: (2023)
par: Yi, Jiawen, et autres
Publié: (2023)
Datrics Text2SQL: A Framework for Natural Language to SQL Query Generation
par: Gladkykh, Tetiana, et autres
Publié: (2025)
par: Gladkykh, Tetiana, et autres
Publié: (2025)
BEAVER: An Enterprise Benchmark for Text-to-SQL
par: Chen, Peter Baile, et autres
Publié: (2024)
par: Chen, Peter Baile, et autres
Publié: (2024)
SQL Query Engine: A Self-Healing LLM Pipeline for Natural Language to PostgreSQL Translation
par: Ijaz, Muhammad Adeel
Publié: (2026)
par: Ijaz, Muhammad Adeel
Publié: (2026)
Can LLMs Think Like Consumers? Benchmarking Crowd-Level Reaction Reconstruction with ConsumerSimBench
par: Wang, Tianyu, et autres
Publié: (2026)
par: Wang, Tianyu, et autres
Publié: (2026)
Benchmarking LLMs for Environmental Review and Permitting
par: Meyur, Rounak, et autres
Publié: (2024)
par: Meyur, Rounak, et autres
Publié: (2024)
Multilingual Question Answering in Low-Resource Settings: A Dzongkha-English Benchmark for Foundation Models
par: Hosain, Md. Tanzib, et autres
Publié: (2025)
par: Hosain, Md. Tanzib, et autres
Publié: (2025)
Can Perplexity Predict Fine-tuning Performance? An Investigation of Tokenization Effects on Sequential Language Models for Nepali
par: Luitel, Nishant, et autres
Publié: (2024)
par: Luitel, Nishant, et autres
Publié: (2024)
MM-Soc: Benchmarking Multimodal Large Language Models in Social Media Platforms
par: Jin, Yiqiao, et autres
Publié: (2024)
par: Jin, Yiqiao, et autres
Publié: (2024)
PARROT: A Benchmark for Evaluating LLMs in Cross-System SQL Translation
par: Zhou, Wei, et autres
Publié: (2025)
par: Zhou, Wei, et autres
Publié: (2025)
IndicGenBench: A Multilingual Benchmark to Evaluate Generation Capabilities of LLMs on Indic Languages
par: Singh, Harman, et autres
Publié: (2024)
par: Singh, Harman, et autres
Publié: (2024)
Hindi-BEIR : A Large Scale Retrieval Benchmark in Hindi
par: Acharya, Arkadeep, et autres
Publié: (2024)
par: Acharya, Arkadeep, et autres
Publié: (2024)
HLB: Benchmarking LLMs' Humanlikeness in Language Use
par: Duan, Xufeng, et autres
Publié: (2024)
par: Duan, Xufeng, et autres
Publié: (2024)
SQL-Exchange: Transforming SQL Queries Across Domains
par: Daviran, Mohammadreza, et autres
Publié: (2025)
par: Daviran, Mohammadreza, et autres
Publié: (2025)
QUIETT: Query-Independent Table Transformation for Robust Reasoning
par: Najpande, Gaurav, et autres
Publié: (2026)
par: Najpande, Gaurav, et autres
Publié: (2026)
Understanding the Effects of Noise in Text-to-SQL: An Examination of the BIRD-Bench Benchmark
par: Wretblad, Niklas, et autres
Publié: (2024)
par: Wretblad, Niklas, et autres
Publié: (2024)
CLARITY: A Framework and Benchmark for Conversational Language Ambiguity and Unanswerability in Interactive NL2SQL Systems
par: Sarwar, Tabinda, et autres
Publié: (2026)
par: Sarwar, Tabinda, et autres
Publié: (2026)
Query and Conquer: Execution-Guided SQL Generation
par: Borchmann, Łukasz, et autres
Publié: (2025)
par: Borchmann, Łukasz, et autres
Publié: (2025)
Faithful Summarization of Consumer Health Queries: A Cross-Lingual Framework with LLMs
par: Abrar, Ajwad, et autres
Publié: (2025)
par: Abrar, Ajwad, et autres
Publié: (2025)
From Natural Language to SQL: Review of LLM-based Text-to-SQL Systems
par: Mohammadjafari, Ali, et autres
Publié: (2024)
par: Mohammadjafari, Ali, et autres
Publié: (2024)
GEMMA-SQL: A Novel Text-to-SQL Model Based on Large Language Models
par: Pandey, Hari Mohan, et autres
Publié: (2025)
par: Pandey, Hari Mohan, et autres
Publié: (2025)
A MISMATCHED Benchmark for Scientific Natural Language Inference
par: Shaik, Firoz, et autres
Publié: (2025)
par: Shaik, Firoz, et autres
Publié: (2025)
TailorSQL: An NL2SQL System Tailored to Your Query Workload
par: Vaidya, Kapil, et autres
Publié: (2025)
par: Vaidya, Kapil, et autres
Publié: (2025)
LocalBench: Benchmarking LLMs on County-Level Local Knowledge and Reasoning
par: Gao, Zihan, et autres
Publié: (2025)
par: Gao, Zihan, et autres
Publié: (2025)
QCoder Benchmark: Bridging Language Generation and Quantum Hardware through Simulator-Based Feedback
par: Mikuriya, Taku, et autres
Publié: (2025)
par: Mikuriya, Taku, et autres
Publié: (2025)
Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages
par: Naous, Tarek, et autres
Publié: (2025)
par: Naous, Tarek, et autres
Publié: (2025)
Documents similaires
-
LLM-Based Support for Diabetes Diagnosis: Opportunities, Scenarios, and Challenges with GPT-5
par: Gupta, Gaurav Kumar, et autres
Publié: (2025) -
LLMs in Disease Diagnosis: A Comparative Study of DeepSeek-R1 and O3 Mini Across Chronic Health Conditions
par: Gupta, Gaurav Kumar, et autres
Publié: (2025) -
MultiTEND: A Multilingual Benchmark for Natural Language to NoSQL Query Translation
par: Qin, Zhiqian, et autres
Publié: (2025) -
GraphRAG on Consumer Hardware: Benchmarking Local LLMs for Healthcare EHR Schema Retrieval
par: Fernandes, Peter, et autres
Publié: (2026) -
A Formal Security Framework for MCP-Based AI Agents: Threat Taxonomy, Verification Models, and Defense Mechanisms
par: Acharya, Nirajan, et autres
Publié: (2026)