Towards AI Evaluation in Domain-Specific RAG Systems: The AgriHubi Case Study
Fuente:
arXiv
Saved in:
| Main Authors: | Hasan, Md. Toufique, Khan, Ayman Asad, Saari, Mika, Bankhele, Vaishnavi, Abrahamsson, Pekka |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Engineering RAG Systems for Real-World Applications: Design, Development, and Evaluation
by: Hasan, Md Toufique, et al.
Published: (2025)
by: Hasan, Md Toufique, et al.
Published: (2025)
Developing Retrieval Augmented Generation (RAG) based LLM Systems from PDFs: An Experience Report
by: Khan, Ayman Asad, et al.
Published: (2024)
by: Khan, Ayman Asad, et al.
Published: (2024)
Experimenting with Multi-Agent Software Development: Towards a Unified Platform
by: Sami, Malik Abdul, et al.
Published: (2024)
by: Sami, Malik Abdul, et al.
Published: (2024)
LLM-Based Multi-Agent Systems for Code Generation: A Multi-Vocal Literature Review
by: Rasheeda, Zeeshan, et al.
Published: (2026)
by: Rasheeda, Zeeshan, et al.
Published: (2026)
Engineering a Governance-Aware AI Sandbox: Design, Implementation, and Lessons Learned
by: Waseem, Muhammad, et al.
Published: (2026)
by: Waseem, Muhammad, et al.
Published: (2026)
A Methodology for Evaluating RAG Systems: A Case Study On Configuration Dependency Validation
by: Simon, Sebastian, et al.
Published: (2024)
by: Simon, Sebastian, et al.
Published: (2024)
From Specification to Service: Accelerating API-First Development Using Multi-Agent Systems
by: Chauhan, Saurabh, et al.
Published: (2025)
by: Chauhan, Saurabh, et al.
Published: (2025)
LLM-based Multi-Agent System for Intelligent Refactoring of Haskell Code
by: Siddeeq, Shahbaz, et al.
Published: (2025)
by: Siddeeq, Shahbaz, et al.
Published: (2025)
Agentic Frameworks for Reasoning Tasks: An Empirical Study
by: Rasheed, Zeeshan, et al.
Published: (2026)
by: Rasheed, Zeeshan, et al.
Published: (2026)
Distributed Approach to Haskell Based Applications Refactoring with LLMs Based Multi-Agent Systems
by: Siddeeq, Shahbaz, et al.
Published: (2025)
by: Siddeeq, Shahbaz, et al.
Published: (2025)
System for systematic literature review using multiple AI agents: Concept and an empirical evaluation
by: Sami, Abdul Malik, et al.
Published: (2024)
by: Sami, Abdul Malik, et al.
Published: (2024)
TimeLess: A Vision for the Next Generation of Software Development
by: Rasheed, Zeeshan, et al.
Published: (2024)
by: Rasheed, Zeeshan, et al.
Published: (2024)
CodePori: Large-Scale System for Autonomous Software Development Using Multi-Agent Technology
by: Rasheed, Zeeshan, et al.
Published: (2024)
by: Rasheed, Zeeshan, et al.
Published: (2024)
Large Language Model Evaluation Via Multi AI Agents: Preliminary results
by: Rasheed, Zeeshan, et al.
Published: (2024)
by: Rasheed, Zeeshan, et al.
Published: (2024)
VAPU: System for Autonomous Legacy Code Modernization
by: Ala-Salmi, Valtteri, et al.
Published: (2025)
by: Ala-Salmi, Valtteri, et al.
Published: (2025)
Context Before Code: An Experience Report on Vibe Coding in Practice
by: Shuvo, Md Nasir Uddin, et al.
Published: (2026)
by: Shuvo, Md Nasir Uddin, et al.
Published: (2026)
An Empirical Study of Multi-Agent RAG for Real-World University Admissions Counseling
by: Nguyen-Duc, Anh, et al.
Published: (2025)
by: Nguyen-Duc, Anh, et al.
Published: (2025)
Leveraging Graph-RAG and Prompt Engineering to Enhance LLM-Based Automated Requirement Traceability and Compliance Checks
by: Masoudifard, Arsalan, et al.
Published: (2024)
by: Masoudifard, Arsalan, et al.
Published: (2024)
Autonomous Legacy Web Application Upgrades Using a Multi-Agent System
by: Ala-Salmi, Valtteri, et al.
Published: (2025)
by: Ala-Salmi, Valtteri, et al.
Published: (2025)
Towards Analysing Invoices and Receipts with Amazon Textract
by: Oommen, Sneha, et al.
Published: (2025)
by: Oommen, Sneha, et al.
Published: (2025)
The EU AI Act is a good start but falls short
by: Sillberg, Chalisa Veesommai, et al.
Published: (2024)
by: Sillberg, Chalisa Veesommai, et al.
Published: (2024)
Assessing Small Language Models for Code Generation: An Empirical Study with Benchmarks
by: Hasan, Md Mahade, et al.
Published: (2025)
by: Hasan, Md Mahade, et al.
Published: (2025)
Evaluating LLM-Based Mobile App Recommendations: An Empirical Study
by: Motger, Quim, et al.
Published: (2025)
by: Motger, Quim, et al.
Published: (2025)
CodeRAG: Finding Relevant and Necessary Knowledge for Retrieval-Augmented Repository-Level Code Completion
by: Zhang, Sheng, et al.
Published: (2025)
by: Zhang, Sheng, et al.
Published: (2025)
AI-assisted Coding with Cody: Lessons from Context Retrieval and Evaluation for Code Recommendations
by: Hartman, Jan, et al.
Published: (2024)
by: Hartman, Jan, et al.
Published: (2024)
Domain-Specific Retrieval-Augmented Generation Using Vector Stores, Knowledge Graphs, and Tensor Factorization
by: Barron, Ryan C., et al.
Published: (2024)
by: Barron, Ryan C., et al.
Published: (2024)
AI based Multiagent Approach for Requirements Elicitation and Analysis
by: Sami, Malik Abdul, et al.
Published: (2024)
by: Sami, Malik Abdul, et al.
Published: (2024)
AI and Agile Software Development: A Research Roadmap from the XP2025 Workshop
by: Zhang, Zheying, et al.
Published: (2025)
by: Zhang, Zheying, et al.
Published: (2025)
A Tool for Test Case Scenarios Generation Using Large Language Models
by: Sami, Abdul Malik, et al.
Published: (2024)
by: Sami, Abdul Malik, et al.
Published: (2024)
Generative AI Adoption in an Energy Company: Exploring Challenges and Use Cases
by: Sami, Malik Abdul, et al.
Published: (2026)
by: Sami, Malik Abdul, et al.
Published: (2026)
Enhancing Open-Domain Task-Solving Capability of LLMs via Autonomous Tool Integration from GitHub
by: Lyu, Bohan, et al.
Published: (2023)
by: Lyu, Bohan, et al.
Published: (2023)
What About Emotions? Guiding Fine-Grained Emotion Extraction from Mobile App Reviews
by: Motger, Quim, et al.
Published: (2025)
by: Motger, Quim, et al.
Published: (2025)
MGS3: A Multi-Granularity Self-Supervised Code Search Framework
by: Li, Rui, et al.
Published: (2025)
by: Li, Rui, et al.
Published: (2025)
Incremental Analysis of Legacy Applications Using Knowledge Graphs for Application Modernization
by: Krishnan, Saravanan, et al.
Published: (2025)
by: Krishnan, Saravanan, et al.
Published: (2025)
FLOWER: Flow-Oriented Entity-Relationship Tool
by: Moskalev, Dmitry
Published: (2025)
by: Moskalev, Dmitry
Published: (2025)
GNN-Coder: Boosting Semantic Code Retrieval with Combined GNNs and Transformer
by: Ye, Yufan, et al.
Published: (2025)
by: Ye, Yufan, et al.
Published: (2025)
Use as Directed? A Comparison of Software Tools Intended to Check Rigor and Transparency of Published Work
by: Eckmann, Peter, et al.
Published: (2025)
by: Eckmann, Peter, et al.
Published: (2025)
SBAN: A Framework & Multi-Dimensional Dataset for Large Language Model Pre-Training and Software Code Mining
by: Jelodar, Hamed, et al.
Published: (2025)
by: Jelodar, Hamed, et al.
Published: (2025)
Optimizing Retrieval Augmented Generation for Object Constraint Language
by: Li, Kevin Chenhao, et al.
Published: (2025)
by: Li, Kevin Chenhao, et al.
Published: (2025)
Deep Code Search with Naming-Agnostic Contrastive Multi-View Learning
by: Feng, Jiadong, et al.
Published: (2024)
by: Feng, Jiadong, et al.
Published: (2024)
Similar Items
-
Engineering RAG Systems for Real-World Applications: Design, Development, and Evaluation
by: Hasan, Md Toufique, et al.
Published: (2025) -
Developing Retrieval Augmented Generation (RAG) based LLM Systems from PDFs: An Experience Report
by: Khan, Ayman Asad, et al.
Published: (2024) -
Experimenting with Multi-Agent Software Development: Towards a Unified Platform
by: Sami, Malik Abdul, et al.
Published: (2024) -
LLM-Based Multi-Agent Systems for Code Generation: A Multi-Vocal Literature Review
by: Rasheeda, Zeeshan, et al.
Published: (2026) -
Engineering a Governance-Aware AI Sandbox: Design, Implementation, and Lessons Learned
by: Waseem, Muhammad, et al.
Published: (2026)