Hallucination-Resistant, Domain-Specific Research Assistant with Self-Evaluation and Vector-Grounded Retrieval
Fuente:
arXiv
Salvato in:
| Autori principali: | Bhavsar, Vivek, Ereifej, Joseph, Gurusami, Aravanan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLMs to Support a Domain Specific Knowledge Assistant
di: Lovin, Maria-Flavia
Pubblicazione: (2025)
di: Lovin, Maria-Flavia
Pubblicazione: (2025)
Domain-Specific Improvement on Psychotherapy Chatbot Using Assistant
di: Kang, Cheng, et al.
Pubblicazione: (2024)
di: Kang, Cheng, et al.
Pubblicazione: (2024)
How Many Parameters Does it Take to Change a Light Bulb? Evaluating Performance in Self-Play of Conversational Games as a Function of Model Characteristics
di: Bhavsar, Nidhir, et al.
Pubblicazione: (2024)
di: Bhavsar, Nidhir, et al.
Pubblicazione: (2024)
ProgRAG: Hallucination-Resistant Progressive Retrieval and Reasoning over Knowledge Graphs
di: Park, Minbae, et al.
Pubblicazione: (2025)
di: Park, Minbae, et al.
Pubblicazione: (2025)
GraphRAG-Bench: Challenging Domain-Specific Reasoning for Evaluating Graph Retrieval-Augmented Generation
di: Xiao, Yilin, et al.
Pubblicazione: (2025)
di: Xiao, Yilin, et al.
Pubblicazione: (2025)
Human-AI Collaborative Taxonomy Construction: A Case Study in Profession-Specific Writing Assistants
di: Lee, Minhwa, et al.
Pubblicazione: (2024)
di: Lee, Minhwa, et al.
Pubblicazione: (2024)
InteGround: On the Evaluation of Verification and Retrieval Planning in Integrative Grounding
di: Jiayang, Cheng, et al.
Pubblicazione: (2025)
di: Jiayang, Cheng, et al.
Pubblicazione: (2025)
Self-Alignment for Factuality: Mitigating Hallucinations in LLMs via Self-Evaluation
di: Zhang, Xiaoying, et al.
Pubblicazione: (2024)
di: Zhang, Xiaoying, et al.
Pubblicazione: (2024)
Domain-Specific Retrieval-Augmented Generation Using Vector Stores, Knowledge Graphs, and Tensor Factorization
di: Barron, Ryan C., et al.
Pubblicazione: (2024)
di: Barron, Ryan C., et al.
Pubblicazione: (2024)
Evaluating ChatGPT on Nuclear Domain-Specific Data
di: Anwar, Muhammad, et al.
Pubblicazione: (2024)
di: Anwar, Muhammad, et al.
Pubblicazione: (2024)
GRAMMAR: Grounded and Modular Methodology for Assessment of Closed-Domain Retrieval-Augmented Language Model
di: Li, Xinzhe, et al.
Pubblicazione: (2024)
di: Li, Xinzhe, et al.
Pubblicazione: (2024)
Vectoring Languages
di: Chen, Joseph
Pubblicazione: (2024)
di: Chen, Joseph
Pubblicazione: (2024)
RAFT: Adapting Language Model to Domain Specific RAG
di: Zhang, Tianjun, et al.
Pubblicazione: (2024)
di: Zhang, Tianjun, et al.
Pubblicazione: (2024)
Enhancing Domain-Specific Retrieval-Augmented Generation: Synthetic Data Generation and Evaluation using Reasoning Models
di: Jadon, Aryan, et al.
Pubblicazione: (2025)
di: Jadon, Aryan, et al.
Pubblicazione: (2025)
RAGalyst: Automated Human-Aligned Agentic Evaluation for Domain-Specific RAG
di: Gao, Joshua, et al.
Pubblicazione: (2025)
di: Gao, Joshua, et al.
Pubblicazione: (2025)
Rankers, Judges, and Assistants: Towards Understanding the Interplay of LLMs in Information Retrieval Evaluation
di: Balog, Krisztian, et al.
Pubblicazione: (2025)
di: Balog, Krisztian, et al.
Pubblicazione: (2025)
ChatSOS: Vector Database Augmented Generative Question Answering Assistant in Safety Engineering
di: Tang, Haiyang, et al.
Pubblicazione: (2024)
di: Tang, Haiyang, et al.
Pubblicazione: (2024)
From Guidelines to Guarantees: A Graph-Based Evaluation Harness for Domain-Specific Evaluation of LLMs
di: Lundin, Jessica M., et al.
Pubblicazione: (2025)
di: Lundin, Jessica M., et al.
Pubblicazione: (2025)
VeriTrail: Closed-Domain Hallucination Detection with Traceability
di: Metropolitansky, Dasha, et al.
Pubblicazione: (2025)
di: Metropolitansky, Dasha, et al.
Pubblicazione: (2025)
GAIus: Combining Genai with Legal Clauses Retrieval for Knowledge-based Assistant
di: Matak, Michał, et al.
Pubblicazione: (2025)
di: Matak, Michał, et al.
Pubblicazione: (2025)
A Functionality-Grounded Benchmark for Evaluating Web Agents in E-commerce Domains
di: Zhang, Xianren, et al.
Pubblicazione: (2025)
di: Zhang, Xianren, et al.
Pubblicazione: (2025)
Sequence-Level Certainty Reduces Hallucination In Knowledge-Grounded Dialogue Generation
di: Wan, Yixin, et al.
Pubblicazione: (2023)
di: Wan, Yixin, et al.
Pubblicazione: (2023)
Fusion-Eval: Integrating Assistant Evaluators with LLMs
di: Shu, Lei, et al.
Pubblicazione: (2023)
di: Shu, Lei, et al.
Pubblicazione: (2023)
DO-RAG: A Domain-Specific QA Framework Using Knowledge Graph-Enhanced Retrieval-Augmented Generation
di: Opoku, David Osei, et al.
Pubblicazione: (2025)
di: Opoku, David Osei, et al.
Pubblicazione: (2025)
Mitigating Hallucination in Abstractive Summarization with Domain-Conditional Mutual Information
di: Chae, Kyubyung, et al.
Pubblicazione: (2024)
di: Chae, Kyubyung, et al.
Pubblicazione: (2024)
DeCoRe: Decoding by Contrasting Retrieval Heads to Mitigate Hallucinations
di: Gema, Aryo Pradipta, et al.
Pubblicazione: (2024)
di: Gema, Aryo Pradipta, et al.
Pubblicazione: (2024)
RepIt: Steering Language Models with Concept-Specific Refusal Vectors
di: Siu, Vincent, et al.
Pubblicazione: (2025)
di: Siu, Vincent, et al.
Pubblicazione: (2025)
DeepWriter: A Fact-Grounded Multimodal Writing Assistant Based On Offline Knowledge Base
di: Mao, Song, et al.
Pubblicazione: (2025)
di: Mao, Song, et al.
Pubblicazione: (2025)
A FAIR and Free Prompt-based Research Assistant
di: Shamsabadi, Mahsa, et al.
Pubblicazione: (2024)
di: Shamsabadi, Mahsa, et al.
Pubblicazione: (2024)
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
di: Liu, Xiang, et al.
Pubblicazione: (2025)
di: Liu, Xiang, et al.
Pubblicazione: (2025)
Think$^{2}$: Grounded Metacognitive Reasoning in Large Language Models
di: Elenjical, Abraham Paul, et al.
Pubblicazione: (2026)
di: Elenjical, Abraham Paul, et al.
Pubblicazione: (2026)
Where Fake Citations Are Made: Tracing Field-Level Hallucination to Specific Neurons in LLMs
di: Chen, Yuefei, et al.
Pubblicazione: (2026)
di: Chen, Yuefei, et al.
Pubblicazione: (2026)
Evaluating LLM Reasoning in the Operations Research Domain with ORQA
di: Mostajabdaveh, Mahdi, et al.
Pubblicazione: (2024)
di: Mostajabdaveh, Mahdi, et al.
Pubblicazione: (2024)
Cross-Domain Content Generation with Domain-Specific Small Language Models
di: Maloo, Ankit, et al.
Pubblicazione: (2024)
di: Maloo, Ankit, et al.
Pubblicazione: (2024)
Self-contradictory Hallucinations of Large Language Models: Evaluation, Detection and Mitigation
di: Mündler, Niels, et al.
Pubblicazione: (2023)
di: Mündler, Niels, et al.
Pubblicazione: (2023)
Lynx: An Open Source Hallucination Evaluation Model
di: Ravi, Selvan Sunitha, et al.
Pubblicazione: (2024)
di: Ravi, Selvan Sunitha, et al.
Pubblicazione: (2024)
Don't Let It Hallucinate: Premise Verification via Retrieval-Augmented Logical Reasoning
di: Qin, Yuehan, et al.
Pubblicazione: (2025)
di: Qin, Yuehan, et al.
Pubblicazione: (2025)
Micro-Macro Retrieval: Reducing Long-Form Hallucination in Large Language Models
di: Feng, Yujie, et al.
Pubblicazione: (2026)
di: Feng, Yujie, et al.
Pubblicazione: (2026)
Do Hallucination Neurons Generalize? Evidence from Cross-Domain Transfer in LLMs
di: Vaddi, Snehit, et al.
Pubblicazione: (2026)
di: Vaddi, Snehit, et al.
Pubblicazione: (2026)
BioRAGent: A Retrieval-Augmented Generation System for Showcasing Generative Query Expansion and Domain-Specific Search for Scientific Q&A
di: Ateia, Samy, et al.
Pubblicazione: (2024)
di: Ateia, Samy, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LLMs to Support a Domain Specific Knowledge Assistant
di: Lovin, Maria-Flavia
Pubblicazione: (2025) -
Domain-Specific Improvement on Psychotherapy Chatbot Using Assistant
di: Kang, Cheng, et al.
Pubblicazione: (2024) -
How Many Parameters Does it Take to Change a Light Bulb? Evaluating Performance in Self-Play of Conversational Games as a Function of Model Characteristics
di: Bhavsar, Nidhir, et al.
Pubblicazione: (2024) -
ProgRAG: Hallucination-Resistant Progressive Retrieval and Reasoning over Knowledge Graphs
di: Park, Minbae, et al.
Pubblicazione: (2025) -
GraphRAG-Bench: Challenging Domain-Specific Reasoning for Evaluating Graph Retrieval-Augmented Generation
di: Xiao, Yilin, et al.
Pubblicazione: (2025)