SHROOM-INDElab at SemEval-2024 Task 6: Zero- and Few-Shot LLM-Based Classification for Hallucination Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Allen, Bradley P., Polat, Fina, Groth, Paul |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SLPL SHROOM at SemEval2024 Task 06: A comprehensive study on models ability to detect hallucination
par: Fallah, Pouya, et autres
Publié: (2024)
par: Fallah, Pouya, et autres
Publié: (2024)
SemEval-2024 Shared Task 6: SHROOM, a Shared-task on Hallucinations and Related Observable Overgeneration Mistakes
par: Mickus, Timothee, et autres
Publié: (2024)
par: Mickus, Timothee, et autres
Publié: (2024)
SmurfCat at SemEval-2024 Task 6: Leveraging Synthetic Data for Hallucination Detection
par: Rykov, Elisei, et autres
Publié: (2024)
par: Rykov, Elisei, et autres
Publié: (2024)
SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes
par: Vázquez, Raúl, et autres
Publié: (2025)
par: Vázquez, Raúl, et autres
Publié: (2025)
MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
par: Borra, Federico, et autres
Publié: (2024)
par: Borra, Federico, et autres
Publié: (2024)
keepitsimple at SemEval-2025 Task 3: LLM-Uncertainty based Approach for Multilingual Hallucination Span Detection
par: Vemula, Saketh Reddy, et autres
Publié: (2025)
par: Vemula, Saketh Reddy, et autres
Publié: (2025)
LyS at SemEval 2025 Task 8: Zero-Shot Code Generation for Tabular QA
par: Gude, Adrián, et autres
Publié: (2025)
par: Gude, Adrián, et autres
Publié: (2025)
NLP at UC Santa Cruz at SemEval-2024 Task 5: Legal Answer Validation using Few-Shot Multi-Choice QA
par: Pahilajani, Anish, et autres
Publié: (2024)
par: Pahilajani, Anish, et autres
Publié: (2024)
REFIND at SemEval-2025 Task 3: Retrieval-Augmented Factuality Hallucination Detection in Large Language Models
par: Lee, DongGeon, et autres
Publié: (2025)
par: Lee, DongGeon, et autres
Publié: (2025)
HalluSearch at SemEval-2025 Task 3: A Search-Enhanced RAG Pipeline for Hallucination Detection
par: Abdallah, Mohamed A., et autres
Publié: (2025)
par: Abdallah, Mohamed A., et autres
Publié: (2025)
KCLarity at SemEval-2026 Task 6: Encoder and Zero-Shot Approaches to Political Evasion Detection
par: Sage, Archie, et autres
Publié: (2026)
par: Sage, Archie, et autres
Publié: (2026)
Zero-Shot Commonsense Validation and Reasoning with Large Language Models: An Evaluation on SemEval-2020 Task 4 Dataset
par: Alfugaha, Rawand, et autres
Publié: (2025)
par: Alfugaha, Rawand, et autres
Publié: (2025)
DaVinci at SemEval-2024 Task 9: Few-shot prompting GPT-3.5 for Unconventional Reasoning
par: Mathur, Suyash Vardhan, et autres
Publié: (2024)
par: Mathur, Suyash Vardhan, et autres
Publié: (2024)
SemEval-2024 Task 3: Multimodal Emotion Cause Analysis in Conversations
par: Wang, Fanfan, et autres
Publié: (2024)
par: Wang, Fanfan, et autres
Publié: (2024)
HausaNLP at SemEval-2025 Task 3: Towards a Fine-Grained Model-Aware Hallucination Detection
par: Bala, Maryam, et autres
Publié: (2025)
par: Bala, Maryam, et autres
Publié: (2025)
IITK at SemEval-2024 Task 4: Hierarchical Embeddings for Detection of Persuasion Techniques in Memes
par: Chikoti, Shreenaga, et autres
Publié: (2024)
par: Chikoti, Shreenaga, et autres
Publié: (2024)
Sharif-MGTD at SemEval-2024 Task 8: A Transformer-Based Approach to Detect Machine Generated Text
par: Ebrahimi, Seyedeh Fatemeh, et autres
Publié: (2024)
par: Ebrahimi, Seyedeh Fatemeh, et autres
Publié: (2024)
PetKaz at SemEval-2024 Task 3: Advancing Emotion Classification with an LLM for Emotion-Cause Pair Extraction in Conversations
par: Kazakov, Roman, et autres
Publié: (2024)
par: Kazakov, Roman, et autres
Publié: (2024)
KInIT at SemEval-2024 Task 8: Fine-tuned LLMs for Multilingual Machine-Generated Text Detection
par: Spiegel, Michal, et autres
Publié: (2024)
par: Spiegel, Michal, et autres
Publié: (2024)
SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
par: Jiang, Yifan, et autres
Publié: (2024)
par: Jiang, Yifan, et autres
Publié: (2024)
mdok-style at SemEval-2026 Task 10: Finetuning LLMs for Conspiracy Detection
par: Macko, Dominik
Publié: (2026)
par: Macko, Dominik
Publié: (2026)
SemEval-2024 Task 2: Safe Biomedical Natural Language Inference for Clinical Trials
par: Jullien, Mael, et autres
Publié: (2024)
par: Jullien, Mael, et autres
Publié: (2024)
OPDAI at SemEval-2024 Task 6: Small LLMs can Accelerate Hallucination Detection with Weakly Supervised Data
par: Wei, Chengcheng, et autres
Publié: (2024)
par: Wei, Chengcheng, et autres
Publié: (2024)
DeepPavlov at SemEval-2024 Task 8: Leveraging Transfer Learning for Detecting Boundaries of Machine-Generated Texts
par: Voznyuk, Anastasia, et autres
Publié: (2024)
par: Voznyuk, Anastasia, et autres
Publié: (2024)
A Benchmark for the Detection of Metalinguistic Disagreements between LLMs and Knowledge Graphs
par: Allen, Bradley P., et autres
Publié: (2025)
par: Allen, Bradley P., et autres
Publié: (2025)
PetKaz at SemEval-2024 Task 8: Can Linguistics Capture the Specifics of LLM-generated Text?
par: Petukhova, Kseniia, et autres
Publié: (2024)
par: Petukhova, Kseniia, et autres
Publié: (2024)
mdok-style at SemEval-2026 Task 9: Finetuning LLMs for Multilingual Polarization Detection
par: Macko, Dominik, et autres
Publié: (2026)
par: Macko, Dominik, et autres
Publié: (2026)
FZI-WIM at SemEval-2024 Task 2: Self-Consistent CoT for Complex NLI in Biomedical Domain
par: Liu, Jin, et autres
Publié: (2024)
par: Liu, Jin, et autres
Publié: (2024)
SemEval 2024 -- Task 10: Emotion Discovery and Reasoning its Flip in Conversation (EDiReF)
par: Kumar, Shivani, et autres
Publié: (2024)
par: Kumar, Shivani, et autres
Publié: (2024)
Abdelhak at SemEval-2024 Task 9 : Decoding Brainteasers, The Efficacy of Dedicated Models Versus ChatGPT
par: Kelious, Abdelhak, et autres
Publié: (2024)
par: Kelious, Abdelhak, et autres
Publié: (2024)
ATLANTIS at SemEval-2025 Task 3: Detecting Hallucinated Text Spans in Question Answering
par: Kobus, Catherine, et autres
Publié: (2025)
par: Kobus, Catherine, et autres
Publié: (2025)
AIMA at SemEval-2024 Task 3: Simple Yet Powerful Emotion Cause Pair Analysis
par: Kure, Alireza Ghahramani, et autres
Publié: (2025)
par: Kure, Alireza Ghahramani, et autres
Publié: (2025)
USTCCTSU at SemEval-2024 Task 1: Reducing Anisotropy for Cross-lingual Semantic Textual Relatedness Task
par: Li, Jianjian, et autres
Publié: (2024)
par: Li, Jianjian, et autres
Publié: (2024)
AIMA at SemEval-2024 Task 10: History-Based Emotion Recognition in Hindi-English Code-Mixed Conversations
par: Abootorabi, Mohammad Mahdi, et autres
Publié: (2025)
par: Abootorabi, Mohammad Mahdi, et autres
Publié: (2025)
Team QUST at SemEval-2024 Task 8: A Comprehensive Study of Monolingual and Multilingual Approaches for Detecting AI-generated Text
par: Xu, Xiaoman, et autres
Publié: (2024)
par: Xu, Xiaoman, et autres
Publié: (2024)
TUM-MiKaNi at SemEval-2025 Task 3: Towards Multilingual and Knowledge-Aware Non-factual Hallucination Identification
par: Anschütz, Miriam, et autres
Publié: (2025)
par: Anschütz, Miriam, et autres
Publié: (2025)
Archimedes-AUEB at SemEval-2024 Task 5: LLM explains Civil Procedure
par: Chlapanis, Odysseas S., et autres
Publié: (2024)
par: Chlapanis, Odysseas S., et autres
Publié: (2024)
UCSC at SemEval-2025 Task 3: Context, Models and Prompt Optimization for Automated Hallucination Detection in LLM Output
par: Huang, Sicong, et autres
Publié: (2025)
par: Huang, Sicong, et autres
Publié: (2025)
HU at SemEval-2024 Task 8A: Can Contrastive Learning Learn Embeddings to Detect Machine-Generated Text?
par: Dipta, Shubhashis Roy, et autres
Publié: (2024)
par: Dipta, Shubhashis Roy, et autres
Publié: (2024)
AILS-NTUA at SemEval-2024 Task 9: Cracking Brain Teasers: Transformer Models for Lateral Thinking Puzzles
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
Documents similaires
-
SLPL SHROOM at SemEval2024 Task 06: A comprehensive study on models ability to detect hallucination
par: Fallah, Pouya, et autres
Publié: (2024) -
SemEval-2024 Shared Task 6: SHROOM, a Shared-task on Hallucinations and Related Observable Overgeneration Mistakes
par: Mickus, Timothee, et autres
Publié: (2024) -
SmurfCat at SemEval-2024 Task 6: Leveraging Synthetic Data for Hallucination Detection
par: Rykov, Elisei, et autres
Publié: (2024) -
SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes
par: Vázquez, Raúl, et autres
Publié: (2025) -
MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
par: Borra, Federico, et autres
Publié: (2024)