SLPL SHROOM at SemEval2024 Task 06: A comprehensive study on models ability to detect hallucination
Fuente:
arXiv
Saved in:
| Main Authors: | Fallah, Pouya, Gooran, Soroush, Jafarinasab, Mohammad, Sadeghi, Pouya, Farnia, Reza, Tarabkhah, Amirreza, Taghavi, Zainab Sadat, Sameti, Hossein |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Sharif-MGTD at SemEval-2024 Task 8: A Transformer-Based Approach to Detect Machine Generated Text
by: Ebrahimi, Seyedeh Fatemeh, et al.
Published: (2024)
by: Ebrahimi, Seyedeh Fatemeh, et al.
Published: (2024)
uTeBC-NLP at SemEval-2024 Task 9: Can LLMs be Lateral Thinkers?
by: Sadeghi, Pouya, et al.
Published: (2024)
by: Sadeghi, Pouya, et al.
Published: (2024)
Sharif-STR at SemEval-2024 Task 1: Transformer as a Regression Model for Fine-Grained Scoring of Textual Semantic Relations
by: Ebrahimi, Seyedeh Fatemeh, et al.
Published: (2024)
by: Ebrahimi, Seyedeh Fatemeh, et al.
Published: (2024)
naab: A ready-to-use plug-and-play corpus for Farsi
by: Sabouri, Sadra, et al.
Published: (2022)
by: Sabouri, Sadra, et al.
Published: (2022)
SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes
by: Vázquez, Raúl, et al.
Published: (2025)
by: Vázquez, Raúl, et al.
Published: (2025)
AILS-NTUA at SemEval-2024 Task 6: Efficient model tuning for hallucination detection and analysis
by: Grigoriadou, Natalia, et al.
Published: (2024)
by: Grigoriadou, Natalia, et al.
Published: (2024)
SemEval-2024 Shared Task 6: SHROOM, a Shared-task on Hallucinations and Related Observable Overgeneration Mistakes
by: Mickus, Timothee, et al.
Published: (2024)
by: Mickus, Timothee, et al.
Published: (2024)
SHROOM-INDElab at SemEval-2024 Task 6: Zero- and Few-Shot LLM-Based Classification for Hallucination Detection
by: Allen, Bradley P., et al.
Published: (2024)
by: Allen, Bradley P., et al.
Published: (2024)
HU at SemEval-2024 Task 8A: Can Contrastive Learning Learn Embeddings to Detect Machine-Generated Text?
by: Dipta, Shubhashis Roy, et al.
Published: (2024)
by: Dipta, Shubhashis Roy, et al.
Published: (2024)
Effect of dispersed hydrophilic silicon dioxide nanoparticles on batch adsorption of benzoic acid from aqueous solution using modified natural vermiculite: An equilibrium study
by: Ehsan Sadeghi Pouya
Published: (2016)
by: Ehsan Sadeghi Pouya
Published: (2016)
CRCL at SemEval-2024 Task 2: Simple prompt optimizations
by: Brutti-Mairesse, Clément, et al.
Published: (2024)
by: Brutti-Mairesse, Clément, et al.
Published: (2024)
SemEval-2025 Task 9: The Food Hazard Detection Challenge
by: Randl, Korbinian, et al.
Published: (2025)
by: Randl, Korbinian, et al.
Published: (2025)
SemEval-2017 Task 4: Sentiment Analysis in Twitter using BERT
by: Das, Rupak Kumar, et al.
Published: (2024)
by: Das, Rupak Kumar, et al.
Published: (2024)
SemEval-2024 Task 3: Multimodal Emotion Cause Analysis in Conversations
by: Wang, Fanfan, et al.
Published: (2024)
by: Wang, Fanfan, et al.
Published: (2024)
Annif at SemEval-2025 Task 5: Traditional XMTC augmented by LLMs
by: Suominen, Osma, et al.
Published: (2025)
by: Suominen, Osma, et al.
Published: (2025)
SemEval-2026 Task 6: CLARITY -- Unmasking Political Question Evasions
by: Thomas, Konstantinos, et al.
Published: (2026)
by: Thomas, Konstantinos, et al.
Published: (2026)
ZJUKLAB at SemEval-2025 Task 4: Unlearning via Model Merging
by: Xu, Haoming, et al.
Published: (2025)
by: Xu, Haoming, et al.
Published: (2025)
SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
by: Jiang, Yifan, et al.
Published: (2024)
by: Jiang, Yifan, et al.
Published: (2024)
eagerlearners at SemEval2024 Task 5: The Legal Argument Reasoning Task in Civil Procedure
by: Sabzevari, Hoorieh, et al.
Published: (2024)
by: Sabzevari, Hoorieh, et al.
Published: (2024)
SemEval-2025 Task 1: AdMIRe -- Advancing Multimodal Idiomaticity Representation
by: Pickard, Thomas, et al.
Published: (2025)
by: Pickard, Thomas, et al.
Published: (2025)
Atyaephyra at SemEval-2025 Task 4: Low-Rank Negative Preference Optimization
by: Bronec, Jan, et al.
Published: (2025)
by: Bronec, Jan, et al.
Published: (2025)
SemEval-2025 Task 11: Bridging the Gap in Text-Based Emotion Detection
by: Muhammad, Shamsuddeen Hassan, et al.
Published: (2025)
by: Muhammad, Shamsuddeen Hassan, et al.
Published: (2025)
SemEval-2026 Task 4: Narrative Story Similarity and Narrative Representation Learning
by: Hatzel, Hans Ole, et al.
Published: (2026)
by: Hatzel, Hans Ole, et al.
Published: (2026)
SemEval-2026 Task 7: Everyday Knowledge Across Diverse Languages and Cultures
by: Ousidhoum, Nedjma, et al.
Published: (2026)
by: Ousidhoum, Nedjma, et al.
Published: (2026)
SemEval-2025 Task 7: Multilingual and Crosslingual Fact-Checked Claim Retrieval
by: Peng, Qiwei, et al.
Published: (2025)
by: Peng, Qiwei, et al.
Published: (2025)
SemEval-2024 Task 1: Semantic Textual Relatedness for African and Asian Languages
by: Ousidhoum, Nedjma, et al.
Published: (2024)
by: Ousidhoum, Nedjma, et al.
Published: (2024)
LTG at SemEval-2025 Task 10: Optimizing Context for Classification of Narrative Roles
by: Rønningstad, Egil, et al.
Published: (2025)
by: Rønningstad, Egil, et al.
Published: (2025)
HausaNLP at SemEval-2025 Task 11: Hausa Text Emotion Detection
by: Sani, Sani Abdullahi, et al.
Published: (2025)
by: Sani, Sani Abdullahi, et al.
Published: (2025)
SemEval-2026 Task 9: Detecting Multilingual, Multicultural and Multievent Online Polarization
by: Naseem, Usman, et al.
Published: (2026)
by: Naseem, Usman, et al.
Published: (2026)
mdok-style at SemEval-2026 Task 10: Finetuning LLMs for Conspiracy Detection
by: Macko, Dominik
Published: (2026)
by: Macko, Dominik
Published: (2026)
Archimedes-AUEB at SemEval-2024 Task 5: LLM explains Civil Procedure
by: Chlapanis, Odysseas S., et al.
Published: (2024)
by: Chlapanis, Odysseas S., et al.
Published: (2024)
BAMO at SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
by: Ansari, Baktash, et al.
Published: (2024)
by: Ansari, Baktash, et al.
Published: (2024)
ATLANTIS at SemEval-2025 Task 3: Detecting Hallucinated Text Spans in Question Answering
by: Kobus, Catherine, et al.
Published: (2025)
by: Kobus, Catherine, et al.
Published: (2025)
ITLC at SemEval-2026 Task 11: Normalization and Deterministic Parsing for Formal Reasoning in LLMs
by: Muhamad, Wicaksono Leksono, et al.
Published: (2026)
by: Muhamad, Wicaksono Leksono, et al.
Published: (2026)
SemEval-2026 Task 3: Dimensional Aspect-Based Sentiment Analysis (DimABSA)
by: Yu, Liang-Chih, et al.
Published: (2026)
by: Yu, Liang-Chih, et al.
Published: (2026)
IITK at SemEval-2024 Task 4: Hierarchical Embeddings for Detection of Persuasion Techniques in Memes
by: Chikoti, Shreenaga, et al.
Published: (2024)
by: Chikoti, Shreenaga, et al.
Published: (2024)
SemEval-2024 Task 8: Multidomain, Multimodel and Multilingual Machine-Generated Text Detection
by: Wang, Yuxia, et al.
Published: (2024)
by: Wang, Yuxia, et al.
Published: (2024)
mdok-style at SemEval-2026 Task 9: Finetuning LLMs for Multilingual Polarization Detection
by: Macko, Dominik, et al.
Published: (2026)
by: Macko, Dominik, et al.
Published: (2026)
Evaluating the Evaluator: Problems with SemEval-2020 Task 1 for Lexical Semantic Change Detection
by: Phan-Tat, Bach, et al.
Published: (2026)
by: Phan-Tat, Bach, et al.
Published: (2026)
MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
by: Borra, Federico, et al.
Published: (2024)
by: Borra, Federico, et al.
Published: (2024)
Similar Items
-
Sharif-MGTD at SemEval-2024 Task 8: A Transformer-Based Approach to Detect Machine Generated Text
by: Ebrahimi, Seyedeh Fatemeh, et al.
Published: (2024) -
uTeBC-NLP at SemEval-2024 Task 9: Can LLMs be Lateral Thinkers?
by: Sadeghi, Pouya, et al.
Published: (2024) -
Sharif-STR at SemEval-2024 Task 1: Transformer as a Regression Model for Fine-Grained Scoring of Textual Semantic Relations
by: Ebrahimi, Seyedeh Fatemeh, et al.
Published: (2024) -
naab: A ready-to-use plug-and-play corpus for Farsi
by: Sabouri, Sadra, et al.
Published: (2022) -
SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes
by: Vázquez, Raúl, et al.
Published: (2025)