MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
Fuente:
arXiv
Saved in:
| Main Authors: | Borra, Federico, Savelli, Claudio, Rosso, Giacomo, Koudounas, Alkis, Giobergia, Flavio |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
"Alexa, can you forget me?" Machine Unlearning Benchmark in Spoken Language Understanding
by: Koudounas, Alkis, et al.
Published: (2025)
by: Koudounas, Alkis, et al.
Published: (2025)
FAME: Fictional Actors for Multilingual Erasure
by: Savelli, Claudio, et al.
Published: (2025)
by: Savelli, Claudio, et al.
Published: (2025)
SmurfCat at SemEval-2024 Task 6: Leveraging Synthetic Data for Hallucination Detection
by: Rykov, Elisei, et al.
Published: (2024)
by: Rykov, Elisei, et al.
Published: (2024)
Houston we have a Divergence: A Subgroup Performance Analysis of ASR Models
by: Koudounas, Alkis, et al.
Published: (2024)
by: Koudounas, Alkis, et al.
Published: (2024)
A Contrastive Learning Approach to Mitigate Bias in Speech Models
by: Koudounas, Alkis, et al.
Published: (2024)
by: Koudounas, Alkis, et al.
Published: (2024)
Reconstructing Atmospheric Parameters of Exoplanets Using Deep Learning
by: Giobergia, Flavio, et al.
Published: (2023)
by: Giobergia, Flavio, et al.
Published: (2023)
OPDAI at SemEval-2024 Task 6: Small LLMs can Accelerate Hallucination Detection with Weakly Supervised Data
by: Wei, Chengcheng, et al.
Published: (2024)
by: Wei, Chengcheng, et al.
Published: (2024)
SHROOM-INDElab at SemEval-2024 Task 6: Zero- and Few-Shot LLM-Based Classification for Hallucination Detection
by: Allen, Bradley P., et al.
Published: (2024)
by: Allen, Bradley P., et al.
Published: (2024)
CLaC at SemEval-2026 Task 6: Response Clarity Detection in Political Discourse
by: Turk, Nawar, et al.
Published: (2026)
by: Turk, Nawar, et al.
Published: (2026)
IITK at SemEval-2024 Task 4: Hierarchical Embeddings for Detection of Persuasion Techniques in Memes
by: Chikoti, Shreenaga, et al.
Published: (2024)
by: Chikoti, Shreenaga, et al.
Published: (2024)
SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
by: Jiang, Yifan, et al.
Published: (2024)
by: Jiang, Yifan, et al.
Published: (2024)
PSK at SemEval-2026 Task 9: Multilingual Polarization Detection Using Ensemble Gemma Models with Synthetic Data Augmentation
by: Pulipaka, Srikar Kashyap
Published: (2026)
by: Pulipaka, Srikar Kashyap
Published: (2026)
ATLANTIS at SemEval-2025 Task 3: Detecting Hallucinated Text Spans in Question Answering
by: Kobus, Catherine, et al.
Published: (2025)
by: Kobus, Catherine, et al.
Published: (2025)
keepitsimple at SemEval-2025 Task 3: LLM-Uncertainty based Approach for Multilingual Hallucination Span Detection
by: Vemula, Saketh Reddy, et al.
Published: (2025)
by: Vemula, Saketh Reddy, et al.
Published: (2025)
SemEval-2024 Shared Task 6: SHROOM, a Shared-task on Hallucinations and Related Observable Overgeneration Mistakes
by: Mickus, Timothee, et al.
Published: (2024)
by: Mickus, Timothee, et al.
Published: (2024)
AILS-NTUA at SemEval-2025 Task 3: Leveraging Large Language Models and Translation Strategies for Multilingual Hallucination Detection
by: Karkani, Dimitra, et al.
Published: (2025)
by: Karkani, Dimitra, et al.
Published: (2025)
AIMA at SemEval-2024 Task 3: Simple Yet Powerful Emotion Cause Pair Analysis
by: Kure, Alireza Ghahramani, et al.
Published: (2025)
by: Kure, Alireza Ghahramani, et al.
Published: (2025)
Archimedes-AUEB at SemEval-2024 Task 5: LLM explains Civil Procedure
by: Chlapanis, Odysseas S., et al.
Published: (2024)
by: Chlapanis, Odysseas S., et al.
Published: (2024)
UCSC at SemEval-2025 Task 3: Context, Models and Prompt Optimization for Automated Hallucination Detection in LLM Output
by: Huang, Sicong, et al.
Published: (2025)
by: Huang, Sicong, et al.
Published: (2025)
HU at SemEval-2024 Task 8A: Can Contrastive Learning Learn Embeddings to Detect Machine-Generated Text?
by: Dipta, Shubhashis Roy, et al.
Published: (2024)
by: Dipta, Shubhashis Roy, et al.
Published: (2024)
CRCL at SemEval-2024 Task 2: Simple prompt optimizations
by: Brutti-Mairesse, Clément, et al.
Published: (2024)
by: Brutti-Mairesse, Clément, et al.
Published: (2024)
mcdok at SemEval-2026 Task 13: Finetuning LLMs for Detection of Machine-Generated Code
by: Skurla, Adam, et al.
Published: (2026)
by: Skurla, Adam, et al.
Published: (2026)
IITK at SemEval-2024 Task 1: Contrastive Learning and Autoencoders for Semantic Textual Relatedness in Multilingual Texts
by: Basak, Udvas, et al.
Published: (2024)
by: Basak, Udvas, et al.
Published: (2024)
uTeBC-NLP at SemEval-2024 Task 9: Can LLMs be Lateral Thinkers?
by: Sadeghi, Pouya, et al.
Published: (2024)
by: Sadeghi, Pouya, et al.
Published: (2024)
MSA at SemEval-2025 Task 3: High Quality Weak Labeling and LLM Ensemble Verification for Multilingual Hallucination Detection
by: Hikal, Baraa, et al.
Published: (2025)
by: Hikal, Baraa, et al.
Published: (2025)
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
by: Ramakrishna, Anil, et al.
Published: (2025)
by: Ramakrishna, Anil, et al.
Published: (2025)
RKadiyala at SemEval-2024 Task 8: Black-Box Word-Level Text Boundary Detection in Partially Machine Generated Texts
by: Kadiyala, Ram Mohan Rao
Published: (2024)
by: Kadiyala, Ram Mohan Rao
Published: (2024)
JNLP at SemEval-2025 Task 11: Cross-Lingual Multi-Label Emotion Detection Using Generative Models
by: Xue, Jieying, et al.
Published: (2025)
by: Xue, Jieying, et al.
Published: (2025)
DeepPavlov at SemEval-2024 Task 8: Leveraging Transfer Learning for Detecting Boundaries of Machine-Generated Texts
by: Voznyuk, Anastasia, et al.
Published: (2024)
by: Voznyuk, Anastasia, et al.
Published: (2024)
SemEval-2025 Task 9: The Food Hazard Detection Challenge
by: Randl, Korbinian, et al.
Published: (2025)
by: Randl, Korbinian, et al.
Published: (2025)
SemEval-2024 Task 8: Multidomain, Multimodel and Multilingual Machine-Generated Text Detection
by: Wang, Yuxia, et al.
Published: (2024)
by: Wang, Yuxia, et al.
Published: (2024)
AIpom at SemEval-2024 Task 8: Detecting AI-produced Outputs in M4
by: Shirnin, Alexander, et al.
Published: (2024)
by: Shirnin, Alexander, et al.
Published: (2024)
UMBCLU at SemEval-2024 Task 1A and 1C: Semantic Textual Relatedness with and without machine translation
by: Dipta, Shubhashis Roy, et al.
Published: (2024)
by: Dipta, Shubhashis Roy, et al.
Published: (2024)
AIMA at SemEval-2024 Task 10: History-Based Emotion Recognition in Hindi-English Code-Mixed Conversations
by: Abootorabi, Mohammad Mahdi, et al.
Published: (2025)
by: Abootorabi, Mohammad Mahdi, et al.
Published: (2025)
TLDR at SemEval-2024 Task 2: T5-generated clinical-Language summaries for DeBERTa Report Analysis
by: Das, Spandan, et al.
Published: (2024)
by: Das, Spandan, et al.
Published: (2024)
CCNU at SemEval-2025 Task 3: Leveraging Internal and External Knowledge of Large Language Models for Multilingual Hallucination Annotation
by: Liu, Xu, et al.
Published: (2025)
by: Liu, Xu, et al.
Published: (2025)
LyS at SemEval 2025 Task 8: Zero-Shot Code Generation for Tabular QA
by: Gude, Adrián, et al.
Published: (2025)
by: Gude, Adrián, et al.
Published: (2025)
REFIND at SemEval-2025 Task 3: Retrieval-Augmented Factuality Hallucination Detection in Large Language Models
by: Lee, DongGeon, et al.
Published: (2025)
by: Lee, DongGeon, et al.
Published: (2025)
HalluSearch at SemEval-2025 Task 3: A Search-Enhanced RAG Pipeline for Hallucination Detection
by: Abdallah, Mohamed A., et al.
Published: (2025)
by: Abdallah, Mohamed A., et al.
Published: (2025)
ZJUKLAB at SemEval-2025 Task 4: Unlearning via Model Merging
by: Xu, Haoming, et al.
Published: (2025)
by: Xu, Haoming, et al.
Published: (2025)
Similar Items
-
"Alexa, can you forget me?" Machine Unlearning Benchmark in Spoken Language Understanding
by: Koudounas, Alkis, et al.
Published: (2025) -
FAME: Fictional Actors for Multilingual Erasure
by: Savelli, Claudio, et al.
Published: (2025) -
SmurfCat at SemEval-2024 Task 6: Leveraging Synthetic Data for Hallucination Detection
by: Rykov, Elisei, et al.
Published: (2024) -
Houston we have a Divergence: A Subgroup Performance Analysis of ASR Models
by: Koudounas, Alkis, et al.
Published: (2024) -
A Contrastive Learning Approach to Mitigate Bias in Speech Models
by: Koudounas, Alkis, et al.
Published: (2024)