SmurfCat at SemEval-2024 Task 6: Leveraging Synthetic Data for Hallucination Detection
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Rykov, Elisei, Shishkina, Yana, Petrushina, Kseniia, Titova, Kseniia, Petrakov, Sergey, Panchenko, Alexander |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Don't Fight Hallucinations, Use Them: Estimating Image Realism using NLI over Atomic Facts
von: Rykov, Elisei, et al.
Veröffentlicht: (2025)
von: Rykov, Elisei, et al.
Veröffentlicht: (2025)
Through the Looking Glass: Common Sense Consistency Evaluation of Weird Images
von: Rykov, Elisei, et al.
Veröffentlicht: (2025)
von: Rykov, Elisei, et al.
Veröffentlicht: (2025)
SmurfCat at PAN 2024 TextDetox: Alignment of Multilingual Transformers for Text Detoxification
von: Rykov, Elisei, et al.
Veröffentlicht: (2024)
von: Rykov, Elisei, et al.
Veröffentlicht: (2024)
When Models Lie, We Learn: Multilingual Span-Level Hallucination Detection with PsiloQA
von: Rykov, Elisei, et al.
Veröffentlicht: (2025)
von: Rykov, Elisei, et al.
Veröffentlicht: (2025)
MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
von: Borra, Federico, et al.
Veröffentlicht: (2024)
von: Borra, Federico, et al.
Veröffentlicht: (2024)
PetKaz at SemEval-2024 Task 8: Can Linguistics Capture the Specifics of LLM-generated Text?
von: Petukhova, Kseniia, et al.
Veröffentlicht: (2024)
von: Petukhova, Kseniia, et al.
Veröffentlicht: (2024)
PetKaz at SemEval-2024 Task 3: Advancing Emotion Classification with an LLM for Emotion-Cause Pair Extraction in Conversations
von: Kazakov, Roman, et al.
Veröffentlicht: (2024)
von: Kazakov, Roman, et al.
Veröffentlicht: (2024)
S3: A Simple Strong Sample-effective Multimodal Dialog System
von: Rykov, Elisei, et al.
Veröffentlicht: (2024)
von: Rykov, Elisei, et al.
Veröffentlicht: (2024)
OPDAI at SemEval-2024 Task 6: Small LLMs can Accelerate Hallucination Detection with Weakly Supervised Data
von: Wei, Chengcheng, et al.
Veröffentlicht: (2024)
von: Wei, Chengcheng, et al.
Veröffentlicht: (2024)
SHROOM-INDElab at SemEval-2024 Task 6: Zero- and Few-Shot LLM-Based Classification for Hallucination Detection
von: Allen, Bradley P., et al.
Veröffentlicht: (2024)
von: Allen, Bradley P., et al.
Veröffentlicht: (2024)
AIpom at SemEval-2024 Task 8: Detecting AI-produced Outputs in M4
von: Shirnin, Alexander, et al.
Veröffentlicht: (2024)
von: Shirnin, Alexander, et al.
Veröffentlicht: (2024)
ATLANTIS at SemEval-2025 Task 3: Detecting Hallucinated Text Spans in Question Answering
von: Kobus, Catherine, et al.
Veröffentlicht: (2025)
von: Kobus, Catherine, et al.
Veröffentlicht: (2025)
SemEval-2024 Shared Task 6: SHROOM, a Shared-task on Hallucinations and Related Observable Overgeneration Mistakes
von: Mickus, Timothee, et al.
Veröffentlicht: (2024)
von: Mickus, Timothee, et al.
Veröffentlicht: (2024)
AILS-NTUA at SemEval-2025 Task 3: Leveraging Large Language Models and Translation Strategies for Multilingual Hallucination Detection
von: Karkani, Dimitra, et al.
Veröffentlicht: (2025)
von: Karkani, Dimitra, et al.
Veröffentlicht: (2025)
SemEval-2025 Task 11: Bridging the Gap in Text-Based Emotion Detection
von: Muhammad, Shamsuddeen Hassan, et al.
Veröffentlicht: (2025)
von: Muhammad, Shamsuddeen Hassan, et al.
Veröffentlicht: (2025)
CRCL at SemEval-2024 Task 2: Simple prompt optimizations
von: Brutti-Mairesse, Clément, et al.
Veröffentlicht: (2024)
von: Brutti-Mairesse, Clément, et al.
Veröffentlicht: (2024)
DeepPavlov at SemEval-2024 Task 8: Leveraging Transfer Learning for Detecting Boundaries of Machine-Generated Texts
von: Voznyuk, Anastasia, et al.
Veröffentlicht: (2024)
von: Voznyuk, Anastasia, et al.
Veröffentlicht: (2024)
SemEval-2025 Task 9: The Food Hazard Detection Challenge
von: Randl, Korbinian, et al.
Veröffentlicht: (2025)
von: Randl, Korbinian, et al.
Veröffentlicht: (2025)
REFIND at SemEval-2025 Task 3: Retrieval-Augmented Factuality Hallucination Detection in Large Language Models
von: Lee, DongGeon, et al.
Veröffentlicht: (2025)
von: Lee, DongGeon, et al.
Veröffentlicht: (2025)
keepitsimple at SemEval-2025 Task 3: LLM-Uncertainty based Approach for Multilingual Hallucination Span Detection
von: Vemula, Saketh Reddy, et al.
Veröffentlicht: (2025)
von: Vemula, Saketh Reddy, et al.
Veröffentlicht: (2025)
HalluSearch at SemEval-2025 Task 3: A Search-Enhanced RAG Pipeline for Hallucination Detection
von: Abdallah, Mohamed A., et al.
Veröffentlicht: (2025)
von: Abdallah, Mohamed A., et al.
Veröffentlicht: (2025)
IITK at SemEval-2024 Task 4: Hierarchical Embeddings for Detection of Persuasion Techniques in Memes
von: Chikoti, Shreenaga, et al.
Veröffentlicht: (2024)
von: Chikoti, Shreenaga, et al.
Veröffentlicht: (2024)
SemEval-2024 Task 8: Multidomain, Multimodel and Multilingual Machine-Generated Text Detection
von: Wang, Yuxia, et al.
Veröffentlicht: (2024)
von: Wang, Yuxia, et al.
Veröffentlicht: (2024)
CCNU at SemEval-2025 Task 3: Leveraging Internal and External Knowledge of Large Language Models for Multilingual Hallucination Annotation
von: Liu, Xu, et al.
Veröffentlicht: (2025)
von: Liu, Xu, et al.
Veröffentlicht: (2025)
SemEval-2024 Task 3: Multimodal Emotion Cause Analysis in Conversations
von: Wang, Fanfan, et al.
Veröffentlicht: (2024)
von: Wang, Fanfan, et al.
Veröffentlicht: (2024)
CLaC at SemEval-2026 Task 6: Response Clarity Detection in Political Discourse
von: Turk, Nawar, et al.
Veröffentlicht: (2026)
von: Turk, Nawar, et al.
Veröffentlicht: (2026)
HausaNLP at SemEval-2025 Task 3: Towards a Fine-Grained Model-Aware Hallucination Detection
von: Bala, Maryam, et al.
Veröffentlicht: (2025)
von: Bala, Maryam, et al.
Veröffentlicht: (2025)
UCSC at SemEval-2025 Task 3: Context, Models and Prompt Optimization for Automated Hallucination Detection in LLM Output
von: Huang, Sicong, et al.
Veröffentlicht: (2025)
von: Huang, Sicong, et al.
Veröffentlicht: (2025)
PSK at SemEval-2026 Task 9: Multilingual Polarization Detection Using Ensemble Gemma Models with Synthetic Data Augmentation
von: Pulipaka, Srikar Kashyap
Veröffentlicht: (2026)
von: Pulipaka, Srikar Kashyap
Veröffentlicht: (2026)
SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
von: Jiang, Yifan, et al.
Veröffentlicht: (2024)
von: Jiang, Yifan, et al.
Veröffentlicht: (2024)
eagerlearners at SemEval2024 Task 5: The Legal Argument Reasoning Task in Civil Procedure
von: Sabzevari, Hoorieh, et al.
Veröffentlicht: (2024)
von: Sabzevari, Hoorieh, et al.
Veröffentlicht: (2024)
AILS-NTUA at SemEval-2024 Task 6: Efficient model tuning for hallucination detection and analysis
von: Grigoriadou, Natalia, et al.
Veröffentlicht: (2024)
von: Grigoriadou, Natalia, et al.
Veröffentlicht: (2024)
SemEval-2026 Task 3: Dimensional Aspect-Based Sentiment Analysis (DimABSA)
von: Yu, Liang-Chih, et al.
Veröffentlicht: (2026)
von: Yu, Liang-Chih, et al.
Veröffentlicht: (2026)
SemEval-2026 Task 6: CLARITY -- Unmasking Political Question Evasions
von: Thomas, Konstantinos, et al.
Veröffentlicht: (2026)
von: Thomas, Konstantinos, et al.
Veröffentlicht: (2026)
SemEval-2024 Task 1: Semantic Textual Relatedness for African and Asian Languages
von: Ousidhoum, Nedjma, et al.
Veröffentlicht: (2024)
von: Ousidhoum, Nedjma, et al.
Veröffentlicht: (2024)
Archimedes-AUEB at SemEval-2024 Task 5: LLM explains Civil Procedure
von: Chlapanis, Odysseas S., et al.
Veröffentlicht: (2024)
von: Chlapanis, Odysseas S., et al.
Veröffentlicht: (2024)
SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes
von: Vázquez, Raúl, et al.
Veröffentlicht: (2025)
von: Vázquez, Raúl, et al.
Veröffentlicht: (2025)
MSA at SemEval-2025 Task 3: High Quality Weak Labeling and LLM Ensemble Verification for Multilingual Hallucination Detection
von: Hikal, Baraa, et al.
Veröffentlicht: (2025)
von: Hikal, Baraa, et al.
Veröffentlicht: (2025)
KCLarity at SemEval-2026 Task 6: Encoder and Zero-Shot Approaches to Political Evasion Detection
von: Sage, Archie, et al.
Veröffentlicht: (2026)
von: Sage, Archie, et al.
Veröffentlicht: (2026)
BAMO at SemEval-2024 Task 9: BRAINTEASER: A Novel Task Defying Common Sense
von: Ansari, Baktash, et al.
Veröffentlicht: (2024)
von: Ansari, Baktash, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Don't Fight Hallucinations, Use Them: Estimating Image Realism using NLI over Atomic Facts
von: Rykov, Elisei, et al.
Veröffentlicht: (2025) -
Through the Looking Glass: Common Sense Consistency Evaluation of Weird Images
von: Rykov, Elisei, et al.
Veröffentlicht: (2025) -
SmurfCat at PAN 2024 TextDetox: Alignment of Multilingual Transformers for Text Detoxification
von: Rykov, Elisei, et al.
Veröffentlicht: (2024) -
When Models Lie, We Learn: Multilingual Span-Level Hallucination Detection with PsiloQA
von: Rykov, Elisei, et al.
Veröffentlicht: (2025) -
MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
von: Borra, Federico, et al.
Veröffentlicht: (2024)