UCSC at SemEval-2025 Task 3: Context, Models and Prompt Optimization for Automated Hallucination Detection in LLM Output
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Sicong, He, Jincheng, Huang, Shiyuan, Anandan, Karthik Raja, Chakraborty, Arkajyoti, Lane, Ian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UCSC-NLP at SemEval-2026 Task 13: Multi-View Generalization and Diagnostic Analysis of Machine-Generated Code Detection
por: Chauhan, Kargi, et al.
Publicado: (2026)
por: Chauhan, Kargi, et al.
Publicado: (2026)
keepitsimple at SemEval-2025 Task 3: LLM-Uncertainty based Approach for Multilingual Hallucination Span Detection
por: Vemula, Saketh Reddy, et al.
Publicado: (2025)
por: Vemula, Saketh Reddy, et al.
Publicado: (2025)
ATLANTIS at SemEval-2025 Task 3: Detecting Hallucinated Text Spans in Question Answering
por: Kobus, Catherine, et al.
Publicado: (2025)
por: Kobus, Catherine, et al.
Publicado: (2025)
LTG at SemEval-2025 Task 10: Optimizing Context for Classification of Narrative Roles
por: Rønningstad, Egil, et al.
Publicado: (2025)
por: Rønningstad, Egil, et al.
Publicado: (2025)
MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
por: Borra, Federico, et al.
Publicado: (2024)
por: Borra, Federico, et al.
Publicado: (2024)
SemEval-2025 Task 9: The Food Hazard Detection Challenge
por: Randl, Korbinian, et al.
Publicado: (2025)
por: Randl, Korbinian, et al.
Publicado: (2025)
MSA at SemEval-2025 Task 3: High Quality Weak Labeling and LLM Ensemble Verification for Multilingual Hallucination Detection
por: Hikal, Baraa, et al.
Publicado: (2025)
por: Hikal, Baraa, et al.
Publicado: (2025)
REFIND at SemEval-2025 Task 3: Retrieval-Augmented Factuality Hallucination Detection in Large Language Models
por: Lee, DongGeon, et al.
Publicado: (2025)
por: Lee, DongGeon, et al.
Publicado: (2025)
HalluSearch at SemEval-2025 Task 3: A Search-Enhanced RAG Pipeline for Hallucination Detection
por: Abdallah, Mohamed A., et al.
Publicado: (2025)
por: Abdallah, Mohamed A., et al.
Publicado: (2025)
AIpom at SemEval-2024 Task 8: Detecting AI-produced Outputs in M4
por: Shirnin, Alexander, et al.
Publicado: (2024)
por: Shirnin, Alexander, et al.
Publicado: (2024)
SmurfCat at SemEval-2024 Task 6: Leveraging Synthetic Data for Hallucination Detection
por: Rykov, Elisei, et al.
Publicado: (2024)
por: Rykov, Elisei, et al.
Publicado: (2024)
HausaNLP at SemEval-2025 Task 3: Towards a Fine-Grained Model-Aware Hallucination Detection
por: Bala, Maryam, et al.
Publicado: (2025)
por: Bala, Maryam, et al.
Publicado: (2025)
DNB-AI-Project at SemEval-2025 Task 5: An LLM-Ensemble Approach for Automated Subject Indexing
por: Kluge, Lisa, et al.
Publicado: (2025)
por: Kluge, Lisa, et al.
Publicado: (2025)
SHROOM-INDElab at SemEval-2024 Task 6: Zero- and Few-Shot LLM-Based Classification for Hallucination Detection
por: Allen, Bradley P., et al.
Publicado: (2024)
por: Allen, Bradley P., et al.
Publicado: (2024)
Atyaephyra at SemEval-2025 Task 4: Low-Rank Negative Preference Optimization
por: Bronec, Jan, et al.
Publicado: (2025)
por: Bronec, Jan, et al.
Publicado: (2025)
SemEval-2025 Task 3: Mu-SHROOM, the Multilingual Shared Task on Hallucinations and Related Observable Overgeneration Mistakes
por: Vázquez, Raúl, et al.
Publicado: (2025)
por: Vázquez, Raúl, et al.
Publicado: (2025)
SemEval-2025 Task 11: Bridging the Gap in Text-Based Emotion Detection
por: Muhammad, Shamsuddeen Hassan, et al.
Publicado: (2025)
por: Muhammad, Shamsuddeen Hassan, et al.
Publicado: (2025)
HausaNLP at SemEval-2025 Task 11: Hausa Text Emotion Detection
por: Sani, Sani Abdullahi, et al.
Publicado: (2025)
por: Sani, Sani Abdullahi, et al.
Publicado: (2025)
AILS-NTUA at SemEval-2025 Task 3: Leveraging Large Language Models and Translation Strategies for Multilingual Hallucination Detection
por: Karkani, Dimitra, et al.
Publicado: (2025)
por: Karkani, Dimitra, et al.
Publicado: (2025)
Mothman at SemEval-2024 Task 9: An Iterative System for Chain-of-Thought Prompt Optimization
por: Chen, Alvin Po-Chun, et al.
Publicado: (2024)
por: Chen, Alvin Po-Chun, et al.
Publicado: (2024)
Annif at SemEval-2025 Task 5: Traditional XMTC augmented by LLMs
por: Suominen, Osma, et al.
Publicado: (2025)
por: Suominen, Osma, et al.
Publicado: (2025)
ZJUKLAB at SemEval-2025 Task 4: Unlearning via Model Merging
por: Xu, Haoming, et al.
Publicado: (2025)
por: Xu, Haoming, et al.
Publicado: (2025)
GateNLP at SemEval-2025 Task 10: Hierarchical Three-Step Prompting for Multilingual Narrative Classification
por: Singh, Iknoor, et al.
Publicado: (2025)
por: Singh, Iknoor, et al.
Publicado: (2025)
PromotionGo at SemEval-2025 Task 11: A Feature-Centric Framework for Cross-Lingual Multi-Emotion Detection in Short Texts
por: Huang, Ziyi, et al.
Publicado: (2025)
por: Huang, Ziyi, et al.
Publicado: (2025)
OPDAI at SemEval-2024 Task 6: Small LLMs can Accelerate Hallucination Detection with Weakly Supervised Data
por: Wei, Chengcheng, et al.
Publicado: (2024)
por: Wei, Chengcheng, et al.
Publicado: (2024)
CCNU at SemEval-2025 Task 3: Leveraging Internal and External Knowledge of Large Language Models for Multilingual Hallucination Annotation
por: Liu, Xu, et al.
Publicado: (2025)
por: Liu, Xu, et al.
Publicado: (2025)
SemEval-2025 Task 1: AdMIRe -- Advancing Multimodal Idiomaticity Representation
por: Pickard, Thomas, et al.
Publicado: (2025)
por: Pickard, Thomas, et al.
Publicado: (2025)
SemEval-2025 Task 7: Multilingual and Crosslingual Fact-Checked Claim Retrieval
por: Peng, Qiwei, et al.
Publicado: (2025)
por: Peng, Qiwei, et al.
Publicado: (2025)
SemEval-2026 Task 9: Detecting Multilingual, Multicultural and Multievent Online Polarization
por: Naseem, Usman, et al.
Publicado: (2026)
por: Naseem, Usman, et al.
Publicado: (2026)
Archimedes-AUEB at SemEval-2024 Task 5: LLM explains Civil Procedure
por: Chlapanis, Odysseas S., et al.
Publicado: (2024)
por: Chlapanis, Odysseas S., et al.
Publicado: (2024)
TUM-MiKaNi at SemEval-2025 Task 3: Towards Multilingual and Knowledge-Aware Non-factual Hallucination Identification
por: Anschütz, Miriam, et al.
Publicado: (2025)
por: Anschütz, Miriam, et al.
Publicado: (2025)
Team A at SemEval-2025 Task 11: Breaking Language Barriers in Emotion Detection with Multilingual Models
por: Sahil, P Sam, et al.
Publicado: (2025)
por: Sahil, P Sam, et al.
Publicado: (2025)
SHA256 at SemEval-2025 Task 4: Selective Amnesia -- Constrained Unlearning for Large Language Models via Knowledge Isolation
por: Agrawal, Saransh, et al.
Publicado: (2025)
por: Agrawal, Saransh, et al.
Publicado: (2025)
Empaths at SemEval-2025 Task 11: Retrieval-Augmented Approach to Perceived Emotions Prediction
por: Morozov, Lev, et al.
Publicado: (2025)
por: Morozov, Lev, et al.
Publicado: (2025)
MRT at SemEval-2025 Task 8: Maximizing Recovery from Tables with Multiple Steps
por: Lagos, Maximiliano Hormazábal, et al.
Publicado: (2025)
por: Lagos, Maximiliano Hormazábal, et al.
Publicado: (2025)
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
por: Ramakrishna, Anil, et al.
Publicado: (2025)
por: Ramakrishna, Anil, et al.
Publicado: (2025)
UWBa at SemEval-2025 Task 7: Multilingual and Crosslingual Fact-Checked Claim Retrieval
por: Lenc, Ladislav, et al.
Publicado: (2025)
por: Lenc, Ladislav, et al.
Publicado: (2025)
LyS at SemEval 2025 Task 8: Zero-Shot Code Generation for Tabular QA
por: Gude, Adrián, et al.
Publicado: (2025)
por: Gude, Adrián, et al.
Publicado: (2025)
mdok-style at SemEval-2026 Task 10: Finetuning LLMs for Conspiracy Detection
por: Macko, Dominik
Publicado: (2026)
por: Macko, Dominik
Publicado: (2026)
CRCL at SemEval-2024 Task 2: Simple prompt optimizations
por: Brutti-Mairesse, Clément, et al.
Publicado: (2024)
por: Brutti-Mairesse, Clément, et al.
Publicado: (2024)
Ejemplares similares
-
UCSC-NLP at SemEval-2026 Task 13: Multi-View Generalization and Diagnostic Analysis of Machine-Generated Code Detection
por: Chauhan, Kargi, et al.
Publicado: (2026) -
keepitsimple at SemEval-2025 Task 3: LLM-Uncertainty based Approach for Multilingual Hallucination Span Detection
por: Vemula, Saketh Reddy, et al.
Publicado: (2025) -
ATLANTIS at SemEval-2025 Task 3: Detecting Hallucinated Text Spans in Question Answering
por: Kobus, Catherine, et al.
Publicado: (2025) -
LTG at SemEval-2025 Task 10: Optimizing Context for Classification of Narrative Roles
por: Rønningstad, Egil, et al.
Publicado: (2025) -
MALTO at SemEval-2024 Task 6: Leveraging Synthetic Data for LLM Hallucination Detection
por: Borra, Federico, et al.
Publicado: (2024)