AILS-NTUA at SemEval-2025 Task 3: Leveraging Large Language Models and Translation Strategies for Multilingual Hallucination Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Karkani, Dimitra, Lymperaiou, Maria, Filandrianos, Giorgos, Spanos, Nikolaos, Voulodimos, Athanasios, Stamou, Giorgos |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AILS-NTUA at SemEval-2026 Task 8: Evaluating Multi-Turn RAG Conversations
par: Athanasiou, Dimosthenis, et autres
Publié: (2026)
par: Athanasiou, Dimosthenis, et autres
Publié: (2026)
AILS-NTUA at SemEval-2025 Task 8: Language-to-Code prompting and Error Fixing for Tabular Question Answering
par: Evangelatos, Andreas, et autres
Publié: (2025)
par: Evangelatos, Andreas, et autres
Publié: (2025)
AILS-NTUA at SemEval-2026 Task 12: Graph-Based Retrieval and Reflective Prompting for Abductive Event Reasoning
par: Karafyllis, Nikolas, et autres
Publié: (2026)
par: Karafyllis, Nikolas, et autres
Publié: (2026)
AILS-NTUA at SemEval-2026 Task 10: Agentic LLMs for Psycholinguistic Marker Extraction and Conspiracy Endorsement Detection
par: Spanakis, Panagiotis Alexios, et autres
Publié: (2026)
par: Spanakis, Panagiotis Alexios, et autres
Publié: (2026)
AILS-NTUA at SemEval-2026 Task 3: Efficient Dimensional Aspect-Based Sentiment Analysis
par: Gazetas, Stavros, et autres
Publié: (2026)
par: Gazetas, Stavros, et autres
Publié: (2026)
AILS-NTUA at SemEval-2025 Task 4: Parameter-Efficient Unlearning for Large Language Models using Data Chunking
par: Premptis, Iraklis, et autres
Publié: (2025)
par: Premptis, Iraklis, et autres
Publié: (2025)
AILS-NTUA at SemEval-2024 Task 6: Efficient model tuning for hallucination detection and analysis
par: Grigoriadou, Natalia, et autres
Publié: (2024)
par: Grigoriadou, Natalia, et autres
Publié: (2024)
AILS-NTUA at SemEval-2024 Task 9: Cracking Brain Teasers: Transformer Models for Lateral Thinking Puzzles
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
SemEval-2026 Task 6: CLARITY -- Unmasking Political Question Evasions
par: Thomas, Konstantinos, et autres
Publié: (2026)
par: Thomas, Konstantinos, et autres
Publié: (2026)
Pitfalls of Scale: Investigating the Inverse Task of Redefinition in Large Language Models
par: Stringli, Elena, et autres
Publié: (2025)
par: Stringli, Elena, et autres
Publié: (2025)
V-CECE: Visual Counterfactual Explanations via Conceptual Edits
par: Spanos, Nikolaos, et autres
Publié: (2025)
par: Spanos, Nikolaos, et autres
Publié: (2025)
HalCECE: A Framework for Explainable Hallucination Detection through Conceptual Counterfactuals in Image Captioning
par: Lymperaiou, Maria, et autres
Publié: (2025)
par: Lymperaiou, Maria, et autres
Publié: (2025)
Puzzle Solving using Reasoning of Large Language Models: A Survey
par: Giadikiaroglou, Panagiotis, et autres
Publié: (2024)
par: Giadikiaroglou, Panagiotis, et autres
Publié: (2024)
Analyze-Prompt-Reason: A Collaborative Agent-Based Framework for Multi-Image Vision-Language Reasoning
par: Vlachos, Angelos, et autres
Publié: (2025)
par: Vlachos, Angelos, et autres
Publié: (2025)
Explaining Vision GNNs: A Semantic and Visual Analysis of Graph-based Image Classification
par: Chaidos, Nikolaos, et autres
Publié: (2025)
par: Chaidos, Nikolaos, et autres
Publié: (2025)
Enhancing adversarial robustness in Natural Language Inference using explanations
par: Koulakos, Alexandros, et autres
Publié: (2024)
par: Koulakos, Alexandros, et autres
Publié: (2024)
RISCORE: Enhancing In-Context Riddle Solving in Language Models through Context-Reconstructed Example Augmentation
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
Evaluating Counterfactual Strategic Reasoning in Large Language Models
par: Georgousis, Dimitrios, et autres
Publié: (2026)
par: Georgousis, Dimitrios, et autres
Publié: (2026)
U-CECE: A Universal Multi-Resolution Framework for Conceptual Counterfactual Explanations
par: Dimitriou, Angeliki, et autres
Publié: (2026)
par: Dimitriou, Angeliki, et autres
Publié: (2026)
PAKTON: A Multi-Agent Framework for Question Answering in Long Legal Agreements
par: Raptopoulos, Petros, et autres
Publié: (2025)
par: Raptopoulos, Petros, et autres
Publié: (2025)
Optimal and efficient text counterfactuals using Graph Neural Networks
par: Lymperopoulos, Dimitris, et autres
Publié: (2024)
par: Lymperopoulos, Dimitris, et autres
Publié: (2024)
Counterfactual Edits for Generative Evaluation
par: Lymperaiou, Maria, et autres
Publié: (2023)
par: Lymperaiou, Maria, et autres
Publié: (2023)
Masked Generative Story Transformer with Character Guidance and Caption Augmentation
par: Papadimitriou, Christos, et autres
Publié: (2024)
par: Papadimitriou, Christos, et autres
Publié: (2024)
Reasoning or Pattern Matching? Probing Large Vision-Language Models with Visual Puzzles
par: Lymperaiou, Maria, et autres
Publié: (2026)
par: Lymperaiou, Maria, et autres
Publié: (2026)
BERTtime Stories: Investigating the Role of Synthetic Story Data in Language Pre-training
par: Theodoropoulos, Nikitas, et autres
Publié: (2024)
par: Theodoropoulos, Nikitas, et autres
Publié: (2024)
The Contribution of Knowledge in Visiolinguistic Learning: A Survey on Tasks and Challenges
par: Lymperaiou, Maria, et autres
Publié: (2023)
par: Lymperaiou, Maria, et autres
Publié: (2023)
Structure Your Data: Towards Semantic Graph Counterfactuals
par: Dimitriou, Angeliki, et autres
Publié: (2024)
par: Dimitriou, Angeliki, et autres
Publié: (2024)
Bias Beware: The Impact of Cognitive Biases on LLM-Driven Product Recommendations
par: Filandrianos, Giorgos, et autres
Publié: (2025)
par: Filandrianos, Giorgos, et autres
Publié: (2025)
Prompt2Fashion: An automatically generated fashion dataset
par: Argyrou, Georgia, et autres
Publié: (2024)
par: Argyrou, Georgia, et autres
Publié: (2024)
Automatic Generation of Fashion Images using Prompting in Generative Machine Learning Models
par: Argyrou, Georgia, et autres
Publié: (2024)
par: Argyrou, Georgia, et autres
Publié: (2024)
"I Never Said That": A dataset, taxonomy and baselines on response clarity classification
par: Thomas, Konstantinos, et autres
Publié: (2024)
par: Thomas, Konstantinos, et autres
Publié: (2024)
Conceptual Contrastive Edits in Textual and Vision-Language Retrieval
par: Lymperaiou, Maria, et autres
Publié: (2025)
par: Lymperaiou, Maria, et autres
Publié: (2025)
A survey on knowledge-enhanced multimodal learning
par: Lymperaiou, Maria, et autres
Publié: (2022)
par: Lymperaiou, Maria, et autres
Publié: (2022)
Large Language Models and Multimodal Retrieval for Visual Word Sense Disambiguation
par: Kritharoula, Anastasia, et autres
Publié: (2023)
par: Kritharoula, Anastasia, et autres
Publié: (2023)
StockSim: A Dual-Mode Order-Level Simulator for Evaluating Multi-Agent LLMs in Financial Markets
par: Papadakis, Charidimos, et autres
Publié: (2025)
par: Papadakis, Charidimos, et autres
Publié: (2025)
ATLAS: Adaptive Trading with LLM AgentS Through Dynamic Prompt Optimization and Multi-Agent Coordination
par: Papadakis, Charidimos, et autres
Publié: (2025)
par: Papadakis, Charidimos, et autres
Publié: (2025)
Assumed Identities: Quantifying Gender Bias in Machine Translation of Gender-Ambiguous Occupational Terms
par: Mastromichalakis, Orfeas Menis, et autres
Publié: (2025)
par: Mastromichalakis, Orfeas Menis, et autres
Publié: (2025)
ARPA: A Novel Hybrid Model for Advancing Visual Word Disambiguation Using Large Language Models and Transformers
par: Papastavrou, Aristi, et autres
Publié: (2024)
par: Papastavrou, Aristi, et autres
Publié: (2024)
CSE-UOI at SemEval-2026 Task 6: A Two-Stage Heterogeneous Ensemble with Deliberative Complexity Gating for Political Evasion Detection
par: Tzouvaras, Christos, et autres
Publié: (2026)
par: Tzouvaras, Christos, et autres
Publié: (2026)
Optimal Recourse Summaries via Bi-Objective Decision Tree Learning
par: Chatzis, Ioannis, et autres
Publié: (2026)
par: Chatzis, Ioannis, et autres
Publié: (2026)
Documents similaires
-
AILS-NTUA at SemEval-2026 Task 8: Evaluating Multi-Turn RAG Conversations
par: Athanasiou, Dimosthenis, et autres
Publié: (2026) -
AILS-NTUA at SemEval-2025 Task 8: Language-to-Code prompting and Error Fixing for Tabular Question Answering
par: Evangelatos, Andreas, et autres
Publié: (2025) -
AILS-NTUA at SemEval-2026 Task 12: Graph-Based Retrieval and Reflective Prompting for Abductive Event Reasoning
par: Karafyllis, Nikolas, et autres
Publié: (2026) -
AILS-NTUA at SemEval-2026 Task 10: Agentic LLMs for Psycholinguistic Marker Extraction and Conspiracy Endorsement Detection
par: Spanakis, Panagiotis Alexios, et autres
Publié: (2026) -
AILS-NTUA at SemEval-2026 Task 3: Efficient Dimensional Aspect-Based Sentiment Analysis
par: Gazetas, Stavros, et autres
Publié: (2026)