SemEval-2024 Task 8: Multidomain, Multimodel and Multilingual Machine-Generated Text Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yuxia, Mansurov, Jonibek, Ivanov, Petar, Su, Jinyan, Shelmanov, Artem, Tsvigun, Akim, Afzal, Osama Mohammed, Mahmoud, Tarek, Puccetti, Giovanni, Arnold, Thomas, Whitehouse, Chenxi, Aji, Alham Fikri, Habash, Nizar, Gurevych, Iryna, Nakov, Preslav |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
M4GT-Bench: Evaluation Benchmark for Black-Box Machine-Generated Text Detection
par: Wang, Yuxia, et autres
Publié: (2024)
par: Wang, Yuxia, et autres
Publié: (2024)
M4: Multi-generator, Multi-domain, and Multi-lingual Black-Box Machine-Generated Text Detection
par: Wang, Yuxia, et autres
Publié: (2023)
par: Wang, Yuxia, et autres
Publié: (2023)
Data Laundering: Artificially Boosting Benchmark Results through Knowledge Distillation
par: Mansurov, Jonibek, et autres
Publié: (2024)
par: Mansurov, Jonibek, et autres
Publié: (2024)
GenAI Content Detection Task 1: English and Multilingual Machine-Generated Text Detection: AI vs. Human
par: Wang, Yuxia, et autres
Publié: (2025)
par: Wang, Yuxia, et autres
Publié: (2025)
LLM-DetectAIve: a Tool for Fine-Grained Machine-Generated Text Detection
par: Abassy, Mervat, et autres
Publié: (2024)
par: Abassy, Mervat, et autres
Publié: (2024)
Is Human-Like Text Liked by Humans? Multilingual Human Detection and Preference Against AI
par: Wang, Yuxia, et autres
Publié: (2025)
par: Wang, Yuxia, et autres
Publié: (2025)
Beyond "Not Novel Enough": Enriching Scholarly Critique with LLM-Assisted Feedback
par: Afzal, Osama Mohammed, et autres
Publié: (2025)
par: Afzal, Osama Mohammed, et autres
Publié: (2025)
Enabling Natural Zero-Shot Prompting on Encoder Models via Statement-Tuning
par: Elshabrawy, Ahmed, et autres
Publié: (2024)
par: Elshabrawy, Ahmed, et autres
Publié: (2024)
From Surveys to Narratives: Rethinking Cultural Value Adaptation in LLMs
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2025)
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2025)
KazMMLU: Evaluating Language Models on Kazakh, Russian, and Regional Knowledge of Kazakhstan
par: Togmanov, Mukhammed, et autres
Publié: (2025)
par: Togmanov, Mukhammed, et autres
Publié: (2025)
DialectalArabicMMLU: Benchmarking Dialectal Capabilities in Arabic and Multilingual Language Models
par: Altakrori, Malik H., et autres
Publié: (2025)
par: Altakrori, Malik H., et autres
Publié: (2025)
AICD Bench: A Challenging Benchmark for AI-Generated Code Detection
par: Orel, Daniil, et autres
Publié: (2026)
par: Orel, Daniil, et autres
Publié: (2026)
A Survey of Confidence Estimation and Calibration in Large Language Models
par: Geng, Jiahui, et autres
Publié: (2023)
par: Geng, Jiahui, et autres
Publié: (2023)
A Head to Predict and a Head to Question: Pre-trained Uncertainty Quantification Heads for Hallucination Detection in LLM Outputs
par: Shelmanov, Artem, et autres
Publié: (2025)
par: Shelmanov, Artem, et autres
Publié: (2025)
ConspirED: A Dataset for Cognitive Traits of Conspiracy Theories and Large Language Model Safety
par: Bates, Luke, et autres
Publié: (2025)
par: Bates, Luke, et autres
Publié: (2025)
Missci: Reconstructing Fallacies in Misrepresented Science
par: Glockner, Max, et autres
Publié: (2024)
par: Glockner, Max, et autres
Publié: (2024)
Multimodal Large Language Models to Support Real-World Fact-Checking
par: Geng, Jiahui, et autres
Publié: (2024)
par: Geng, Jiahui, et autres
Publié: (2024)
$\texttt{Droid}$: A Resource Suite for AI-Generated Code Detection
par: Orel, Daniil, et autres
Publié: (2025)
par: Orel, Daniil, et autres
Publié: (2025)
Grounding Fallacies Misrepresenting Scientific Publications in Evidence
par: Glockner, Max, et autres
Publié: (2024)
par: Glockner, Max, et autres
Publié: (2024)
LoraxBench: A Multitask, Multilingual Benchmark Suite for 20 Indonesian Languages
par: Aji, Alham Fikri, et autres
Publié: (2025)
par: Aji, Alham Fikri, et autres
Publié: (2025)
Improving Low-Resource Machine Translation via Round-Trip Reinforcement Learning
par: Attia, Ahmed, et autres
Publié: (2026)
par: Attia, Ahmed, et autres
Publié: (2026)
Daisy-TTS: Simulating Wider Spectrum of Emotions via Prosody Embedding Decomposition
par: Chevi, Rendi, et autres
Publié: (2024)
par: Chevi, Rendi, et autres
Publié: (2024)
A Template Is All You Meme
par: Bates, Luke, et autres
Publié: (2023)
par: Bates, Luke, et autres
Publié: (2023)
Con Instruction: Universal Jailbreaking of Multimodal Large Language Models via Non-Textual Modalities
par: Geng, Jiahui, et autres
Publié: (2025)
par: Geng, Jiahui, et autres
Publié: (2025)
OpenFactCheck: A Unified Framework for Factuality Evaluation of LLMs
par: Iqbal, Hasan, et autres
Publié: (2024)
par: Iqbal, Hasan, et autres
Publié: (2024)
Co-FactChecker: A Framework for Human-AI Collaborative Claim Verification Using Large Reasoning Models
par: Sahnan, Dhruv, et autres
Publié: (2026)
par: Sahnan, Dhruv, et autres
Publié: (2026)
Balanced Multi-Factor In-Context Learning for Multilingual Large Language Models
par: Kaneko, Masahiro, et autres
Publié: (2025)
par: Kaneko, Masahiro, et autres
Publié: (2025)
Sense Representations Are Inducible Interfaces
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
LLM Olympiad: Why Model Evaluation Needs a Sealed Exam
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
Extracting General-use Transformers for Low-resource Languages via Knowledge Distillation
par: Cruz, Jan Christian Blaise, et autres
Publié: (2025)
par: Cruz, Jan Christian Blaise, et autres
Publié: (2025)
Beyond Probabilities: Unveiling the Misalignment in Evaluating Large Language Models
par: Lyu, Chenyang, et autres
Publié: (2024)
par: Lyu, Chenyang, et autres
Publié: (2024)
FMI_SU_Yotkova_Kastreva at SemEval-2026 Task 13: Lightweight Detection of LLM-Generated Code via Stylometric Signals
par: Yotkova, Elitsa, et autres
Publié: (2026)
par: Yotkova, Elitsa, et autres
Publié: (2026)
FIRE: Fact-checking with Iterative Retrieval and Verification
par: Xie, Zhuohan, et autres
Publié: (2024)
par: Xie, Zhuohan, et autres
Publié: (2024)
Adapting Fake News Detection to the Era of Large Language Models
par: Su, Jinyan, et autres
Publié: (2023)
par: Su, Jinyan, et autres
Publié: (2023)
Corpus Poisoning via Approximate Greedy Gradient Descent
par: Su, Jinyan, et autres
Publié: (2024)
par: Su, Jinyan, et autres
Publié: (2024)
Rethinking STS and NLI in Large Language Models
par: Wang, Yuxia, et autres
Publié: (2023)
par: Wang, Yuxia, et autres
Publié: (2023)
From Multiple-Choice to Extractive QA: A Case Study for English and Arabic
par: Lynn, Teresa, et autres
Publié: (2024)
par: Lynn, Teresa, et autres
Publié: (2024)
Language-Specific Latent Process Hinders Cross-Lingual Performance
par: Lim, Zheng Wei, et autres
Publié: (2025)
par: Lim, Zheng Wei, et autres
Publié: (2025)
The Privileged Students: On the Value of Initialization in Multilingual Knowledge Distillation
par: Wibowo, Haryo Akbarianto, et autres
Publié: (2024)
par: Wibowo, Haryo Akbarianto, et autres
Publié: (2024)
Can Multimodal LLMs do Visual Temporal Understanding and Reasoning? The answer is No!
par: Imam, Mohamed Fazli, et autres
Publié: (2025)
par: Imam, Mohamed Fazli, et autres
Publié: (2025)
Documents similaires
-
M4GT-Bench: Evaluation Benchmark for Black-Box Machine-Generated Text Detection
par: Wang, Yuxia, et autres
Publié: (2024) -
M4: Multi-generator, Multi-domain, and Multi-lingual Black-Box Machine-Generated Text Detection
par: Wang, Yuxia, et autres
Publié: (2023) -
Data Laundering: Artificially Boosting Benchmark Results through Knowledge Distillation
par: Mansurov, Jonibek, et autres
Publié: (2024) -
GenAI Content Detection Task 1: English and Multilingual Machine-Generated Text Detection: AI vs. Human
par: Wang, Yuxia, et autres
Publié: (2025) -
LLM-DetectAIve: a Tool for Fine-Grained Machine-Generated Text Detection
par: Abassy, Mervat, et autres
Publié: (2024)