Cloaked Classifiers: Pseudonymization Strategies on Sensitive Classification Tasks
Fuente:
arXiv
Saved in:
| Main Authors: | Riabi, Arij, Mahamdi, Menel, Mouilleron, Virginie, Seddah, Djamé |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Beyond Dataset Creation: Critical View of Annotation Variation and Bias Probing of a Dataset for Online Radical Content Detection
by: Riabi, Arij, et al.
Published: (2024)
by: Riabi, Arij, et al.
Published: (2024)
Enriching the NArabizi Treebank: A Multifaceted Approach to Supporting an Under-Resourced Language
by: Riabi, Arij, et al.
Published: (2023)
by: Riabi, Arij, et al.
Published: (2023)
Common Ground, Diverse Roots: The Difficulty of Classifying Common Examples in Spanish Varieties
by: Lopetegui, Javier A., et al.
Published: (2024)
by: Lopetegui, Javier A., et al.
Published: (2024)
Can Character-based Language Models Improve Downstream Task Performance in Low-Resource and Noisy Language Scenarios?
by: Riabi, Arij, et al.
Published: (2021)
by: Riabi, Arij, et al.
Published: (2021)
When Tables Go Crazy: Evaluating Multimodal Models on French Financial Documents
by: Mouilleron, Virginie, et al.
Published: (2026)
by: Mouilleron, Virginie, et al.
Published: (2026)
Multilingual, Multimodal Pipeline for Creating Authentic and Structured Fact-Checked Claim Dataset
by: Hüsünbeyi, Z. Melce, et al.
Published: (2026)
by: Hüsünbeyi, Z. Melce, et al.
Published: (2026)
ModernBERT or DeBERTaV3? Examining Architecture and Data Influence on Transformer Encoder Models Performance
by: Antoun, Wissam, et al.
Published: (2025)
by: Antoun, Wissam, et al.
Published: (2025)
From Text to Source: Results in Detecting Large Language Model-Generated Content
by: Antoun, Wissam, et al.
Published: (2023)
by: Antoun, Wissam, et al.
Published: (2023)
Triggers Hijack Language Circuits: A Mechanistic Analysis of Backdoor Behaviors in Large Language Models
by: Lasnier, Théo, et al.
Published: (2026)
by: Lasnier, Théo, et al.
Published: (2026)
Rethinking the Multilingual Reasoning Gap with Layer Swap
by: Lasbordes, Maxence, et al.
Published: (2026)
by: Lasbordes, Maxence, et al.
Published: (2026)
Disentangling meaning from language in LLM-based machine translation
by: Lasnier, Théo, et al.
Published: (2026)
by: Lasnier, Théo, et al.
Published: (2026)
Language-Switching Triggers Take a Latent Detour Through Language Models
by: Kulumba, Francis, et al.
Published: (2026)
by: Kulumba, Francis, et al.
Published: (2026)
IYKYK: Using language models to decode extremist cryptolects
by: de Kock, Christine, et al.
Published: (2025)
by: de Kock, Christine, et al.
Published: (2025)
CamemBERT 2.0: A Smarter French Language Model Aged to Perfection
by: Antoun, Wissam, et al.
Published: (2024)
by: Antoun, Wissam, et al.
Published: (2024)
Gaperon: A Peppered English-French Generative Language Model Suite
by: Godey, Nathan, et al.
Published: (2025)
by: Godey, Nathan, et al.
Published: (2025)
ToxiCloakCN: Evaluating Robustness of Offensive Language Detection in Chinese with Cloaking Perturbations
by: Xiao, Yunze, et al.
Published: (2024)
by: Xiao, Yunze, et al.
Published: (2024)
Leveraging Wikidata for Geographically Informed Sociocultural Bias Dataset Creation: Application to Latin America
by: Karmim, Yannis, et al.
Published: (2026)
by: Karmim, Yannis, et al.
Published: (2026)
Survey of Pseudonymization, Abstractive Summarization & Spell Checker for Hindi and Marathi
by: Ransing, Rasika, et al.
Published: (2024)
by: Ransing, Rasika, et al.
Published: (2024)
Breaking the Cloak! Unveiling Chinese Cloaked Toxicity with Homophone Graph and Toxic Lexicon
by: Ma, Xuchen, et al.
Published: (2025)
by: Ma, Xuchen, et al.
Published: (2025)
Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark
by: Mayhew, Stephen, et al.
Published: (2023)
by: Mayhew, Stephen, et al.
Published: (2023)
Structured Semantic Cloaking for Jailbreak Attacks on Large Language Models
by: Sun, Xiaobing, et al.
Published: (2026)
by: Sun, Xiaobing, et al.
Published: (2026)
DeIDClinic: A Risk-Aware Pseudonymization Framework for Clinical Text De-identification and Re-identification Risk Assessment
by: Paul, Angel, et al.
Published: (2024)
by: Paul, Angel, et al.
Published: (2024)
A General Pseudonymization Framework for Cloud-Based LLMs: Replacing Privacy Information in Controlled Text Generation
by: Hou, Shilong, et al.
Published: (2025)
by: Hou, Shilong, et al.
Published: (2025)
Lost in Pronunciation: Detecting Chinese Offensive Language Disguised by Phonetic Cloaking Replacement
by: Guo, Haotan, et al.
Published: (2025)
by: Guo, Haotan, et al.
Published: (2025)
CodeCloak: A Method for Evaluating and Mitigating Code Leakage by LLM Code Assistants
by: Noah, Amit Finkman, et al.
Published: (2024)
by: Noah, Amit Finkman, et al.
Published: (2024)
Inequality in the Age of Pseudonymity
by: Yaish, Aviv, et al.
Published: (2025)
by: Yaish, Aviv, et al.
Published: (2025)
MMBERT: Scaled Mixture-of-Experts Multimodal BERT for Robust Chinese Hate Speech Detection under Cloaking Perturbations
by: Xue, Qiyao, et al.
Published: (2025)
by: Xue, Qiyao, et al.
Published: (2025)
On VLMs for Diverse Tasks in Multimodal Meme Classification
by: Gavit, Deepesh, et al.
Published: (2025)
by: Gavit, Deepesh, et al.
Published: (2025)
Are Large Language Models Good Classifiers? A Study on Edit Intent Classification in Scientific Document Revisions
by: Ruan, Qian, et al.
Published: (2024)
by: Ruan, Qian, et al.
Published: (2024)
dzNLP at NADI 2024 Shared Task: Multi-Classifier Ensemble with Weighted Voting and TF-IDF Features
by: Lichouri, Mohamed, et al.
Published: (2024)
by: Lichouri, Mohamed, et al.
Published: (2024)
Evaluating Prompting Strategies and Large Language Models in Systematic Literature Review Screening: Relevance and Task-Stage Classification
by: Han, Binglan, et al.
Published: (2025)
by: Han, Binglan, et al.
Published: (2025)
Multimodal Fact-Checking with Vision Language Models: A Probing Classifier based Solution with Embedding Strategies
by: Cekinel, Recep Firat, et al.
Published: (2024)
by: Cekinel, Recep Firat, et al.
Published: (2024)
Shape-Based Single Object Classification Using Ensemble Method Classifiers
by: Kamarudin, Nur Shazwani, et al.
Published: (2025)
by: Kamarudin, Nur Shazwani, et al.
Published: (2025)
Evaluation of Few-Shot Learning for Classification Tasks in the Polish Language
by: Hadeliya, Tsimur, et al.
Published: (2024)
by: Hadeliya, Tsimur, et al.
Published: (2024)
Large Language Models in the Task of Automatic Validation of Text Classifier Predictions
by: Tsymbalov, Aleksandr, et al.
Published: (2025)
by: Tsymbalov, Aleksandr, et al.
Published: (2025)
Strategy-Induct: Task-Level Strategy Induction for Instruction Generation
by: Chen, Po-Chun, et al.
Published: (2026)
by: Chen, Po-Chun, et al.
Published: (2026)
Research Experiment on Multi-Model Comparison for Chinese Text Classification Tasks
by: Li, JiaCheng
Published: (2024)
by: Li, JiaCheng
Published: (2024)
Multilingual Retrieval Augmented Generation for Culturally-Sensitive Tasks: A Benchmark for Cross-lingual Robustness
by: Li, Bryan, et al.
Published: (2024)
by: Li, Bryan, et al.
Published: (2024)
Your Extreme Multi-label Classifier is Secretly a Hierarchical Text Classifier for Free
by: Bertalis, Nerijus, et al.
Published: (2024)
by: Bertalis, Nerijus, et al.
Published: (2024)
TaskComplexity: A Dataset for Task Complexity Classification with In-Context Learning, FLAN-T5 and GPT-4o Benchmarks
by: Rasheed, Areeg Fahad, et al.
Published: (2024)
by: Rasheed, Areeg Fahad, et al.
Published: (2024)
Similar Items
-
Beyond Dataset Creation: Critical View of Annotation Variation and Bias Probing of a Dataset for Online Radical Content Detection
by: Riabi, Arij, et al.
Published: (2024) -
Enriching the NArabizi Treebank: A Multifaceted Approach to Supporting an Under-Resourced Language
by: Riabi, Arij, et al.
Published: (2023) -
Common Ground, Diverse Roots: The Difficulty of Classifying Common Examples in Spanish Varieties
by: Lopetegui, Javier A., et al.
Published: (2024) -
Can Character-based Language Models Improve Downstream Task Performance in Low-Resource and Noisy Language Scenarios?
by: Riabi, Arij, et al.
Published: (2021) -
When Tables Go Crazy: Evaluating Multimodal Models on French Financial Documents
by: Mouilleron, Virginie, et al.
Published: (2026)