Fine-Tuning Over Architectural Complexity: Broad-Coverage PII Detection on PIIBench with DeBERTa
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Jha, Pritesh |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PIIBench: A Unified Multi-Source Benchmark Corpus for Personally Identifiable Information Detection
par: Jha, Pritesh
Publié: (2026)
par: Jha, Pritesh
Publié: (2026)
A Hybrid DeBERTa and Gated Broad Learning System for Cyberbullying Detection in English Text
par: Kumar, Devesh
Publié: (2025)
par: Kumar, Devesh
Publié: (2025)
Performance Evaluation of Emotion Classification in Japanese Using RoBERTa and DeBERTa
par: Takenaka, Yoichi
Publié: (2025)
par: Takenaka, Yoichi
Publié: (2025)
Instruct-DeBERTa: A Hybrid Approach for Aspect-based Sentiment Analysis on Textual Reviews
par: Jayakody, Dineth, et autres
Publié: (2024)
par: Jayakody, Dineth, et autres
Publié: (2024)
An Advanced NLP Framework for Automated Medical Diagnosis with DeBERTa and Dynamic Contextual Positional Gating
par: Khaniki, Mohammad Ali Labbaf, et autres
Publié: (2025)
par: Khaniki, Mohammad Ali Labbaf, et autres
Publié: (2025)
Sarang at DEFACTIFY 4.0: Detecting AI-Generated Text Using Noised Data and an Ensemble of DeBERTa Models
par: Trivedi, Avinash, et autres
Publié: (2025)
par: Trivedi, Avinash, et autres
Publié: (2025)
CGRA-DeBERTa Concept Guided Residual Augmentation Transformer for Theologically Islamic Understanding
par: Hussain, Tahir, et autres
Publié: (2026)
par: Hussain, Tahir, et autres
Publié: (2026)
TLDR at SemEval-2024 Task 2: T5-generated clinical-Language summaries for DeBERTa Report Analysis
par: Das, Spandan, et autres
Publié: (2024)
par: Das, Spandan, et autres
Publié: (2024)
NER- RoBERTa: Fine-Tuning RoBERTa for Named Entity Recognition (NER) within low-resource languages
par: Abdullah, Abdulhady Abas, et autres
Publié: (2024)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2024)
RaV-IDP: A Reconstruction-as-Validation Framework for Faithful Intelligent Document Processing
par: Jha, Pritesh
Publié: (2026)
par: Jha, Pritesh
Publié: (2026)
PlantDeBERTa: An Open Source Language Model for Plant Science
par: Khey, Hiba, et autres
Publié: (2025)
par: Khey, Hiba, et autres
Publié: (2025)
multiMentalRoBERTa: A Fine-tuned Multiclass Classifier for Mental Health Disorder
par: Islam, K M Sajjadul, et autres
Publié: (2025)
par: Islam, K M Sajjadul, et autres
Publié: (2025)
DESS: DeBERTa Enhanced Syntactic-Semantic Aspect Sentiment Triplet Extraction
par: Thenuwara, Vishal, et autres
Publié: (2025)
par: Thenuwara, Vishal, et autres
Publié: (2025)
SecureNet: A Comparative Study of DeBERTa and Large Language Models for Phishing Detection
par: Mahendru, Sakshi, et autres
Publié: (2024)
par: Mahendru, Sakshi, et autres
Publié: (2024)
PII-Scope: A Comprehensive Study on Training Data PII Extraction Attacks in LLMs
par: Nakka, Krishna Kanth, et autres
Publié: (2024)
par: Nakka, Krishna Kanth, et autres
Publié: (2024)
Scalable multilingual PII annotation for responsible AI in LLMs
par: Meena, Bharti, et autres
Publié: (2025)
par: Meena, Bharti, et autres
Publié: (2025)
GlotCC: An Open Broad-Coverage CommonCrawl Corpus and Pipeline for Minority Languages
par: Kargaran, Amir Hossein, et autres
Publié: (2024)
par: Kargaran, Amir Hossein, et autres
Publié: (2024)
Data Quality Matters: Suicide Intention Detection on Social Media Posts Using RoBERTa-CNN
par: Lin, Emily, et autres
Publié: (2024)
par: Lin, Emily, et autres
Publié: (2024)
StressRoBERTa: Cross-Condition Transfer Learning from Depression, Anxiety, and PTSD to Stress Detection
par: Alqahtani, Amal, et autres
Publié: (2025)
par: Alqahtani, Amal, et autres
Publié: (2025)
HydraLoRA: An Asymmetric LoRA Architecture for Efficient Fine-Tuning
par: Tian, Chunlin, et autres
Publié: (2024)
par: Tian, Chunlin, et autres
Publié: (2024)
Bonafide at LegalLens 2024 Shared Task: Using Lightweight DeBERTa Based Encoder For Legal Violation Detection and Resolution
par: Bordia, Shikha
Publié: (2024)
par: Bordia, Shikha
Publié: (2024)
Reasoning Towards Fairness: Mitigating Bias in Language Models through Reasoning-Guided Fine-Tuning
par: Kabra, Sanchit, et autres
Publié: (2025)
par: Kabra, Sanchit, et autres
Publié: (2025)
Spectrum Tuning: Post-Training for Distributional Coverage and In-Context Steerability
par: Sorensen, Taylor, et autres
Publié: (2025)
par: Sorensen, Taylor, et autres
Publié: (2025)
Instruction Tuning With Loss Over Instructions
par: Shi, Zhengyan, et autres
Publié: (2024)
par: Shi, Zhengyan, et autres
Publié: (2024)
GLiNER2-PII: A Multilingual Model for Personally Identifiable Information Extraction
par: Zaratiana, Urchade, et autres
Publié: (2026)
par: Zaratiana, Urchade, et autres
Publié: (2026)
PANORAMA: A synthetic PII-laced dataset for studying sensitive data memorization in LLMs
par: Selvam, Sriram, et autres
Publié: (2025)
par: Selvam, Sriram, et autres
Publié: (2025)
PIIGuard: Mitigating PII Harvesting under Adversarial Sanitization
par: Liu, Mingshuo, et autres
Publié: (2026)
par: Liu, Mingshuo, et autres
Publié: (2026)
A Study of Large Language Models for Patient Information Extraction: Model Architecture, Fine-Tuning Strategy, and Multi-task Instruction Tuning
par: Peng, Cheng, et autres
Publié: (2025)
par: Peng, Cheng, et autres
Publié: (2025)
PII-Compass: Guiding LLM training data extraction prompts towards the target PII via grounding
par: Nakka, Krishna Kanth, et autres
Publié: (2024)
par: Nakka, Krishna Kanth, et autres
Publié: (2024)
From LLM to Conversational Agent: A Memory Enhanced Architecture with Fine-Tuning of Large Language Models
par: Liu, Na, et autres
Publié: (2024)
par: Liu, Na, et autres
Publié: (2024)
Comparing LLM and Fine-Tuned Model Performance on NVDRS Circumstance Extraction with Varying Prompt Complexity
par: Martin, Geoffrey, et autres
Publié: (2026)
par: Martin, Geoffrey, et autres
Publié: (2026)
Duluth at SemEval-2026 Task 6: DeBERTa with LLM-Augmented Data for Unmasking Political Question Evasions
par: Syed, Shujauddin, et autres
Publié: (2026)
par: Syed, Shujauddin, et autres
Publié: (2026)
Binary Token-Level Classification with DeBERTa for All-Type MWE Identification: A Lightweight Approach with Linguistic Enhancement
par: Rossini, Diego, et autres
Publié: (2026)
par: Rossini, Diego, et autres
Publié: (2026)
Natural Language Fine-Tuning
par: Liu, Jia, et autres
Publié: (2024)
par: Liu, Jia, et autres
Publié: (2024)
Parameter-Efficient Fine-Tuning for Medical Text Summarization: A Comparative Study of Lora, Prompt Tuning, and Full Fine-Tuning
par: Shernazarov, Ulugbek, et autres
Publié: (2026)
par: Shernazarov, Ulugbek, et autres
Publié: (2026)
Mast Kalandar at SemEval-2024 Task 8: On the Trail of Textual Origins: RoBERTa-BiLSTM Approach to Detect AI-Generated Text
par: Bafna, Jainit Sushil, et autres
Publié: (2024)
par: Bafna, Jainit Sushil, et autres
Publié: (2024)
PAFT: Prompt-Agnostic Fine-Tuning
par: Wei, Chenxing, et autres
Publié: (2025)
par: Wei, Chenxing, et autres
Publié: (2025)
Parameter-Efficient Fine-Tuning With Adapters
par: Chen, Keyu, et autres
Publié: (2024)
par: Chen, Keyu, et autres
Publié: (2024)
Locale-Conditioned Few-Shot Prompting Mitigates Demonstration Regurgitation in On-Device PII Substitution with Small Language Models
par: Sadani, Anuj, et autres
Publié: (2026)
par: Sadani, Anuj, et autres
Publié: (2026)
When Does Language Transfer Help? Sequential Fine-Tuning for Cross-Lingual Euphemism Detection
par: Sammartino, Julia, et autres
Publié: (2025)
par: Sammartino, Julia, et autres
Publié: (2025)
Documents similaires
-
PIIBench: A Unified Multi-Source Benchmark Corpus for Personally Identifiable Information Detection
par: Jha, Pritesh
Publié: (2026) -
A Hybrid DeBERTa and Gated Broad Learning System for Cyberbullying Detection in English Text
par: Kumar, Devesh
Publié: (2025) -
Performance Evaluation of Emotion Classification in Japanese Using RoBERTa and DeBERTa
par: Takenaka, Yoichi
Publié: (2025) -
Instruct-DeBERTa: A Hybrid Approach for Aspect-based Sentiment Analysis on Textual Reviews
par: Jayakody, Dineth, et autres
Publié: (2024) -
An Advanced NLP Framework for Automated Medical Diagnosis with DeBERTa and Dynamic Contextual Positional Gating
par: Khaniki, Mohammad Ali Labbaf, et autres
Publié: (2025)