Towards Fair and Efficient De-identification: Quantifying the Efficiency and Generalizability of De-identification Approaches
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zambare, Noopur, Aghakasiri, Kiana, Lin, Carissa, Ye, Carrie, Mitchell, J. Ross, Abdalla, Mohamed |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Not What the Doctor Ordered: Surveying LLM-based De-identification and Quantifying Clinical Information Loss
par: Aghakasiri, Kiana, et autres
Publié: (2025)
par: Aghakasiri, Kiana, et autres
Publié: (2025)
AIOptimizer - Software performance optimisation prototype for cost minimisation
par: Zambare, Noopur
Publié: (2023)
par: Zambare, Noopur
Publié: (2023)
In the Name of Fairness: Assessing the Bias in Clinical Record De-identification
par: Xiao, Yuxin, et autres
Publié: (2023)
par: Xiao, Yuxin, et autres
Publié: (2023)
Thunder-DeID: Accurate and Efficient De-identification Framework for Korean Court Judgments
par: Hahm, Sungeun, et autres
Publié: (2025)
par: Hahm, Sungeun, et autres
Publié: (2025)
Beyond a Million Tokens: Benchmarking and Enhancing Long-Term Memory in LLMs
par: Tavakoli, Mohammad, et autres
Publié: (2025)
par: Tavakoli, Mohammad, et autres
Publié: (2025)
DeIDClinic: A Risk-Aware Pseudonymization Framework for Clinical Text De-identification and Re-identification Risk Assessment
par: Paul, Angel, et autres
Publié: (2024)
par: Paul, Angel, et autres
Publié: (2024)
Enhancing Clinical Models with Pseudo Data for De-identification
par: Landes, Paul, et autres
Publié: (2025)
par: Landes, Paul, et autres
Publié: (2025)
Enhancing the De-identification of Personally Identifiable Information in Educational Data
par: Ji, Zilyu, et autres
Publié: (2025)
par: Ji, Zilyu, et autres
Publié: (2025)
Re-identification of De-identified Documents with Autoregressive Infilling
par: Charpentier, Lucas Georges Gabriel, et autres
Publié: (2025)
par: Charpentier, Lucas Georges Gabriel, et autres
Publié: (2025)
Comparing Multiclass Classification Algorithms for Financial Distress Prediction
par: Zambare, Noopur, et autres
Publié: (2023)
par: Zambare, Noopur, et autres
Publié: (2023)
Paradox of De-identification: A Critique of HIPAA Safe Harbour in the Age of LLMs
par: Jiang, Lavender Y., et autres
Publié: (2026)
par: Jiang, Lavender Y., et autres
Publié: (2026)
Collaboration or Corporate Capture? Quantifying NLP's Reliance on Industry Artifacts and Contributions
par: Aitken, Will, et autres
Publié: (2023)
par: Aitken, Will, et autres
Publié: (2023)
Anonpsy: A Graph-Based Framework for Structure-Preserving De-identification of Psychiatric Narratives
par: Lim, Kyung Ho, et autres
Publié: (2026)
par: Lim, Kyung Ho, et autres
Publié: (2026)
De-identification is not enough: a comparison between de-identified and synthetic clinical notes
par: Sarkar, Atiquer Rahman, et autres
Publié: (2024)
par: Sarkar, Atiquer Rahman, et autres
Publié: (2024)
Differentially Private De-identification of Dutch Clinical Notes: A Comparative Evaluation
par: Miranda, Michele, et autres
Publié: (2026)
par: Miranda, Michele, et autres
Publié: (2026)
Improving the Performance of Radiology Report De-identification with Large-Scale Training and Benchmarking Against Cloud Vendor Methods
par: Prakash, Eva, et autres
Publié: (2025)
par: Prakash, Eva, et autres
Publié: (2025)
Automated Identification of Discourse Markers Using the NLP Approach: The Case of "Okay"
par: Sanosi, Abdulaziz, et autres
Publié: (2021)
par: Sanosi, Abdulaziz, et autres
Publié: (2021)
A Trip Towards Fairness: Bias and De-Biasing in Large Language Models
par: Ranaldi, Leonardo, et autres
Publié: (2023)
par: Ranaldi, Leonardo, et autres
Publié: (2023)
Cross-lingual paraphrase identification
par: Fedorova, Inessa, et autres
Publié: (2024)
par: Fedorova, Inessa, et autres
Publié: (2024)
SHIELD: A Diverse Clinical Note Dataset and Distilled Small Language Models for Enterprise-Scale De-identification
par: Posada, Jose D., et autres
Publié: (2026)
par: Posada, Jose D., et autres
Publié: (2026)
GiusBERTo: A Legal Language Model for Personal Data De-identification in Italian Court of Auditors Decisions
par: Salierno, Giulio, et autres
Publié: (2024)
par: Salierno, Giulio, et autres
Publié: (2024)
CodeSCM: Causal Analysis for Multi-Modal Code Generation
par: Gupta, Mukur, et autres
Publié: (2025)
par: Gupta, Mukur, et autres
Publié: (2025)
LLMs-in-the-Loop Part 2: Expert Small AI Models for Anonymization and De-identification of PHI Across Multiple Languages
par: Gunay, Murat, et autres
Publié: (2024)
par: Gunay, Murat, et autres
Publié: (2024)
Synthetic Data for Veterinary EHR De-identification: Benefits, Limits, and Safety Trade-offs Under Fixed Compute
par: Brundage, David
Publié: (2026)
par: Brundage, David
Publié: (2026)
Efficiently Quantifying and Mitigating Ripple Effects in Model Editing
par: Wang, Jianchen, et autres
Publié: (2024)
par: Wang, Jianchen, et autres
Publié: (2024)
Stronger Re-identification Attacks through Reasoning and Aggregation
par: Charpentier, Lucas Georges Gabriel, et autres
Publié: (2025)
par: Charpentier, Lucas Georges Gabriel, et autres
Publié: (2025)
Hate Speech Detection with Generalizable Target-aware Fairness
par: Chen, Tong, et autres
Publié: (2024)
par: Chen, Tong, et autres
Publié: (2024)
De-identification of clinical free text using natural language processing: A systematic review of current approaches
par: Kovačević, Aleksandar, et autres
Publié: (2023)
par: Kovačević, Aleksandar, et autres
Publié: (2023)
Feature engineering vs. deep learning for paper section identification: Toward applications in Chinese medical literature
par: Zhou, Sijia, et autres
Publié: (2024)
par: Zhou, Sijia, et autres
Publié: (2024)
CTC-DID: CTC-Based Arabic dialect identification for streaming applications
par: Farooq, Muhammad Umar, et autres
Publié: (2026)
par: Farooq, Muhammad Umar, et autres
Publié: (2026)
Comparing representations of long clinical texts for the task of patient note-identification
par: Alsaidi, Safa, et autres
Publié: (2025)
par: Alsaidi, Safa, et autres
Publié: (2025)
Automatic register identification for the open web using multilingual deep learning
par: Henriksson, Erik, et autres
Publié: (2024)
par: Henriksson, Erik, et autres
Publié: (2024)
AROhI: An Interactive Tool for Estimating ROI of Data Analytics
par: Zambare, Noopur, et autres
Publié: (2024)
par: Zambare, Noopur, et autres
Publié: (2024)
AIDBench: A benchmark for evaluating the authorship identification capability of large language models
par: Wen, Zichen, et autres
Publié: (2024)
par: Wen, Zichen, et autres
Publié: (2024)
Classifier identification in Ancient Egyptian as a low-resource sequence-labelling task
par: Nikolaev, Dmitry, et autres
Publié: (2024)
par: Nikolaev, Dmitry, et autres
Publié: (2024)
Unveiling the Tapestry of Automated Essay Scoring: A Comprehensive Investigation of Accuracy, Fairness, and Generalizability
par: Yang, Kaixun, et autres
Publié: (2024)
par: Yang, Kaixun, et autres
Publié: (2024)
Brain-tuning Improves Generalizability and Efficiency of Brain Alignment in Speech Models
par: Moussa, Omer, et autres
Publié: (2025)
par: Moussa, Omer, et autres
Publié: (2025)
AIDetx: a compression-based method for identification of machine-learning generated text
par: Almeida, Leonardo, et autres
Publié: (2024)
par: Almeida, Leonardo, et autres
Publié: (2024)
AI-based approach to burnout identification from textual data
par: Zavertiaeva, Marina, et autres
Publié: (2026)
par: Zavertiaeva, Marina, et autres
Publié: (2026)
Towards Generalizable Implicit In-Context Learning with Attention Routing
par: Li, Jiaqian, et autres
Publié: (2025)
par: Li, Jiaqian, et autres
Publié: (2025)
Documents similaires
-
Not What the Doctor Ordered: Surveying LLM-based De-identification and Quantifying Clinical Information Loss
par: Aghakasiri, Kiana, et autres
Publié: (2025) -
AIOptimizer - Software performance optimisation prototype for cost minimisation
par: Zambare, Noopur
Publié: (2023) -
In the Name of Fairness: Assessing the Bias in Clinical Record De-identification
par: Xiao, Yuxin, et autres
Publié: (2023) -
Thunder-DeID: Accurate and Efficient De-identification Framework for Korean Court Judgments
par: Hahm, Sungeun, et autres
Publié: (2025) -
Beyond a Million Tokens: Benchmarking and Enhancing Long-Term Memory in LLMs
par: Tavakoli, Mohammad, et autres
Publié: (2025)