Lexical Substitution is not Synonym Substitution: On the Importance of Producing Contextually Relevant Word Substitutes
Fuente:
arXiv
Guardado en:
| Autores principales: | Vladika, Juraj, Meisenbacher, Stephen, Matthes, Florian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DP-MLM: Differentially Private Text Rewriting Using Masked Language Models
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
Towards A Structured Overview of Use Cases for Natural Language Processing in the Legal Domain: A German Perspective
por: Vladika, Juraj, et al.
Publicado: (2024)
por: Vladika, Juraj, et al.
Publicado: (2024)
On the Influence of Context Size and Model Choice in Retrieval-Augmented Generation Systems
por: Vladika, Juraj, et al.
Publicado: (2025)
por: Vladika, Juraj, et al.
Publicado: (2025)
With Privacy, Size Matters: On the Importance of Dataset Size in Differentially Private Text Rewriting
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
MedSEBA: Synthesizing Evidence-Based Answers Grounded in Evolving Medical Literature
por: Vladika, Juraj, et al.
Publicado: (2025)
por: Vladika, Juraj, et al.
Publicado: (2025)
Comparing Knowledge Sources for Open-Domain Scientific Claim Verification
por: Vladika, Juraj, et al.
Publicado: (2024)
por: Vladika, Juraj, et al.
Publicado: (2024)
Improving Health Question Answering with Reliable and Time-Aware Evidence Retrieval
por: Vladika, Juraj, et al.
Publicado: (2024)
por: Vladika, Juraj, et al.
Publicado: (2024)
FActBench: A Benchmark for Fine-grained Automatic Evaluation of LLM-Generated Text in the Medical Domain
por: Afzal, Anum, et al.
Publicado: (2025)
por: Afzal, Anum, et al.
Publicado: (2025)
Correcting Hallucinations in News Summaries: Exploration of Self-Correcting LLM Methods with External Knowledge
por: Vladika, Juraj, et al.
Publicado: (2025)
por: Vladika, Juraj, et al.
Publicado: (2025)
MedREQAL: Examining Medical Knowledge Recall of Large Language Models via Question Answering
por: Vladika, Juraj, et al.
Publicado: (2024)
por: Vladika, Juraj, et al.
Publicado: (2024)
A Collocation-based Method for Addressing Challenges in Word-level Metric Differential Privacy
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
Step-by-Step Fact Verification System for Medical Claims with Explainable Reasoning
por: Vladika, Juraj, et al.
Publicado: (2025)
por: Vladika, Juraj, et al.
Publicado: (2025)
Facts Fade Fast: Evaluating Memorization of Outdated Medical Knowledge in Large Language Models
por: Vladika, Juraj, et al.
Publicado: (2025)
por: Vladika, Juraj, et al.
Publicado: (2025)
HealthFC: Verifying Health Claims with Evidence-Based Medical Fact-Checking
por: Vladika, Juraj, et al.
Publicado: (2023)
por: Vladika, Juraj, et al.
Publicado: (2023)
Enhancing Answer Attribution for Faithful Text Generation with Large Language Models
por: Vladika, Juraj, et al.
Publicado: (2024)
por: Vladika, Juraj, et al.
Publicado: (2024)
1-Diffractor: Efficient and Utility-Preserving Text Obfuscation Leveraging Word-Level Metric Differential Privacy
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
Just Rewrite It Again: A Post-Processing Method for Enhanced Semantic Similarity and Privacy Preservation of Differentially Private Rewritten Text
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
Thinking Outside of the Differential Privacy Box: A Case Study in Text Privatization with Language Model Prompting
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
The Double-edged Sword of LLM-based Data Reconstruction: Understanding and Mitigating Contextual Vulnerability in Word-level Differential Privacy Text Sanitization
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
Enterprise Use Cases Combining Knowledge Graphs and Natural Language Processing
por: Schneider, Phillip, et al.
Publicado: (2024)
por: Schneider, Phillip, et al.
Publicado: (2024)
A Comparative Analysis of Word-Level Metric Differential Privacy: Benchmarking The Privacy-Utility Trade-off
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
Leveraging Semantic Triples for Private Document Generation with Local Differential Privacy Guarantees
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
On the Impact of Noise in Differentially Private Text Rewriting
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
LLM-as-a-Judge for Privacy Evaluation? Exploring the Alignment of Human and LLM Perceptions of Privacy in Textual Data
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
A Systematic Exploration of Text Decomposition and Budget Distribution in Differentially Private Text Obfuscation
por: Meisenbacher, Stephen, et al.
Publicado: (2026)
por: Meisenbacher, Stephen, et al.
Publicado: (2026)
Spend Your Budget Wisely: Towards an Intelligent Distribution of the Privacy Budget in Differentially Private Text Rewriting
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
A Case Study on the Impact of Anonymization Along the RAG Pipeline
por: Bodea, Andreea-Elena, et al.
Publicado: (2026)
por: Bodea, Andreea-Elena, et al.
Publicado: (2026)
Multilingual Substitution-based Word Sense Induction
por: Kokosinskii, Denis, et al.
Publicado: (2024)
por: Kokosinskii, Denis, et al.
Publicado: (2024)
ProLex: A Benchmark for Language Proficiency-oriented Lexical Substitution
por: Zhang, Xuanming, et al.
Publicado: (2024)
por: Zhang, Xuanming, et al.
Publicado: (2024)
Investigating User Perspectives on Differentially Private Text Privatization
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
por: Meisenbacher, Stephen, et al.
Publicado: (2025)
Unsupervised Candidate Ranking for Lexical Substitution via Holistic Sentence Semantics
por: Hu, Zhongyang, et al.
Publicado: (2025)
por: Hu, Zhongyang, et al.
Publicado: (2025)
Learning to Substitute Words with Model-based Score Ranking
por: Liu, Hongye, et al.
Publicado: (2025)
por: Liu, Hongye, et al.
Publicado: (2025)
SoK: Privacy Risks and Mitigations in Retrieval-Augmented Generation Systems
por: Bodea, Andreea-Elena, et al.
Publicado: (2026)
por: Bodea, Andreea-Elena, et al.
Publicado: (2026)
When Explainability Meets Privacy: An Investigation at the Intersection of Post-hoc Explainability and Differential Privacy in the Context of Natural Language Processing
por: Dhaini, Mahdi, et al.
Publicado: (2025)
por: Dhaini, Mahdi, et al.
Publicado: (2025)
An Improved Method for Class-specific Keyword Extraction: A Case Study in the German Business Registry
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
por: Meisenbacher, Stephen, et al.
Publicado: (2024)
Substitution for Non-Wellfounded Syntax with Binders through Monoidal Categories
por: Matthes, Ralph, et al.
Publicado: (2023)
por: Matthes, Ralph, et al.
Publicado: (2023)
Adapter-based Approaches to Knowledge-enhanced Language Models -- A Survey
por: Fichtl, Alexander, et al.
Publicado: (2024)
por: Fichtl, Alexander, et al.
Publicado: (2024)
Learning to Substitute Components for Compositional Generalization
por: Li, Zhaoyi, et al.
Publicado: (2025)
por: Li, Zhaoyi, et al.
Publicado: (2025)
LexiMark: Robust Watermarking via Lexical Substitutions to Enhance Membership Verification of an LLM's Textual Training Data
por: German, Eyal, et al.
Publicado: (2025)
por: German, Eyal, et al.
Publicado: (2025)
A Systematic Comparison of Contextualized Word Embeddings for Lexical Semantic Change
por: Periti, Francesco, et al.
Publicado: (2024)
por: Periti, Francesco, et al.
Publicado: (2024)
Ejemplares similares
-
DP-MLM: Differentially Private Text Rewriting Using Masked Language Models
por: Meisenbacher, Stephen, et al.
Publicado: (2024) -
Towards A Structured Overview of Use Cases for Natural Language Processing in the Legal Domain: A German Perspective
por: Vladika, Juraj, et al.
Publicado: (2024) -
On the Influence of Context Size and Model Choice in Retrieval-Augmented Generation Systems
por: Vladika, Juraj, et al.
Publicado: (2025) -
With Privacy, Size Matters: On the Importance of Dataset Size in Differentially Private Text Rewriting
por: Meisenbacher, Stephen, et al.
Publicado: (2025) -
MedSEBA: Synthesizing Evidence-Based Answers Grounded in Evolving Medical Literature
por: Vladika, Juraj, et al.
Publicado: (2025)