Tau-Eval: A Unified Evaluation Framework for Useful and Private Text Anonymization
Fuente:
arXiv
Salvato in:
| Autori principali: | Loiseau, Gabriel, Sileo, Damien, Riquet, Damien, Meyer, Maxime, Tommasi, Marc |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adaptive Text Anonymization: Learning Privacy-Utility Trade-offs via Prompt Optimization
di: Loiseau, Gabriel, et al.
Pubblicazione: (2026)
di: Loiseau, Gabriel, et al.
Pubblicazione: (2026)
TAROT: Task-Oriented Authorship Obfuscation Using Policy Optimization Methods
di: Loiseau, Gabriel, et al.
Pubblicazione: (2024)
di: Loiseau, Gabriel, et al.
Pubblicazione: (2024)
Distilling Human-Aligned Privacy Sensitivity Assessment from Large Language Models
di: Loiseau, Gabriel, et al.
Pubblicazione: (2026)
di: Loiseau, Gabriel, et al.
Pubblicazione: (2026)
Logic Haystacks: Probing LLMs Long-Context Logical Reasoning (Without Easily Identifiable Unrelated Padding)
di: Sileo, Damien
Pubblicazione: (2025)
di: Sileo, Damien
Pubblicazione: (2025)
Attention Overflow: Language Model Input Blur during Long-Context Missing Items Recommendation
di: Sileo, Damien
Pubblicazione: (2024)
di: Sileo, Damien
Pubblicazione: (2024)
Scaling Synthetic Logical Reasoning Datasets with Context-Sensitive Declarative Grammars
di: Sileo, Damien
Pubblicazione: (2024)
di: Sileo, Damien
Pubblicazione: (2024)
Saturation-Driven Dataset Generation for LLM Mathematical Reasoning in the TPTP Ecosystem
di: Quesnel, Valentin, et al.
Pubblicazione: (2025)
di: Quesnel, Valentin, et al.
Pubblicazione: (2025)
Reasoning Core: A Scalable Procedural Data Generation Suite for Symbolic Pre-training and Post-Training
di: Lacombe, Valentin, et al.
Pubblicazione: (2026)
di: Lacombe, Valentin, et al.
Pubblicazione: (2026)
MortalMATH: Evaluating the Conflict Between Reasoning Objectives and Emergency Contexts
di: Lanzeray, Etienne, et al.
Pubblicazione: (2026)
di: Lanzeray, Etienne, et al.
Pubblicazione: (2026)
Reasoning Core: A Scalable RL Environment for LLM Symbolic Reasoning
di: Lacombe, Valentin, et al.
Pubblicazione: (2025)
di: Lacombe, Valentin, et al.
Pubblicazione: (2025)
Analysis of Speech Temporal Dynamics in the Context of Speaker Verification and Voice Anonymization
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2024)
Exploiting Context-dependent Duration Features for Voice Anonymization Attack Systems
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025)
di: Tomashenko, Natalia, et al.
Pubblicazione: (2025)
NormEval: A Unified Multi-Metric Framework for Evaluating Semantic Fidelity in Text Normalization
di: Kafi, Md Abdullah Al, et al.
Pubblicazione: (2025)
di: Kafi, Md Abdullah Al, et al.
Pubblicazione: (2025)
A Symbolic Framework for Evaluating Mathematical Reasoning and Generalisation with Transformers
di: Meadows, Jordan, et al.
Pubblicazione: (2023)
di: Meadows, Jordan, et al.
Pubblicazione: (2023)
Recipient Profiling: Predicting Characteristics from Messages
di: Borquez, Martin, et al.
Pubblicazione: (2024)
di: Borquez, Martin, et al.
Pubblicazione: (2024)
Comparing Feature Importance and Rule Extraction for Interpretability on Text Data
di: Lopardo, Gianluigi, et al.
Pubblicazione: (2022)
di: Lopardo, Gianluigi, et al.
Pubblicazione: (2022)
ProactiveEval: A Unified Evaluation Framework for Proactive Dialogue Agents
di: Liu, Tianjian, et al.
Pubblicazione: (2025)
di: Liu, Tianjian, et al.
Pubblicazione: (2025)
CALE : Concept-Aligned Embeddings for Both Within-Lemma and Inter-Lemma Sense Differentiation
di: Liétard, Bastien, et al.
Pubblicazione: (2025)
di: Liétard, Bastien, et al.
Pubblicazione: (2025)
Subject-level Inference for Realistic Text Anonymization Evaluation
di: Oh, Myeong Seok, et al.
Pubblicazione: (2026)
di: Oh, Myeong Seok, et al.
Pubblicazione: (2026)
A Sea of Words: An In-Depth Analysis of Anchors for Text Data
di: Lopardo, Gianluigi, et al.
Pubblicazione: (2022)
di: Lopardo, Gianluigi, et al.
Pubblicazione: (2022)
BatchEval: Towards Human-like Text Evaluation
di: Yuan, Peiwen, et al.
Pubblicazione: (2023)
di: Yuan, Peiwen, et al.
Pubblicazione: (2023)
RepEval: Effective Text Evaluation with LLM Representation
di: Sheng, Shuqian, et al.
Pubblicazione: (2024)
di: Sheng, Shuqian, et al.
Pubblicazione: (2024)
SynthTextEval: Synthetic Text Data Generation and Evaluation for High-Stakes Domains
di: Ramesh, Krithika, et al.
Pubblicazione: (2025)
di: Ramesh, Krithika, et al.
Pubblicazione: (2025)
MT-PingEval: Evaluating Multi-Turn Collaboration with Private Information Games
di: Eisenstein, Jacob, et al.
Pubblicazione: (2026)
di: Eisenstein, Jacob, et al.
Pubblicazione: (2026)
Eval4Sim: An Evaluation Framework for Persona Simulation
di: Bao, Eliseo, et al.
Pubblicazione: (2026)
di: Bao, Eliseo, et al.
Pubblicazione: (2026)
SQLStructEval: Structural Evaluation of LLM Text-to-SQL Generation
di: Zhou, Yixi, et al.
Pubblicazione: (2026)
di: Zhou, Yixi, et al.
Pubblicazione: (2026)
IncogniText: Privacy-enhancing Conditional Text Anonymization via LLM-based Private Attribute Randomization
di: Frikha, Ahmed, et al.
Pubblicazione: (2024)
di: Frikha, Ahmed, et al.
Pubblicazione: (2024)
DIRI: Adversarial Patient Reidentification with Large Language Models for Evaluating Clinical Text Anonymization
di: Morris, John X., et al.
Pubblicazione: (2024)
di: Morris, John X., et al.
Pubblicazione: (2024)
EvalCards: A Framework for Standardized Evaluation Reporting
di: Dhar, Ruchira, et al.
Pubblicazione: (2025)
di: Dhar, Ruchira, et al.
Pubblicazione: (2025)
UniFinEval: Towards Unified Evaluation of Financial Multimodal Models across Text, Images and Videos
di: Yang, Zhi, et al.
Pubblicazione: (2026)
di: Yang, Zhi, et al.
Pubblicazione: (2026)
MMD-Flagger: Leveraging Maximum Mean Discrepancy to Detect Hallucinations
di: Mitsuzawa, Kensuke, et al.
Pubblicazione: (2025)
di: Mitsuzawa, Kensuke, et al.
Pubblicazione: (2025)
EvalSense: A Framework for Domain-Specific LLM (Meta-)Evaluation
di: Dejl, Adam, et al.
Pubblicazione: (2026)
di: Dejl, Adam, et al.
Pubblicazione: (2026)
Check-Eval: A Checklist-based Approach for Evaluating Text Quality
di: Pereira, Jayr, et al.
Pubblicazione: (2024)
di: Pereira, Jayr, et al.
Pubblicazione: (2024)
UniDial-EvalKit: A Unified Toolkit for Evaluating Multi-Faceted Conversational Abilities
di: Jia, Qi, et al.
Pubblicazione: (2026)
di: Jia, Qi, et al.
Pubblicazione: (2026)
Anonymous-by-Construction: An LLM-Driven Framework for Privacy-Preserving Text
di: Albanese, Federico, et al.
Pubblicazione: (2026)
di: Albanese, Federico, et al.
Pubblicazione: (2026)
A Survey of Useful LLM Evaluation
di: Peng, Ji-Lun, et al.
Pubblicazione: (2024)
di: Peng, Ji-Lun, et al.
Pubblicazione: (2024)
AdaptEval: Evaluating Large Language Models on Domain Adaptation for Text Summarization
di: Afzal, Anum, et al.
Pubblicazione: (2024)
di: Afzal, Anum, et al.
Pubblicazione: (2024)
MTQ-Eval: Multilingual Text Quality Evaluation for Language Models
di: Pokharel, Rhitabrat, et al.
Pubblicazione: (2025)
di: Pokharel, Rhitabrat, et al.
Pubblicazione: (2025)
OnionEval: An Unified Evaluation of Fact-conflicting Hallucination for Small-Large Language Models
di: Sun, Chongren, et al.
Pubblicazione: (2025)
di: Sun, Chongren, et al.
Pubblicazione: (2025)
ReliableEval: A Recipe for Stochastic LLM Evaluation via Method of Moments
di: Lior, Gili, et al.
Pubblicazione: (2025)
di: Lior, Gili, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Adaptive Text Anonymization: Learning Privacy-Utility Trade-offs via Prompt Optimization
di: Loiseau, Gabriel, et al.
Pubblicazione: (2026) -
TAROT: Task-Oriented Authorship Obfuscation Using Policy Optimization Methods
di: Loiseau, Gabriel, et al.
Pubblicazione: (2024) -
Distilling Human-Aligned Privacy Sensitivity Assessment from Large Language Models
di: Loiseau, Gabriel, et al.
Pubblicazione: (2026) -
Logic Haystacks: Probing LLMs Long-Context Logical Reasoning (Without Easily Identifiable Unrelated Padding)
di: Sileo, Damien
Pubblicazione: (2025) -
Attention Overflow: Language Model Input Blur during Long-Context Missing Items Recommendation
di: Sileo, Damien
Pubblicazione: (2024)