Distilling Human-Aligned Privacy Sensitivity Assessment from Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Loiseau, Gabriel, Sileo, Damien, Riquet, Damien, Meyer, Maxime, Tommasi, Marc |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Adaptive Text Anonymization: Learning Privacy-Utility Trade-offs via Prompt Optimization
by: Loiseau, Gabriel, et al.
Published: (2026)
by: Loiseau, Gabriel, et al.
Published: (2026)
TAROT: Task-Oriented Authorship Obfuscation Using Policy Optimization Methods
by: Loiseau, Gabriel, et al.
Published: (2024)
by: Loiseau, Gabriel, et al.
Published: (2024)
Tau-Eval: A Unified Evaluation Framework for Useful and Private Text Anonymization
by: Loiseau, Gabriel, et al.
Published: (2025)
by: Loiseau, Gabriel, et al.
Published: (2025)
Attention Overflow: Language Model Input Blur during Long-Context Missing Items Recommendation
by: Sileo, Damien
Published: (2024)
by: Sileo, Damien
Published: (2024)
Scaling Synthetic Logical Reasoning Datasets with Context-Sensitive Declarative Grammars
by: Sileo, Damien
Published: (2024)
by: Sileo, Damien
Published: (2024)
Logic Haystacks: Probing LLMs Long-Context Logical Reasoning (Without Easily Identifiable Unrelated Padding)
by: Sileo, Damien
Published: (2025)
by: Sileo, Damien
Published: (2025)
Saturation-Driven Dataset Generation for LLM Mathematical Reasoning in the TPTP Ecosystem
by: Quesnel, Valentin, et al.
Published: (2025)
by: Quesnel, Valentin, et al.
Published: (2025)
Reasoning Core: A Scalable Procedural Data Generation Suite for Symbolic Pre-training and Post-Training
by: Lacombe, Valentin, et al.
Published: (2026)
by: Lacombe, Valentin, et al.
Published: (2026)
Reasoning Core: A Scalable RL Environment for LLM Symbolic Reasoning
by: Lacombe, Valentin, et al.
Published: (2025)
by: Lacombe, Valentin, et al.
Published: (2025)
MortalMATH: Evaluating the Conflict Between Reasoning Objectives and Emergency Contexts
by: Lanzeray, Etienne, et al.
Published: (2026)
by: Lanzeray, Etienne, et al.
Published: (2026)
CALE : Concept-Aligned Embeddings for Both Within-Lemma and Inter-Lemma Sense Differentiation
by: Liétard, Bastien, et al.
Published: (2025)
by: Liétard, Bastien, et al.
Published: (2025)
Recipient Profiling: Predicting Characteristics from Messages
by: Borquez, Martin, et al.
Published: (2024)
by: Borquez, Martin, et al.
Published: (2024)
Privacy-Preserving Instructions for Aligning Large Language Models
by: Yu, Da, et al.
Published: (2024)
by: Yu, Da, et al.
Published: (2024)
Investigating Human-Aligned Large Language Model Uncertainty
by: Moore, Kyle, et al.
Published: (2025)
by: Moore, Kyle, et al.
Published: (2025)
A Study on Hidden Layer Distillation for Large Language Model Pre-Training
by: Guigon, Maxime, et al.
Published: (2026)
by: Guigon, Maxime, et al.
Published: (2026)
Aligning Large Language Models with Human Preferences through Representation Engineering
by: Liu, Wenhao, et al.
Published: (2023)
by: Liu, Wenhao, et al.
Published: (2023)
Augmenting Human-Annotated Training Data with Large Language Model Generation and Distillation in Open-Response Assessment
by: Borchers, Conrad, et al.
Published: (2025)
by: Borchers, Conrad, et al.
Published: (2025)
Aligning Large Language Model Behavior with Human Citation Preferences
by: Ando, Kenichiro, et al.
Published: (2026)
by: Ando, Kenichiro, et al.
Published: (2026)
ChatGLM-RLHF: Practices of Aligning Large Language Models with Human Feedback
by: Hou, Zhenyu, et al.
Published: (2024)
by: Hou, Zhenyu, et al.
Published: (2024)
Waste Not, Want Not; Recycled Gumbel Noise Improves Consistency in Natural Language Generation
by: de Mijolla, Damien, et al.
Published: (2025)
by: de Mijolla, Damien, et al.
Published: (2025)
AlignCultura: Towards Culturally Aligned Large Language Models?
by: Kashyap, Gautam Siddharth, et al.
Published: (2026)
by: Kashyap, Gautam Siddharth, et al.
Published: (2026)
A Human-Centric Pipeline for Aligning Large Language Models with Chinese Medical Ethics
by: Jin, Haoan, et al.
Published: (2026)
by: Jin, Haoan, et al.
Published: (2026)
SensorLLM: Aligning Large Language Models with Motion Sensors for Human Activity Recognition
by: Li, Zechen, et al.
Published: (2024)
by: Li, Zechen, et al.
Published: (2024)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
by: Jiang, Guanying, et al.
Published: (2024)
by: Jiang, Guanying, et al.
Published: (2024)
Distilling Empathy from Large Language Models
by: Xie, Henry J., et al.
Published: (2025)
by: Xie, Henry J., et al.
Published: (2025)
CulturePark: Boosting Cross-cultural Understanding in Large Language Models
by: Li, Cheng, et al.
Published: (2024)
by: Li, Cheng, et al.
Published: (2024)
Aligning Model Evaluations with Human Preferences: Mitigating Token Count Bias in Language Model Assessments
by: Daynauth, Roland, et al.
Published: (2024)
by: Daynauth, Roland, et al.
Published: (2024)
Quantification of Large Language Model Distillation
by: Lee, Sunbowen, et al.
Published: (2025)
by: Lee, Sunbowen, et al.
Published: (2025)
Are Aligned Large Language Models Still Misaligned?
by: Naseem, Usman, et al.
Published: (2026)
by: Naseem, Usman, et al.
Published: (2026)
DCR-Consistency: Divide-Conquer-Reasoning for Consistency Evaluation and Improvement of Large Language Models
by: Cui, Wendi, et al.
Published: (2024)
by: Cui, Wendi, et al.
Published: (2024)
SLMEval: Entropy-Based Calibration for Human-Aligned Evaluation of Large Language Models
by: Daynauth, Roland, et al.
Published: (2025)
by: Daynauth, Roland, et al.
Published: (2025)
Robust Privacy Amidst Innovation with Large Language Models Through a Critical Assessment of the Risks
by: Chuang, Yao-Shun, et al.
Published: (2024)
by: Chuang, Yao-Shun, et al.
Published: (2024)
MMD-Flagger: Leveraging Maximum Mean Discrepancy to Detect Hallucinations
by: Mitsuzawa, Kensuke, et al.
Published: (2025)
by: Mitsuzawa, Kensuke, et al.
Published: (2025)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
by: Zhang, Songming, et al.
Published: (2025)
by: Zhang, Songming, et al.
Published: (2025)
Capturing Nuanced Preferences: Preference-Aligned Distillation for Small Language Models
by: Gu, Yanggan, et al.
Published: (2025)
by: Gu, Yanggan, et al.
Published: (2025)
Large Language Models Align with the Human Brain during Creative Thinking
by: Ismayilzada, Mete, et al.
Published: (2026)
by: Ismayilzada, Mete, et al.
Published: (2026)
Aligning Large Language Models with Human Opinions through Persona Selection and Value--Belief--Norm Reasoning
by: Long, Do Xuan, et al.
Published: (2023)
by: Long, Do Xuan, et al.
Published: (2023)
Beyond Labels: Aligning Large Language Models with Human-like Reasoning
by: Kabir, Muhammad Rafsan, et al.
Published: (2024)
by: Kabir, Muhammad Rafsan, et al.
Published: (2024)
Aligning Large Language Models with Diverse Political Viewpoints
by: Stammbach, Dominik, et al.
Published: (2024)
by: Stammbach, Dominik, et al.
Published: (2024)
ADELIE: Aligning Large Language Models on Information Extraction
by: Qi, Yunjia, et al.
Published: (2024)
by: Qi, Yunjia, et al.
Published: (2024)
Similar Items
-
Adaptive Text Anonymization: Learning Privacy-Utility Trade-offs via Prompt Optimization
by: Loiseau, Gabriel, et al.
Published: (2026) -
TAROT: Task-Oriented Authorship Obfuscation Using Policy Optimization Methods
by: Loiseau, Gabriel, et al.
Published: (2024) -
Tau-Eval: A Unified Evaluation Framework for Useful and Private Text Anonymization
by: Loiseau, Gabriel, et al.
Published: (2025) -
Attention Overflow: Language Model Input Blur during Long-Context Missing Items Recommendation
by: Sileo, Damien
Published: (2024) -
Scaling Synthetic Logical Reasoning Datasets with Context-Sensitive Declarative Grammars
by: Sileo, Damien
Published: (2024)