On Active Privacy Auditing in Supervised Fine-tuning for White-Box Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Qian, Wu, Hanpeng, Zhang, Xi Sheryl |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Party Supervised Fine-tuning of Language Models for Multi-Party Dialogue Generation
par: Wang, Xiaoyu, et autres
Publié: (2024)
par: Wang, Xiaoyu, et autres
Publié: (2024)
RobustFT: Robust Supervised Fine-tuning for Large Language Models under Noisy Response
par: Luo, Junyu, et autres
Publié: (2024)
par: Luo, Junyu, et autres
Publié: (2024)
Fine-tuning vs Prompting, Can Language Models Understand Human Values?
par: Sun, Pingwei
Publié: (2024)
par: Sun, Pingwei
Publié: (2024)
Semi-supervised Fine-tuning for Large Language Models
par: Luo, Junyu, et autres
Publié: (2024)
par: Luo, Junyu, et autres
Publié: (2024)
Federated Fine-tuning of Large Language Models under Heterogeneous Tasks and Client Resources
par: Bai, Jiamu, et autres
Publié: (2024)
par: Bai, Jiamu, et autres
Publié: (2024)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
par: Dong, Guanting, et autres
Publié: (2023)
par: Dong, Guanting, et autres
Publié: (2023)
When Long Helps Short: How Context Length in Supervised Fine-tuning Affects Behavior of Large Language Models
par: Zheng, Yingming, et autres
Publié: (2025)
par: Zheng, Yingming, et autres
Publié: (2025)
Breaking mBad! Supervised Fine-tuning for Cross-Lingual Detoxification
par: Beniwal, Himanshu, et autres
Publié: (2025)
par: Beniwal, Himanshu, et autres
Publié: (2025)
Sensitivity of Small Language Models to Fine-tuning Data Contamination
par: Scaria, Nicy, et autres
Publié: (2025)
par: Scaria, Nicy, et autres
Publié: (2025)
Fine-tuned Large Language Models (LLMs): Improved Prompt Injection Attacks Detection
par: Rahman, Md Abdur, et autres
Publié: (2024)
par: Rahman, Md Abdur, et autres
Publié: (2024)
Fine-tuning Language Models with Generative Adversarial Reward Modelling
par: Yu, Zhang Ze, et autres
Publié: (2023)
par: Yu, Zhang Ze, et autres
Publié: (2023)
LaFFi: Leveraging Hybrid Natural Language Feedback for Fine-tuning Language Models
par: Li, Qianxi, et autres
Publié: (2023)
par: Li, Qianxi, et autres
Publié: (2023)
Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
par: Wang, Yibo, et autres
Publié: (2025)
par: Wang, Yibo, et autres
Publié: (2025)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
par: Lyu, Yougang, et autres
Publié: (2024)
par: Lyu, Yougang, et autres
Publié: (2024)
Progtuning: Progressive Fine-tuning Framework for Transformer-based Language Models
par: Ji, Xiaoshuang, et autres
Publié: (2025)
par: Ji, Xiaoshuang, et autres
Publié: (2025)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
par: Zhu, Lianghui, et autres
Publié: (2023)
par: Zhu, Lianghui, et autres
Publié: (2023)
Dhati+: Fine-tuned Large Language Models for Arabic Subjectivity Evaluation
par: Bellaouar, Slimane, et autres
Publié: (2025)
par: Bellaouar, Slimane, et autres
Publié: (2025)
Compositional Subspace Representation Fine-tuning for Adaptive Large Language Models
par: Zhou, Andy
Publié: (2025)
par: Zhou, Andy
Publié: (2025)
Exploring Memorization in Fine-tuned Language Models
par: Zeng, Shenglai, et autres
Publié: (2023)
par: Zeng, Shenglai, et autres
Publié: (2023)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
par: Wang, Renxi, et autres
Publié: (2023)
par: Wang, Renxi, et autres
Publié: (2023)
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
par: Kim, Kyeonghyun, et autres
Publié: (2025)
par: Kim, Kyeonghyun, et autres
Publié: (2025)
Small Language Models Fine-tuned to Coordinate Larger Language Models improve Complex Reasoning
par: Juneja, Gurusha, et autres
Publié: (2023)
par: Juneja, Gurusha, et autres
Publié: (2023)
You Only Fine-tune Once: Many-Shot In-Context Fine-Tuning for Large Language Models
par: He, Wenchong, et autres
Publié: (2025)
par: He, Wenchong, et autres
Publié: (2025)
Advancing Single and Multi-task Text Classification through Large Language Model Fine-tuning
par: Zhao, Hang, et autres
Publié: (2024)
par: Zhao, Hang, et autres
Publié: (2024)
Prompting or Fine-tuning? Exploring Large Language Models for Causal Graph Validation
par: Susanti, Yuni, et autres
Publié: (2024)
par: Susanti, Yuni, et autres
Publié: (2024)
Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language Models
par: Zhao, Zhixue, et autres
Publié: (2024)
par: Zhao, Zhixue, et autres
Publié: (2024)
Systematic Analysis for Pretrained Language Model Priming for Parameter-Efficient Fine-tuning
par: Huang, Shih-Cheng, et autres
Publié: (2022)
par: Huang, Shih-Cheng, et autres
Publié: (2022)
AgentXRay: White-Boxing Agentic Systems via Workflow Reconstruction
par: Shi, Ruijie, et autres
Publié: (2026)
par: Shi, Ruijie, et autres
Publié: (2026)
Structure-aware Fine-tuning for Code Pre-trained Models
par: Wu, Jiayi, et autres
Publié: (2024)
par: Wu, Jiayi, et autres
Publié: (2024)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
par: Chen, Yukang, et autres
Publié: (2023)
par: Chen, Yukang, et autres
Publié: (2023)
Information Guided Regularization for Fine-tuning Language Models
par: Sharma, Mandar, et autres
Publié: (2024)
par: Sharma, Mandar, et autres
Publié: (2024)
STAR: Constraint LoRA with Dynamic Active Learning for Data-Efficient Fine-Tuning of Large Language Models
par: Zhang, Linhai, et autres
Publié: (2024)
par: Zhang, Linhai, et autres
Publié: (2024)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
par: Song, Weixi, et autres
Publié: (2023)
par: Song, Weixi, et autres
Publié: (2023)
Packing Analysis: Packing Is More Appropriate for Large Models or Datasets in Supervised Fine-tuning
par: Wang, Shuhe, et autres
Publié: (2024)
par: Wang, Shuhe, et autres
Publié: (2024)
Language Models are Homer Simpson! Safety Re-Alignment of Fine-tuned Language Models through Task Arithmetic
par: Bhardwaj, Rishabh, et autres
Publié: (2024)
par: Bhardwaj, Rishabh, et autres
Publié: (2024)
SPAFIT: Stratified Progressive Adaptation Fine-tuning for Pre-trained Large Language Models
par: Arora, Samir, et autres
Publié: (2024)
par: Arora, Samir, et autres
Publié: (2024)
Fine-tuning Language Models for Recipe Generation: A Comparative Analysis and Benchmark Study
par: Vij, Anneketh, et autres
Publié: (2025)
par: Vij, Anneketh, et autres
Publié: (2025)
Automatic Essay Multi-dimensional Scoring with Fine-tuning and Multiple Regression
par: Sun, Kun, et autres
Publié: (2024)
par: Sun, Kun, et autres
Publié: (2024)
Efficient End-to-end Language Model Fine-tuning on Graphs
par: Xue, Rui, et autres
Publié: (2023)
par: Xue, Rui, et autres
Publié: (2023)
Fine-tuning can Help Detect Pretraining Data from Large Language Models
par: Zhang, Hengxiang, et autres
Publié: (2024)
par: Zhang, Hengxiang, et autres
Publié: (2024)
Documents similaires
-
Multi-Party Supervised Fine-tuning of Language Models for Multi-Party Dialogue Generation
par: Wang, Xiaoyu, et autres
Publié: (2024) -
RobustFT: Robust Supervised Fine-tuning for Large Language Models under Noisy Response
par: Luo, Junyu, et autres
Publié: (2024) -
Fine-tuning vs Prompting, Can Language Models Understand Human Values?
par: Sun, Pingwei
Publié: (2024) -
Semi-supervised Fine-tuning for Large Language Models
par: Luo, Junyu, et autres
Publié: (2024) -
Federated Fine-tuning of Large Language Models under Heterogeneous Tasks and Client Resources
par: Bai, Jiamu, et autres
Publié: (2024)