Adapting Large Language Models for Content Moderation: Pitfalls in Data Engineering and Supervised Fine-tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Huan, Zhang, Changqing, Fu, Huazhu, Zhao, Peilin, Wu, Bingzhe |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Spurious Feature Eraser: Stabilizing Test-Time Adaptation for Vision-Language Foundation Model
por: Ma, Huan, et al.
Publicado: (2024)
por: Ma, Huan, et al.
Publicado: (2024)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
por: Dong, Guanting, et al.
Publicado: (2023)
por: Dong, Guanting, et al.
Publicado: (2023)
Semi-Supervised Learning for Large Language Models Safety and Content Moderation
por: Dinuta, Eduard Stefan, et al.
Publicado: (2025)
por: Dinuta, Eduard Stefan, et al.
Publicado: (2025)
EDCO: Dynamic Curriculum Orchestration for Domain-specific Large Language Model Fine-tuning
por: Pang, Jing-Cheng, et al.
Publicado: (2026)
por: Pang, Jing-Cheng, et al.
Publicado: (2026)
Virus: Harmful Fine-tuning Attack for Large Language Models Bypassing Guardrail Moderation
por: Huang, Tiansheng, et al.
Publicado: (2025)
por: Huang, Tiansheng, et al.
Publicado: (2025)
Right Question is Already Half the Answer: Fully Unsupervised LLM Reasoning Incentivization
por: Zhang, Qingyang, et al.
Publicado: (2025)
por: Zhang, Qingyang, et al.
Publicado: (2025)
Leveraging Large Language Models for Structure Learning in Prompted Weak Supervision
por: Su, Jinyan, et al.
Publicado: (2024)
por: Su, Jinyan, et al.
Publicado: (2024)
Fine-tuning Large Language Model for Automated Algorithm Design
por: Liu, Fei, et al.
Publicado: (2025)
por: Liu, Fei, et al.
Publicado: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
por: Song, Weixi, et al.
Publicado: (2023)
por: Song, Weixi, et al.
Publicado: (2023)
A Study of Optimizations for Fine-tuning Large Language Models
por: Singh, Arjun, et al.
Publicado: (2024)
por: Singh, Arjun, et al.
Publicado: (2024)
Fine-tuning can Help Detect Pretraining Data from Large Language Models
por: Zhang, Hengxiang, et al.
Publicado: (2024)
por: Zhang, Hengxiang, et al.
Publicado: (2024)
Efficiently Estimating Data Efficiency for Language Model Fine-tuning
por: Je, Gyung Hyun, et al.
Publicado: (2025)
por: Je, Gyung Hyun, et al.
Publicado: (2025)
Generated Data with Fake Privacy: Hidden Dangers of Fine-tuning Large Language Models on Generated Data
por: Akkus, Atilla, et al.
Publicado: (2024)
por: Akkus, Atilla, et al.
Publicado: (2024)
Financial Fine-tuning a Large Time Series Model
por: Fu, Xinghong, et al.
Publicado: (2024)
por: Fu, Xinghong, et al.
Publicado: (2024)
Fine-tuning Large Language Models for Domain-specific Machine Translation
por: Zheng, Jiawei, et al.
Publicado: (2024)
por: Zheng, Jiawei, et al.
Publicado: (2024)
EpilepsyLLM: Domain-Specific Large Language Model Fine-tuned with Epilepsy Medical Knowledge
por: Zhao, Xuyang, et al.
Publicado: (2024)
por: Zhao, Xuyang, et al.
Publicado: (2024)
COME: Test-time adaption by Conservatively Minimizing Entropy
por: Zhang, Qingyang, et al.
Publicado: (2024)
por: Zhang, Qingyang, et al.
Publicado: (2024)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
A Survey on Federated Fine-tuning of Large Language Models
por: Wu, Yebo, et al.
Publicado: (2025)
por: Wu, Yebo, et al.
Publicado: (2025)
Do Retrieval-Augmented Language Models Adapt to Varying User Needs?
por: Wu, Peilin, et al.
Publicado: (2025)
por: Wu, Peilin, et al.
Publicado: (2025)
Data Quality Control in Federated Instruction-tuning of Large Language Models
por: Du, Yaxin, et al.
Publicado: (2024)
por: Du, Yaxin, et al.
Publicado: (2024)
Pharmacist: Safety Alignment Data Curation for Large Language Models against Harmful Fine-tuning
por: Liu, Guozhi, et al.
Publicado: (2025)
por: Liu, Guozhi, et al.
Publicado: (2025)
Diversity in Large Language Models under Supervised Fine-Tuning
por: Klypa, Roman, et al.
Publicado: (2026)
por: Klypa, Roman, et al.
Publicado: (2026)
Fine-tuning Large Language Models with Limited Data: A Survey and Practical Guide
por: Szep, Marton, et al.
Publicado: (2024)
por: Szep, Marton, et al.
Publicado: (2024)
Synthesizing and Adapting Error Correction Data for Mobile Large Language Model Applications
por: Zhang, Yanxiang, et al.
Publicado: (2025)
por: Zhang, Yanxiang, et al.
Publicado: (2025)
Navigating the Designs of Privacy-Preserving Fine-tuning for Large Language Models
por: Shi, Haonan, et al.
Publicado: (2025)
por: Shi, Haonan, et al.
Publicado: (2025)
Fine-tuning of Large Language Models for Domain-Specific Cybersecurity Knowledge
por: Huang, Yuan
Publicado: (2025)
por: Huang, Yuan
Publicado: (2025)
Packing Analysis: Packing Is More Appropriate for Large Models or Datasets in Supervised Fine-tuning
por: Wang, Shuhe, et al.
Publicado: (2024)
por: Wang, Shuhe, et al.
Publicado: (2024)
Forgetting: A New Mechanism Towards Better Large Language Model Fine-tuning
por: Taheri, Ali, et al.
Publicado: (2025)
por: Taheri, Ali, et al.
Publicado: (2025)
Financial Sentiment Analysis: Leveraging Actual and Synthetic Data for Supervised Fine-tuning
por: Atsiwo, Abraham
Publicado: (2024)
por: Atsiwo, Abraham
Publicado: (2024)
Selecting Large Language Model to Fine-tune via Rectified Scaling Law
por: Lin, Haowei, et al.
Publicado: (2024)
por: Lin, Haowei, et al.
Publicado: (2024)
Out-Of-Distribution Detection with Diversification (Provably)
por: Yao, Haiyun, et al.
Publicado: (2024)
por: Yao, Haiyun, et al.
Publicado: (2024)
Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective
por: Ghosh, Bishwamittra, et al.
Publicado: (2026)
por: Ghosh, Bishwamittra, et al.
Publicado: (2026)
RE-Adapt: Reverse Engineered Adaptation of Large Language Models
por: Fleshman, William, et al.
Publicado: (2024)
por: Fleshman, William, et al.
Publicado: (2024)
LLASP: Fine-tuning Large Language Models for Answer Set Programming
por: Coppolillo, Erica, et al.
Publicado: (2024)
por: Coppolillo, Erica, et al.
Publicado: (2024)
Efficient Ensemble for Fine-tuning Language Models on Multiple Datasets
por: Li, Dongyue, et al.
Publicado: (2025)
por: Li, Dongyue, et al.
Publicado: (2025)
Lisa: Lazy Safety Alignment for Large Language Models against Harmful Fine-tuning Attack
por: Huang, Tiansheng, et al.
Publicado: (2024)
por: Huang, Tiansheng, et al.
Publicado: (2024)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024)
por: Li, Ziniu, et al.
Publicado: (2024)
Adapting Large Language Models for Parameter-Efficient Log Anomaly Detection
por: Lim, Ying Fu, et al.
Publicado: (2025)
por: Lim, Ying Fu, et al.
Publicado: (2025)
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
por: Tang, Xinyu, et al.
Publicado: (2024)
por: Tang, Xinyu, et al.
Publicado: (2024)
Ejemplares similares
-
Spurious Feature Eraser: Stabilizing Test-Time Adaptation for Vision-Language Foundation Model
por: Ma, Huan, et al.
Publicado: (2024) -
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
por: Dong, Guanting, et al.
Publicado: (2023) -
Semi-Supervised Learning for Large Language Models Safety and Content Moderation
por: Dinuta, Eduard Stefan, et al.
Publicado: (2025) -
EDCO: Dynamic Curriculum Orchestration for Domain-specific Large Language Model Fine-tuning
por: Pang, Jing-Cheng, et al.
Publicado: (2026) -
Virus: Harmful Fine-tuning Attack for Large Language Models Bypassing Guardrail Moderation
por: Huang, Tiansheng, et al.
Publicado: (2025)