Fine-Tuning, Quantization, and LLMs: Navigating Unintended Outcomes
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kumar, Divyanshu, Kumar, Anurakt, Agarwal, Sahil, Harshangi, Prashanth |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SAGE-RT: Synthetic Alignment data Generation for Safety Evaluation and Red Teaming
von: Kumar, Anurakt, et al.
Veröffentlicht: (2024)
von: Kumar, Anurakt, et al.
Veröffentlicht: (2024)
No Free Lunch with Guardrails
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025)
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025)
Quantifying CBRN Risk in Frontier Models
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025)
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025)
Beyond Text: Multimodal Jailbreaking of Vision-Language and Audio Models through Perceptually Simple Transformations
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025)
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025)
Investigating Implicit Bias in Large Language Models: A Large-Scale Study of Over 50 LLMs
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2024)
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2024)
BugWhisperer: Fine-Tuning LLMs for SoC Hardware Vulnerability Detection
von: Tarek, Shams, et al.
Veröffentlicht: (2025)
von: Tarek, Shams, et al.
Veröffentlicht: (2025)
Persistent Backdoor Attacks under Continual Fine-Tuning of LLMs
von: Cui, Jing, et al.
Veröffentlicht: (2025)
von: Cui, Jing, et al.
Veröffentlicht: (2025)
Differentiation-Based Extraction of Proprietary Data from Fine-Tuned LLMs
von: Li, Zongjie, et al.
Veröffentlicht: (2025)
von: Li, Zongjie, et al.
Veröffentlicht: (2025)
Quantum Gatekeeper: Multi-Factor Context-Bound Image Steganography with VQC Based Key Derivation on Quantum Hardware
von: Tomar, Sahil, et al.
Veröffentlicht: (2026)
von: Tomar, Sahil, et al.
Veröffentlicht: (2026)
Guardians of Trust: Navigating Data Security in AIOps through Vendor Partnerships
von: Kumar, Subhadip
Veröffentlicht: (2023)
von: Kumar, Subhadip
Veröffentlicht: (2023)
Analysing Safety Risks in LLMs Fine-Tuned with Pseudo-Malicious Cyber Security Data
von: ElZemity, Adel, et al.
Veröffentlicht: (2025)
von: ElZemity, Adel, et al.
Veröffentlicht: (2025)
A Systematic Evaluation of Parameter-Efficient Fine-Tuning Methods for the Security of Code LLMs
von: Lee, Kiho, et al.
Veröffentlicht: (2025)
von: Lee, Kiho, et al.
Veröffentlicht: (2025)
Scam Shield: Multi-Model Voting and Fine-Tuned LLMs Against Adversarial Attacks
von: Chang, Chen-Wei, et al.
Veröffentlicht: (2025)
von: Chang, Chen-Wei, et al.
Veröffentlicht: (2025)
Defending MoE LLMs against Harmful Fine-Tuning via Safety Routing Alignment
von: Kim, Jaehan, et al.
Veröffentlicht: (2025)
von: Kim, Jaehan, et al.
Veröffentlicht: (2025)
CurricuLLM: Designing Personalized and Workforce-Aligned Cybersecurity Curricula Using Fine-Tuned LLMs
von: Nijdam, Arthur, et al.
Veröffentlicht: (2026)
von: Nijdam, Arthur, et al.
Veröffentlicht: (2026)
Automated Classification of Cybercrime Complaints using Transformer-based Language Models for Hinglish Texts
von: Rani, Nanda, et al.
Veröffentlicht: (2024)
von: Rani, Nanda, et al.
Veröffentlicht: (2024)
PACZero: PAC-Private Fine-Tuning of Language Models via Sign Quantization
von: Ertan, Murat Bilgehan, et al.
Veröffentlicht: (2026)
von: Ertan, Murat Bilgehan, et al.
Veröffentlicht: (2026)
FTSmartAudit: A Knowledge Distillation-Enhanced Framework for Automated Smart Contract Auditing Using Fine-Tuned LLMs
von: Wei, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Wei, Zhiyuan, et al.
Veröffentlicht: (2024)
Towards Effective Offensive Security LLM Agents: Hyperparameter Tuning, LLM as a Judge, and a Lightweight CTF Benchmark
von: Shao, Minghao, et al.
Veröffentlicht: (2025)
von: Shao, Minghao, et al.
Veröffentlicht: (2025)
Benchmarking Large Language Models for Zero-shot and Few-shot Phishing URL Detection
von: Hasan, Najmul, et al.
Veröffentlicht: (2026)
von: Hasan, Najmul, et al.
Veröffentlicht: (2026)
Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets
von: Lu, Ning, et al.
Veröffentlicht: (2025)
von: Lu, Ning, et al.
Veröffentlicht: (2025)
CTIGuardian: A Few-Shot Framework for Mitigating Privacy Leakage in Fine-Tuned LLMs
von: Arachchige, Shashie Dilhara Batan, et al.
Veröffentlicht: (2025)
von: Arachchige, Shashie Dilhara Batan, et al.
Veröffentlicht: (2025)
On the Effectiveness of Instruction-Tuning Local LLMs for Identifying Software Vulnerabilities
von: Park, Sangryu, et al.
Veröffentlicht: (2025)
von: Park, Sangryu, et al.
Veröffentlicht: (2025)
Silent Sabotage During Fine-Tuning: Few-Shot Rationale Poisoning of Compact Medical LLMs
von: Xie, Jingyuan, et al.
Veröffentlicht: (2026)
von: Xie, Jingyuan, et al.
Veröffentlicht: (2026)
PEFT-as-an-Attack! Jailbreaking Language Models during Federated Parameter-Efficient Fine-Tuning
von: Li, Shenghui, et al.
Veröffentlicht: (2024)
von: Li, Shenghui, et al.
Veröffentlicht: (2024)
Fine-Tuning Small Language Models for Solution-Oriented Windows Event Log Analysis
von: Akhtar, Siraaj, et al.
Veröffentlicht: (2026)
von: Akhtar, Siraaj, et al.
Veröffentlicht: (2026)
TamperBench: Systematically Stress-Testing LLM Safety Under Fine-Tuning and Tampering
von: Hossain, Saad, et al.
Veröffentlicht: (2026)
von: Hossain, Saad, et al.
Veröffentlicht: (2026)
Accuracy and Efficiency Trade-Offs in LLM-Based Malware Detection and Explanation: A Comparative Study of Parameter Tuning vs. Full Fine-Tuning
von: Gravereaux, Stephen C., et al.
Veröffentlicht: (2025)
von: Gravereaux, Stephen C., et al.
Veröffentlicht: (2025)
A Survey on Offensive AI Within Cybersecurity
von: Girhepuje, Sahil, et al.
Veröffentlicht: (2024)
von: Girhepuje, Sahil, et al.
Veröffentlicht: (2024)
Data Provenance Auditing of Fine-Tuned Large Language Models with a Text-Preserving Technique
von: Li, Yanming, et al.
Veröffentlicht: (2025)
von: Li, Yanming, et al.
Veröffentlicht: (2025)
Dual-Priv Pruning : Efficient Differential Private Fine-Tuning in Multimodal Large Language Models
von: Wei, Qianshan, et al.
Veröffentlicht: (2025)
von: Wei, Qianshan, et al.
Veröffentlicht: (2025)
Exploring AI in Steganography and Steganalysis: Trends, Clusters, and Sustainable Development Potential
von: Sahu, Aditya Kumar, et al.
Veröffentlicht: (2025)
von: Sahu, Aditya Kumar, et al.
Veröffentlicht: (2025)
SENTAUR: Security EnhaNced Trojan Assessment Using LLMs Against Undesirable Revisions
von: Bhandari, Jitendra, et al.
Veröffentlicht: (2024)
von: Bhandari, Jitendra, et al.
Veröffentlicht: (2024)
DP-FedLoRA: Privacy-Enhanced Federated Fine-Tuning for On-Device Large Language Models
von: Xu, Honghui, et al.
Veröffentlicht: (2025)
von: Xu, Honghui, et al.
Veröffentlicht: (2025)
Secret Stealing Attacks on Local LLM Fine-Tuning through Supply-Chain Model Code Backdoors
von: Li, Zi, et al.
Veröffentlicht: (2026)
von: Li, Zi, et al.
Veröffentlicht: (2026)
RewardDS: Privacy-Preserving Fine-Tuning for Large Language Models via Reward Driven Data Synthesis
von: Wang, Jianwei, et al.
Veröffentlicht: (2025)
von: Wang, Jianwei, et al.
Veröffentlicht: (2025)
VeriLoRA: Fine-Tuning Large Language Models with Verifiable Security via Zero-Knowledge Proofs
von: Liao, Guofu, et al.
Veröffentlicht: (2025)
von: Liao, Guofu, et al.
Veröffentlicht: (2025)
VERA: Validation and Enhancement for Retrieval Augmented systems
von: Birur, Nitin Aravind, et al.
Veröffentlicht: (2024)
von: Birur, Nitin Aravind, et al.
Veröffentlicht: (2024)
Security Document Classification with a Fine-Tuned Local Large Language Model: Benchmark Data and an Open-Source System
von: Dobrovolskyi, Ivan
Veröffentlicht: (2026)
von: Dobrovolskyi, Ivan
Veröffentlicht: (2026)
Self-Mined Hardness for Safety Fine-Tuning
von: Gupta, Prakhar, et al.
Veröffentlicht: (2026)
von: Gupta, Prakhar, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
SAGE-RT: Synthetic Alignment data Generation for Safety Evaluation and Red Teaming
von: Kumar, Anurakt, et al.
Veröffentlicht: (2024) -
No Free Lunch with Guardrails
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025) -
Quantifying CBRN Risk in Frontier Models
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025) -
Beyond Text: Multimodal Jailbreaking of Vision-Language and Audio Models through Perceptually Simple Transformations
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2025) -
Investigating Implicit Bias in Large Language Models: A Large-Scale Study of Over 50 LLMs
von: Kumar, Divyanshu, et al.
Veröffentlicht: (2024)