PETA: Parameter-Efficient Trojan Attacks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hong, Lauren, Wang, Ting |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Trojan Detection in Large Language Models: Insights from The Trojan Detection Challenge
par: Maloyan, Narek, et autres
Publié: (2024)
par: Maloyan, Narek, et autres
Publié: (2024)
Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment
par: Wang, Haoran, et autres
Publié: (2023)
par: Wang, Haoran, et autres
Publié: (2023)
Analyzing Multi-Head Attention on Trojan BERT Models
par: Wang, Jingwei
Publié: (2024)
par: Wang, Jingwei
Publié: (2024)
Defending Against Weight-Poisoning Backdoor Attacks for Parameter-Efficient Fine-Tuning
par: Zhao, Shuai, et autres
Publié: (2024)
par: Zhao, Shuai, et autres
Publié: (2024)
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
par: Liang, Jiacheng, et autres
Publié: (2024)
par: Liang, Jiacheng, et autres
Publié: (2024)
MoRA: High-Rank Updating for Parameter-Efficient Fine-Tuning
par: Jiang, Ting, et autres
Publié: (2024)
par: Jiang, Ting, et autres
Publié: (2024)
MaPPER: Multimodal Prior-guided Parameter Efficient Tuning for Referring Expression Comprehension
par: Liu, Ting, et autres
Publié: (2024)
par: Liu, Ting, et autres
Publié: (2024)
High-Rank Structured Modulation for Parameter-Efficient Fine-Tuning
par: Liu, Yongkang, et autres
Publié: (2026)
par: Liu, Yongkang, et autres
Publié: (2026)
Dependency Parsing is More Parameter-Efficient with Normalization
par: Gajo, Paolo, et autres
Publié: (2025)
par: Gajo, Paolo, et autres
Publié: (2025)
Representation-Guided Parameter-Efficient LLM Unlearning
par: Xiao, Zeguan, et autres
Publié: (2026)
par: Xiao, Zeguan, et autres
Publié: (2026)
Language and Task Arithmetic with Parameter-Efficient Layers for Zero-Shot Summarization
par: Chronopoulou, Alexandra, et autres
Publié: (2023)
par: Chronopoulou, Alexandra, et autres
Publié: (2023)
MiLoRA: Harnessing Minor Singular Components for Parameter-Efficient LLM Finetuning
par: Wang, Hanqing, et autres
Publié: (2024)
par: Wang, Hanqing, et autres
Publié: (2024)
TAO-Attack: Toward Advanced Optimization-Based Jailbreak Attacks for Large Language Models
par: Xu, Zhi, et autres
Publié: (2026)
par: Xu, Zhi, et autres
Publié: (2026)
TrojanRAG: Retrieval-Augmented Generation Can Be Backdoor Driver in Large Language Models
par: Cheng, Pengzhou, et autres
Publié: (2024)
par: Cheng, Pengzhou, et autres
Publié: (2024)
Efficient and Personalized Mobile Health Event Prediction via Small Language Models
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
par: Chang, Aofei, et autres
Publié: (2024)
par: Chang, Aofei, et autres
Publié: (2024)
Language Fusion for Parameter-Efficient Cross-lingual Transfer
par: Borchert, Philipp, et autres
Publié: (2025)
par: Borchert, Philipp, et autres
Publié: (2025)
Light-PEFT: Lightening Parameter-Efficient Fine-Tuning via Early Pruning
par: Gu, Naibin, et autres
Publié: (2024)
par: Gu, Naibin, et autres
Publié: (2024)
Semantic are Beacons: A Semantic Perspective for Unveiling Parameter-Efficient Fine-Tuning in Knowledge Learning
par: Wang, Renzhi, et autres
Publié: (2024)
par: Wang, Renzhi, et autres
Publié: (2024)
Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity
par: Wang, Tuowei, et autres
Publié: (2025)
par: Wang, Tuowei, et autres
Publié: (2025)
TrojanStego: Your Language Model Can Secretly Be A Steganographic Privacy Leaking Agent
par: Meier, Dominik, et autres
Publié: (2025)
par: Meier, Dominik, et autres
Publié: (2025)
Med42 -- Evaluating Fine-Tuning Strategies for Medical LLMs: Full-Parameter vs. Parameter-Efficient Approaches
par: Christophe, Clément, et autres
Publié: (2024)
par: Christophe, Clément, et autres
Publié: (2024)
Solving Trojan Detection Competitions with Linear Weight Classification
par: Huster, Todd, et autres
Publié: (2024)
par: Huster, Todd, et autres
Publié: (2024)
Parameter-Efficient Quality Estimation via Frozen Recursive Models
par: Abubacar, Umar, et autres
Publié: (2026)
par: Abubacar, Umar, et autres
Publié: (2026)
SIBO: A Simple Booster for Parameter-Efficient Fine-Tuning
par: Wen, Zhihao, et autres
Publié: (2024)
par: Wen, Zhihao, et autres
Publié: (2024)
Collaborative Distillation Strategies for Parameter-Efficient Language Model Deployment
par: Meng, Xiandong, et autres
Publié: (2025)
par: Meng, Xiandong, et autres
Publié: (2025)
MoRAgent: Parameter Efficient Agent Tuning with Mixture-of-Roles
par: Han, Jing, et autres
Publié: (2025)
par: Han, Jing, et autres
Publié: (2025)
UORA: Uniform Orthogonal Reinitialization Adaptation in Parameter-Efficient Fine-Tuning of Large Models
par: Zhang, Xueyan, et autres
Publié: (2025)
par: Zhang, Xueyan, et autres
Publié: (2025)
Parameter-Efficient Detoxification with Contrastive Decoding
par: Niu, Tong, et autres
Publié: (2024)
par: Niu, Tong, et autres
Publié: (2024)
Parameter-Efficient Fine-Tuning With Adapters
par: Chen, Keyu, et autres
Publié: (2024)
par: Chen, Keyu, et autres
Publié: (2024)
PRIDE -- Parameter-Efficient Reduction of Identity Discrimination for Equality in LLMs
par: Menke, Maluna, et autres
Publié: (2025)
par: Menke, Maluna, et autres
Publié: (2025)
QUAD: Quantization and Parameter-Efficient Tuning of LLM with Activation Decomposition
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
If You Don't Understand It, Don't Use It: Eliminating Trojans with Filters Between Layers
par: Hernandez, Adriano
Publié: (2024)
par: Hernandez, Adriano
Publié: (2024)
Trojan-Speak: Bypassing Constitutional Classifiers with No Jailbreak Tax via Adversarial Finetuning
par: Sel, Bilgehan, et autres
Publié: (2026)
par: Sel, Bilgehan, et autres
Publié: (2026)
Adapt Once, Thrive with Updates: Transferable Parameter-Efficient Fine-Tuning on Evolving Base Models
par: Gu, Naibin, et autres
Publié: (2025)
par: Gu, Naibin, et autres
Publié: (2025)
From Parameters to Data: A Task-Parameter-Guided Fine-Tuning Pipeline for Efficient LLM Alignment
par: Chen, Hao, et autres
Publié: (2026)
par: Chen, Hao, et autres
Publié: (2026)
Separator Injection Attack: Uncovering Dialogue Biases in Large Language Models Caused by Role Separators
par: Li, Xitao, et autres
Publié: (2025)
par: Li, Xitao, et autres
Publié: (2025)
Fine-Tuned LLMs Know They Don't Know: A Parameter-Efficient Approach to Recovering Honesty
par: Shi, Zeyu, et autres
Publié: (2025)
par: Shi, Zeyu, et autres
Publié: (2025)
STEP: Staged Parameter-Efficient Pre-training for Large Language Models
par: Yano, Kazuki, et autres
Publié: (2025)
par: Yano, Kazuki, et autres
Publié: (2025)
Graft: Integrating the Domain Knowledge via Efficient Parameter Synergy for MLLMs
par: Dai, Yang, et autres
Publié: (2025)
par: Dai, Yang, et autres
Publié: (2025)
Documents similaires
-
Trojan Detection in Large Language Models: Insights from The Trojan Detection Challenge
par: Maloyan, Narek, et autres
Publié: (2024) -
Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment
par: Wang, Haoran, et autres
Publié: (2023) -
Analyzing Multi-Head Attention on Trojan BERT Models
par: Wang, Jingwei
Publié: (2024) -
Defending Against Weight-Poisoning Backdoor Attacks for Parameter-Efficient Fine-Tuning
par: Zhao, Shuai, et autres
Publié: (2024) -
Watermark under Fire: A Robustness Evaluation of LLM Watermarking
par: Liang, Jiacheng, et autres
Publié: (2024)