PromptFix: Few-shot Backdoor Removal via Adversarial Prompt Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Tianrong, Xi, Zhaohan, Wang, Ting, Mitra, Prasenjit, Chen, Jinghui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Few-shot Prompting for Pairwise Ranking: An Effective Non-Parametric Retrieval Model
di: Sinhababu, Nilanjan, et al.
Pubblicazione: (2024)
di: Sinhababu, Nilanjan, et al.
Pubblicazione: (2024)
Dialogue for Prompting: a Policy-Gradient-Based Discrete Prompt Generation for Few-shot Learning
di: Li, Chengzhengxu, et al.
Pubblicazione: (2023)
di: Li, Chengzhengxu, et al.
Pubblicazione: (2023)
Revisiting Chain-of-Thought Prompting: Zero-shot Can Be Stronger than Few-shot
di: Cheng, Xiang, et al.
Pubblicazione: (2025)
di: Cheng, Xiang, et al.
Pubblicazione: (2025)
PromptAL: Sample-Aware Dynamic Soft Prompts for Few-Shot Active Learning
di: Xiang, Hui, et al.
Pubblicazione: (2025)
di: Xiang, Hui, et al.
Pubblicazione: (2025)
Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection
di: Yan, Jun, et al.
Pubblicazione: (2023)
di: Yan, Jun, et al.
Pubblicazione: (2023)
Semantic Captioning: Benchmark Dataset and Graph-Aware Few-Shot In-Context Learning for SQL2Text
di: Al-Lawati, Ali, et al.
Pubblicazione: (2025)
di: Al-Lawati, Ali, et al.
Pubblicazione: (2025)
PromptFix: You Prompt and We Fix the Photo
di: Yu, Yongsheng, et al.
Pubblicazione: (2024)
di: Yu, Yongsheng, et al.
Pubblicazione: (2024)
JoPA:Explaining Large Language Model's Generation via Joint Prompt Attribution
di: Chang, Yurui, et al.
Pubblicazione: (2024)
di: Chang, Yurui, et al.
Pubblicazione: (2024)
Fight Back Against Jailbreaking via Prompt Adversarial Tuning
di: Mo, Yichuan, et al.
Pubblicazione: (2024)
di: Mo, Yichuan, et al.
Pubblicazione: (2024)
Prompt Optimization via Adversarial In-Context Learning
di: Do, Xuan Long, et al.
Pubblicazione: (2023)
di: Do, Xuan Long, et al.
Pubblicazione: (2023)
StablePT: Towards Stable Prompting for Few-shot Learning via Input Separation
di: Liu, Xiaoming, et al.
Pubblicazione: (2024)
di: Liu, Xiaoming, et al.
Pubblicazione: (2024)
Token-Level Adversarial Prompt Detection Based on Perplexity Measures and Contextual Information
di: Hu, Zhengmian, et al.
Pubblicazione: (2023)
di: Hu, Zhengmian, et al.
Pubblicazione: (2023)
Prompt as Free Lunch: Enhancing Diversity in Source-Free Cross-domain Few-shot Learning through Semantic-Guided Prompting
di: Zhuo, Linhai, et al.
Pubblicazione: (2024)
di: Zhuo, Linhai, et al.
Pubblicazione: (2024)
M$^2$PT: Multimodal Prompt Tuning for Zero-shot Instruction Learning
di: Wang, Taowen, et al.
Pubblicazione: (2024)
di: Wang, Taowen, et al.
Pubblicazione: (2024)
WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response
di: Zhang, Tianrong, et al.
Pubblicazione: (2024)
di: Zhang, Tianrong, et al.
Pubblicazione: (2024)
Pre-trained Language Models Improve the Few-shot Prompt Ability of Decision Transformer
di: Yang, Yu, et al.
Pubblicazione: (2024)
di: Yang, Yu, et al.
Pubblicazione: (2024)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
Few-shot Knowledge Graph Relational Reasoning via Subgraph Adaptation
di: Liu, Haochen, et al.
Pubblicazione: (2024)
di: Liu, Haochen, et al.
Pubblicazione: (2024)
Few-Shot Adversarial Prompt Learning on Vision-Language Models
di: Zhou, Yiwei, et al.
Pubblicazione: (2024)
di: Zhou, Yiwei, et al.
Pubblicazione: (2024)
DynaPrompt: Dynamic Test-Time Prompt Tuning
di: Xiao, Zehao, et al.
Pubblicazione: (2025)
di: Xiao, Zehao, et al.
Pubblicazione: (2025)
Efficient Prompt Tuning by Multi-Space Projection and Prompt Fusion
di: Lan, Pengxiang, et al.
Pubblicazione: (2024)
di: Lan, Pengxiang, et al.
Pubblicazione: (2024)
SCULPT: Systematic Tuning of Long Prompts
di: Kumar, Shanu, et al.
Pubblicazione: (2024)
di: Kumar, Shanu, et al.
Pubblicazione: (2024)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
di: Liu, Xinyang, et al.
Pubblicazione: (2023)
di: Liu, Xinyang, et al.
Pubblicazione: (2023)
Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization
di: Cao, Yuanpu, et al.
Pubblicazione: (2024)
di: Cao, Yuanpu, et al.
Pubblicazione: (2024)
On the Utility of Domain-Adjacent Fine-Tuned Model Ensembles for Few-shot Problems
di: Alam, Md Ibrahim Ibne, et al.
Pubblicazione: (2024)
di: Alam, Md Ibrahim Ibne, et al.
Pubblicazione: (2024)
PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning
di: Kim, Gyeongman, et al.
Pubblicazione: (2024)
di: Kim, Gyeongman, et al.
Pubblicazione: (2024)
Selective Prompting Tuning for Personalized Conversations with LLMs
di: Huang, Qiushi, et al.
Pubblicazione: (2024)
di: Huang, Qiushi, et al.
Pubblicazione: (2024)
UniGuardian: A Unified Defense for Detecting Prompt Injection, Backdoor Attacks and Adversarial Attacks in Large Language Models
di: Lin, Huawei, et al.
Pubblicazione: (2025)
di: Lin, Huawei, et al.
Pubblicazione: (2025)
Can Embedding Similarity Predict Cross-Lingual Transfer? A Systematic Study on African Languages
di: Idris, Tewodros Kederalah, et al.
Pubblicazione: (2026)
di: Idris, Tewodros Kederalah, et al.
Pubblicazione: (2026)
Prompt Tuning for Natural Language to SQL with Embedding Fine-Tuning and RAG
di: Jang, Jisoo, et al.
Pubblicazione: (2025)
di: Jang, Jisoo, et al.
Pubblicazione: (2025)
Hard Prompts Made Interpretable: Sparse Entropy Regularization for Prompt Tuning with RL
di: Choi, Yunseon, et al.
Pubblicazione: (2024)
di: Choi, Yunseon, et al.
Pubblicazione: (2024)
TrojFSP: Trojan Insertion in Few-shot Prompt Tuning
di: Zheng, Mengxin, et al.
Pubblicazione: (2023)
di: Zheng, Mengxin, et al.
Pubblicazione: (2023)
Aligning the Spectrum: Hybrid Graph Pre-training and Prompt Tuning across Homophily and Heterophily
di: Luo, Haitong, et al.
Pubblicazione: (2025)
di: Luo, Haitong, et al.
Pubblicazione: (2025)
FPT: Feature Prompt Tuning for Few-shot Readability Assessment
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
IDIAPers @ Causal News Corpus 2022: Efficient Causal Relation Identification Through a Prompt-based Few-shot Approach
di: Burdisso, Sergio, et al.
Pubblicazione: (2022)
di: Burdisso, Sergio, et al.
Pubblicazione: (2022)
Plug and Play with Prompts: A Prompt Tuning Approach for Controlling Text Generation
di: Ajwani, Rohan Deepak, et al.
Pubblicazione: (2024)
di: Ajwani, Rohan Deepak, et al.
Pubblicazione: (2024)
Graph-based Molecular In-context Learning Grounded on Morgan Fingerprints
di: Al-Lawati, Ali, et al.
Pubblicazione: (2025)
di: Al-Lawati, Ali, et al.
Pubblicazione: (2025)
Subgraph-level Universal Prompt Tuning
di: Lee, Junhyun, et al.
Pubblicazione: (2024)
di: Lee, Junhyun, et al.
Pubblicazione: (2024)
AMU-Tuning: Effective Logit Bias for CLIP-based Few-shot Learning
di: Tang, Yuwei, et al.
Pubblicazione: (2024)
di: Tang, Yuwei, et al.
Pubblicazione: (2024)
Exploring Embedding Priors in Prompt-Tuning for Improved Interpretability and Control
di: Sedov, Sergey, et al.
Pubblicazione: (2024)
di: Sedov, Sergey, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Few-shot Prompting for Pairwise Ranking: An Effective Non-Parametric Retrieval Model
di: Sinhababu, Nilanjan, et al.
Pubblicazione: (2024) -
Dialogue for Prompting: a Policy-Gradient-Based Discrete Prompt Generation for Few-shot Learning
di: Li, Chengzhengxu, et al.
Pubblicazione: (2023) -
Revisiting Chain-of-Thought Prompting: Zero-shot Can Be Stronger than Few-shot
di: Cheng, Xiang, et al.
Pubblicazione: (2025) -
PromptAL: Sample-Aware Dynamic Soft Prompts for Few-Shot Active Learning
di: Xiang, Hui, et al.
Pubblicazione: (2025) -
Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection
di: Yan, Jun, et al.
Pubblicazione: (2023)