Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts
Fuente:
arXiv
Guardado en:
| Autores principales: | Sharma, Kartik, Jin, Yiqiao, Rakesh, Vineeth, Dou, Yingtong, Pan, Menghai, Das, Mahashweta, Kumar, Srijan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SARA: Selective and Adaptive Retrieval-augmented Generation with Context Compression
por: Jin, Yiqiao, et al.
Publicado: (2025)
por: Jin, Yiqiao, et al.
Publicado: (2025)
Personalized Layer Selection for Graph Neural Networks
por: Sharma, Kartik, et al.
Publicado: (2025)
por: Sharma, Kartik, et al.
Publicado: (2025)
Efficient Knowledge Probing of Large Language Models by Adapting Pre-trained Embeddings
por: Sharma, Kartik, et al.
Publicado: (2025)
por: Sharma, Kartik, et al.
Publicado: (2025)
UniGuard: Towards Universal Safety Guardrails for Jailbreak Attacks on Multimodal Large Language Models
por: Oh, Sejoon, et al.
Publicado: (2024)
por: Oh, Sejoon, et al.
Publicado: (2024)
MedHalu: Hallucinations in Responses to Healthcare Queries by Large Language Models
por: Agarwal, Vibhor, et al.
Publicado: (2024)
por: Agarwal, Vibhor, et al.
Publicado: (2024)
A Thousand Words or An Image: Studying the Influence of Persona Modality in Multimodal LLMs
por: Broomfield, Julius, et al.
Publicado: (2025)
por: Broomfield, Julius, et al.
Publicado: (2025)
On Prompt-Driven Safeguarding for Large Language Models
por: Zheng, Chujie, et al.
Publicado: (2024)
por: Zheng, Chujie, et al.
Publicado: (2024)
TREASURE: The Visa Payment Foundation Model for High-Volume Transaction Understanding
por: Yeh, Chin-Chia Michael, et al.
Publicado: (2025)
por: Yeh, Chin-Chia Michael, et al.
Publicado: (2025)
COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics
por: Sharma, Kartik, et al.
Publicado: (2026)
por: Sharma, Kartik, et al.
Publicado: (2026)
UniSD: Towards a Unified Self-Distillation Framework for Large Language Models
por: Jin, Yiqiao, et al.
Publicado: (2026)
por: Jin, Yiqiao, et al.
Publicado: (2026)
MAIN-RAG: Multi-Agent Filtering Retrieval-Augmented Generation
por: Chang, Chia-Yuan, et al.
Publicado: (2024)
por: Chang, Chia-Yuan, et al.
Publicado: (2024)
MM-Soc: Benchmarking Multimodal Large Language Models in Social Media Platforms
por: Jin, Yiqiao, et al.
Publicado: (2024)
por: Jin, Yiqiao, et al.
Publicado: (2024)
OG-RAG: Ontology-Grounded Retrieval-Augmented Generation For Large Language Models
por: Sharma, Kartik, et al.
Publicado: (2024)
por: Sharma, Kartik, et al.
Publicado: (2024)
Enhancing Foundation Models in Transaction Understanding with LLM-based Sentence Embeddings
por: Fan, Xiran, et al.
Publicado: (2025)
por: Fan, Xiran, et al.
Publicado: (2025)
Cross-Modal Projection in Multimodal LLMs Doesn't Really Project Visual Attributes to Textual Space
por: Verma, Gaurav, et al.
Publicado: (2024)
por: Verma, Gaurav, et al.
Publicado: (2024)
A Framework for Real-time Safeguarding the Text Generation of Large Language Model
por: Dong, Ximing, et al.
Publicado: (2024)
por: Dong, Ximing, et al.
Publicado: (2024)
MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization
por: Chen, Yuyan, et al.
Publicado: (2024)
por: Chen, Yuyan, et al.
Publicado: (2024)
Debiasing Large Language Models via Adaptive Causal Prompting with Sketch-of-Thought
por: Li, Bowen, et al.
Publicado: (2026)
por: Li, Bowen, et al.
Publicado: (2026)
SlideAgent: Hierarchical Agentic Framework for Multi-Page Visual Document Understanding
por: Jin, Yiqiao, et al.
Publicado: (2025)
por: Jin, Yiqiao, et al.
Publicado: (2025)
When Prompt Optimization Becomes Jailbreaking: Adaptive Red-Teaming of Large Language Models
por: Shamsi, Zafir, et al.
Publicado: (2026)
por: Shamsi, Zafir, et al.
Publicado: (2026)
Hypothesis Testing Prompting Improves Deductive Reasoning in Large Language Models
por: Li, Yitian, et al.
Publicado: (2024)
por: Li, Yitian, et al.
Publicado: (2024)
KnowledgePrompts: Exploring the Abilities of Large Language Models to Solve Proportional Analogies via Knowledge-Enhanced Prompting
por: Wijesiriwardene, Thilini, et al.
Publicado: (2024)
por: Wijesiriwardene, Thilini, et al.
Publicado: (2024)
PromptBridge: Cross-Model Prompt Transfer for Large Language Models
por: Wang, Yaxuan, et al.
Publicado: (2025)
por: Wang, Yaxuan, et al.
Publicado: (2025)
A Framework for Situating Innovations, Opportunities, and Challenges in Advancing Vertical Systems with Large AI Models
por: Verma, Gaurav, et al.
Publicado: (2025)
por: Verma, Gaurav, et al.
Publicado: (2025)
Chinese Metaphor Recognition Using a Multi-stage Prompting Large Language Model
por: Wang, Jie, et al.
Publicado: (2024)
por: Wang, Jie, et al.
Publicado: (2024)
Goal-guided Generative Prompt Injection Attack on Large Language Models
por: Zhang, Chong, et al.
Publicado: (2024)
por: Zhang, Chong, et al.
Publicado: (2024)
IAA: Inner-Adaptor Architecture Empowers Frozen Large Language Model with Multimodal Capabilities
por: Wang, Bin, et al.
Publicado: (2024)
por: Wang, Bin, et al.
Publicado: (2024)
SEALGuard: Safeguarding the Multilingual Conversations in Southeast Asian Languages for LLM Software Systems
por: Shan, Wenliang, et al.
Publicado: (2025)
por: Shan, Wenliang, et al.
Publicado: (2025)
Jailbreaking Safeguarded Text-to-Image Models via Large Language Models
por: Jiang, Zhengyuan, et al.
Publicado: (2025)
por: Jiang, Zhengyuan, et al.
Publicado: (2025)
Are Large Language Models Good Prompt Optimizers?
por: Ma, Ruotian, et al.
Publicado: (2024)
por: Ma, Ruotian, et al.
Publicado: (2024)
Large Language Models Prompting With Episodic Memory
por: Do, Dai, et al.
Publicado: (2024)
por: Do, Dai, et al.
Publicado: (2024)
On the Worst Prompt Performance of Large Language Models
por: Cao, Bowen, et al.
Publicado: (2024)
por: Cao, Bowen, et al.
Publicado: (2024)
PromptKeeper: Safeguarding System Prompts for LLMs
por: Jiang, Zhifeng, et al.
Publicado: (2024)
por: Jiang, Zhifeng, et al.
Publicado: (2024)
CompeteAI: Understanding the Competition Dynamics in Large Language Model-based Agents
por: Zhao, Qinlin, et al.
Publicado: (2023)
por: Zhao, Qinlin, et al.
Publicado: (2023)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
por: Dong, Honghua, et al.
Publicado: (2024)
por: Dong, Honghua, et al.
Publicado: (2024)
TextReg: Mitigating Prompt Distributional Overfitting via Regularized Text-Space Optimization
por: Fu, Lucheng, et al.
Publicado: (2026)
por: Fu, Lucheng, et al.
Publicado: (2026)
HiFACTMix: A Code-Mixed Benchmark and Graph-Aware Model for EvidenceBased Political Claim Verification in Hinglish
por: Thakur, Rakesh, et al.
Publicado: (2025)
por: Thakur, Rakesh, et al.
Publicado: (2025)
MASCOT: Towards Multi-Agent Socio-Collaborative Companion Systems
por: Wang, Yiyang, et al.
Publicado: (2026)
por: Wang, Yiyang, et al.
Publicado: (2026)
Robustness of Prompting: Enhancing Robustness of Large Language Models Against Prompting Attacks
por: Mu, Lin, et al.
Publicado: (2025)
por: Mu, Lin, et al.
Publicado: (2025)
Diverse Prompts: Illuminating the Prompt Space of Large Language Models with MAP-Elites
por: Santos, Gabriel Machado, et al.
Publicado: (2025)
por: Santos, Gabriel Machado, et al.
Publicado: (2025)
Ejemplares similares
-
SARA: Selective and Adaptive Retrieval-augmented Generation with Context Compression
por: Jin, Yiqiao, et al.
Publicado: (2025) -
Personalized Layer Selection for Graph Neural Networks
por: Sharma, Kartik, et al.
Publicado: (2025) -
Efficient Knowledge Probing of Large Language Models by Adapting Pre-trained Embeddings
por: Sharma, Kartik, et al.
Publicado: (2025) -
UniGuard: Towards Universal Safety Guardrails for Jailbreak Attacks on Multimodal Large Language Models
por: Oh, Sejoon, et al.
Publicado: (2024) -
MedHalu: Hallucinations in Responses to Healthcare Queries by Large Language Models
por: Agarwal, Vibhor, et al.
Publicado: (2024)