StructTransform: A Scalable Attack Surface for Safety-Aligned Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yoosuf, Shehel, Ali, Temoor, Lekssays, Ahmed, AlSabah, Mashael, Khalil, Issa |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Examining the Rat in the Tunnel: Interpretable Multi-Label Classification of Tor-based Malware
par: Karunanayake, Ishan, et autres
Publié: (2024)
par: Karunanayake, Ishan, et autres
Publié: (2024)
Poison with Style: A Practical Poisoning Attack on Code Large Language Models
par: Tran, Khang, et autres
Publié: (2026)
par: Tran, Khang, et autres
Publié: (2026)
LLMxCPG: Context-Aware Vulnerability Detection Through Code Property Graph-Guided Large Language Models
par: Lekssays, Ahmed, et autres
Publié: (2025)
par: Lekssays, Ahmed, et autres
Publié: (2025)
PromSec: Prompt Optimization for Secure Generation of Functional Source Code with Large Language Models (LLMs)
par: Nazzal, Mahmoud, et autres
Publié: (2024)
par: Nazzal, Mahmoud, et autres
Publié: (2024)
Bridging Code Property Graphs and Language Models for Program Analysis
par: Lekssays, Ahmed
Publié: (2026)
par: Lekssays, Ahmed
Publié: (2026)
Gradient Transformer: Learning to Generate Updates for LLMs
par: Nguyen, Binh-Nguyen, et autres
Publié: (2026)
par: Nguyen, Binh-Nguyen, et autres
Publié: (2026)
EvoStruct: Bridging Evolutionary and Structural Priors for Antibody CDR Design via Protein Language Model Adaptation
par: Ahmed, Mansoor, et autres
Publié: (2026)
par: Ahmed, Mansoor, et autres
Publié: (2026)
StructCoder: Structure-Aware Transformer for Code Generation
par: Tipirneni, Sindhu, et autres
Publié: (2022)
par: Tipirneni, Sindhu, et autres
Publié: (2022)
StructEval: Deepen and Broaden Large Language Model Assessment via Structured Evaluation
par: Cao, Boxi, et autres
Publié: (2024)
par: Cao, Boxi, et autres
Publié: (2024)
Lisa: Lazy Safety Alignment for Large Language Models against Harmful Fine-tuning Attack
par: Huang, Tiansheng, et autres
Publié: (2024)
par: Huang, Tiansheng, et autres
Publié: (2024)
NeuRel-Attack: Neuron Relearning for Safety Disalignment in Large Language Models
par: Zhou, Yi, et autres
Publié: (2025)
par: Zhou, Yi, et autres
Publié: (2025)
Inference-Time Decomposition of Activations (ITDA): A Scalable Approach to Interpreting Large Language Models
par: Leask, Patrick, et autres
Publié: (2025)
par: Leask, Patrick, et autres
Publié: (2025)
Adaptive Malware Detection using Sequential Feature Selection: A Dueling Double Deep Q-Network (D3QN) Framework for Intelligent Classification
par: Khan, Naseem, et autres
Publié: (2025)
par: Khan, Naseem, et autres
Publié: (2025)
ABC Align: Large Language Model Alignment for Safety & Accuracy
par: Seneque, Gareth, et autres
Publié: (2024)
par: Seneque, Gareth, et autres
Publié: (2024)
Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks
par: Andriushchenko, Maksym, et autres
Publié: (2024)
par: Andriushchenko, Maksym, et autres
Publié: (2024)
Improving Acoustic Side-Channel Attacks on Keyboards Using Transformers and Large Language Models
par: Park, Jin Hyun, et autres
Publié: (2025)
par: Park, Jin Hyun, et autres
Publié: (2025)
Aligning Agents like Large Language Models
par: Jelley, Adam, et autres
Publié: (2024)
par: Jelley, Adam, et autres
Publié: (2024)
Vulnerability Mitigation for Safety-Aligned Language Models via Debiasing
par: Tran, Thien Q., et autres
Publié: (2025)
par: Tran, Thien Q., et autres
Publié: (2025)
Align to Structure: Aligning Large Language Models with Structural Information
par: Kim, Zae Myung, et autres
Publié: (2025)
par: Kim, Zae Myung, et autres
Publié: (2025)
AlignGuard: Scalable Safety Alignment for Text-to-Image Generation
par: Liu, Runtao, et autres
Publié: (2024)
par: Liu, Runtao, et autres
Publié: (2024)
Scalable Fingerprinting of Large Language Models
par: Nasery, Anshul, et autres
Publié: (2025)
par: Nasery, Anshul, et autres
Publié: (2025)
ViGText: Deepfake Image Detection with Vision-Language Model Explanations and Graph Neural Networks
par: ALBarqawi, Ahmad, et autres
Publié: (2025)
par: ALBarqawi, Ahmad, et autres
Publié: (2025)
TabStruct: Measuring Structural Fidelity of Tabular Data
par: Jiang, Xiangjian, et autres
Publié: (2025)
par: Jiang, Xiangjian, et autres
Publié: (2025)
LLMSynthor: Macro-Aligned Micro-Records Synthesis with Large Language Models
par: Tang, Yihong, et autres
Publié: (2025)
par: Tang, Yihong, et autres
Publié: (2025)
Attacking Large Language Models with Projected Gradient Descent
par: Geisler, Simon, et autres
Publié: (2024)
par: Geisler, Simon, et autres
Publié: (2024)
Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models
par: Li, Xiao, et autres
Publié: (2024)
par: Li, Xiao, et autres
Publié: (2024)
A Scalable and Generalized Deep Learning Framework for Anomaly Detection in Surveillance Videos
par: Jebur, Sabah Abdulazeez, et autres
Publié: (2024)
par: Jebur, Sabah Abdulazeez, et autres
Publié: (2024)
On the Effectiveness of Membership Inference in Targeted Data Extraction from Large Language Models
par: Sahili, Ali Al, et autres
Publié: (2025)
par: Sahili, Ali Al, et autres
Publié: (2025)
PRPO: Paragraph-level Policy Optimization for Vision-Language Deepfake Detection
par: Nguyen, Tuan, et autres
Publié: (2025)
par: Nguyen, Tuan, et autres
Publié: (2025)
UniGuard: Towards Universal Safety Guardrails for Jailbreak Attacks on Multimodal Large Language Models
par: Oh, Sejoon, et autres
Publié: (2024)
par: Oh, Sejoon, et autres
Publié: (2024)
SOS! Soft Prompt Attack Against Open-Source Large Language Models
par: Yang, Ziqing, et autres
Publié: (2024)
par: Yang, Ziqing, et autres
Publié: (2024)
Comparing Reconstruction Attacks on Pretrained Versus Full Fine-tuned Large Language Model Embeddings on Homo Sapiens Splice Sites Genomic Data
par: Al-Saidi, Reem, et autres
Publié: (2025)
par: Al-Saidi, Reem, et autres
Publié: (2025)
Synthetic Interaction Data for Scalable Personalization in Large Language Models
par: Ma, Yuchen, et autres
Publié: (2026)
par: Ma, Yuchen, et autres
Publié: (2026)
Robust and Scalable Model Editing for Large Language Models
par: Chen, Yingfa, et autres
Publié: (2024)
par: Chen, Yingfa, et autres
Publié: (2024)
Semantic Membership Inference Attack against Large Language Models
par: Mozaffari, Hamid, et autres
Publié: (2024)
par: Mozaffari, Hamid, et autres
Publié: (2024)
Sampling-aware Adversarial Attacks Against Large Language Models
par: Beyer, Tim, et autres
Publié: (2025)
par: Beyer, Tim, et autres
Publié: (2025)
Learning Safety Constraints for Large Language Models
par: Chen, Xin, et autres
Publié: (2025)
par: Chen, Xin, et autres
Publié: (2025)
Special Characters Attack: Toward Scalable Training Data Extraction From Large Language Models
par: Bai, Yang, et autres
Publié: (2024)
par: Bai, Yang, et autres
Publié: (2024)
Sketching the Readout of Large Language Models for Scalable Data Attribution and Valuation
par: Ran, Yide, et autres
Publié: (2026)
par: Ran, Yide, et autres
Publié: (2026)
Beyond Human Data: Aligning Multimodal Large Language Models by Iterative Self-Evolution
par: Tan, Wentao, et autres
Publié: (2024)
par: Tan, Wentao, et autres
Publié: (2024)
Documents similaires
-
Examining the Rat in the Tunnel: Interpretable Multi-Label Classification of Tor-based Malware
par: Karunanayake, Ishan, et autres
Publié: (2024) -
Poison with Style: A Practical Poisoning Attack on Code Large Language Models
par: Tran, Khang, et autres
Publié: (2026) -
LLMxCPG: Context-Aware Vulnerability Detection Through Code Property Graph-Guided Large Language Models
par: Lekssays, Ahmed, et autres
Publié: (2025) -
PromSec: Prompt Optimization for Secure Generation of Functional Source Code with Large Language Models (LLMs)
par: Nazzal, Mahmoud, et autres
Publié: (2024) -
Bridging Code Property Graphs and Language Models for Program Analysis
par: Lekssays, Ahmed
Publié: (2026)