SEA: Low-Resource Safety Alignment for Multimodal Large Language Models via Synthetic Embeddings
Fuente:
arXiv
Saved in:
| Main Authors: | Lu, Weikai, Peng, Hao, Zhuang, Huiping, Chen, Cen, Zeng, Ziqian |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ARGUS: Defending Against Multimodal Indirect Prompt Injection via Steering Instruction-Following Behavior
by: Lu, Weikai, et al.
Published: (2025)
by: Lu, Weikai, et al.
Published: (2025)
Structured Visual Narratives Undermine Safety Alignment in Multimodal Large Language Models
by: Tan, Rui Yang, et al.
Published: (2026)
by: Tan, Rui Yang, et al.
Published: (2026)
Medical MLLM is Vulnerable: Cross-Modality Jailbreak and Mismatched Attacks on Medical Multimodal Large Language Models
by: Huang, Xijie, et al.
Published: (2024)
by: Huang, Xijie, et al.
Published: (2024)
Beyond Text: Multimodal Jailbreaking of Vision-Language and Audio Models through Perceptually Simple Transformations
by: Kumar, Divyanshu, et al.
Published: (2025)
by: Kumar, Divyanshu, et al.
Published: (2025)
Test-Time Backdoor Attacks on Multimodal Large Language Models
by: Lu, Dong, et al.
Published: (2024)
by: Lu, Dong, et al.
Published: (2024)
PRISM-XR: Empowering Privacy-Aware XR Collaboration with Multimodal Large Language Models
by: Chen, Jiangong, et al.
Published: (2026)
by: Chen, Jiangong, et al.
Published: (2026)
PrivacyRestore: Privacy-Preserving Inference in Large Language Models via Privacy Removal and Restoration
by: Zeng, Ziqian, et al.
Published: (2024)
by: Zeng, Ziqian, et al.
Published: (2024)
Multimodal Unlearnable Examples: Protecting Data against Multimodal Contrastive Learning
by: Liu, Xinwei, et al.
Published: (2024)
by: Liu, Xinwei, et al.
Published: (2024)
Embedding Digital Signature into CSV Files Using Data Hiding
by: Ito, Akinori
Published: (2024)
by: Ito, Akinori
Published: (2024)
The Synthetic Media Shift: Tracking the Rise, Virality, and Detectability of AI-Generated Multimodal Misinformation
by: Chrysidis, Zacharias, et al.
Published: (2026)
by: Chrysidis, Zacharias, et al.
Published: (2026)
RoboKA: KAN Informed Multimodal Learning for RoboCall Surveillance System
by: Choudhury, Nitin, et al.
Published: (2026)
by: Choudhury, Nitin, et al.
Published: (2026)
Intelligent Carrier Allocation: A Cross-Modal Reasoning Framework for Adaptive Multimodal Steganography
by: Das, Abhirup, et al.
Published: (2025)
by: Das, Abhirup, et al.
Published: (2025)
Benchmarking Large Multimodal Models against Common Corruptions
by: Zhang, Jiawei, et al.
Published: (2024)
by: Zhang, Jiawei, et al.
Published: (2024)
Security Analysis of Thumbnail-Preserving Image Encryption and a New Framework
by: Xie, Dong, et al.
Published: (2025)
by: Xie, Dong, et al.
Published: (2025)
Raster Domain Text Steganography: A Unified Framework for Multimodal Secure Embedding
by: Kandala, A V Uday Kiran
Published: (2025)
by: Kandala, A V Uday Kiran
Published: (2025)
SyncGait: Robust Long-Distance Authentication for Drone Delivery via Implicit Gait Behaviors
by: Ling, Zijian, et al.
Published: (2025)
by: Ling, Zijian, et al.
Published: (2025)
E-FreeM2: Efficient Training-Free Multi-Scale and Cross-Modal News Verification via MLLMs
by: Phan, Van-Hoang, et al.
Published: (2025)
by: Phan, Van-Hoang, et al.
Published: (2025)
Multichannel Steganography: A Provably Secure Hybrid Steganographic Model for Secure Communication
by: Omego, Obinna, et al.
Published: (2025)
by: Omego, Obinna, et al.
Published: (2025)
RewardDS: Privacy-Preserving Fine-Tuning for Large Language Models via Reward Driven Data Synthesis
by: Wang, Jianwei, et al.
Published: (2025)
by: Wang, Jianwei, et al.
Published: (2025)
Steganographic Embeddings as an Effective Data Augmentation
by: DiSalvo, Nicholas
Published: (2025)
by: DiSalvo, Nicholas
Published: (2025)
Investigating Vulnerabilities and Defenses Against Audio-Visual Attacks: A Comprehensive Survey Emphasizing Multimodal Models
by: Wen, Jinming, et al.
Published: (2025)
by: Wen, Jinming, et al.
Published: (2025)
PRoADS: Provably Secure and Robust Audio Diffusion Steganography with latent optimization and backward Euler Inversion
by: Yan, YongPeng, et al.
Published: (2026)
by: Yan, YongPeng, et al.
Published: (2026)
Federated Domain-Specific Knowledge Transfer on Large Language Models Using Synthetic Data
by: Li, Haoran, et al.
Published: (2024)
by: Li, Haoran, et al.
Published: (2024)
Embedded Blockchains: A Synthesis of Blockchains, Spread Spectrum Watermarking, Perceptual Hashing & Digital Signatures
by: Blake, Sam
Published: (2020)
by: Blake, Sam
Published: (2020)
Cyber Vaccine for Deepfake Immunity
by: Chang, Ching-Chun, et al.
Published: (2023)
by: Chang, Ching-Chun, et al.
Published: (2023)
Fast Audio Codec Identification Using Overlapping LCS
by: Jafari, Farzane
Published: (2025)
by: Jafari, Farzane
Published: (2025)
StegoHound: A Novel Multi-Approaches Method for Efficient and Effective Identification and Extraction of Digital Evidence Masked by Steganographic Techniques in WAV and MP3 Files
by: Ghanem, Mohamed C., et al.
Published: (2023)
by: Ghanem, Mohamed C., et al.
Published: (2023)
Reversible Video Steganography Using Quick Response Codes and Modified ElGamal Cryptosystem
by: Mstafa, Ramadhan J.
Published: (2025)
by: Mstafa, Ramadhan J.
Published: (2025)
Digital Fingerprinting on Multimedia: A Survey
by: Chen, Wendi, et al.
Published: (2024)
by: Chen, Wendi, et al.
Published: (2024)
MaskAnyone Toolkit: Offering Strategies for Minimizing Privacy Risks and Maximizing Utility in Audio-Visual Data Archiving
by: Owoyele, Babajide Alamu, et al.
Published: (2024)
by: Owoyele, Babajide Alamu, et al.
Published: (2024)
An Efficient Light-weight LSB steganography with Deep learning Steganalysis
by: Das, Dipnarayan, et al.
Published: (2022)
by: Das, Dipnarayan, et al.
Published: (2022)
AMUSE: Adaptive Multi-Segment Encoding for Dataset Watermarking
by: Alvar, Saeed Ranjbar, et al.
Published: (2024)
by: Alvar, Saeed Ranjbar, et al.
Published: (2024)
CorrNetDroid: Android Malware Detector leveraging a Correlation-based Feature Selection for Network Traffic features
by: Sharma, Yash, et al.
Published: (2025)
by: Sharma, Yash, et al.
Published: (2025)
An Efficient Digital Watermarking Technique for Small Scale devices
by: Talathi, Kaushik, et al.
Published: (2025)
by: Talathi, Kaushik, et al.
Published: (2025)
Privis: Towards Content-Aware Secure Volumetric Video Delivery
by: Hu, Kaiyuan, et al.
Published: (2025)
by: Hu, Kaiyuan, et al.
Published: (2025)
Semi-fragile watermarking of remote sensing images using DWT, vector quantization and automatic tiling
by: Serra-Ruiz, Jordi, et al.
Published: (2025)
by: Serra-Ruiz, Jordi, et al.
Published: (2025)
Robust Steganography with Boundary-Preserving Overflow Alleviation and Adaptive Error Correction
by: Cheng, Yu, et al.
Published: (2024)
by: Cheng, Yu, et al.
Published: (2024)
Interoperable Provenance Authentication of Broadcast Media using Open Standards-based Metadata, Watermarking and Cryptography
by: Simmons, John C., et al.
Published: (2024)
by: Simmons, John C., et al.
Published: (2024)
Forensic analysis of video data deletion and recovery in Honeywell surveillance file system
by: Yoon, Jinhee, et al.
Published: (2026)
by: Yoon, Jinhee, et al.
Published: (2026)
QMedShield: A Novel Quantum Chaos-based Image Encryption Scheme for Secure Medical Image Storage in the Cloud
by: Rajan, Arun Amaithi, et al.
Published: (2024)
by: Rajan, Arun Amaithi, et al.
Published: (2024)
Similar Items
-
ARGUS: Defending Against Multimodal Indirect Prompt Injection via Steering Instruction-Following Behavior
by: Lu, Weikai, et al.
Published: (2025) -
Structured Visual Narratives Undermine Safety Alignment in Multimodal Large Language Models
by: Tan, Rui Yang, et al.
Published: (2026) -
Medical MLLM is Vulnerable: Cross-Modality Jailbreak and Mismatched Attacks on Medical Multimodal Large Language Models
by: Huang, Xijie, et al.
Published: (2024) -
Beyond Text: Multimodal Jailbreaking of Vision-Language and Audio Models through Perceptually Simple Transformations
by: Kumar, Divyanshu, et al.
Published: (2025) -
Test-Time Backdoor Attacks on Multimodal Large Language Models
by: Lu, Dong, et al.
Published: (2024)