ProjLens: Unveiling the Role of Projectors in Multimodal Model Safety
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Kun, Qian, Cheng, Yu, Miao, Peng, Lilan, Lin, Liang, Zhang, Jiaming, Zhang, Tianyu, Cheng, Yu, Wang, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Security Threat of Compressed Projectors in Large Vision-Language Models
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
Dataset Ownership in the Era of Large Language Models
di: Li, Kun, et al.
Pubblicazione: (2025)
di: Li, Kun, et al.
Pubblicazione: (2025)
G-Safeguard: A Topology-Guided Security Lens and Treatment on LLM-based Multi-agent Systems
di: Wang, Shilong, et al.
Pubblicazione: (2025)
di: Wang, Shilong, et al.
Pubblicazione: (2025)
AutoIoT: Automated IoT Platform Using Large Language Models
di: Cheng, Ye, et al.
Pubblicazione: (2024)
di: Cheng, Ye, et al.
Pubblicazione: (2024)
JailbreakLens: Interpreting Jailbreak Mechanism in the Lens of Representation and Circuit
di: He, Zeqing, et al.
Pubblicazione: (2024)
di: He, Zeqing, et al.
Pubblicazione: (2024)
On the Role of Attention Heads in Large Language Model Safety
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
Psyzkaller: Learning from Historical and On-the-Fly Execution Data for Smarter Seed Generation in OS kernel Fuzzing
di: Liu, Boyu, et al.
Pubblicazione: (2025)
di: Liu, Boyu, et al.
Pubblicazione: (2025)
Unveiling the Bandwidth Nightmare: CDN Compression Format Conversion Attacks
di: Lin, Ziyu, et al.
Pubblicazione: (2024)
di: Lin, Ziyu, et al.
Pubblicazione: (2024)
Profiling for Pennies: Unveiling the Privacy Iceberg of LLM Agents
di: Chen, Jiahao, et al.
Pubblicazione: (2026)
di: Chen, Jiahao, et al.
Pubblicazione: (2026)
A Trajectory-Based Safety Audit of Clawdbot (OpenClaw)
di: Chen, Tianyu, et al.
Pubblicazione: (2026)
di: Chen, Tianyu, et al.
Pubblicazione: (2026)
Behavioral Authentication for Security and Safety
di: Wang, Cheng, et al.
Pubblicazione: (2023)
di: Wang, Cheng, et al.
Pubblicazione: (2023)
Optimizing seed inputs in fuzzing with machine learning
di: Cheng, Liang, et al.
Pubblicazione: (2019)
di: Cheng, Liang, et al.
Pubblicazione: (2019)
Unveiling Security Weaknesses in Autonomous Driving Systems: An In-Depth Empirical Study
di: Cheng, Wenyuan, et al.
Pubblicazione: (2025)
di: Cheng, Wenyuan, et al.
Pubblicazione: (2025)
Privacy-Preserving Socialized Recommendation based on Multi-View Clustering in a Cloud Environment
di: Guo, Cheng, et al.
Pubblicazione: (2025)
di: Guo, Cheng, et al.
Pubblicazione: (2025)
Toward a Principled Framework for Agent Safety Measurement
di: Lin, Shuyi, et al.
Pubblicazione: (2026)
di: Lin, Shuyi, et al.
Pubblicazione: (2026)
Automatic Generation of a Cryptography Misuse Taxonomy Using Large Language Models
di: Zhang, Yang, et al.
Pubblicazione: (2025)
di: Zhang, Yang, et al.
Pubblicazione: (2025)
SafeBench: A Safety Evaluation Framework for Multimodal Large Language Models
di: Ying, Zonghao, et al.
Pubblicazione: (2024)
di: Ying, Zonghao, et al.
Pubblicazione: (2024)
BADTV: Unveiling Backdoor Threats in Third-Party Task Vectors
di: Hsu, Chia-Yi, et al.
Pubblicazione: (2025)
di: Hsu, Chia-Yi, et al.
Pubblicazione: (2025)
CompVPD: Iteratively Identifying Vulnerability Patches Based on Human Validation Results with a Precise Context
di: Chen, Tianyu, et al.
Pubblicazione: (2023)
di: Chen, Tianyu, et al.
Pubblicazione: (2023)
MLLMGuard: A Multi-dimensional Safety Evaluation Suite for Multimodal Large Language Models
di: Gu, Tianle, et al.
Pubblicazione: (2024)
di: Gu, Tianle, et al.
Pubblicazione: (2024)
Feature-Oriented IoT Malware Analysis: Extraction, Classification, and Future Directions
di: Qian, Zhuoyun, et al.
Pubblicazione: (2025)
di: Qian, Zhuoyun, et al.
Pubblicazione: (2025)
Starfish: Rebalancing Multi-Party Off-Chain Payment Channels
di: Xu, Minghui, et al.
Pubblicazione: (2025)
di: Xu, Minghui, et al.
Pubblicazione: (2025)
LIFT: Automating Symbolic Execution Optimization with Large Language Models for AI Networks
di: Wang, Ruoxi, et al.
Pubblicazione: (2025)
di: Wang, Ruoxi, et al.
Pubblicazione: (2025)
NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models
di: Zhang, Chuhan, et al.
Pubblicazione: (2025)
di: Zhang, Chuhan, et al.
Pubblicazione: (2025)
Large Language Model Adversarial Landscape Through the Lens of Attack Objectives
di: Wang, Nan, et al.
Pubblicazione: (2025)
di: Wang, Nan, et al.
Pubblicazione: (2025)
"MCP Does Not Stand for Misuse Cryptography Protocol": Uncovering Cryptographic Misuse in Model Context Protocol at Scale
di: Yan, Biwei, et al.
Pubblicazione: (2025)
di: Yan, Biwei, et al.
Pubblicazione: (2025)
AutoJailbreak: Exploring Jailbreak Attacks and Defenses through a Dependency Lens
di: Lu, Lin, et al.
Pubblicazione: (2024)
di: Lu, Lin, et al.
Pubblicazione: (2024)
VENOMREC: Cross-Modal Interactive Poisoning for Targeted Promotion in Multimodal LLM Recommender Systems
di: Guan, Guowei, et al.
Pubblicazione: (2026)
di: Guan, Guowei, et al.
Pubblicazione: (2026)
Beyond Jailbreak: Unveiling Risks in LLM Applications Arising from Blurred Capability Boundaries
di: Zhang, Yunyi, et al.
Pubblicazione: (2025)
di: Zhang, Yunyi, et al.
Pubblicazione: (2025)
Unveiling Malware Patterns: A Self-analysis Perspective
di: Zhong, Fangtian, et al.
Pubblicazione: (2025)
di: Zhong, Fangtian, et al.
Pubblicazione: (2025)
Supply Chain Network Security Investment Strategies Based on Nonlinear Budget Constraints: The Moderating Roles of Market Share and Attack Risk
di: Cheng, Jiajie, et al.
Pubblicazione: (2025)
di: Cheng, Jiajie, et al.
Pubblicazione: (2025)
MMDT: Decoding the Trustworthiness and Safety of Multimodal Foundation Models
di: Xu, Chejian, et al.
Pubblicazione: (2025)
di: Xu, Chejian, et al.
Pubblicazione: (2025)
On Protecting the Data Privacy of Large Language Models (LLMs): A Survey
di: Yan, Biwei, et al.
Pubblicazione: (2024)
di: Yan, Biwei, et al.
Pubblicazione: (2024)
EGNInfoLeaker: Unveiling the Risks of Public Key Reuse and User Identity Leakage in Blockchain
di: Li, Chenyu, et al.
Pubblicazione: (2025)
di: Li, Chenyu, et al.
Pubblicazione: (2025)
Safeguarding Multimodal Knowledge Copyright in the RAG-as-a-Service Environment
di: Chen, Tianyu, et al.
Pubblicazione: (2025)
di: Chen, Tianyu, et al.
Pubblicazione: (2025)
VulLibGen: Generating Names of Vulnerability-Affected Packages via a Large Language Model
di: Chen, Tianyu, et al.
Pubblicazione: (2023)
di: Chen, Tianyu, et al.
Pubblicazione: (2023)
UpSafe$^\circ$C: Upcycling for Controllable Safety in Large Language Models
di: Sun, Yuhao, et al.
Pubblicazione: (2025)
di: Sun, Yuhao, et al.
Pubblicazione: (2025)
Unveiling the Unseen: Exploring Whitebox Membership Inference through the Lens of Explainability
di: Li, Chenxi, et al.
Pubblicazione: (2024)
di: Li, Chenxi, et al.
Pubblicazione: (2024)
A Model for Assessing Network Asset Vulnerability Using QPSO-LightGBM
di: Li, Xinyu, et al.
Pubblicazione: (2024)
di: Li, Xinyu, et al.
Pubblicazione: (2024)
SafeToolBench: Pioneering a Prospective Benchmark to Evaluating Tool Utilization Safety in LLMs
di: Xia, Hongfei, et al.
Pubblicazione: (2025)
di: Xia, Hongfei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Security Threat of Compressed Projectors in Large Vision-Language Models
di: Zhang, Yudong, et al.
Pubblicazione: (2025) -
Dataset Ownership in the Era of Large Language Models
di: Li, Kun, et al.
Pubblicazione: (2025) -
G-Safeguard: A Topology-Guided Security Lens and Treatment on LLM-based Multi-agent Systems
di: Wang, Shilong, et al.
Pubblicazione: (2025) -
AutoIoT: Automated IoT Platform Using Large Language Models
di: Cheng, Ye, et al.
Pubblicazione: (2024) -
JailbreakLens: Interpreting Jailbreak Mechanism in the Lens of Representation and Circuit
di: He, Zeqing, et al.
Pubblicazione: (2024)