Do Vision-Language Models Respect Contextual Integrity in Location Disclosure?
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Ruixin, Mendes, Ethan, Wang, Arthur, Hays, James, Das, Sauvik, Xu, Wei, Ritter, Alan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bridging the Copyright Gap: Do Large Vision-Language Models Recognize and Respect Copyrighted Content?
di: Xu, Naen, et al.
Pubblicazione: (2025)
di: Xu, Naen, et al.
Pubblicazione: (2025)
Data-Driven Falsification of Cyber-Physical Systems
di: Kundu, Atanu, et al.
Pubblicazione: (2025)
di: Kundu, Atanu, et al.
Pubblicazione: (2025)
"It's a Fair Game", or Is It? Examining How Users Navigate Disclosure Risks and Benefits When Using LLM-Based Conversational Agents
di: Zhang, Zhiping, et al.
Pubblicazione: (2023)
di: Zhang, Zhiping, et al.
Pubblicazione: (2023)
Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory
di: Mireshghallah, Niloofar, et al.
Pubblicazione: (2023)
di: Mireshghallah, Niloofar, et al.
Pubblicazione: (2023)
Privacy Bias in Language Models: A Contextual Integrity-based Auditing Metric
di: Shvartzshnaider, Yan, et al.
Pubblicazione: (2024)
di: Shvartzshnaider, Yan, et al.
Pubblicazione: (2024)
Human-Centered Privacy Research in the Age of Large Language Models
di: Li, Tianshi, et al.
Pubblicazione: (2024)
di: Li, Tianshi, et al.
Pubblicazione: (2024)
It Takes Two: Complementary Self-Distillation for Contextual Integrity in LLMs
di: Park, Sangwoo, et al.
Pubblicazione: (2026)
di: Park, Sangwoo, et al.
Pubblicazione: (2026)
Granular Privacy Control for Geolocation with Vision Language Models
di: Mendes, Ethan, et al.
Pubblicazione: (2024)
di: Mendes, Ethan, et al.
Pubblicazione: (2024)
Do Phone-Use Agents Respect Your Privacy?
di: Tang, Zhengyang, et al.
Pubblicazione: (2026)
di: Tang, Zhengyang, et al.
Pubblicazione: (2026)
PiCo: Jailbreaking Multimodal Large Language Models via Pictorial Code Contextualization
di: Liu, Aofan, et al.
Pubblicazione: (2025)
di: Liu, Aofan, et al.
Pubblicazione: (2025)
Obfuscated Location Disclosure for Remote ID Enabled Drones
di: Brighente, Alessandro, et al.
Pubblicazione: (2024)
di: Brighente, Alessandro, et al.
Pubblicazione: (2024)
Concept-Guided Backdoor Attack on Vision Language Models
di: Shen, Haoyu, et al.
Pubblicazione: (2025)
di: Shen, Haoyu, et al.
Pubblicazione: (2025)
GoldCoin: Grounding Large Language Models in Privacy Laws via Contextual Integrity Theory
di: Fan, Wei, et al.
Pubblicazione: (2024)
di: Fan, Wei, et al.
Pubblicazione: (2024)
Protecting Vehicle Location Privacy with Contextually-Driven Synthetic Location Generation
di: Yadav, Sourabh, et al.
Pubblicazione: (2024)
di: Yadav, Sourabh, et al.
Pubblicazione: (2024)
Ablating Safety: Mechanisms for Removing Alignment in Language Models for Security Applications
di: David, Isaac, et al.
Pubblicazione: (2026)
di: David, Isaac, et al.
Pubblicazione: (2026)
Membership Inference Attacks Against Vision-Language Models
di: Hu, Yuke, et al.
Pubblicazione: (2025)
di: Hu, Yuke, et al.
Pubblicazione: (2025)
Scalable GPU-Based Integrity Verification for Large Machine Learning Models
di: Spoczynski, Marcin, et al.
Pubblicazione: (2025)
di: Spoczynski, Marcin, et al.
Pubblicazione: (2025)
How Well Can LLM Agents Simulate End-User Security and Privacy Attitudes and Behaviors?
di: Li, Yuxuan, et al.
Pubblicazione: (2026)
di: Li, Yuxuan, et al.
Pubblicazione: (2026)
Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities
di: Qu, Yiting, et al.
Pubblicazione: (2025)
di: Qu, Yiting, et al.
Pubblicazione: (2025)
Blind PRNG Hijacking: An Undetectable Integrity-Preserving Attack Against LLM Watermarking
di: You, Ziyang, et al.
Pubblicazione: (2026)
di: You, Ziyang, et al.
Pubblicazione: (2026)
Integrating Differential Privacy and Contextual Integrity
di: Benthall, Sebastian, et al.
Pubblicazione: (2024)
di: Benthall, Sebastian, et al.
Pubblicazione: (2024)
CIMemories: A Compositional Benchmark for Contextual Integrity of Persistent Memory in LLMs
di: Mireshghallah, Niloofar, et al.
Pubblicazione: (2025)
di: Mireshghallah, Niloofar, et al.
Pubblicazione: (2025)
Inducing Overthink: Hierarchical Genetic Algorithm-based DoS Attack on Black-Box Large Language Reasoning Models
di: Wang, Shuqiang, et al.
Pubblicazione: (2026)
di: Wang, Shuqiang, et al.
Pubblicazione: (2026)
Adversarial attacks against Modern Vision-Language Models
di: La Torre, Alejandro Paredes
Pubblicazione: (2026)
di: La Torre, Alejandro Paredes
Pubblicazione: (2026)
Beyond Jailbreaking: Auditing Contextual Privacy in LLM Agents
di: Das, Saswat, et al.
Pubblicazione: (2025)
di: Das, Saswat, et al.
Pubblicazione: (2025)
Lost in Disclosure: On The Inference of Password Composition Policies
di: Johnson, Saul, et al.
Pubblicazione: (2020)
di: Johnson, Saul, et al.
Pubblicazione: (2020)
The Security Threat of Compressed Projectors in Large Vision-Language Models
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
Less Is More -- Until It Breaks: Security Pitfalls of Vision Token Compression in Large Vision-Language Models
di: Zhang, Xiaomei, et al.
Pubblicazione: (2026)
di: Zhang, Xiaomei, et al.
Pubblicazione: (2026)
Backdooring Bias in Large Language Models
di: Das, Anudeep, et al.
Pubblicazione: (2026)
di: Das, Anudeep, et al.
Pubblicazione: (2026)
OCCULT: Evaluating Large Language Models for Offensive Cyber Operation Capabilities
di: Kouremetis, Michael, et al.
Pubblicazione: (2025)
di: Kouremetis, Michael, et al.
Pubblicazione: (2025)
Distilling Lightweight Language Models for C/C++ Vulnerabilities
di: Wei, Zhiyuan, et al.
Pubblicazione: (2025)
di: Wei, Zhiyuan, et al.
Pubblicazione: (2025)
Do Coding Agents Understand Least-Privilege Authorization?
di: Yan, Zheng, et al.
Pubblicazione: (2026)
di: Yan, Zheng, et al.
Pubblicazione: (2026)
JailDAM: Jailbreak Detection with Adaptive Memory for Vision-Language Model
di: Nian, Yi, et al.
Pubblicazione: (2025)
di: Nian, Yi, et al.
Pubblicazione: (2025)
PrivScope: Task-scoped Disclosure Control for Hybrid Agentic Systems
di: Seeam, Shafizur Rahman, et al.
Pubblicazione: (2026)
di: Seeam, Shafizur Rahman, et al.
Pubblicazione: (2026)
Vulnerability Disclosure through Adaptive Black-Box Adversarial Attacks on NIDS
di: Ennaji, Sabrine, et al.
Pubblicazione: (2025)
di: Ennaji, Sabrine, et al.
Pubblicazione: (2025)
Data Defenses Against Large Language Models
di: Agnew, William, et al.
Pubblicazione: (2024)
di: Agnew, William, et al.
Pubblicazione: (2024)
Privacy Checklist: Privacy Violation Detection Grounding on Contextual Integrity Theory
di: Li, Haoran, et al.
Pubblicazione: (2024)
di: Li, Haoran, et al.
Pubblicazione: (2024)
DropVLA: An Action-Level Backdoor Attack on Vision-Language-Action Models
di: Xu, Zonghuan, et al.
Pubblicazione: (2025)
di: Xu, Zonghuan, et al.
Pubblicazione: (2025)
Structural Enforcement of Goal Integrity in AI Agents via Separation-of-Powers Architecture
di: Xiang, Rong
Pubblicazione: (2026)
di: Xiang, Rong
Pubblicazione: (2026)
PromptLocate: Localizing Prompt Injection Attacks
di: Jia, Yuqi, et al.
Pubblicazione: (2025)
di: Jia, Yuqi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Bridging the Copyright Gap: Do Large Vision-Language Models Recognize and Respect Copyrighted Content?
di: Xu, Naen, et al.
Pubblicazione: (2025) -
Data-Driven Falsification of Cyber-Physical Systems
di: Kundu, Atanu, et al.
Pubblicazione: (2025) -
"It's a Fair Game", or Is It? Examining How Users Navigate Disclosure Risks and Benefits When Using LLM-Based Conversational Agents
di: Zhang, Zhiping, et al.
Pubblicazione: (2023) -
Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory
di: Mireshghallah, Niloofar, et al.
Pubblicazione: (2023) -
Privacy Bias in Language Models: A Contextual Integrity-based Auditing Metric
di: Shvartzshnaider, Yan, et al.
Pubblicazione: (2024)