Towards Sensitivity-Aware Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Fazlija, Dren, Olatunji, Iyiola E., Kudenko, Daniel, Sikdar, Sandipan |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ACCESS DENIED INC: The First Benchmark Environment for Sensitivity Awareness
by: Fazlija, Dren, et al.
Published: (2025)
by: Fazlija, Dren, et al.
Published: (2025)
Adversarial Attacks and Defenses on Graph-aware Large Language Models (LLMs)
by: Olatunji, Iyiola E., et al.
Published: (2025)
by: Olatunji, Iyiola E., et al.
Published: (2025)
How Secure is Secure Code Generation? Adversarial Prompts Put LLM Defenses to the Test
by: Tessa, Melissa, et al.
Published: (2026)
by: Tessa, Melissa, et al.
Published: (2026)
Open LLMs are Necessary for Current Private Adaptations and Outperform their Closed Alternatives
by: Hanke, Vincent, et al.
Published: (2024)
by: Hanke, Vincent, et al.
Published: (2024)
SCOOTER: A Human Evaluation Framework for Unrestricted Adversarial Examples
by: Fazlija, Dren, et al.
Published: (2025)
by: Fazlija, Dren, et al.
Published: (2025)
LiteAtt: A Peer-to-Peer Self-Attestation Framework and Handshake Protocol for Connected IoT Devices
by: Kohli, Varun, et al.
Published: (2026)
by: Kohli, Varun, et al.
Published: (2026)
Towards Irreversible Machine Unlearning for Diffusion Models
by: Yuan, Xun, et al.
Published: (2025)
by: Yuan, Xun, et al.
Published: (2025)
Toward Accessible Mobile Money: A Voice-Driven, Biometrically Secured USSD Automation Framework for Visually Impaired Users
by: Ajayi, Sunday, et al.
Published: (2026)
by: Ajayi, Sunday, et al.
Published: (2026)
Smooth Sensitivity Revisited: Towards Optimality
by: Hladík, Richard, et al.
Published: (2024)
by: Hladík, Richard, et al.
Published: (2024)
Swarm-Net: Firmware Attestation in IoT Swarms using Graph Neural Networks and Volatile Memory
by: Kohli, Varun, et al.
Published: (2024)
by: Kohli, Varun, et al.
Published: (2024)
False Sense of Security on Protected Wi-Fi Networks
by: Lim, Yong Zhi, et al.
Published: (2025)
by: Lim, Yong Zhi, et al.
Published: (2025)
Privacy-preserving Robotic-based Multi-factor Authentication Scheme for Secure Automated Delivery System
by: Yang, Yang, et al.
Published: (2024)
by: Yang, Yang, et al.
Published: (2024)
Baiting AI: Deceptive Adversary Against AI-Protected Industrial Infrastructures
by: Pasikhani, Aryan, et al.
Published: (2026)
by: Pasikhani, Aryan, et al.
Published: (2026)
Laplace Transform Interpretation of Differential Privacy
by: Chourasia, Rishav, et al.
Published: (2024)
by: Chourasia, Rishav, et al.
Published: (2024)
GenSIaC: Toward Security-Aware Infrastructure-as-Code Generation with Large Language Models
by: Li, Yikun, et al.
Published: (2025)
by: Li, Yikun, et al.
Published: (2025)
Risk-Aware Sensitive Property-Driven Resource Management in Cloud Datacenters
by: Felemban, Muhamad, et al.
Published: (2025)
by: Felemban, Muhamad, et al.
Published: (2025)
Toward a Military Smart Cyber Situational Awareness (CSA)
by: Feijó-Añazco, Anthony, et al.
Published: (2026)
by: Feijó-Añazco, Anthony, et al.
Published: (2026)
Towards Automated Pentesting with Large Language Models
by: Bessa, Ricardo, et al.
Published: (2026)
by: Bessa, Ricardo, et al.
Published: (2026)
Quantifying Memory Cells Vulnerability for DRAM Security
by: Hu, Zilong, et al.
Published: (2026)
by: Hu, Zilong, et al.
Published: (2026)
Leveraging A New GAN-based Transformer with ECDH Crypto-system for Enhancing Energy Theft Detection in Smart Grid
by: Yang, Yang, et al.
Published: (2024)
by: Yang, Yang, et al.
Published: (2024)
Towards Action Hijacking of Large Language Model-based Agent
by: Zhang, Yuyang, et al.
Published: (2024)
by: Zhang, Yuyang, et al.
Published: (2024)
UIBDiffusion: Universal Imperceptible Backdoor Attack for Diffusion Models
by: Han, Yuning, et al.
Published: (2024)
by: Han, Yuning, et al.
Published: (2024)
VFLGAN-TS: Vertical Federated Learning-based Generative Adversarial Networks for Publication of Vertically Partitioned Time-Series Data
by: Yuan, Xun, et al.
Published: (2024)
by: Yuan, Xun, et al.
Published: (2024)
Permit: Permission-Aware Representation Intervention for Controlled Generation in Large Language Models
by: Sun, Pengcheng, et al.
Published: (2026)
by: Sun, Pengcheng, et al.
Published: (2026)
Cybersecurity in Vehicle-to-Grid (V2G) Systems: A Systematic Review
by: Razzaque, Mohammad A, et al.
Published: (2025)
by: Razzaque, Mohammad A, et al.
Published: (2025)
Towards Identification and Intervention of Safety-Critical Parameters in Large Language Models
by: Qi, Weiwei, et al.
Published: (2026)
by: Qi, Weiwei, et al.
Published: (2026)
PortGPT: Towards Automated Backporting Using Large Language Models
by: Li, Zhaoyang, et al.
Published: (2025)
by: Li, Zhaoyang, et al.
Published: (2025)
Towards Robust Multimodal Large Language Models Against Jailbreak Attacks
by: Yin, Ziyi, et al.
Published: (2025)
by: Yin, Ziyi, et al.
Published: (2025)
Understanding the Error Sensitivity of Privacy-Aware Computing
by: Mazzanti, Matías, et al.
Published: (2025)
by: Mazzanti, Matías, et al.
Published: (2025)
SAGE: A Generic Framework for LLM Safety Evaluation
by: Jindal, Madhur, et al.
Published: (2025)
by: Jindal, Madhur, et al.
Published: (2025)
Towards Supporting Penetration Testing Education with Large Language Models: an Evaluation and Comparison
by: Nizon-Deladoeuille, Martin, et al.
Published: (2025)
by: Nizon-Deladoeuille, Martin, et al.
Published: (2025)
KinGuard: Hierarchical Kinship-Aware Fingerprinting to Defend Against Large Language Model Stealing
by: Xu, Zhenhua, et al.
Published: (2026)
by: Xu, Zhenhua, et al.
Published: (2026)
BeamClean: Language Aware Embedding Reconstruction
by: Kale, Kaan, et al.
Published: (2025)
by: Kale, Kaan, et al.
Published: (2025)
Adversary-Aware DPO: Enhancing Safety Alignment in Vision Language Models via Adversarial Training
by: Weng, Fenghua, et al.
Published: (2025)
by: Weng, Fenghua, et al.
Published: (2025)
Towards Scalable and Interpretable Mobile App Risk Analysis via Large Language Models
by: Yang, Yu, et al.
Published: (2025)
by: Yang, Yu, et al.
Published: (2025)
A Transformer-Based Approach for DDoS Attack Detection in IoT Networks
by: Dey, Sandipan, et al.
Published: (2025)
by: Dey, Sandipan, et al.
Published: (2025)
FPT-Noise: Dynamic Scene-Aware Counterattack for Test-Time Adversarial Defense in Vision-Language Models
by: Deng, Jia, et al.
Published: (2025)
by: Deng, Jia, et al.
Published: (2025)
Software-Hardware Binding for Protection of Sensitive Data in Embedded Software
by: Fischer, Bernhard, et al.
Published: (2026)
by: Fischer, Bernhard, et al.
Published: (2026)
From Sands to Mansions: Towards Automated Cyberattack Emulation with Classical Planning and Large Language Models
by: Wang, Lingzhi, et al.
Published: (2024)
by: Wang, Lingzhi, et al.
Published: (2024)
CyLens: Towards Reinventing Cyber Threat Intelligence in the Paradigm of Agentic Large Language Models
by: Liu, Xiaoqun, et al.
Published: (2025)
by: Liu, Xiaoqun, et al.
Published: (2025)
Similar Items
-
ACCESS DENIED INC: The First Benchmark Environment for Sensitivity Awareness
by: Fazlija, Dren, et al.
Published: (2025) -
Adversarial Attacks and Defenses on Graph-aware Large Language Models (LLMs)
by: Olatunji, Iyiola E., et al.
Published: (2025) -
How Secure is Secure Code Generation? Adversarial Prompts Put LLM Defenses to the Test
by: Tessa, Melissa, et al.
Published: (2026) -
Open LLMs are Necessary for Current Private Adaptations and Outperform their Closed Alternatives
by: Hanke, Vincent, et al.
Published: (2024) -
SCOOTER: A Human Evaluation Framework for Unrestricted Adversarial Examples
by: Fazlija, Dren, et al.
Published: (2025)