Text Embedding Inversion Security for Multilingual Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yiyi, Lent, Heather, Bjerva, Johannes |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Against All Odds: Overcoming Typology, Script, and Language Confusion in Multilingual Embedding Inversion Attacks
di: Chen, Yiyi, et al.
Pubblicazione: (2024)
di: Chen, Yiyi, et al.
Pubblicazione: (2024)
LAGO: Few-shot Crosslingual Embedding Inversion Attacks via Language Similarity-Aware Graph Optimization
di: Yu, Wenrui, et al.
Pubblicazione: (2025)
di: Yu, Wenrui, et al.
Pubblicazione: (2025)
ALGEN: Few-shot Inversion Attacks on Textual Embeddings using Alignment and Generation
di: Chen, Yiyi, et al.
Pubblicazione: (2025)
di: Chen, Yiyi, et al.
Pubblicazione: (2025)
Large Language Models are Easily Confused: A Quantitative Metric, Security Implications and Typological Analysis
di: Chen, Yiyi, et al.
Pubblicazione: (2024)
di: Chen, Yiyi, et al.
Pubblicazione: (2024)
Eguard: Defending LLM Embeddings Against Inversion Attacks via Text Mutual Information Optimization
di: Liu, Tiantian, et al.
Pubblicazione: (2024)
di: Liu, Tiantian, et al.
Pubblicazione: (2024)
NLP Security and Ethics, in the Wild
di: Lent, Heather, et al.
Pubblicazione: (2025)
di: Lent, Heather, et al.
Pubblicazione: (2025)
Safe Text-to-Image Generation: Simply Sanitize the Prompt Embedding
di: Qiu, Huming, et al.
Pubblicazione: (2024)
di: Qiu, Huming, et al.
Pubblicazione: (2024)
Security and Privacy Challenges of Large Language Models: A Survey
di: Das, Badhan Chandra, et al.
Pubblicazione: (2024)
di: Das, Badhan Chandra, et al.
Pubblicazione: (2024)
From Thinking to Output: Chain-of-Thought and Text Generation Characteristics in Reasoning Language Models
di: Liu, Junhao, et al.
Pubblicazione: (2025)
di: Liu, Junhao, et al.
Pubblicazione: (2025)
Institutional Platform for Secure Self-Service Large Language Model Exploration
di: Bumgardner, V. K. Cody, et al.
Pubblicazione: (2024)
di: Bumgardner, V. K. Cody, et al.
Pubblicazione: (2024)
Continuous Embedding Attacks via Clipped Inputs in Jailbreaking Large Language Models
di: Xu, Zihao, et al.
Pubblicazione: (2024)
di: Xu, Zihao, et al.
Pubblicazione: (2024)
Text2VLM: Adapting Text-Only Datasets to Evaluate Alignment Training in Visual Language Models
di: Downer, Gabriel, et al.
Pubblicazione: (2025)
di: Downer, Gabriel, et al.
Pubblicazione: (2025)
Was it Slander? Towards Exact Inversion of Generative Language Models
di: Skapars, Adrians, et al.
Pubblicazione: (2024)
di: Skapars, Adrians, et al.
Pubblicazione: (2024)
Supporting Artifact Evaluation with LLMs: A Study with Published Security Research Papers
di: Heye, David, et al.
Pubblicazione: (2026)
di: Heye, David, et al.
Pubblicazione: (2026)
Shared Path: Unraveling Memorization in Multilingual LLMs through Language Similarities
di: Luo, Xiaoyu, et al.
Pubblicazione: (2025)
di: Luo, Xiaoyu, et al.
Pubblicazione: (2025)
Balancing Innovation and Privacy: Data Security Strategies in Natural Language Processing Applications
di: Liu, Shaobo, et al.
Pubblicazione: (2024)
di: Liu, Shaobo, et al.
Pubblicazione: (2024)
Reverse-Engineering Model Editing on Language Models
di: Sun, Zhiyu, et al.
Pubblicazione: (2026)
di: Sun, Zhiyu, et al.
Pubblicazione: (2026)
Semantic Leakage from Image Embeddings
di: Chen, Yiyi, et al.
Pubblicazione: (2026)
di: Chen, Yiyi, et al.
Pubblicazione: (2026)
Distract Large Language Models for Automatic Jailbreak Attack
di: Xiao, Zeguan, et al.
Pubblicazione: (2024)
di: Xiao, Zeguan, et al.
Pubblicazione: (2024)
Towards Reliable and Practical LLM Security Evaluations via Bayesian Modelling
di: Llewellyn, Mary, et al.
Pubblicazione: (2025)
di: Llewellyn, Mary, et al.
Pubblicazione: (2025)
PRISON: Unmasking the Criminal Potential of Large Language Models
di: Wu, Xinyi, et al.
Pubblicazione: (2025)
di: Wu, Xinyi, et al.
Pubblicazione: (2025)
Securing Multi-turn Conversational Language Models From Distributed Backdoor Triggers
di: Tong, Terry, et al.
Pubblicazione: (2024)
di: Tong, Terry, et al.
Pubblicazione: (2024)
Secure Code Generation via Online Reinforcement Learning with Vulnerability Reward Model
di: Wu, Tianyi, et al.
Pubblicazione: (2026)
di: Wu, Tianyi, et al.
Pubblicazione: (2026)
Directional Embedding Smoothing for Robust Vision Language Models
di: Wang, Ye, et al.
Pubblicazione: (2026)
di: Wang, Ye, et al.
Pubblicazione: (2026)
Beyond Weaponization: NLP Security for Medium and Lower-Resourced Languages in Their Own Right
di: Lent, Heather
Pubblicazione: (2025)
di: Lent, Heather
Pubblicazione: (2025)
Is the System Message Really Important to Jailbreaks in Large Language Models?
di: Zou, Xiaotian, et al.
Pubblicazione: (2024)
di: Zou, Xiaotian, et al.
Pubblicazione: (2024)
Guarding Your Conversations: Privacy Gatekeepers for Secure Interactions with Cloud-Based AI Models
di: Uzor, GodsGift, et al.
Pubblicazione: (2025)
di: Uzor, GodsGift, et al.
Pubblicazione: (2025)
Modeling the Attack: Detecting AI-Generated Text by Quantifying Adversarial Perturbations
di: Teja, Lekkala Sai, et al.
Pubblicazione: (2025)
di: Teja, Lekkala Sai, et al.
Pubblicazione: (2025)
CREBench: Evaluating Large Language Models in Cryptographic Binary Reverse Engineering
di: Chen, Baicheng, et al.
Pubblicazione: (2026)
di: Chen, Baicheng, et al.
Pubblicazione: (2026)
Intrusion Detection at Scale with the Assistance of a Command-line Language Model
di: Lin, Jiongliang, et al.
Pubblicazione: (2024)
di: Lin, Jiongliang, et al.
Pubblicazione: (2024)
Citation: A Key to Building Responsible and Accountable Large Language Models
di: Huang, Jie, et al.
Pubblicazione: (2023)
di: Huang, Jie, et al.
Pubblicazione: (2023)
Stealthy and Persistent Unalignment on Large Language Models via Backdoor Injections
di: Cao, Yuanpu, et al.
Pubblicazione: (2023)
di: Cao, Yuanpu, et al.
Pubblicazione: (2023)
Jailbreaking Multimodal Large Language Models via Shuffle Inconsistency
di: Zhao, Shiji, et al.
Pubblicazione: (2025)
di: Zhao, Shiji, et al.
Pubblicazione: (2025)
REEF: Representation Encoding Fingerprints for Large Language Models
di: Zhang, Jie, et al.
Pubblicazione: (2024)
di: Zhang, Jie, et al.
Pubblicazione: (2024)
Resource Consumption Threats in Large Language Models
di: Zhang, Yuanhe, et al.
Pubblicazione: (2026)
di: Zhang, Yuanhe, et al.
Pubblicazione: (2026)
DUP: Detection-guided Unlearning for Backdoor Purification in Language Models
di: Hu, Man, et al.
Pubblicazione: (2025)
di: Hu, Man, et al.
Pubblicazione: (2025)
Quantifying Association Capabilities of Large Language Models and Its Implications on Privacy Leakage
di: Shao, Hanyin, et al.
Pubblicazione: (2023)
di: Shao, Hanyin, et al.
Pubblicazione: (2023)
The Ethics of Interaction: Mitigating Security Threats in LLMs
di: Kumar, Ashutosh, et al.
Pubblicazione: (2024)
di: Kumar, Ashutosh, et al.
Pubblicazione: (2024)
AVISE: Framework for Evaluating the Security of AI Systems
di: Lempinen, Mikko, et al.
Pubblicazione: (2026)
di: Lempinen, Mikko, et al.
Pubblicazione: (2026)
CCJA: Context-Coherent Jailbreak Attack for Aligned Large Language Models
di: Zhou, Guanghao, et al.
Pubblicazione: (2025)
di: Zhou, Guanghao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Against All Odds: Overcoming Typology, Script, and Language Confusion in Multilingual Embedding Inversion Attacks
di: Chen, Yiyi, et al.
Pubblicazione: (2024) -
LAGO: Few-shot Crosslingual Embedding Inversion Attacks via Language Similarity-Aware Graph Optimization
di: Yu, Wenrui, et al.
Pubblicazione: (2025) -
ALGEN: Few-shot Inversion Attacks on Textual Embeddings using Alignment and Generation
di: Chen, Yiyi, et al.
Pubblicazione: (2025) -
Large Language Models are Easily Confused: A Quantitative Metric, Security Implications and Typological Analysis
di: Chen, Yiyi, et al.
Pubblicazione: (2024) -
Eguard: Defending LLM Embeddings Against Inversion Attacks via Text Mutual Information Optimization
di: Liu, Tiantian, et al.
Pubblicazione: (2024)