Transformers and Large Language Models for Efficient Intrusion Detection Systems: A Comprehensive Survey
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Kheddar, Hamza |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LenslessMic: Audio Encryption and Authentication via Lensless Computational Imaging
par: Grinberg, Petr, et autres
Publié: (2025)
par: Grinberg, Petr, et autres
Publié: (2025)
Hierarchical Graph Neural Network for Compressed Speech Steganalysis
par: Hemis, Mustapha, et autres
Publié: (2025)
par: Hemis, Mustapha, et autres
Publié: (2025)
A Comprehensive Survey of Hallucination in Large Language, Image, Video and Audio Foundation Models
par: Sahoo, Pranab, et autres
Publié: (2024)
par: Sahoo, Pranab, et autres
Publié: (2024)
Audio-Visual Deepfake Detection With Local Temporal Inconsistencies
par: Astrid, Marcella, et autres
Publié: (2025)
par: Astrid, Marcella, et autres
Publié: (2025)
Deep Learning Techniques for Hand Vein Biometrics: A Comprehensive Review
par: Hemis, Mustapha, et autres
Publié: (2024)
par: Hemis, Mustapha, et autres
Publié: (2024)
SE-Enhanced ViT and BiLSTM-Based Intrusion Detection for Secure IIoT and IoMT Environments
par: Gueriani, Afrah, et autres
Publié: (2026)
par: Gueriani, Afrah, et autres
Publié: (2026)
Artificial Intelligence for Cochlear Implants: Review of Strategies, Challenges, and Perspectives
par: Essaid, Billel, et autres
Publié: (2024)
par: Essaid, Billel, et autres
Publié: (2024)
Multilingual and Multi-Accent Jailbreaking of Audio LLMs
par: Roh, Jaechul, et autres
Publié: (2025)
par: Roh, Jaechul, et autres
Publié: (2025)
Stream-Omni: Simultaneous Multimodal Interactions with Large Language-Vision-Speech Model
par: Zhang, Shaolei, et autres
Publié: (2025)
par: Zhang, Shaolei, et autres
Publié: (2025)
Silence is Golden: Leveraging Adversarial Examples to Nullify Audio Control in LDM-based Talking-Head Generation
par: Gan, Yuan, et autres
Publié: (2025)
par: Gan, Yuan, et autres
Publié: (2025)
TMT: Tri-Modal Translation between Speech, Image, and Text by Processing Different Modalities as Different Languages
par: Kim, Minsu, et autres
Publié: (2024)
par: Kim, Minsu, et autres
Publié: (2024)
Next Token Prediction Towards Multimodal Intelligence: A Comprehensive Survey
par: Chen, Liang, et autres
Publié: (2024)
par: Chen, Liang, et autres
Publié: (2024)
Preference Tuning with Human Feedback on Language, Speech, and Vision Tasks: A Survey
par: Winata, Genta Indra, et autres
Publié: (2024)
par: Winata, Genta Indra, et autres
Publié: (2024)
VyAnG-Net: A Novel Multi-Modal Sarcasm Recognition Model by Uncovering Visual, Acoustic and Glossary Features
par: Pandey, Ananya, et autres
Publié: (2024)
par: Pandey, Ananya, et autres
Publié: (2024)
Hybrid ResNet-1D-BiGRU with Multi-Head Attention for Cyberattack Detection in Industrial IoT Environments
par: Gueriani, Afrah, et autres
Publié: (2026)
par: Gueriani, Afrah, et autres
Publié: (2026)
Efficiently Train ASR Models that Memorize Less and Perform Better with Per-core Clipping
par: Wang, Lun, et autres
Publié: (2024)
par: Wang, Lun, et autres
Publié: (2024)
The First VoicePrivacy Attacker Challenge
par: Tomashenko, Natalia, et autres
Publié: (2025)
par: Tomashenko, Natalia, et autres
Publié: (2025)
Target speaker anonymization in multi-speaker recordings
par: Tomashenko, Natalia, et autres
Publié: (2025)
par: Tomashenko, Natalia, et autres
Publié: (2025)
The First VoicePrivacy Attacker Challenge Evaluation Plan
par: Tomashenko, Natalia, et autres
Publié: (2024)
par: Tomashenko, Natalia, et autres
Publié: (2024)
The VoicePrivacy 2024 Challenge Evaluation Plan
par: Tomashenko, Natalia, et autres
Publié: (2024)
par: Tomashenko, Natalia, et autres
Publié: (2024)
Qwen3-Omni Technical Report
par: Xu, Jin, et autres
Publié: (2025)
par: Xu, Jin, et autres
Publié: (2025)
Modality-Inconsistent Continual Learning of Multimodal Large Language Models
par: Pian, Weiguo, et autres
Publié: (2024)
par: Pian, Weiguo, et autres
Publié: (2024)
Safety at Scale: A Comprehensive Survey of Large Model and Agent Safety
par: Ma, Xingjun, et autres
Publié: (2025)
par: Ma, Xingjun, et autres
Publié: (2025)
Release of Pre-Trained Models for the Japanese Language
par: Sawada, Kei, et autres
Publié: (2024)
par: Sawada, Kei, et autres
Publié: (2024)
Exploiting Context-dependent Duration Features for Voice Anonymization Attack Systems
par: Tomashenko, Natalia, et autres
Publié: (2025)
par: Tomashenko, Natalia, et autres
Publié: (2025)
Large Language Models Implicitly Learn to See and Hear Just By Reading
par: Verma, Prateek, et autres
Publié: (2025)
par: Verma, Prateek, et autres
Publié: (2025)
MMFformer: Multimodal Fusion Transformer Network for Depression Detection
par: Haque, Md Rezwanul, et autres
Publié: (2025)
par: Haque, Md Rezwanul, et autres
Publié: (2025)
AdvWave: Stealthy Adversarial Jailbreak Attack against Large Audio-Language Models
par: Kang, Mintong, et autres
Publié: (2024)
par: Kang, Mintong, et autres
Publié: (2024)
Any2Point: Empowering Any-modality Large Models for Efficient 3D Understanding
par: Tang, Yiwen, et autres
Publié: (2024)
par: Tang, Yiwen, et autres
Publié: (2024)
Deep Learning for Steganalysis of Diverse Data Types: A review of methods, taxonomy, challenges and future directions
par: Kheddar, Hamza, et autres
Publié: (2023)
par: Kheddar, Hamza, et autres
Publié: (2023)
Full-Rank No More: Low-Rank Weight Training for Modern Speech Recognition Models
par: Fernandez-Lopez, Adriana, et autres
Publié: (2024)
par: Fernandez-Lopez, Adriana, et autres
Publié: (2024)
Towards Holistic Evaluation of Large Audio-Language Models: A Comprehensive Survey
par: Yang, Chih-Kai, et autres
Publié: (2025)
par: Yang, Chih-Kai, et autres
Publié: (2025)
Degrading Voice: A Comprehensive Overview of Robust Voice Conversion Through Input Manipulation
par: Song, Xining, et autres
Publié: (2025)
par: Song, Xining, et autres
Publié: (2025)
Beyond Boundaries: A Comprehensive Survey of Transferable Attacks on AI Systems
par: Wang, Guangjing, et autres
Publié: (2023)
par: Wang, Guangjing, et autres
Publié: (2023)
JALMBench: Benchmarking Jailbreak Vulnerabilities in Audio Language Models
par: Peng, Zifan, et autres
Publié: (2025)
par: Peng, Zifan, et autres
Publié: (2025)
End-to-end Listen, Look, Speak and Act
par: Wang, Siyin, et autres
Publié: (2025)
par: Wang, Siyin, et autres
Publié: (2025)
Automated Extraction of Spatio-Semantic Graphs for Identifying Cognitive Impairment
par: Ng, Si-Ioi, et autres
Publié: (2025)
par: Ng, Si-Ioi, et autres
Publié: (2025)
Bayesian Example Selection Improves In-Context Learning for Speech, Text, and Visual Modalities
par: Wang, Siyin, et autres
Publié: (2024)
par: Wang, Siyin, et autres
Publié: (2024)
VSSFlow: Unifying Video-conditioned Sound and Speech Generation via Joint Learning
par: Cheng, Xin, et autres
Publié: (2025)
par: Cheng, Xin, et autres
Publié: (2025)
The Evolution of Multimodal Model Architectures
par: Wadekar, Shakti N., et autres
Publié: (2024)
par: Wadekar, Shakti N., et autres
Publié: (2024)
Documents similaires
-
LenslessMic: Audio Encryption and Authentication via Lensless Computational Imaging
par: Grinberg, Petr, et autres
Publié: (2025) -
Hierarchical Graph Neural Network for Compressed Speech Steganalysis
par: Hemis, Mustapha, et autres
Publié: (2025) -
A Comprehensive Survey of Hallucination in Large Language, Image, Video and Audio Foundation Models
par: Sahoo, Pranab, et autres
Publié: (2024) -
Audio-Visual Deepfake Detection With Local Temporal Inconsistencies
par: Astrid, Marcella, et autres
Publié: (2025) -
Deep Learning Techniques for Hand Vein Biometrics: A Comprehensive Review
par: Hemis, Mustapha, et autres
Publié: (2024)