MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Zihan, Bhupendra, Sailor Hardik, Wu, Jinyang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Quantizer-Aware Hierarchical Neural Codec Modeling for Speech Deepfake Detection
par: Wu, Jinyang, et autres
Publié: (2026)
par: Wu, Jinyang, et autres
Publié: (2026)
SEA-Spoof: Bridging The Gap in Multilingual Audio Deepfake Detection for South-East Asian
par: Wu, Jinyang, et autres
Publié: (2025)
par: Wu, Jinyang, et autres
Publié: (2025)
Mixture of LoRA Experts
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
MixFake: Benchmarking and Enhancing Audio Deepfake Detection in Diverse Real-world Mixed Audio
par: Li, Qingcao, et autres
Publié: (2026)
par: Li, Qingcao, et autres
Publié: (2026)
Manipulated Regions Localization For Partially Deepfake Audio: A Survey
par: He, Jiayi, et autres
Publié: (2025)
par: He, Jiayi, et autres
Publié: (2025)
MeMo: Attentional Momentum for Real-time Audio-visual Speaker Extraction under Impaired Visual Conditions
par: Li, Junjie, et autres
Publié: (2025)
par: Li, Junjie, et autres
Publié: (2025)
Enkidu: Universal Frequential Perturbation for Real-Time Audio Privacy Protection against Voice Deepfakes
par: Feng, Zhou, et autres
Publié: (2025)
par: Feng, Zhou, et autres
Publié: (2025)
From Talking to Singing: A New Challenge for Audio-Visual Deepfake Detection
par: Liu, Ke, et autres
Publié: (2026)
par: Liu, Ke, et autres
Publié: (2026)
Speech Foundation Model Ensembles for the Controlled Singing Voice Deepfake Detection (CtrSVDD) Challenge 2024
par: Guragain, Anmol, et autres
Publié: (2024)
par: Guragain, Anmol, et autres
Publié: (2024)
SAVe: Self-Supervised Audio-visual Deepfake Detection Exploiting Visual Artifacts and Audio-visual Misalignment
par: Shahzad, Sahibzada Adil, et autres
Publié: (2026)
par: Shahzad, Sahibzada Adil, et autres
Publié: (2026)
A Survey on Speech Deepfake Detection
par: Li, Menglu, et autres
Publié: (2024)
par: Li, Menglu, et autres
Publié: (2024)
MoTAS: MoE-Guided Feature Selection from TTS-Augmented Speech for Enhanced Multimodal Alzheimer's Early Screening
par: Shao, Yongqi, et autres
Publié: (2025)
par: Shao, Yongqi, et autres
Publié: (2025)
MoLT: Mixture of Layer-Wise Tokens for Efficient Audio-Visual Learning
par: Rho, Kyeongha, et autres
Publié: (2025)
par: Rho, Kyeongha, et autres
Publié: (2025)
Multi-level SSL Feature Gating for Audio Deepfake Detection
par: Tran, Hoan My, et autres
Publié: (2025)
par: Tran, Hoan My, et autres
Publié: (2025)
Anomaly Detection and Localization for Speech Deepfakes via Feature Pyramid Matching
par: Coletta, Emma, et autres
Publié: (2025)
par: Coletta, Emma, et autres
Publié: (2025)
LoVA: Long-form Video-to-Audio Generation
par: Cheng, Xin, et autres
Publié: (2024)
par: Cheng, Xin, et autres
Publié: (2024)
RAVSS: Robust Audio-Visual Speech Separation in Multi-Speaker Scenarios with Missing Visual Cues
par: Pan, Tianrui, et autres
Publié: (2024)
par: Pan, Tianrui, et autres
Publié: (2024)
Human-Inspired Computing for Robust and Efficient Audio-Visual Speech Recognition
par: Liu, Qianhui, et autres
Publié: (2024)
par: Liu, Qianhui, et autres
Publié: (2024)
Attentive Merging of Hidden Embeddings from Pre-trained Speech Model for Anti-spoofing Detection
par: Pan, Zihan, et autres
Publié: (2024)
par: Pan, Zihan, et autres
Publié: (2024)
MusiCRS: Benchmarking Audio-Centric Conversational Recommendation
par: Surana, Rohan, et autres
Publié: (2025)
par: Surana, Rohan, et autres
Publié: (2025)
Generative Audio Extension and Morphing
par: Seetharaman, Prem, et autres
Publié: (2026)
par: Seetharaman, Prem, et autres
Publié: (2026)
Detecting Audio-Visual Deepfakes with Fine-Grained Inconsistencies
par: Astrid, Marcella, et autres
Publié: (2024)
par: Astrid, Marcella, et autres
Publié: (2024)
Double Mixture: Towards Continual Event Detection from Speech
par: Kang, Jingqi, et autres
Publié: (2024)
par: Kang, Jingqi, et autres
Publié: (2024)
SpotSound: Enhancing Large Audio-Language Models with Fine-Grained Temporal Grounding
par: Sun, Luoyi, et autres
Publié: (2026)
par: Sun, Luoyi, et autres
Publié: (2026)
Every Breath You Don't Take: Deepfake Speech Detection Using Breath
par: Layton, Seth, et autres
Publié: (2024)
par: Layton, Seth, et autres
Publié: (2024)
MoLEx: Mixture of Layer Experts for Finetuning with Sparse Upcycling
par: Teo, Rachel S. Y., et autres
Publié: (2025)
par: Teo, Rachel S. Y., et autres
Publié: (2025)
Self-Attention and Hybrid Features for Replay and Deep-Fake Audio Detection
par: Huang, Lian, et autres
Publié: (2024)
par: Huang, Lian, et autres
Publié: (2024)
A Multi-Stream Fusion Approach with One-Class Learning for Audio-Visual Deepfake Detection
par: Lee, Kyungbok, et autres
Publié: (2024)
par: Lee, Kyungbok, et autres
Publié: (2024)
Noise-Conditioned Mixture-of-Experts Framework for Robust Speaker Verification
par: Gu, Bin, et autres
Publié: (2025)
par: Gu, Bin, et autres
Publié: (2025)
A Unified Framework for Modality-Agnostic Deepfakes Detection
par: Yu, Cai, et autres
Publié: (2023)
par: Yu, Cai, et autres
Publié: (2023)
VERSA: A Versatile Evaluation Toolkit for Speech, Audio, and Music
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
HDA-SELD: Hierarchical Cross-Modal Distillation with Multi-Level Data Augmentation for Low-Resource Audio-Visual Sound Event Localization and Detection
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
SafeEar: Content Privacy-Preserving Audio Deepfake Detection
par: Li, Xinfeng, et autres
Publié: (2024)
par: Li, Xinfeng, et autres
Publié: (2024)
AVFF: Audio-Visual Feature Fusion for Video Deepfake Detection
par: Oorloff, Trevine, et autres
Publié: (2024)
par: Oorloff, Trevine, et autres
Publié: (2024)
Audio-Visual Separation with Hierarchical Fusion and Representation Alignment
par: Hu, Han, et autres
Publié: (2025)
par: Hu, Han, et autres
Publié: (2025)
SVDD 2024: The Inaugural Singing Voice Deepfake Detection Challenge
par: Zhang, You, et autres
Publié: (2024)
par: Zhang, You, et autres
Publié: (2024)
ZO-ASR: Zeroth-Order Fine-Tuning of Speech Foundation Models without Back-Propagation
par: Peng, Yuezhang, et autres
Publié: (2025)
par: Peng, Yuezhang, et autres
Publié: (2025)
DreamFoley: Scalable VLMs for High-Fidelity Video-to-Audio Generation
par: Li, Fu, et autres
Publié: (2025)
par: Li, Fu, et autres
Publié: (2025)
Delayed Commitment for Representation Readiness in Stage-wise Audio-Visual Learning
par: Xu, Xinmeng, et autres
Publié: (2026)
par: Xu, Xinmeng, et autres
Publié: (2026)
Audio-Visual Speech Separation via Bottleneck Iterative Network
par: Zhang, Sidong, et autres
Publié: (2025)
par: Zhang, Sidong, et autres
Publié: (2025)
Documents similaires
-
Quantizer-Aware Hierarchical Neural Codec Modeling for Speech Deepfake Detection
par: Wu, Jinyang, et autres
Publié: (2026) -
SEA-Spoof: Bridging The Gap in Multilingual Audio Deepfake Detection for South-East Asian
par: Wu, Jinyang, et autres
Publié: (2025) -
Mixture of LoRA Experts
par: Wu, Xun, et autres
Publié: (2024) -
MixFake: Benchmarking and Enhancing Audio Deepfake Detection in Diverse Real-world Mixed Audio
par: Li, Qingcao, et autres
Publié: (2026) -
Manipulated Regions Localization For Partially Deepfake Audio: A Survey
par: He, Jiayi, et autres
Publié: (2025)