AASIST3: KAN-Enhanced AASIST Speech Deepfake Detection using SSL Features and Additional Regularization for the ASVspoof 2024 Challenge
Fuente:
arXiv
Guardado en:
| Autores principales: | Borodin, Kirill, Kudryavtsev, Vasiliy, Korzh, Dmitrii, Efimenko, Alexey, Mkrtchian, Grach, Gorodnichev, Mikhail, Rogov, Oleg Y. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
When Spoof Detectors Travel: Evaluation Across 66 Languages in the Low-Resource Language Spoofing Corpus
por: Borodin, Kirill, et al.
Publicado: (2026)
por: Borodin, Kirill, et al.
Publicado: (2026)
Application of ASV for Voice Identification after VC and Duration Predictor Improvement in TTS Models
por: Nikolayevich, Borodin Kirill, et al.
Publicado: (2024)
por: Nikolayevich, Borodin Kirill, et al.
Publicado: (2024)
Balalaika: Data-Centric, Prosody-Aware Annotation Pipeline for Russian Speech
por: Borodin, Kirill, et al.
Publicado: (2025)
por: Borodin, Kirill, et al.
Publicado: (2025)
Combining Masked Language Modeling and Cross-Modal Contrastive Learning for Prosody-Aware TTS
por: Borodin, Kirill, et al.
Publicado: (2026)
por: Borodin, Kirill, et al.
Publicado: (2026)
Towards Scalable AASIST: Refining Graph Attention for Speech Deepfake Detection
por: Viakhirev, Ivan, et al.
Publicado: (2025)
por: Viakhirev, Ivan, et al.
Publicado: (2025)
Interpreting Multi-Branch Anti-Spoofing Architectures: Correlating Internal Strategy with Empirical Performance
por: Viakhirev, Ivan, et al.
Publicado: (2026)
por: Viakhirev, Ivan, et al.
Publicado: (2026)
Improving Short Utterance Anti-Spoofing with AASIST2
por: Zhang, Yuxiang, et al.
Publicado: (2023)
por: Zhang, Yuxiang, et al.
Publicado: (2023)
From Visual to Multimodal: Systematic Ablation of Encoders and Fusion Strategies in Animal Identification
por: Kudryavtsev, Vasiliy, et al.
Publicado: (2026)
por: Kudryavtsev, Vasiliy, et al.
Publicado: (2026)
Certification of Speaker Recognition Models to Additive Perturbations
por: Korzh, Dmitrii, et al.
Publicado: (2024)
por: Korzh, Dmitrii, et al.
Publicado: (2024)
Benchmarking Compact VLMs for Clip-Level Surveillance Anomaly Detection Under Weak Supervision
por: Borodin, Kirill, et al.
Publicado: (2026)
por: Borodin, Kirill, et al.
Publicado: (2026)
Evaluating Generalization and Robustness in Russian Anti-Spoofing: The RuASD Initiative
por: Lysikova, Ksenia, et al.
Publicado: (2026)
por: Lysikova, Ksenia, et al.
Publicado: (2026)
From Dispersion to Attraction: Spectral Dynamics of Hallucination Across Whisper Model Scales
por: Viakhirev, Ivan, et al.
Publicado: (2026)
por: Viakhirev, Ivan, et al.
Publicado: (2026)
ASASVIcomtech: The Vicomtech-UGR Speech Deepfake Detection and SASV Systems for the ASVspoof5 Challenge
por: Martín-Doñas, Juan M., et al.
Publicado: (2024)
por: Martín-Doñas, Juan M., et al.
Publicado: (2024)
Novel Loss-Enhanced Universal Adversarial Patches for Sustainable Speaker Privacy
por: Karimov, Elvir, et al.
Publicado: (2025)
por: Karimov, Elvir, et al.
Publicado: (2025)
ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale
por: Wang, Xin, et al.
Publicado: (2024)
por: Wang, Xin, et al.
Publicado: (2024)
ASVspoof 5: Design, Collection and Validation of Resources for Spoofing, Deepfake, and Adversarial Attack Detection Using Crowdsourced Speech
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
BUT Systems and Analyses for the ASVspoof 5 Challenge
por: Rohdin, Johan, et al.
Publicado: (2024)
por: Rohdin, Johan, et al.
Publicado: (2024)
XMUspeech Systems for the ASVspoof 5 Challenge
por: Li, Wangjie, et al.
Publicado: (2025)
por: Li, Wangjie, et al.
Publicado: (2025)
Towards Robust Speech Deepfake Detection via Human-Inspired Reasoning
por: Dvirniak, Artem, et al.
Publicado: (2026)
por: Dvirniak, Artem, et al.
Publicado: (2026)
Temporal Variability and Multi-Viewed Self-Supervised Representations to Tackle the ASVspoof5 Deepfake Challenge
por: Xie, Yuankun, et al.
Publicado: (2024)
por: Xie, Yuankun, et al.
Publicado: (2024)
ASVspoof2019 vs. ASVspoof5: Assessment and Comparison
por: Weizman, Avishai, et al.
Publicado: (2025)
por: Weizman, Avishai, et al.
Publicado: (2025)
BEAT2AASIST model with layer fusion for ESDD 2026 Challenge
por: Chung, Sanghyeok, et al.
Publicado: (2025)
por: Chung, Sanghyeok, et al.
Publicado: (2025)
UR Channel-Robust Synthetic Speech Detection System for ASVspoof 2021
por: Chen, Xinhui, et al.
Publicado: (2021)
por: Chen, Xinhui, et al.
Publicado: (2021)
SZU-AFS Antispoofing System for the ASVspoof 5 Challenge
por: Xu, Yuxiong, et al.
Publicado: (2024)
por: Xu, Yuxiong, et al.
Publicado: (2024)
USTC-KXDIGIT System Description for ASVspoof5 Challenge
por: Chen, Yihao, et al.
Publicado: (2024)
por: Chen, Yihao, et al.
Publicado: (2024)
Spoofing-Robust Speaker Verification Using Parallel Embedding Fusion: BTU Speech Group's Approach for ASVspoof5 Challenge
por: Kurnaz, Oğuzhan, et al.
Publicado: (2024)
por: Kurnaz, Oğuzhan, et al.
Publicado: (2024)
Unmasking Deepfakes: Leveraging Augmentations and Features Variability for Deepfake Speech Detection
por: Rimon, Inbal, et al.
Publicado: (2025)
por: Rimon, Inbal, et al.
Publicado: (2025)
Comprehensive Layer-wise Analysis of SSL Models for Audio Deepfake Detection
por: Kheir, Yassine El, et al.
Publicado: (2025)
por: Kheir, Yassine El, et al.
Publicado: (2025)
Exploring SSL Discrete Speech Features for Zipformer-based Contextual ASR
por: Cui, Mingyu, et al.
Publicado: (2024)
por: Cui, Mingyu, et al.
Publicado: (2024)
Learn from Real: Reality Defender's Submission to ASVspoof5 Challenge
por: Zhu, Yi, et al.
Publicado: (2024)
por: Zhu, Yi, et al.
Publicado: (2024)
KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features
por: Kukanov, Ivan, et al.
Publicado: (2025)
por: Kukanov, Ivan, et al.
Publicado: (2025)
From KAN to GR-KAN: Advancing Speech Enhancement with KAN-Based Methodology
por: Li, Haoyang, et al.
Publicado: (2024)
por: Li, Haoyang, et al.
Publicado: (2024)
SPEAR: A Unified SSL Framework for Learning Speech and Audio Representations
por: Yang, Xiaoyu, et al.
Publicado: (2025)
por: Yang, Xiaoyu, et al.
Publicado: (2025)
Fusion of Modulation Spectrogram and SSL with Multi-head Attention for Fake Speech Detection
por: N, Rishith Sadashiv T, et al.
Publicado: (2025)
por: N, Rishith Sadashiv T, et al.
Publicado: (2025)
Post-training for Deepfake Speech Detection
por: Ge, Wanying, et al.
Publicado: (2025)
por: Ge, Wanying, et al.
Publicado: (2025)
Source Verification for Speech Deepfakes
por: Negroni, Viola, et al.
Publicado: (2025)
por: Negroni, Viola, et al.
Publicado: (2025)
k2SSL: A Faster and Better Framework for Self-Supervised Speech Representation Learning
por: Yang, Yifan, et al.
Publicado: (2024)
por: Yang, Yifan, et al.
Publicado: (2024)
VAE-based Phoneme Alignment Using Gradient Annealing and SSL Acoustic Features
por: Koriyama, Tomoki
Publicado: (2024)
por: Koriyama, Tomoki
Publicado: (2024)
Phoneme-Level Feature Discrepancies: A Key to Detecting Sophisticated Speech Deepfakes
por: Zhang, Kuiyuan, et al.
Publicado: (2024)
por: Zhang, Kuiyuan, et al.
Publicado: (2024)
FakeMark: Deepfake Speech Attribution With Watermarked Artifacts
por: Ge, Wanying, et al.
Publicado: (2025)
por: Ge, Wanying, et al.
Publicado: (2025)
Ejemplares similares
-
When Spoof Detectors Travel: Evaluation Across 66 Languages in the Low-Resource Language Spoofing Corpus
por: Borodin, Kirill, et al.
Publicado: (2026) -
Application of ASV for Voice Identification after VC and Duration Predictor Improvement in TTS Models
por: Nikolayevich, Borodin Kirill, et al.
Publicado: (2024) -
Balalaika: Data-Centric, Prosody-Aware Annotation Pipeline for Russian Speech
por: Borodin, Kirill, et al.
Publicado: (2025) -
Combining Masked Language Modeling and Cross-Modal Contrastive Learning for Prosody-Aware TTS
por: Borodin, Kirill, et al.
Publicado: (2026) -
Towards Scalable AASIST: Refining Graph Attention for Speech Deepfake Detection
por: Viakhirev, Ivan, et al.
Publicado: (2025)