Transformer Based Machine Fault Detection From Audio Input
Fuente:
arXiv
Salvato in:
| Autore principale: | Holla, Kiran Voderhobli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Large Language Models aren't all that you need
di: Holla, Kiran Voderhobli, et al.
Pubblicazione: (2024)
di: Holla, Kiran Voderhobli, et al.
Pubblicazione: (2024)
How to Label Resynthesized Audio: The Dual Role of Neural Audio Codecs in Audio Deepfake Detection
di: Xiao, Yixuan, et al.
Pubblicazione: (2026)
di: Xiao, Yixuan, et al.
Pubblicazione: (2026)
Improving Out-of-Domain Audio Deepfake Detection via Layer Selection and Fusion of SSL-Based Countermeasures
di: Serrano, Pierre, et al.
Pubblicazione: (2025)
di: Serrano, Pierre, et al.
Pubblicazione: (2025)
Detecting and Mitigating Insertion Hallucination in Video-to-Audio Generation
di: Chen, Liyang, et al.
Pubblicazione: (2025)
di: Chen, Liyang, et al.
Pubblicazione: (2025)
Audiopedia: Audio QA with Knowledge
di: Penamakuri, Abhirama Subramanyam, et al.
Pubblicazione: (2024)
di: Penamakuri, Abhirama Subramanyam, et al.
Pubblicazione: (2024)
From Coarse to Fine: Efficient Training for Audio Spectrogram Transformers
di: Feng, Jiu, et al.
Pubblicazione: (2024)
di: Feng, Jiu, et al.
Pubblicazione: (2024)
Linguistic and Audio Embedding-Based Machine Learning for Alzheimer's Dementia and Mild Cognitive Impairment Detection: Insights from the PROCESS Challenge
di: Devahi, Adharsha Sam Edwin Sam, et al.
Pubblicazione: (2025)
di: Devahi, Adharsha Sam Edwin Sam, et al.
Pubblicazione: (2025)
AaSP: Aliasing-aware Self-Supervised Pre-Training for Audio Spectrogram Transformers
di: Yamamoto, Kohei, et al.
Pubblicazione: (2025)
di: Yamamoto, Kohei, et al.
Pubblicazione: (2025)
AMAuT: A Flexible and Efficient Multiview Audio Transformer Framework Trained from Scratch
di: Shao, Weichuang, et al.
Pubblicazione: (2025)
di: Shao, Weichuang, et al.
Pubblicazione: (2025)
Investigating the Impact of Speech Enhancement on Audio Deepfake Detection in Noisy Environments
di: Anacin, et al.
Pubblicazione: (2026)
di: Anacin, et al.
Pubblicazione: (2026)
ADNAC: Audio Denoiser using Neural Audio Codec
di: Jimon, Daniel, et al.
Pubblicazione: (2025)
di: Jimon, Daniel, et al.
Pubblicazione: (2025)
Deformable Audio Transformer for Audio Event Detection
di: Zhu, Wentao
Pubblicazione: (2023)
di: Zhu, Wentao
Pubblicazione: (2023)
Towards Trustworthy Audio Deepfake Detection: A Systematic Framework for Diagnosing and Mitigating Gender Bias
di: Fursule, Aishwarya, et al.
Pubblicazione: (2026)
di: Fursule, Aishwarya, et al.
Pubblicazione: (2026)
Echo: Towards Advanced Audio Comprehension via Audio-Interleaved Reasoning
di: Wu, Daiqing, et al.
Pubblicazione: (2026)
di: Wu, Daiqing, et al.
Pubblicazione: (2026)
Audio Question Answering with GRPO-Based Fine-Tuning and Calibrated Segment-Level Predictions
di: Gibier, Marcel, et al.
Pubblicazione: (2025)
di: Gibier, Marcel, et al.
Pubblicazione: (2025)
Virtual Consistency for Audio Editing
di: Cervera, Matthieu, et al.
Pubblicazione: (2025)
di: Cervera, Matthieu, et al.
Pubblicazione: (2025)
uaMix-MAE: Efficient Tuning of Pretrained Audio Transformers with Unsupervised Audio Mixtures
di: Tabassum, Afrina, et al.
Pubblicazione: (2024)
di: Tabassum, Afrina, et al.
Pubblicazione: (2024)
PACE: Pretrained Audio Continual Learning
di: Li, Chang, et al.
Pubblicazione: (2026)
di: Li, Chang, et al.
Pubblicazione: (2026)
Segmentwise Pruning in Audio-Language Models
di: Gibier, Marcel, et al.
Pubblicazione: (2025)
di: Gibier, Marcel, et al.
Pubblicazione: (2025)
Adapting Neural Audio Codecs to EEG
di: Kastrati, Ard, et al.
Pubblicazione: (2025)
di: Kastrati, Ard, et al.
Pubblicazione: (2025)
Audio-based Anomaly Detection in Industrial Machines Using Deep One-Class Support Vector Data Description
di: Kilickaya, Sertac, et al.
Pubblicazione: (2024)
di: Kilickaya, Sertac, et al.
Pubblicazione: (2024)
APEX: Audio Prototype EXplanations for Classification Tasks
di: Kawa, Piotr, et al.
Pubblicazione: (2026)
di: Kawa, Piotr, et al.
Pubblicazione: (2026)
Investigating Modality Contribution in Audio LLMs for Music
di: Morais, Giovana, et al.
Pubblicazione: (2025)
di: Morais, Giovana, et al.
Pubblicazione: (2025)
Audio Super-Resolution with Latent Bridge Models
di: Li, Chang, et al.
Pubblicazione: (2025)
di: Li, Chang, et al.
Pubblicazione: (2025)
Does Audio Deepfake Detection Generalize?
di: Müller, Nicolas M., et al.
Pubblicazione: (2022)
di: Müller, Nicolas M., et al.
Pubblicazione: (2022)
Representation-Based Data Quality Audits for Audio
di: Gonzalez-Jimenez, Alvaro, et al.
Pubblicazione: (2025)
di: Gonzalez-Jimenez, Alvaro, et al.
Pubblicazione: (2025)
Synthesizer Sound Matching Using Audio Spectrogram Transformers
di: Bruford, Fred, et al.
Pubblicazione: (2024)
di: Bruford, Fred, et al.
Pubblicazione: (2024)
An Enhanced Audio Feature Tailored for Anomalous Sound Detection Based on Pre-trained Models
di: Zhong, Guirui, et al.
Pubblicazione: (2025)
di: Zhong, Guirui, et al.
Pubblicazione: (2025)
Training-Free Multimodal Guidance for Video to Audio Generation
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
Semantic-Aware Confidence Calibration for Automated Audio Captioning
di: Dunker, Lucas, et al.
Pubblicazione: (2025)
di: Dunker, Lucas, et al.
Pubblicazione: (2025)
Estimated Audio-Caption Correspondences Improve Language-Based Audio Retrieval
di: Primus, Paul, et al.
Pubblicazione: (2024)
di: Primus, Paul, et al.
Pubblicazione: (2024)
Audio Transformers
di: Verma, Prateek, et al.
Pubblicazione: (2021)
di: Verma, Prateek, et al.
Pubblicazione: (2021)
Targeted Augmented Data for Audio Deepfake Detection
di: Astrid, Marcella, et al.
Pubblicazione: (2024)
di: Astrid, Marcella, et al.
Pubblicazione: (2024)
Unified AI for Accurate Audio Anomaly Detection
di: Khaleghpour, Hamideh, et al.
Pubblicazione: (2025)
di: Khaleghpour, Hamideh, et al.
Pubblicazione: (2025)
FastWave: Optimized Diffusion Model for Audio Super-Resolution
di: Kuznetsov, Nikita, et al.
Pubblicazione: (2026)
di: Kuznetsov, Nikita, et al.
Pubblicazione: (2026)
Audio-Visual Continual Test-Time Adaptation without Forgetting
di: Maharana, Sarthak Kumar, et al.
Pubblicazione: (2026)
di: Maharana, Sarthak Kumar, et al.
Pubblicazione: (2026)
TADA! Tuning Audio Diffusion Models through Activation Steering
di: Staniszewski, Łukasz, et al.
Pubblicazione: (2026)
di: Staniszewski, Łukasz, et al.
Pubblicazione: (2026)
Can Synthetic Audio From Generative Foundation Models Assist Audio Recognition and Speech Modeling?
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
Unleashing the Power of Natural Audio Featuring Multiple Sound Sources
di: Cheng, Xize, et al.
Pubblicazione: (2025)
di: Cheng, Xize, et al.
Pubblicazione: (2025)
Improving Audio Classification by Transitioning from Zero- to Few-Shot
di: Taylor, James, et al.
Pubblicazione: (2025)
di: Taylor, James, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Large Language Models aren't all that you need
di: Holla, Kiran Voderhobli, et al.
Pubblicazione: (2024) -
How to Label Resynthesized Audio: The Dual Role of Neural Audio Codecs in Audio Deepfake Detection
di: Xiao, Yixuan, et al.
Pubblicazione: (2026) -
Improving Out-of-Domain Audio Deepfake Detection via Layer Selection and Fusion of SSL-Based Countermeasures
di: Serrano, Pierre, et al.
Pubblicazione: (2025) -
Detecting and Mitigating Insertion Hallucination in Video-to-Audio Generation
di: Chen, Liyang, et al.
Pubblicazione: (2025) -
Audiopedia: Audio QA with Knowledge
di: Penamakuri, Abhirama Subramanyam, et al.
Pubblicazione: (2024)