Toward Multimodal Industrial Fault Analysis: A Single-Speed Chain Conveyor Dataset with Audio and Vibration Signals
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Zhang, Zhang, Yucong, Miao, Xiaoxiao, Li, Ming |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Interpretable Audio Editing Evaluation via Chain-of-Thought Difference-Commonality Reasoning with Multimodal LLMs
par: Jia, Yuhang, et autres
Publié: (2025)
par: Jia, Yuhang, et autres
Publié: (2025)
Online Single-Channel Audio-Based Sound Speed Estimation for Robust Multi-Channel Audio Control
par: Fuglsig, Andreas Jonas, et autres
Publié: (2026)
par: Fuglsig, Andreas Jonas, et autres
Publié: (2026)
CompSpoof: A Dataset and Joint Learning Framework for Component-Level Audio Anti-spoofing Countermeasures
par: Zhang, Xueping, et autres
Publié: (2025)
par: Zhang, Xueping, et autres
Publié: (2025)
Libri2Vox Dataset: Target Speaker Extraction with Diverse Speaker Conditions and Synthetic Data
par: Liu, Yun, et autres
Publié: (2024)
par: Liu, Yun, et autres
Publié: (2024)
Multimodal Laryngoscopic Video Analysis for Assisted Diagnosis of Vocal Fold Paralysis
par: Zhang, Yucong, et autres
Publié: (2024)
par: Zhang, Yucong, et autres
Publié: (2024)
Fine-Grained Engine Fault Sound Event Detection Using Multimodal Signals
par: Fedorishin, Dennis, et autres
Publié: (2024)
par: Fedorishin, Dennis, et autres
Publié: (2024)
EffectiveASR: A Single-Step Non-Autoregressive Mandarin Speech Recognition Architecture with High Accuracy and Inference Speed
par: Zhuang, Ziyang, et autres
Publié: (2024)
par: Zhuang, Ziyang, et autres
Publié: (2024)
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
par: Jiang, Yidi, et autres
Publié: (2025)
par: Jiang, Yidi, et autres
Publié: (2025)
ADD 2023: Towards Audio Deepfake Detection and Analysis in the Wild
par: Yi, Jiangyan, et autres
Publié: (2024)
par: Yi, Jiangyan, et autres
Publié: (2024)
ECHO: Frequency-aware Hierarchical Encoding for Variable-length Signals
par: Zhang, Yucong, et autres
Publié: (2025)
par: Zhang, Yucong, et autres
Publié: (2025)
From Contrast to Commonality: Audio Commonality Captioning for Enhanced Audio-Text Cross-modal Understanding in Multimodal LLMs
par: Jia, Yuhang, et autres
Publié: (2025)
par: Jia, Yuhang, et autres
Publié: (2025)
A Practical Guide to Spectrogram Analysis for Audio Signal Processing
par: Khodzhaev, Zulfidin
Publié: (2024)
par: Khodzhaev, Zulfidin
Publié: (2024)
DFADD: The Diffusion and Flow-Matching Based Audio Deepfake Dataset
par: Du, Jiawei, et autres
Publié: (2024)
par: Du, Jiawei, et autres
Publié: (2024)
AudioRAG: A Challenging Benchmark for Audio Reasoning and Information Retrieval
par: Lin, Jingru, et autres
Publié: (2026)
par: Lin, Jingru, et autres
Publié: (2026)
Unsupervised Single-Channel Audio Separation with Diffusion Source Priors
par: Shi, Runwu, et autres
Publié: (2025)
par: Shi, Runwu, et autres
Publié: (2025)
MelTok: 2D Tokenization for Single-Codebook Audio Compression
par: Li, Jingyi, et autres
Publié: (2025)
par: Li, Jingyi, et autres
Publié: (2025)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
par: Chen, Xuanjun, et autres
Publié: (2025)
par: Chen, Xuanjun, et autres
Publié: (2025)
EmoFake: An Initial Dataset for Emotion Fake Audio Detection
par: Zhao, Yan, et autres
Publié: (2022)
par: Zhao, Yan, et autres
Publié: (2022)
UniAudio: An Audio Foundation Model Toward Universal Audio Generation
par: Yang, Dongchao, et autres
Publié: (2023)
par: Yang, Dongchao, et autres
Publié: (2023)
AudioComposer: Towards Fine-grained Audio Generation with Natural Language Descriptions
par: Wang, Yuanyuan, et autres
Publié: (2024)
par: Wang, Yuanyuan, et autres
Publié: (2024)
ASPED: An Audio Dataset for Detecting Pedestrians
par: Seshadri, Pavan, et autres
Publié: (2023)
par: Seshadri, Pavan, et autres
Publié: (2023)
BWSNet: Automatic Perceptual Assessment of Audio Signals
par: Veillon, Clément Le Moine, et autres
Publié: (2023)
par: Veillon, Clément Le Moine, et autres
Publié: (2023)
AeroGPT: Leveraging Large-Scale Audio Model for Aero-Engine Bearing Fault Diagnosis
par: Liu, Jiale, et autres
Publié: (2025)
par: Liu, Jiale, et autres
Publié: (2025)
MT2KD: Towards A General-Purpose Encoder for Speech, Speaker, and Audio Events
par: Yang, Xiaoyu, et autres
Publié: (2024)
par: Yang, Xiaoyu, et autres
Publié: (2024)
Mitigating Language Mismatch in SSL-Based Speaker Anonymization
par: Zhang, Zhe, et autres
Publié: (2025)
par: Zhang, Zhe, et autres
Publié: (2025)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
par: Ratnarajah, Anton, et autres
Publié: (2023)
par: Ratnarajah, Anton, et autres
Publié: (2023)
AUV: Teaching Audio Universal Vector Quantization with Single Nested Codebook
par: Chen, Yushen, et autres
Publié: (2025)
par: Chen, Yushen, et autres
Publié: (2025)
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
par: Li, Yuang, et autres
Publié: (2024)
par: Li, Yuang, et autres
Publié: (2024)
Towards Robust Audio Deepfake Detection: A Evolving Benchmark for Continual Learning
par: Zhang, Xiaohui, et autres
Publié: (2024)
par: Zhang, Xiaohui, et autres
Publié: (2024)
Two-stage Audio-Visual Target Speaker Extraction System for Real-Time Processing On Edge Device
par: Li, Zixuan, et autres
Publié: (2025)
par: Li, Zixuan, et autres
Publié: (2025)
HearFit+: Personalized Fitness Monitoring via Audio Signals on Smart Speakers
par: Xie, Yadong, et autres
Publié: (2025)
par: Xie, Yadong, et autres
Publié: (2025)
SecureSpeech: Prompt-based Speaker and Content Protection
par: Hui, Belinda Soh Hui, et autres
Publié: (2025)
par: Hui, Belinda Soh Hui, et autres
Publié: (2025)
Target Speaker Extraction with Curriculum Learning
par: Liu, Yun, et autres
Publié: (2024)
par: Liu, Yun, et autres
Publié: (2024)
Hyperbolic Embeddings for Order-Aware Classification of Audio Effect Chains
par: Wada, Aogu, et autres
Publié: (2025)
par: Wada, Aogu, et autres
Publié: (2025)
SemanticAudio: Audio Generation and Editing in Semantic Space
par: Dai, Zheqi, et autres
Publié: (2026)
par: Dai, Zheqi, et autres
Publié: (2026)
PromptSep: Generative Audio Separation via Multimodal Prompting
par: Wen, Yutong, et autres
Publié: (2025)
par: Wen, Yutong, et autres
Publié: (2025)
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
par: Gong, Yitian, et autres
Publié: (2026)
par: Gong, Yitian, et autres
Publié: (2026)
Enhancing Zero-shot Audio Classification using Sound Attribute Knowledge from Large Language Models
par: Xu, Xuenan, et autres
Publié: (2024)
par: Xu, Xuenan, et autres
Publié: (2024)
A Detailed Audio-Text Data Simulation Pipeline using Single-Event Sounds
par: Xu, Xuenan, et autres
Publié: (2024)
par: Xu, Xuenan, et autres
Publié: (2024)
Exploring Perceptual Audio Quality Measurement on Stereo Processing Using the Open Dataset of Audio Quality
par: Delgado, Pablo M., et autres
Publié: (2025)
par: Delgado, Pablo M., et autres
Publié: (2025)
Documents similaires
-
Interpretable Audio Editing Evaluation via Chain-of-Thought Difference-Commonality Reasoning with Multimodal LLMs
par: Jia, Yuhang, et autres
Publié: (2025) -
Online Single-Channel Audio-Based Sound Speed Estimation for Robust Multi-Channel Audio Control
par: Fuglsig, Andreas Jonas, et autres
Publié: (2026) -
CompSpoof: A Dataset and Joint Learning Framework for Component-Level Audio Anti-spoofing Countermeasures
par: Zhang, Xueping, et autres
Publié: (2025) -
Libri2Vox Dataset: Target Speaker Extraction with Diverse Speaker Conditions and Synthetic Data
par: Liu, Yun, et autres
Publié: (2024) -
Multimodal Laryngoscopic Video Analysis for Assisted Diagnosis of Vocal Fold Paralysis
par: Zhang, Yucong, et autres
Publié: (2024)