Benchmarking Machine Learning Methods for Distributed Acoustic Sensing
Fuente:
arXiv
Salvato in:
| Autori principali: | Shi, Shuaikai, Zong, Qijun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Acoustic Scene Classification: A Competition Review
di: Gharib, Shayan, et al.
Pubblicazione: (2018)
di: Gharib, Shayan, et al.
Pubblicazione: (2018)
MMAudioReverbs: Video-Guided Acoustic Modeling for Dereverberation and Room Impulse Response Estimation
di: Takahashi, Akira, et al.
Pubblicazione: (2026)
di: Takahashi, Akira, et al.
Pubblicazione: (2026)
Decoding Emotions: Unveiling Facial Expressions through Acoustic Sensing with Contrastive Attention
di: Wang, Guangjing, et al.
Pubblicazione: (2024)
di: Wang, Guangjing, et al.
Pubblicazione: (2024)
AC-Foley: Reference-Audio-Guided Video-to-Audio Synthesis with Acoustic Transfer
di: Fang, Pengjun, et al.
Pubblicazione: (2026)
di: Fang, Pengjun, et al.
Pubblicazione: (2026)
A High-Accuracy Optical Music Recognition Method Based on Bottleneck Residual Convolutions
di: Ma, Junwen, et al.
Pubblicazione: (2026)
di: Ma, Junwen, et al.
Pubblicazione: (2026)
An Eye for an Ear: Zero-shot Audio Description Leveraging an Image Captioner using Audiovisual Distribution Alignment
di: Malard, Hugo, et al.
Pubblicazione: (2024)
di: Malard, Hugo, et al.
Pubblicazione: (2024)
Real Acoustic Fields: An Audio-Visual Room Acoustics Dataset and Benchmark
di: Chen, Ziyang, et al.
Pubblicazione: (2024)
di: Chen, Ziyang, et al.
Pubblicazione: (2024)
Topological Deep Learning for Speech Data
di: Yu, Zhiwang
Pubblicazione: (2025)
di: Yu, Zhiwang
Pubblicazione: (2025)
Characterizing Continual Learning Scenarios and Strategies for Audio Analysis
di: Bhatt, Ruchi, et al.
Pubblicazione: (2024)
di: Bhatt, Ruchi, et al.
Pubblicazione: (2024)
Automated Detection of Dolphin Whistles with Convolutional Networks and Transfer Learning
di: Korkmaz, Burla Nur, et al.
Pubblicazione: (2022)
di: Korkmaz, Burla Nur, et al.
Pubblicazione: (2022)
Exploring Federated Self-Supervised Learning for General Purpose Audio Understanding
di: Rehman, Yasar Abbas Ur, et al.
Pubblicazione: (2024)
di: Rehman, Yasar Abbas Ur, et al.
Pubblicazione: (2024)
Deep Neural Networks for Automatic Speaker Recognition Do Not Learn Supra-Segmental Temporal Features
di: Neururer, Daniel, et al.
Pubblicazione: (2023)
di: Neururer, Daniel, et al.
Pubblicazione: (2023)
Towards reliable respiratory disease diagnosis based on cough sounds and vision transformers
di: Wang, Qian, et al.
Pubblicazione: (2024)
di: Wang, Qian, et al.
Pubblicazione: (2024)
Prosody-Enhanced Acoustic Pre-training and Acoustic-Disentangled Prosody Adapting for Movie Dubbing
di: Zhang, Zhedong, et al.
Pubblicazione: (2025)
di: Zhang, Zhedong, et al.
Pubblicazione: (2025)
Improving Acoustic Scene Classification with City Features
di: Cai, Yiqiang, et al.
Pubblicazione: (2025)
di: Cai, Yiqiang, et al.
Pubblicazione: (2025)
Data Augmentation Using Neural Acoustic Fields With Retrieval-Augmented Pre-training
di: Ick, Christopher, et al.
Pubblicazione: (2025)
di: Ick, Christopher, et al.
Pubblicazione: (2025)
Direction-Aware Neural Acoustic Fields for Few-Shot Interpolation of Ambisonic Impulse Responses
di: Ick, Christopher, et al.
Pubblicazione: (2025)
di: Ick, Christopher, et al.
Pubblicazione: (2025)
Few-shot Acoustic Synthesis with Multimodal Flow Matching
di: Brunetto, Amandine
Pubblicazione: (2026)
di: Brunetto, Amandine
Pubblicazione: (2026)
SOAF: Scene Occlusion-aware Neural Acoustic Field
di: Gao, Huiyu, et al.
Pubblicazione: (2024)
di: Gao, Huiyu, et al.
Pubblicazione: (2024)
MMAudioSep: Taming Video-to-Audio Generative Model Towards Video/Text-Queried Sound Separation
di: Takahashi, Akira, et al.
Pubblicazione: (2025)
di: Takahashi, Akira, et al.
Pubblicazione: (2025)
Training-Free Voice Conversion with Factorized Optimal Transport
di: Lobashev, Alexander, et al.
Pubblicazione: (2025)
di: Lobashev, Alexander, et al.
Pubblicazione: (2025)
Step-by-Step Video-to-Audio Synthesis via Negative Audio Guidance
di: Hayakawa, Akio, et al.
Pubblicazione: (2025)
di: Hayakawa, Akio, et al.
Pubblicazione: (2025)
Exploring Audio Cues for Enhanced Test-Time Video Model Adaptation
di: Zeng, Runhao, et al.
Pubblicazione: (2025)
di: Zeng, Runhao, et al.
Pubblicazione: (2025)
Ditto: Motion-Space Diffusion for Controllable Realtime Talking Head Synthesis
di: Li, Tianqi, et al.
Pubblicazione: (2024)
di: Li, Tianqi, et al.
Pubblicazione: (2024)
Addressing Representation Collapse in Vector Quantized Models with One Linear Layer
di: Zhu, Yongxin, et al.
Pubblicazione: (2024)
di: Zhu, Yongxin, et al.
Pubblicazione: (2024)
Assessing the Robustness of Spectral Clustering for Deep Speaker Diarization
di: Raghav, Nikhil, et al.
Pubblicazione: (2024)
di: Raghav, Nikhil, et al.
Pubblicazione: (2024)
Exploring Green AI for Audio Deepfake Detection
di: Saha, Subhajit, et al.
Pubblicazione: (2024)
di: Saha, Subhajit, et al.
Pubblicazione: (2024)
Joint Multimodal Transformer for Emotion Recognition in the Wild
di: Waligora, Paul, et al.
Pubblicazione: (2024)
di: Waligora, Paul, et al.
Pubblicazione: (2024)
Dynamic Cross Attention for Audio-Visual Person Verification
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024)
di: Praveen, R. Gnana, et al.
Pubblicazione: (2024)
Dynamic Modality and View Selection for Multimodal Emotion Recognition with Missing Modalities
di: Menon, Luciana Trinkaus, et al.
Pubblicazione: (2024)
di: Menon, Luciana Trinkaus, et al.
Pubblicazione: (2024)
Developing an AI-based Integrated System for Bee Health Evaluation
di: Liang, Andrew
Pubblicazione: (2024)
di: Liang, Andrew
Pubblicazione: (2024)
Integrating Audio, Visual, and Semantic Information for Enhanced Multimodal Speaker Diarization
di: Cheng, Luyao, et al.
Pubblicazione: (2024)
di: Cheng, Luyao, et al.
Pubblicazione: (2024)
The Solution for Temporal Sound Localisation Task of ICCV 1st Perception Test Challenge 2023
di: Huang, Yurui, et al.
Pubblicazione: (2024)
di: Huang, Yurui, et al.
Pubblicazione: (2024)
Character-aware audio-visual subtitling in context
di: Huh, Jaesung, et al.
Pubblicazione: (2024)
di: Huh, Jaesung, et al.
Pubblicazione: (2024)
MMAudio: Taming Multimodal Joint Training for High-Quality Video-to-Audio Synthesis
di: Cheng, Ho Kei, et al.
Pubblicazione: (2024)
di: Cheng, Ho Kei, et al.
Pubblicazione: (2024)
Attention Isn't All You Need for Emotion Recognition:Domain Features Outperform Transformers on the EAV Dataset
di: Guragain, Anmol
Pubblicazione: (2026)
di: Guragain, Anmol
Pubblicazione: (2026)
AV-Link: Temporally-Aligned Diffusion Features for Cross-Modal Audio-Video Generation
di: Haji-Ali, Moayed, et al.
Pubblicazione: (2024)
di: Haji-Ali, Moayed, et al.
Pubblicazione: (2024)
SEE-2-SOUND: Zero-Shot Spatial Environment-to-Spatial Sound
di: Dagli, Rishit, et al.
Pubblicazione: (2024)
di: Dagli, Rishit, et al.
Pubblicazione: (2024)
SoundBrush: Sound as a Brush for Visual Scene Editing
di: Sung-Bin, Kim, et al.
Pubblicazione: (2024)
di: Sung-Bin, Kim, et al.
Pubblicazione: (2024)
Attention-guided Spectrogram Sequence Modeling with CNNs for Music Genre Classification
di: Sridhar, Aditya
Pubblicazione: (2024)
di: Sridhar, Aditya
Pubblicazione: (2024)
Documenti analoghi
-
Acoustic Scene Classification: A Competition Review
di: Gharib, Shayan, et al.
Pubblicazione: (2018) -
MMAudioReverbs: Video-Guided Acoustic Modeling for Dereverberation and Room Impulse Response Estimation
di: Takahashi, Akira, et al.
Pubblicazione: (2026) -
Decoding Emotions: Unveiling Facial Expressions through Acoustic Sensing with Contrastive Attention
di: Wang, Guangjing, et al.
Pubblicazione: (2024) -
AC-Foley: Reference-Audio-Guided Video-to-Audio Synthesis with Acoustic Transfer
di: Fang, Pengjun, et al.
Pubblicazione: (2026) -
A High-Accuracy Optical Music Recognition Method Based on Bottleneck Residual Convolutions
di: Ma, Junwen, et al.
Pubblicazione: (2026)