Solution for Temporal Sound Localisation Task of ECCV Second Perception Test Challenge 2024
Fuente:
arXiv
Salvato in:
| Autori principali: | Gu, Haowei, Zhu, Weihao, Yang, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Solution for Temporal Sound Localisation Task of ICCV 1st Perception Test Challenge 2023
di: Huang, Yurui, et al.
Pubblicazione: (2024)
di: Huang, Yurui, et al.
Pubblicazione: (2024)
Description and Discussion on DCASE 2024 Challenge Task 2: First-Shot Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
di: Nishida, Tomoya, et al.
Pubblicazione: (2024)
di: Nishida, Tomoya, et al.
Pubblicazione: (2024)
TCG CREST System Description for the Second DISPLACE Challenge
di: Raghav, Nikhil, et al.
Pubblicazione: (2024)
di: Raghav, Nikhil, et al.
Pubblicazione: (2024)
Advanced Framework for Animal Sound Classification With Features Optimization
di: Yang, Qiang, et al.
Pubblicazione: (2024)
di: Yang, Qiang, et al.
Pubblicazione: (2024)
Cross-domain Sound Recognition for Efficient Underwater Data Analysis
di: Park, Jeongsoo, et al.
Pubblicazione: (2023)
di: Park, Jeongsoo, et al.
Pubblicazione: (2023)
A Comprehensive Survey on Heart Sound Analysis in the Deep Learning Era
di: Ren, Zhao, et al.
Pubblicazione: (2023)
di: Ren, Zhao, et al.
Pubblicazione: (2023)
SoundMorpher: Perceptually-Uniform Sound Morphing with Diffusion Model
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction
di: Chen, Tuochao, et al.
Pubblicazione: (2025)
di: Chen, Tuochao, et al.
Pubblicazione: (2025)
ParaMETA: Towards Learning Disentangled Paralinguistic Speaking Styles Representations from Speech
di: Lou, Haowei, et al.
Pubblicazione: (2026)
di: Lou, Haowei, et al.
Pubblicazione: (2026)
Patch-Mix Contrastive Learning with Audio Spectrogram Transformer on Respiratory Sound Classification
di: Bae, Sangmin, et al.
Pubblicazione: (2023)
di: Bae, Sangmin, et al.
Pubblicazione: (2023)
The iNaturalist Sounds Dataset
di: Chasmai, Mustafa, et al.
Pubblicazione: (2025)
di: Chasmai, Mustafa, et al.
Pubblicazione: (2025)
SoundCTM: Unifying Score-based and Consistency Models for Full-band Text-to-Sound Generation
di: Saito, Koichi, et al.
Pubblicazione: (2024)
di: Saito, Koichi, et al.
Pubblicazione: (2024)
Breaking Down Power Barriers in On-Device Streaming ASR: Insights and Solutions
di: Li, Yang, et al.
Pubblicazione: (2024)
di: Li, Yang, et al.
Pubblicazione: (2024)
Description on IEEE ICME 2024 Grand Challenge: Semi-supervised Acoustic Scene Classification under Domain Shift
di: Bai, Jisheng, et al.
Pubblicazione: (2024)
di: Bai, Jisheng, et al.
Pubblicazione: (2024)
Sound Event Detection and Localization with Distance Estimation
di: Krause, Daniel Aleksander, et al.
Pubblicazione: (2024)
di: Krause, Daniel Aleksander, et al.
Pubblicazione: (2024)
Sound Tagging in Infant-centric Home Soundscapes
di: Khan, Mohammad Nur Hossain, et al.
Pubblicazione: (2024)
di: Khan, Mohammad Nur Hossain, et al.
Pubblicazione: (2024)
Focal Modulation Networks for Interpretable Sound Classification
di: Della Libera, Luca, et al.
Pubblicazione: (2024)
di: Della Libera, Luca, et al.
Pubblicazione: (2024)
Audio Geolocation: A Natural Sounds Benchmark
di: Chasmai, Mustafa, et al.
Pubblicazione: (2025)
di: Chasmai, Mustafa, et al.
Pubblicazione: (2025)
Sound event detection based on auxiliary decoder and maximum probability aggregation for DCASE Challenge 2024 Task 4
di: Son, Sang Won, et al.
Pubblicazione: (2024)
di: Son, Sang Won, et al.
Pubblicazione: (2024)
Audio Simulation for Sound Source Localization in Virtual Evironment
di: Di Yuan, Yi, et al.
Pubblicazione: (2024)
di: Di Yuan, Yi, et al.
Pubblicazione: (2024)
Synthesizer Sound Matching Using Audio Spectrogram Transformers
di: Bruford, Fred, et al.
Pubblicazione: (2024)
di: Bruford, Fred, et al.
Pubblicazione: (2024)
Energy Consumption Trends in Sound Event Detection Systems
di: Douwes, Constance, et al.
Pubblicazione: (2024)
di: Douwes, Constance, et al.
Pubblicazione: (2024)
Mixture of Mixups for Multi-label Classification of Rare Anuran Sounds
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
Embedding-Space Diffusion for Zero-Shot Environmental Sound Classification
di: Sims, Ysobel, et al.
Pubblicazione: (2024)
di: Sims, Ysobel, et al.
Pubblicazione: (2024)
Activity-Guided Industrial Anomalous Sound Detection against Interferences
di: Lee, Yunjoo, et al.
Pubblicazione: (2024)
di: Lee, Yunjoo, et al.
Pubblicazione: (2024)
Sound event localization and classification using WASN in Outdoor Environment
di: Zhang, Dongzhe, et al.
Pubblicazione: (2024)
di: Zhang, Dongzhe, et al.
Pubblicazione: (2024)
Automatic Inspection Based on Switch Sounds of Electric Point Machines
di: Shibata, Ayano, et al.
Pubblicazione: (2025)
di: Shibata, Ayano, et al.
Pubblicazione: (2025)
SoundReactor: Frame-level Online Video-to-Audio Generation
di: Saito, Koichi, et al.
Pubblicazione: (2025)
di: Saito, Koichi, et al.
Pubblicazione: (2025)
Self-Supervised Learning for Few-Shot Bird Sound Classification
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
Feature Aggregation in Joint Sound Classification and Localization Neural Networks
di: Healy, Brendan, et al.
Pubblicazione: (2023)
di: Healy, Brendan, et al.
Pubblicazione: (2023)
Maximum Likelihood Estimation of the Direction of Sound In A Reverberant Noisy Environment
di: Mansour, Mohamed F.
Pubblicazione: (2024)
di: Mansour, Mohamed F.
Pubblicazione: (2024)
HyperGANStrument: Instrument Sound Synthesis and Editing with Pitch-Invariant Hypernetworks
di: Zhang, Zhe, et al.
Pubblicazione: (2024)
di: Zhang, Zhe, et al.
Pubblicazione: (2024)
Abnormal Respiratory Sound Identification Using Audio-Spectrogram Vision Transformer
di: Ariyanti, Whenty, et al.
Pubblicazione: (2024)
di: Ariyanti, Whenty, et al.
Pubblicazione: (2024)
Lungmix: A Mixup-Based Strategy for Generalization in Respiratory Sound Classification
di: Ge, Shijia, et al.
Pubblicazione: (2024)
di: Ge, Shijia, et al.
Pubblicazione: (2024)
Sound Source Separation Using Latent Variational Block-Wise Disentanglement
di: Helwani, Karim, et al.
Pubblicazione: (2024)
di: Helwani, Karim, et al.
Pubblicazione: (2024)
wav2pos: Sound Source Localization using Masked Autoencoders
di: Berg, Axel, et al.
Pubblicazione: (2024)
di: Berg, Axel, et al.
Pubblicazione: (2024)
RCT: Random Consistency Training for Semi-supervised Sound Event Detection
di: Shao, Nian, et al.
Pubblicazione: (2021)
di: Shao, Nian, et al.
Pubblicazione: (2021)
Exploring Performance-Complexity Trade-Offs in Sound Event Detection Models
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
Regularized Contrastive Pre-training for Few-shot Bioacoustic Sound Detection
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
Aggregation Strategies for Efficient Annotation of Bioacoustic Sound Events Using Active Learning
di: Lindholm, Richard, et al.
Pubblicazione: (2025)
di: Lindholm, Richard, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Solution for Temporal Sound Localisation Task of ICCV 1st Perception Test Challenge 2023
di: Huang, Yurui, et al.
Pubblicazione: (2024) -
Description and Discussion on DCASE 2024 Challenge Task 2: First-Shot Unsupervised Anomalous Sound Detection for Machine Condition Monitoring
di: Nishida, Tomoya, et al.
Pubblicazione: (2024) -
TCG CREST System Description for the Second DISPLACE Challenge
di: Raghav, Nikhil, et al.
Pubblicazione: (2024) -
Advanced Framework for Animal Sound Classification With Features Optimization
di: Yang, Qiang, et al.
Pubblicazione: (2024) -
Cross-domain Sound Recognition for Efficient Underwater Data Analysis
di: Park, Jeongsoo, et al.
Pubblicazione: (2023)