audio dataset
Fuente:
Zenodo
Salvato in:
| Autore principale: | handesha |
|---|---|
| Natura: | Recurso digital |
| Pubblicazione: |
Zenodo
2025
|
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Audio Dialogues: Dialogues dataset for audio and music understanding
di: Goel, Arushi, et al.
Pubblicazione: (2024)
di: Goel, Arushi, et al.
Pubblicazione: (2024)
Unsupervised outlier detection to improve bird audio dataset labels
di: Collins, Bruce
Pubblicazione: (2025)
di: Collins, Bruce
Pubblicazione: (2025)
An RFP dataset for Real, Fake, and Partially fake audio detection
di: AlAli, Abdulazeez, et al.
Pubblicazione: (2024)
di: AlAli, Abdulazeez, et al.
Pubblicazione: (2024)
Circumventing shortcuts in audio-visual deepfake detection datasets with unsupervised learning
di: Smeu, Stefan, et al.
Pubblicazione: (2024)
di: Smeu, Stefan, et al.
Pubblicazione: (2024)
RELATE: Subjective evaluation dataset for automatic evaluation of relevance between text and audio
di: Kanamori, Yusuke, et al.
Pubblicazione: (2025)
di: Kanamori, Yusuke, et al.
Pubblicazione: (2025)
A 1000-hour EEG-EMG-audio dataset of Japanese speech production
di: Sato, Motoshige, et al.
Pubblicazione: (2026)
di: Sato, Motoshige, et al.
Pubblicazione: (2026)
Exploring trends in audio mixes and masters: Insights from a dataset analysis
di: Mourgela, Angeliki, et al.
Pubblicazione: (2024)
di: Mourgela, Angeliki, et al.
Pubblicazione: (2024)
WikiMuTe: A web-sourced dataset of semantic descriptions for music audio
di: Weck, Benno, et al.
Pubblicazione: (2023)
di: Weck, Benno, et al.
Pubblicazione: (2023)
Chinese-LiPS: A Chinese audio-visual speech recognition dataset with Lip-reading and Presentation Slides
di: Zhao, Jinghua, et al.
Pubblicazione: (2025)
di: Zhao, Jinghua, et al.
Pubblicazione: (2025)
Scaling up masked audio encoder learning for general audio classification
di: Dinkel, Heinrich, et al.
Pubblicazione: (2024)
di: Dinkel, Heinrich, et al.
Pubblicazione: (2024)
Online incremental learning for audio classification using a pretrained audio model
di: Mulimani, Manjunath, et al.
Pubblicazione: (2025)
di: Mulimani, Manjunath, et al.
Pubblicazione: (2025)
Session six audio material
di: Abhari, Ahmad
Pubblicazione: (2026)
di: Abhari, Ahmad
Pubblicazione: (2026)
Introduzione all’audio forense
di: Cenceschi, Sonia, et al.
Pubblicazione: (2026)
di: Cenceschi, Sonia, et al.
Pubblicazione: (2026)
Spectrogram features for audio and speech analysis
di: McLoughlin, Ian, et al.
Pubblicazione: (2026)
di: McLoughlin, Ian, et al.
Pubblicazione: (2026)
Towards audio language modeling -- an overview
di: Wu, Haibin, et al.
Pubblicazione: (2024)
di: Wu, Haibin, et al.
Pubblicazione: (2024)
Stage-adaptive audio diffusion modeling
di: Zhang, Xuanhao, et al.
Pubblicazione: (2026)
di: Zhang, Xuanhao, et al.
Pubblicazione: (2026)
A SOUND APPROACH: Using Large Language Models to generate audio descriptions for egocentric text-audio retrieval
di: Oncescu, Andreea-Maria, et al.
Pubblicazione: (2024)
di: Oncescu, Andreea-Maria, et al.
Pubblicazione: (2024)
Interfacing with history: Curating with audio augmented objects
di: Cliffe, Laurence
Pubblicazione: (2024)
di: Cliffe, Laurence
Pubblicazione: (2024)
Joint sentiment analysis of lyrics and audio in music
di: Schaab, Lea, et al.
Pubblicazione: (2024)
di: Schaab, Lea, et al.
Pubblicazione: (2024)
Character-aware audio-visual subtitling in context
di: Huh, Jaesung, et al.
Pubblicazione: (2024)
di: Huh, Jaesung, et al.
Pubblicazione: (2024)
Are audio DeepFake detection models polyglots?
di: Marek, Bartłomiej, et al.
Pubblicazione: (2024)
di: Marek, Bartłomiej, et al.
Pubblicazione: (2024)
Versatile audio-visual learning for emotion recognition
di: Goncalves, Lucas, et al.
Pubblicazione: (2023)
di: Goncalves, Lucas, et al.
Pubblicazione: (2023)
Blind speaker identification for audio forensic purposes
di: Dora María Ballesteros Larrota
Pubblicazione: (2017)
di: Dora María Ballesteros Larrota
Pubblicazione: (2017)
animal2vec and MeerKAT: A self‐supervised transformer for rare‐event raw audio input and a large‐scale reference dataset for bioacoustics
di: Julian C. Schäfer‐Zimmermann, et al.
Pubblicazione: (2025)
di: Julian C. Schäfer‐Zimmermann, et al.
Pubblicazione: (2025)
animal2vec and MeerKAT: A self-supervised transformer for rare-event raw audio input and a large-scale reference dataset for bioacoustics
di: Schäfer-Zimmermann, Julian C., et al.
Pubblicazione: (2024)
di: Schäfer-Zimmermann, Julian C., et al.
Pubblicazione: (2024)
Multimodal recognition with deep learning: audio, image, and text
di: Gummula, Ravi, et al.
Pubblicazione: (2025)
di: Gummula, Ravi, et al.
Pubblicazione: (2025)
ADIFF: Explaining audio difference using natural language
di: Deshmukh, Soham, et al.
Pubblicazione: (2025)
di: Deshmukh, Soham, et al.
Pubblicazione: (2025)
ADIFF: Explaining audio difference using natural language
di: Deshmukh, Soham, et al.
Pubblicazione: (2025)
di: Deshmukh, Soham, et al.
Pubblicazione: (2025)
MBCodec:Thorough disentangle for high-fidelity audio compression
di: Zhang, Ruonan, et al.
Pubblicazione: (2025)
di: Zhang, Ruonan, et al.
Pubblicazione: (2025)
Transformation of audio embeddings into interpretable, concept-based representations
di: Zhang, Alice, et al.
Pubblicazione: (2025)
di: Zhang, Alice, et al.
Pubblicazione: (2025)
Cryfish: On deep audio analysis with Large Language Models
di: Mitrofanov, Anton, et al.
Pubblicazione: (2025)
di: Mitrofanov, Anton, et al.
Pubblicazione: (2025)
Recomposer: Event-roll-guided generative audio editing
di: Ellis, Daniel P. W., et al.
Pubblicazione: (2025)
di: Ellis, Daniel P. W., et al.
Pubblicazione: (2025)
Training chord recognition models on artificially generated audio
di: Majchrzak, Martyna, et al.
Pubblicazione: (2025)
di: Majchrzak, Martyna, et al.
Pubblicazione: (2025)
Mellow: a small audio language model for reasoning
di: Deshmukh, Soham, et al.
Pubblicazione: (2025)
di: Deshmukh, Soham, et al.
Pubblicazione: (2025)
Mixer Metaphors: audio interfaces for non-musical applications
di: McNamara, Tace, et al.
Pubblicazione: (2025)
di: McNamara, Tace, et al.
Pubblicazione: (2025)
Real-time implementation of vibrato transfer as an audio effect
di: Hyrkas, Jeremy
Pubblicazione: (2025)
di: Hyrkas, Jeremy
Pubblicazione: (2025)
Bird detection in audio: a survey and a challenge
di: Stowell, Dan, et al.
Pubblicazione: (2016)
di: Stowell, Dan, et al.
Pubblicazione: (2016)
WavLM model ensemble for audio deepfake detection
di: Combei, David, et al.
Pubblicazione: (2024)
di: Combei, David, et al.
Pubblicazione: (2024)
Tweaking autoregressive methods for inpainting of gaps in audio signals
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024)
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024)
Compositional nonlinear audio signal processing with Volterra series
di: Araujo-Simon, Jake
Pubblicazione: (2023)
di: Araujo-Simon, Jake
Pubblicazione: (2023)
Documenti analoghi
-
Audio Dialogues: Dialogues dataset for audio and music understanding
di: Goel, Arushi, et al.
Pubblicazione: (2024) -
Unsupervised outlier detection to improve bird audio dataset labels
di: Collins, Bruce
Pubblicazione: (2025) -
An RFP dataset for Real, Fake, and Partially fake audio detection
di: AlAli, Abdulazeez, et al.
Pubblicazione: (2024) -
Circumventing shortcuts in audio-visual deepfake detection datasets with unsupervised learning
di: Smeu, Stefan, et al.
Pubblicazione: (2024) -
RELATE: Subjective evaluation dataset for automatic evaluation of relevance between text and audio
di: Kanamori, Yusuke, et al.
Pubblicazione: (2025)