MolAudioNet: A Multimodal Molecular Audio Dataset for AI
Fuente:
Zenodo
Salvato in:
| Autori principali: | Zhou, Jianping, Zhou, Emily |
|---|---|
| Natura: | Recurso digital |
| Pubblicazione: |
Zenodo
2025
|
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MVAD: A Benchmark Dataset for Multimodal AI-Generated Video-Audio Detection
di: Hu, Mengxue, et al.
Pubblicazione: (2025)
di: Hu, Mengxue, et al.
Pubblicazione: (2025)
MolTextNet: A Two-Million Molecule-Text Dataset for Multimodal Molecular Learning
di: Zhu, Yihan, et al.
Pubblicazione: (2025)
di: Zhu, Yihan, et al.
Pubblicazione: (2025)
SoccerNet-Echoes: A Soccer Game Audio Commentary Dataset
di: Gautam, Sushant, et al.
Pubblicazione: (2024)
di: Gautam, Sushant, et al.
Pubblicazione: (2024)
Audio Atlas: Visualizing and Exploring Audio Datasets
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
di: Bang, Hayeon, et al.
Pubblicazione: (2024)
di: Bang, Hayeon, et al.
Pubblicazione: (2024)
Audio Spatially-Guided Fusion for Audio-Visual Navigation
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
Audio ControlNet for Fine-Grained Audio Generation and Editing
di: Zhu, Haina, et al.
Pubblicazione: (2026)
di: Zhu, Haina, et al.
Pubblicazione: (2026)
MRSAudio: A Large-Scale Multimodal Recorded Spatial Audio Dataset with Refined Annotations
di: Guo, Wenxiang, et al.
Pubblicazione: (2025)
di: Guo, Wenxiang, et al.
Pubblicazione: (2025)
WavCaps: A ChatGPT-Assisted Weakly-Labelled Audio Captioning Dataset for Audio-Language Multimodal Research
di: Mei, Xinhao, et al.
Pubblicazione: (2023)
di: Mei, Xinhao, et al.
Pubblicazione: (2023)
AudioNet: Supervised Deep Hashing for Retrieval of Similar Audio Events
di: Dutta, Sagar, et al.
Pubblicazione: (2025)
di: Dutta, Sagar, et al.
Pubblicazione: (2025)
AudioTime: A Temporally-aligned Audio-text Benchmark Dataset
di: Xie, Zeyu, et al.
Pubblicazione: (2024)
di: Xie, Zeyu, et al.
Pubblicazione: (2024)
MMED: A Multimodal Micro-Expression Dataset based on Audio-Visual Fusion
di: Wang, Junbo, et al.
Pubblicazione: (2025)
di: Wang, Junbo, et al.
Pubblicazione: (2025)
Audio Spoof Detection with GaborNet
di: Maciejko, Waldek
Pubblicazione: (2026)
di: Maciejko, Waldek
Pubblicazione: (2026)
UniAudio: An Audio Foundation Model Toward Universal Audio Generation
di: Yang, Dongchao, et al.
Pubblicazione: (2023)
di: Yang, Dongchao, et al.
Pubblicazione: (2023)
Audio Is the Achilles' Heel: Red Teaming Audio Large Multimodal Models
di: Yang, Hao, et al.
Pubblicazione: (2024)
di: Yang, Hao, et al.
Pubblicazione: (2024)
ChronosAudio: A Comprehensive Long-Audio Benchmark for Evaluating Audio-Large Language Models
di: Luo, Kaiwen, et al.
Pubblicazione: (2026)
di: Luo, Kaiwen, et al.
Pubblicazione: (2026)
AVAR-Net: A Lightweight Audio-Visual Anomaly Recognition Framework with a Benchmark Dataset
di: Ali, Amjid, et al.
Pubblicazione: (2025)
di: Ali, Amjid, et al.
Pubblicazione: (2025)
MolProphecy: Bridging Medicinal Chemists' Knowledge and Molecular Pre-Trained Models via a Multi-Modal Framework
di: Zhao, Jianping, et al.
Pubblicazione: (2025)
di: Zhao, Jianping, et al.
Pubblicazione: (2025)
Representation-Regularized Convolutional Audio Transformer for Audio Understanding
di: Han, Bing, et al.
Pubblicazione: (2026)
di: Han, Bing, et al.
Pubblicazione: (2026)
JoVA: Unified Multimodal Learning for Joint Video-Audio Generation
di: Huang, Xiaohu, et al.
Pubblicazione: (2025)
di: Huang, Xiaohu, et al.
Pubblicazione: (2025)
AudioRole: An Audio Dataset for Character Role-Playing in Large Language Models
di: Li, Wenyu, et al.
Pubblicazione: (2025)
di: Li, Wenyu, et al.
Pubblicazione: (2025)
AudioSetMix: Enhancing Audio-Language Datasets with LLM-Assisted Augmentations
di: Xu, David
Pubblicazione: (2024)
di: Xu, David
Pubblicazione: (2024)
SAM Audio Judge: A Unified Multimodal Framework for Perceptual Evaluation of Audio Separation
di: Wang, Helin, et al.
Pubblicazione: (2026)
di: Wang, Helin, et al.
Pubblicazione: (2026)
UltraEval-Audio: A Unified Framework for Comprehensive Evaluation of Audio Foundation Models
di: Shi, Qundong, et al.
Pubblicazione: (2026)
di: Shi, Qundong, et al.
Pubblicazione: (2026)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
di: Wang, Lu, et al.
Pubblicazione: (2025)
di: Wang, Lu, et al.
Pubblicazione: (2025)
Hybrid Audio Detection Using Fine-Tuned Audio Spectrogram Transformers: A Dataset-Driven Evaluation of Mixed AI-Human Speech
di: Huang, Kunyang, et al.
Pubblicazione: (2025)
di: Huang, Kunyang, et al.
Pubblicazione: (2025)
AudioSetCaps: An Enriched Audio-Caption Dataset using Automated Generation Pipeline with Large Audio and Language Models
di: Bai, Jisheng, et al.
Pubblicazione: (2024)
di: Bai, Jisheng, et al.
Pubblicazione: (2024)
Omni-Embed-Audio: Leveraging Multimodal LLMs for Robust Audio-Text Retrieval
di: Yoo, HaeJun, et al.
Pubblicazione: (2026)
di: Yoo, HaeJun, et al.
Pubblicazione: (2026)
Efficient Selective Audio Masked Multimodal Bottleneck Transformer for Audio-Video Classification
di: Zhu, Wentao
Pubblicazione: (2024)
di: Zhu, Wentao
Pubblicazione: (2024)
Decoupled Audio-Visual Dataset Distillation
di: Li, Wenyuan, et al.
Pubblicazione: (2025)
di: Li, Wenyuan, et al.
Pubblicazione: (2025)
ODAQ: Open Dataset of Audio Quality
di: Torcoli, Matteo, et al.
Pubblicazione: (2023)
di: Torcoli, Matteo, et al.
Pubblicazione: (2023)
Sound Check: Auditing Audio Datasets
di: Agnew, William, et al.
Pubblicazione: (2024)
di: Agnew, William, et al.
Pubblicazione: (2024)
ASPED: An Audio Dataset for Detecting Pedestrians
di: Seshadri, Pavan, et al.
Pubblicazione: (2023)
di: Seshadri, Pavan, et al.
Pubblicazione: (2023)
Multimodal Class-aware Semantic Enhancement Network for Audio-Visual Video Parsing
di: Zhao, Pengcheng, et al.
Pubblicazione: (2024)
di: Zhao, Pengcheng, et al.
Pubblicazione: (2024)
AudioLCM: Text-to-Audio Generation with Latent Consistency Models
di: Liu, Huadai, et al.
Pubblicazione: (2024)
di: Liu, Huadai, et al.
Pubblicazione: (2024)
Revisiting Audio-language Pretraining for Learning General-purpose Audio Representation
di: Tseng, Wei-Cheng, et al.
Pubblicazione: (2025)
di: Tseng, Wei-Cheng, et al.
Pubblicazione: (2025)
Mol-LLM: Multimodal Generalist Molecular LLM with Improved Graph Utilization
di: Lee, Chanhui, et al.
Pubblicazione: (2025)
di: Lee, Chanhui, et al.
Pubblicazione: (2025)
M$^3$AV: A Multimodal, Multigenre, and Multipurpose Audio-Visual Academic Lecture Dataset
di: Chen, Zhe, et al.
Pubblicazione: (2024)
di: Chen, Zhe, et al.
Pubblicazione: (2024)
AUDITA: A New Dataset to Audit Humans vs. AI Skill at Audio QA
di: Kabir, Tasnim, et al.
Pubblicazione: (2026)
di: Kabir, Tasnim, et al.
Pubblicazione: (2026)
Generative AI for Music and Audio
di: Dong, Hao-Wen
Pubblicazione: (2024)
di: Dong, Hao-Wen
Pubblicazione: (2024)
Documenti analoghi
-
MVAD: A Benchmark Dataset for Multimodal AI-Generated Video-Audio Detection
di: Hu, Mengxue, et al.
Pubblicazione: (2025) -
MolTextNet: A Two-Million Molecule-Text Dataset for Multimodal Molecular Learning
di: Zhu, Yihan, et al.
Pubblicazione: (2025) -
SoccerNet-Echoes: A Soccer Game Audio Commentary Dataset
di: Gautam, Sushant, et al.
Pubblicazione: (2024) -
Audio Atlas: Visualizing and Exploring Audio Datasets
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024) -
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
di: Bang, Hayeon, et al.
Pubblicazione: (2024)