HARP: A Large-Scale Higher-Order Ambisonic Room Impulse Response Dataset
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Saini, Shivam, Peissig, Jürgen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Compression of Higher Order Ambisonics with Multichannel RVQGAN
par: Hirvonen, Toni, et autres
Publié: (2024)
par: Hirvonen, Toni, et autres
Publié: (2024)
PDMX: A Large-Scale Public Domain MusicXML Dataset for Symbolic Music Processing
par: Long, Phillip, et autres
Publié: (2024)
par: Long, Phillip, et autres
Publié: (2024)
HiFi-HARP: A High-Fidelity 7th-Order Ambisonic Room Impulse Response Dataset
par: Saini, Shivam, et autres
Publié: (2025)
par: Saini, Shivam, et autres
Publié: (2025)
Jailbreak-AudioBench: In-Depth Evaluation and Analysis of Jailbreak Threats for Large Audio Language Models
par: Cheng, Hao, et autres
Publié: (2025)
par: Cheng, Hao, et autres
Publié: (2025)
Exploring Adapter Design Tradeoffs for Low Resource Music Generation
par: Mehta, Atharva, et autres
Publié: (2025)
par: Mehta, Atharva, et autres
Publié: (2025)
Robust Multi-Modal Speech In-Painting: A Sequence-to-Sequence Approach
par: Elyaderani, Mahsa Kadkhodaei, et autres
Publié: (2024)
par: Elyaderani, Mahsa Kadkhodaei, et autres
Publié: (2024)
AudioRole: An Audio Dataset for Character Role-Playing in Large Language Models
par: Li, Wenyu, et autres
Publié: (2025)
par: Li, Wenyu, et autres
Publié: (2025)
Music Enhancement with Deep Filters: A Technical Report for The ICASSP 2024 Cadenza Challenge
par: Shao, Keren, et autres
Publié: (2024)
par: Shao, Keren, et autres
Publié: (2024)
SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning
par: Nam, KiHyun, et autres
Publié: (2026)
par: Nam, KiHyun, et autres
Publié: (2026)
Sequence-to-Sequence Multi-Modal Speech In-Painting
par: Elyaderani, Mahsa Kadkhodaei, et autres
Publié: (2024)
par: Elyaderani, Mahsa Kadkhodaei, et autres
Publié: (2024)
Carnatic Raga Identification System using Rigorous Time-Delay Neural Network
par: Natesan, Sanjay, et autres
Publié: (2024)
par: Natesan, Sanjay, et autres
Publié: (2024)
MR-MT3: Memory Retaining Multi-Track Music Transcription to Mitigate Instrument Leakage
par: Tan, Hao Hao, et autres
Publié: (2024)
par: Tan, Hao Hao, et autres
Publié: (2024)
Instruct-MusicGen: Unlocking Text-to-Music Editing for Music Language Models via Instruction Tuning
par: Zhang, Yixiao, et autres
Publié: (2024)
par: Zhang, Yixiao, et autres
Publié: (2024)
Understanding Pedestrian Movement Using Urban Sensing Technologies: The Promise of Audio-based Sensors
par: Han, Chaeyeon, et autres
Publié: (2024)
par: Han, Chaeyeon, et autres
Publié: (2024)
DOA-Aware Audio-Visual Self-Supervised Learning for Sound Event Localization and Detection
par: Fujita, Yoto, et autres
Publié: (2024)
par: Fujita, Yoto, et autres
Publié: (2024)
Efficient Fine-Grained Guidance for Diffusion Model Based Symbolic Music Generation
par: Zhu, Tingyu, et autres
Publié: (2024)
par: Zhu, Tingyu, et autres
Publié: (2024)
Generative AI for Music and Audio
par: Dong, Hao-Wen
Publié: (2024)
par: Dong, Hao-Wen
Publié: (2024)
LM2D: Lyrics- and Music-Driven Dance Synthesis
par: Yin, Wenjie, et autres
Publié: (2024)
par: Yin, Wenjie, et autres
Publié: (2024)
Challenge on Sound Scene Synthesis: Evaluating Text-to-Audio Generation
par: Lee, Junwon, et autres
Publié: (2024)
par: Lee, Junwon, et autres
Publié: (2024)
Automatic Music Transcription using Convolutional Neural Networks and Constant-Q transform
par: Telila, Yohannis, et autres
Publié: (2025)
par: Telila, Yohannis, et autres
Publié: (2025)
Audio Transformers
par: Verma, Prateek, et autres
Publié: (2021)
par: Verma, Prateek, et autres
Publié: (2021)
Content Adaptive Front End For Audio Classification
par: Verma, Prateek, et autres
Publié: (2023)
par: Verma, Prateek, et autres
Publié: (2023)
From Discord to Harmony: Decomposed Consonance-based Training for Improved Audio Chord Estimation
par: Poltronieri, Andrea, et autres
Publié: (2025)
par: Poltronieri, Andrea, et autres
Publié: (2025)
LauraGPT: Listen, Attend, Understand, and Regenerate Audio with GPT
par: Du, Zhihao, et autres
Publié: (2023)
par: Du, Zhihao, et autres
Publié: (2023)
Diverse Audio Embeddings -- Bringing Features Back Outperforms CLAP!
par: Verma, Prateek
Publié: (2023)
par: Verma, Prateek
Publié: (2023)
Fast Text-to-Audio Generation with Adversarial Post-Training
par: Novack, Zachary, et autres
Publié: (2025)
par: Novack, Zachary, et autres
Publié: (2025)
MusRec: Zero-Shot Text-to-Music Editing via Rectified Flow and Diffusion Transformers
par: Boudaghi, Ali, et autres
Publié: (2025)
par: Boudaghi, Ali, et autres
Publié: (2025)
kNN-SVC: Robust Zero-Shot Singing Voice Conversion with Additive Synthesis and Concatenation Smoothness Optimization
par: Shao, Keren, et autres
Publié: (2025)
par: Shao, Keren, et autres
Publié: (2025)
Do Audio-Visual Segmentation Models Truly Segment Sounding Objects?
par: Li, Jia, et autres
Publié: (2025)
par: Li, Jia, et autres
Publié: (2025)
The Name-Free Gap: Policy-Aware Stylistic Control in Music Generation
par: Nagarajan, Ashwin, et autres
Publié: (2025)
par: Nagarajan, Ashwin, et autres
Publié: (2025)
JEN-1: Text-Guided Universal Music Generation with Omnidirectional Diffusion Models
par: Li, Peike, et autres
Publié: (2023)
par: Li, Peike, et autres
Publié: (2023)
Purification Before Fusion: Toward Mask-Free Speech Enhancement for Robust Audio-Visual Speech Recognition
par: Wu, Linzhi, et autres
Publié: (2026)
par: Wu, Linzhi, et autres
Publié: (2026)
On the de-duplication of the Lakh MIDI dataset
par: Choi, Eunjin, et autres
Publié: (2025)
par: Choi, Eunjin, et autres
Publié: (2025)
WavReward: Spoken Dialogue Models With Generalist Reward Evaluators
par: Ji, Shengpeng, et autres
Publié: (2025)
par: Ji, Shengpeng, et autres
Publié: (2025)
CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction
par: Ma, Yinghao, et autres
Publié: (2026)
par: Ma, Yinghao, et autres
Publié: (2026)
Segment-Factorized Full-Song Generation on Symbolic Piano Music
par: Chen, Ping-Yi, et autres
Publié: (2025)
par: Chen, Ping-Yi, et autres
Publié: (2025)
EchoMark: Perceptual Acoustic Environment Transfer with Watermark-Embedded Room Impulse Response
par: Huang, Chenpei, et autres
Publié: (2025)
par: Huang, Chenpei, et autres
Publié: (2025)
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
par: Bang, Hayeon, et autres
Publié: (2024)
par: Bang, Hayeon, et autres
Publié: (2024)
Robust Audio Anti-Spoofing with Fusion-Reconstruction Learning on Multi-Order Spectrograms
par: Wen, Penghui, et autres
Publié: (2023)
par: Wen, Penghui, et autres
Publié: (2023)
CHORDONOMICON: A Dataset of 666,000 Songs and their Chord Progressions
par: Kantarelis, Spyridon, et autres
Publié: (2024)
par: Kantarelis, Spyridon, et autres
Publié: (2024)
Documents similaires
-
Compression of Higher Order Ambisonics with Multichannel RVQGAN
par: Hirvonen, Toni, et autres
Publié: (2024) -
PDMX: A Large-Scale Public Domain MusicXML Dataset for Symbolic Music Processing
par: Long, Phillip, et autres
Publié: (2024) -
HiFi-HARP: A High-Fidelity 7th-Order Ambisonic Room Impulse Response Dataset
par: Saini, Shivam, et autres
Publié: (2025) -
Jailbreak-AudioBench: In-Depth Evaluation and Analysis of Jailbreak Threats for Large Audio Language Models
par: Cheng, Hao, et autres
Publié: (2025) -
Exploring Adapter Design Tradeoffs for Low Resource Music Generation
par: Mehta, Atharva, et autres
Publié: (2025)