Audio-Based Pedestrian Detection in the Presence of Vehicular Noise
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Yonghyun, Han, Chaeyeon, Sarode, Akash, Posner, Noah, Guhathakurta, Subhrajit, Lerch, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ASPED: An Audio Dataset for Detecting Pedestrians
par: Seshadri, Pavan, et autres
Publié: (2023)
par: Seshadri, Pavan, et autres
Publié: (2023)
Understanding Pedestrian Movement Using Urban Sensing Technologies: The Promise of Audio-based Sensors
par: Han, Chaeyeon, et autres
Publié: (2024)
par: Han, Chaeyeon, et autres
Publié: (2024)
Towards Robust Transcription: Exploring Noise Injection Strategies for Training Data Augmentation
par: Kim, Yonghyun, et autres
Publié: (2024)
par: Kim, Yonghyun, et autres
Publié: (2024)
Quantifying Spatial Audio Quality Impairment
par: Watcharasupat, Karn N., et autres
Publié: (2023)
par: Watcharasupat, Karn N., et autres
Publié: (2023)
Noise-Agnostic Multitask Whisper Training for Reducing False Alarm Errors in Call-for-Help Detection
par: Ryu, Myeonghoon, et autres
Publié: (2025)
par: Ryu, Myeonghoon, et autres
Publié: (2025)
Replay Attacks Against Audio Deepfake Detection
par: Müller, Nicolas, et autres
Publié: (2025)
par: Müller, Nicolas, et autres
Publié: (2025)
Region-Based Optimization in Continual Learning for Audio Deepfake Detection
par: Chen, Yujie, et autres
Publié: (2024)
par: Chen, Yujie, et autres
Publié: (2024)
HierCon: Hierarchical Contrastive Attention for Audio Deepfake Detection
par: Liang, Zhili Nicholas, et autres
Publié: (2026)
par: Liang, Zhili Nicholas, et autres
Publié: (2026)
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
par: Bjare, Mathias Rose, et autres
Publié: (2025)
par: Bjare, Mathias Rose, et autres
Publié: (2025)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
par: Xie, Yuankun, et autres
Publié: (2024)
par: Xie, Yuankun, et autres
Publié: (2024)
EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning
par: Kim, Jaeyeon, et autres
Publié: (2024)
par: Kim, Jaeyeon, et autres
Publié: (2024)
Deepfake Audio Detection Using Spectrogram-based Feature and Ensemble of Deep Learning Models
par: Pham, Lam, et autres
Publié: (2024)
par: Pham, Lam, et autres
Publié: (2024)
Retrieval-Augmented Audio Deepfake Detection
par: Kang, Zuheng, et autres
Publié: (2024)
par: Kang, Zuheng, et autres
Publié: (2024)
ViSAGe: Video-to-Spatial Audio Generation
par: Kim, Jaeyeon, et autres
Publié: (2025)
par: Kim, Jaeyeon, et autres
Publié: (2025)
Representation-Regularized Convolutional Audio Transformer for Audio Understanding
par: Han, Bing, et autres
Publié: (2026)
par: Han, Bing, et autres
Publié: (2026)
AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion
par: Zhao, Junqi, et autres
Publié: (2025)
par: Zhao, Junqi, et autres
Publié: (2025)
WoW-Bench: Evaluating Fine-Grained Acoustic Perception in Audio-Language Models via Marine Mammal Vocalizations
par: Kim, Jaeyeon, et autres
Publié: (2025)
par: Kim, Jaeyeon, et autres
Publié: (2025)
The Codecfake Dataset and Countermeasures for the Universally Detection of Deepfake Audio
par: Xie, Yuankun, et autres
Publié: (2024)
par: Xie, Yuankun, et autres
Publié: (2024)
Augmentation through Laundering Attacks for Audio Spoof Detection
par: Ali, Hashim, et autres
Publié: (2024)
par: Ali, Hashim, et autres
Publié: (2024)
Harder or Different? Understanding Generalization of Audio Deepfake Detection
par: Müller, Nicolas M., et autres
Publié: (2024)
par: Müller, Nicolas M., et autres
Publié: (2024)
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
par: Li, Yuang, et autres
Publié: (2024)
par: Li, Yuang, et autres
Publié: (2024)
PianoVAM: A Multimodal Piano Performance Dataset
par: Kim, Yonghyun, et autres
Publié: (2025)
par: Kim, Yonghyun, et autres
Publié: (2025)
MAT-SED: A Masked Audio Transformer with Masked-Reconstruction Based Pre-training for Sound Event Detection
par: Cai, Pengfei, et autres
Publié: (2024)
par: Cai, Pengfei, et autres
Publié: (2024)
Improving Anomalous Sound Detection via Low-Rank Adaptation Fine-Tuning of Pre-Trained Audio Models
par: Zheng, Xinhu, et autres
Publié: (2024)
par: Zheng, Xinhu, et autres
Publié: (2024)
Fundamental Survey on Neuromorphic Based Audio Classification
par: Basu, Amlan, et autres
Publié: (2025)
par: Basu, Amlan, et autres
Publié: (2025)
Audio Deepfake Detection in the Age of Advanced Text-to-Speech models
par: Singh, Robin, et autres
Publié: (2026)
par: Singh, Robin, et autres
Publié: (2026)
Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio
par: Lu, Yi, et autres
Publié: (2024)
par: Lu, Yi, et autres
Publié: (2024)
Towards Attention-based Contrastive Learning for Audio Spoof Detection
par: Goel, Chirag, et autres
Publié: (2024)
par: Goel, Chirag, et autres
Publié: (2024)
Generalizable Audio Spoofing Detection using Non-Semantic Representations
par: Das, Arnab, et autres
Publié: (2025)
par: Das, Arnab, et autres
Publié: (2025)
How Do Neural Spoofing Countermeasures Detect Partially Spoofed Audio?
par: Liu, Tianchi, et autres
Publié: (2024)
par: Liu, Tianchi, et autres
Publié: (2024)
SLIM: Style-Linguistics Mismatch Model for Generalized Audio Deepfake Detection
par: Zhu, Yi, et autres
Publié: (2024)
par: Zhu, Yi, et autres
Publié: (2024)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
par: Kumar, Abhay, et autres
Publié: (2025)
par: Kumar, Abhay, et autres
Publié: (2025)
Audio Mamba: Pretrained Audio State Space Model For Audio Tagging
par: Lin, Jiaju, et autres
Publié: (2024)
par: Lin, Jiaju, et autres
Publié: (2024)
Sommelier: Scalable Open Multi-turn Audio Pre-processing for Full-duplex Speech Language Models
par: Jung, Kyudan, et autres
Publié: (2026)
par: Jung, Kyudan, et autres
Publié: (2026)
Audio Atlas: Visualizing and Exploring Audio Datasets
par: Lanzendörfer, Luca A., et autres
Publié: (2024)
par: Lanzendörfer, Luca A., et autres
Publié: (2024)
I Can Hear You: Selective Robust Training for Deepfake Audio Detection
par: Zhang, Zirui, et autres
Publié: (2024)
par: Zhang, Zirui, et autres
Publié: (2024)
AFSS: Artifact-Focused Self-Synthesis for Mitigating Bias in Audio Deepfake Detection
par: Nguyen-Le, Hai-Son, et autres
Publié: (2026)
par: Nguyen-Le, Hai-Son, et autres
Publié: (2026)
HyperPotter: Spell the Charm of High-Order Interactions in Audio Deepfake Detection
par: Wen, Qing, et autres
Publié: (2026)
par: Wen, Qing, et autres
Publié: (2026)
Example-Based Framework for Perceptually Guided Audio Texture Generation
par: Kamath, Purnima, et autres
Publié: (2023)
par: Kamath, Purnima, et autres
Publié: (2023)
Generalizable Prompt Tuning for Audio-Language Models via Semantic Expansion
par: Jang, Jaehyuk, et autres
Publié: (2026)
par: Jang, Jaehyuk, et autres
Publié: (2026)
Documents similaires
-
ASPED: An Audio Dataset for Detecting Pedestrians
par: Seshadri, Pavan, et autres
Publié: (2023) -
Understanding Pedestrian Movement Using Urban Sensing Technologies: The Promise of Audio-based Sensors
par: Han, Chaeyeon, et autres
Publié: (2024) -
Towards Robust Transcription: Exploring Noise Injection Strategies for Training Data Augmentation
par: Kim, Yonghyun, et autres
Publié: (2024) -
Quantifying Spatial Audio Quality Impairment
par: Watcharasupat, Karn N., et autres
Publié: (2023) -
Noise-Agnostic Multitask Whisper Training for Reducing False Alarm Errors in Call-for-Help Detection
par: Ryu, Myeonghoon, et autres
Publié: (2025)