Audio-Based Pedestrian Detection in the Presence of Vehicular Noise
Fuente:
arXiv
Guardado en:
| Autores principales: | Kim, Yonghyun, Han, Chaeyeon, Sarode, Akash, Posner, Noah, Guhathakurta, Subhrajit, Lerch, Alexander |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ASPED: An Audio Dataset for Detecting Pedestrians
por: Seshadri, Pavan, et al.
Publicado: (2023)
por: Seshadri, Pavan, et al.
Publicado: (2023)
Understanding Pedestrian Movement Using Urban Sensing Technologies: The Promise of Audio-based Sensors
por: Han, Chaeyeon, et al.
Publicado: (2024)
por: Han, Chaeyeon, et al.
Publicado: (2024)
Towards Robust Transcription: Exploring Noise Injection Strategies for Training Data Augmentation
por: Kim, Yonghyun, et al.
Publicado: (2024)
por: Kim, Yonghyun, et al.
Publicado: (2024)
Quantifying Spatial Audio Quality Impairment
por: Watcharasupat, Karn N., et al.
Publicado: (2023)
por: Watcharasupat, Karn N., et al.
Publicado: (2023)
Noise-Agnostic Multitask Whisper Training for Reducing False Alarm Errors in Call-for-Help Detection
por: Ryu, Myeonghoon, et al.
Publicado: (2025)
por: Ryu, Myeonghoon, et al.
Publicado: (2025)
Replay Attacks Against Audio Deepfake Detection
por: Müller, Nicolas, et al.
Publicado: (2025)
por: Müller, Nicolas, et al.
Publicado: (2025)
Region-Based Optimization in Continual Learning for Audio Deepfake Detection
por: Chen, Yujie, et al.
Publicado: (2024)
por: Chen, Yujie, et al.
Publicado: (2024)
HierCon: Hierarchical Contrastive Attention for Audio Deepfake Detection
por: Liang, Zhili Nicholas, et al.
Publicado: (2026)
por: Liang, Zhili Nicholas, et al.
Publicado: (2026)
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
por: Bjare, Mathias Rose, et al.
Publicado: (2025)
por: Bjare, Mathias Rose, et al.
Publicado: (2025)
Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?
por: Xie, Yuankun, et al.
Publicado: (2024)
por: Xie, Yuankun, et al.
Publicado: (2024)
EnCLAP: Combining Neural Audio Codec and Audio-Text Joint Embedding for Automated Audio Captioning
por: Kim, Jaeyeon, et al.
Publicado: (2024)
por: Kim, Jaeyeon, et al.
Publicado: (2024)
Deepfake Audio Detection Using Spectrogram-based Feature and Ensemble of Deep Learning Models
por: Pham, Lam, et al.
Publicado: (2024)
por: Pham, Lam, et al.
Publicado: (2024)
Retrieval-Augmented Audio Deepfake Detection
por: Kang, Zuheng, et al.
Publicado: (2024)
por: Kang, Zuheng, et al.
Publicado: (2024)
ViSAGe: Video-to-Spatial Audio Generation
por: Kim, Jaeyeon, et al.
Publicado: (2025)
por: Kim, Jaeyeon, et al.
Publicado: (2025)
Representation-Regularized Convolutional Audio Transformer for Audio Understanding
por: Han, Bing, et al.
Publicado: (2026)
por: Han, Bing, et al.
Publicado: (2026)
AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion
por: Zhao, Junqi, et al.
Publicado: (2025)
por: Zhao, Junqi, et al.
Publicado: (2025)
WoW-Bench: Evaluating Fine-Grained Acoustic Perception in Audio-Language Models via Marine Mammal Vocalizations
por: Kim, Jaeyeon, et al.
Publicado: (2025)
por: Kim, Jaeyeon, et al.
Publicado: (2025)
The Codecfake Dataset and Countermeasures for the Universally Detection of Deepfake Audio
por: Xie, Yuankun, et al.
Publicado: (2024)
por: Xie, Yuankun, et al.
Publicado: (2024)
Augmentation through Laundering Attacks for Audio Spoof Detection
por: Ali, Hashim, et al.
Publicado: (2024)
por: Ali, Hashim, et al.
Publicado: (2024)
Harder or Different? Understanding Generalization of Audio Deepfake Detection
por: Müller, Nicolas M., et al.
Publicado: (2024)
por: Müller, Nicolas M., et al.
Publicado: (2024)
Cross-Domain Audio Deepfake Detection: Dataset and Analysis
por: Li, Yuang, et al.
Publicado: (2024)
por: Li, Yuang, et al.
Publicado: (2024)
PianoVAM: A Multimodal Piano Performance Dataset
por: Kim, Yonghyun, et al.
Publicado: (2025)
por: Kim, Yonghyun, et al.
Publicado: (2025)
MAT-SED: A Masked Audio Transformer with Masked-Reconstruction Based Pre-training for Sound Event Detection
por: Cai, Pengfei, et al.
Publicado: (2024)
por: Cai, Pengfei, et al.
Publicado: (2024)
Improving Anomalous Sound Detection via Low-Rank Adaptation Fine-Tuning of Pre-Trained Audio Models
por: Zheng, Xinhu, et al.
Publicado: (2024)
por: Zheng, Xinhu, et al.
Publicado: (2024)
Fundamental Survey on Neuromorphic Based Audio Classification
por: Basu, Amlan, et al.
Publicado: (2025)
por: Basu, Amlan, et al.
Publicado: (2025)
Audio Deepfake Detection in the Age of Advanced Text-to-Speech models
por: Singh, Robin, et al.
Publicado: (2026)
por: Singh, Robin, et al.
Publicado: (2026)
Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio
por: Lu, Yi, et al.
Publicado: (2024)
por: Lu, Yi, et al.
Publicado: (2024)
Towards Attention-based Contrastive Learning for Audio Spoof Detection
por: Goel, Chirag, et al.
Publicado: (2024)
por: Goel, Chirag, et al.
Publicado: (2024)
Generalizable Audio Spoofing Detection using Non-Semantic Representations
por: Das, Arnab, et al.
Publicado: (2025)
por: Das, Arnab, et al.
Publicado: (2025)
How Do Neural Spoofing Countermeasures Detect Partially Spoofed Audio?
por: Liu, Tianchi, et al.
Publicado: (2024)
por: Liu, Tianchi, et al.
Publicado: (2024)
SLIM: Style-Linguistics Mismatch Model for Generalized Audio Deepfake Detection
por: Zhu, Yi, et al.
Publicado: (2024)
por: Zhu, Yi, et al.
Publicado: (2024)
IndieFake Dataset: A Benchmark Dataset for Audio Deepfake Detection
por: Kumar, Abhay, et al.
Publicado: (2025)
por: Kumar, Abhay, et al.
Publicado: (2025)
Audio Mamba: Pretrained Audio State Space Model For Audio Tagging
por: Lin, Jiaju, et al.
Publicado: (2024)
por: Lin, Jiaju, et al.
Publicado: (2024)
Sommelier: Scalable Open Multi-turn Audio Pre-processing for Full-duplex Speech Language Models
por: Jung, Kyudan, et al.
Publicado: (2026)
por: Jung, Kyudan, et al.
Publicado: (2026)
Audio Atlas: Visualizing and Exploring Audio Datasets
por: Lanzendörfer, Luca A., et al.
Publicado: (2024)
por: Lanzendörfer, Luca A., et al.
Publicado: (2024)
I Can Hear You: Selective Robust Training for Deepfake Audio Detection
por: Zhang, Zirui, et al.
Publicado: (2024)
por: Zhang, Zirui, et al.
Publicado: (2024)
AFSS: Artifact-Focused Self-Synthesis for Mitigating Bias in Audio Deepfake Detection
por: Nguyen-Le, Hai-Son, et al.
Publicado: (2026)
por: Nguyen-Le, Hai-Son, et al.
Publicado: (2026)
HyperPotter: Spell the Charm of High-Order Interactions in Audio Deepfake Detection
por: Wen, Qing, et al.
Publicado: (2026)
por: Wen, Qing, et al.
Publicado: (2026)
Example-Based Framework for Perceptually Guided Audio Texture Generation
por: Kamath, Purnima, et al.
Publicado: (2023)
por: Kamath, Purnima, et al.
Publicado: (2023)
Generalizable Prompt Tuning for Audio-Language Models via Semantic Expansion
por: Jang, Jaehyuk, et al.
Publicado: (2026)
por: Jang, Jaehyuk, et al.
Publicado: (2026)
Ejemplares similares
-
ASPED: An Audio Dataset for Detecting Pedestrians
por: Seshadri, Pavan, et al.
Publicado: (2023) -
Understanding Pedestrian Movement Using Urban Sensing Technologies: The Promise of Audio-based Sensors
por: Han, Chaeyeon, et al.
Publicado: (2024) -
Towards Robust Transcription: Exploring Noise Injection Strategies for Training Data Augmentation
por: Kim, Yonghyun, et al.
Publicado: (2024) -
Quantifying Spatial Audio Quality Impairment
por: Watcharasupat, Karn N., et al.
Publicado: (2023) -
Noise-Agnostic Multitask Whisper Training for Reducing False Alarm Errors in Call-for-Help Detection
por: Ryu, Myeonghoon, et al.
Publicado: (2025)