Evaluation of Audio Language Models for Fairness, Safety, and Security
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Aloufi, Ranya, Gupta, Srishti, Shaw, Soumya, Biggio, Battista, Schönherr, Lea |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Buffer-free Class-Incremental Learning with Out-of-Distribution Detection
par: Gupta, Srishti, et autres
Publié: (2025)
par: Gupta, Srishti, et autres
Publié: (2025)
Do LLM Decoders Listen Fairly? Benchmarking How Language Model Priors Shape Bias in Speech Recognition
par: Ginjala, Srishti, et autres
Publié: (2026)
par: Ginjala, Srishti, et autres
Publié: (2026)
AudioGuard: Toward Comprehensive Audio Safety Protection Across Diverse Threat Models
par: Kang, Mintong, et autres
Publié: (2026)
par: Kang, Mintong, et autres
Publié: (2026)
Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering
par: Glazer, Neta, et autres
Publié: (2026)
par: Glazer, Neta, et autres
Publié: (2026)
Eureka-Audio: Triggering Audio Intelligence in Compact Language Models
par: Zhang, Dan, et autres
Publié: (2026)
par: Zhang, Dan, et autres
Publié: (2026)
Gender Fairness in Audio Deepfake Detection: Performance and Disparity Analysis
par: Fursule, Aishwarya, et autres
Publié: (2026)
par: Fursule, Aishwarya, et autres
Publié: (2026)
The Sonar Moment: Benchmarking Audio-Language Models in Audio Geo-Localization
par: Zhang, Ruixing, et autres
Publié: (2026)
par: Zhang, Ruixing, et autres
Publié: (2026)
Audio-Maestro: Enhancing Large Audio-Language Models with Tool-Augmented Reasoning
par: Lee, Kuan-Yi, et autres
Publié: (2025)
par: Lee, Kuan-Yi, et autres
Publié: (2025)
HalluAudio: A Comprehensive Benchmark for Hallucination Detection in Large Audio-Language Models
par: Zhao, Feiyu, et autres
Publié: (2026)
par: Zhao, Feiyu, et autres
Publié: (2026)
AudioMotionBench: Evaluating Auditory Motion Perception in Audio LLMs
par: Sun, Zhe, et autres
Publié: (2025)
par: Sun, Zhe, et autres
Publié: (2025)
Audio Jailbreaks in Large Audio-Language Models: Taxonomy, Attack-Defense Analysis, and Cost-Aware Evaluation
par: Feng, Bo-Han, et autres
Publié: (2026)
par: Feng, Bo-Han, et autres
Publié: (2026)
PitchBench: Measuring Pitch Hearing in Audio-Language Models
par: Dujardin, Milan Liessens, et autres
Publié: (2026)
par: Dujardin, Milan Liessens, et autres
Publié: (2026)
Towards Fine-grained Temporal Perception: Post-Training Large Audio-Language Models with Audio-Side Time Prompt
par: Shi, Yanfeng, et autres
Publié: (2026)
par: Shi, Yanfeng, et autres
Publié: (2026)
AudioCapBench: Quick Evaluation on Audio Captioning across Sound, Music, and Speech
par: Qiu, Jielin, et autres
Publié: (2026)
par: Qiu, Jielin, et autres
Publié: (2026)
The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models
par: You, Yuhuan, et autres
Publié: (2026)
par: You, Yuhuan, et autres
Publié: (2026)
Do Audio-Visual Large Language Models Really See and Hear?
par: Selvakumar, Ramaneswaran, et autres
Publié: (2026)
par: Selvakumar, Ramaneswaran, et autres
Publié: (2026)
OWL: Geometry-Aware Spatial Reasoning for Audio Large Language Models
par: Biswas, Subrata, et autres
Publié: (2025)
par: Biswas, Subrata, et autres
Publié: (2025)
Who Can Withstand Chat-Audio Attacks? An Evaluation Benchmark for Large Audio-Language Models
par: Yang, Wanqi, et autres
Publié: (2024)
par: Yang, Wanqi, et autres
Publié: (2024)
CALM: Class-Conditional Sparse Attention Vectors for Large Audio-Language Models
par: Mehta, Videet, et autres
Publié: (2026)
par: Mehta, Videet, et autres
Publié: (2026)
Language Models as Semantic Teachers: Post-Training Alignment for Medical Audio Understanding
par: Wang, Tsai-Ning, et autres
Publié: (2025)
par: Wang, Tsai-Ning, et autres
Publié: (2025)
Temporal Contrastive Decoding: A Training-Free Method for Large Audio-Language Models
par: Li, Yanda, et autres
Publié: (2026)
par: Li, Yanda, et autres
Publié: (2026)
AudioSAE: Towards Understanding of Audio-Processing Models with Sparse AutoEncoders
par: Aparin, Georgii, et autres
Publié: (2026)
par: Aparin, Georgii, et autres
Publié: (2026)
VocalParse: Towards Unified and Scalable Singing Voice Transcription with Large Audio Language Models
par: Chen, Yukun, et autres
Publié: (2026)
par: Chen, Yukun, et autres
Publié: (2026)
EMO-TTA: Improving Test-Time Adaptation of Audio-Language Models for Speech Emotion Recognition
par: Shi, Jiacheng, et autres
Publié: (2025)
par: Shi, Jiacheng, et autres
Publié: (2025)
AT-ADD: All-Type Audio Deepfake Detection Challenge Evaluation Plan
par: Xie, Yuankun, et autres
Publié: (2026)
par: Xie, Yuankun, et autres
Publié: (2026)
ClaritySpeech: Dementia Obfuscation in Speech
par: Woszczyk, Dominika, et autres
Publié: (2025)
par: Woszczyk, Dominika, et autres
Publié: (2025)
Prosody-Driven Privacy-Preserving Dementia Detection
par: Woszczyk, Dominika, et autres
Publié: (2024)
par: Woszczyk, Dominika, et autres
Publié: (2024)
DEAF: A Benchmark for Diagnostic Evaluation of Acoustic Faithfulness in Audio Language Models
par: Xiong, Jiaqi, et autres
Publié: (2026)
par: Xiong, Jiaqi, et autres
Publié: (2026)
Evaluating Semantic Fragility in Text-to-Audio Generation Systems Under Controlled Prompt Perturbations
par: Wu, Jiahui
Publié: (2026)
par: Wu, Jiahui
Publié: (2026)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
par: Wang, Lu, et autres
Publié: (2025)
par: Wang, Lu, et autres
Publié: (2025)
AudioMoG: Guiding Audio Generation with Mixture-of-Guidance
par: Wang, Junyou, et autres
Publié: (2025)
par: Wang, Junyou, et autres
Publié: (2025)
Robust Neural Audio Fingerprinting using Music Foundation Models
par: Singh, Shubhr, et autres
Publié: (2025)
par: Singh, Shubhr, et autres
Publié: (2025)
Rebellion: Noise-Robust Reasoning Training for Audio Reasoning Models
par: Huang, Tiansheng, et autres
Publié: (2025)
par: Huang, Tiansheng, et autres
Publié: (2025)
Exploring How Audio Effects Alter Emotion with Foundation Models
par: Katsis, Stelios, et autres
Publié: (2025)
par: Katsis, Stelios, et autres
Publié: (2025)
UltraEval-Audio: A Unified Framework for Comprehensive Evaluation of Audio Foundation Models
par: Shi, Qundong, et autres
Publié: (2026)
par: Shi, Qundong, et autres
Publié: (2026)
MeanAudio: Fast and Faithful Text-to-Audio Generation with Mean Flows
par: Li, Xiquan, et autres
Publié: (2025)
par: Li, Xiquan, et autres
Publié: (2025)
Audio Jailbreak: An Open Comprehensive Benchmark for Jailbreaking Large Audio-Language Models
par: Song, Zirui, et autres
Publié: (2025)
par: Song, Zirui, et autres
Publié: (2025)
Investigating Safety Vulnerabilities of Large Audio-Language Models Under Speaker Emotional Variations
par: Feng, Bo-Han, et autres
Publié: (2025)
par: Feng, Bo-Han, et autres
Publié: (2025)
Evaluation of Deep Audio Representations for Hearables
par: Gröger, Fabian, et autres
Publié: (2025)
par: Gröger, Fabian, et autres
Publié: (2025)
Stable Audio 3
par: Evans, Zach, et autres
Publié: (2026)
par: Evans, Zach, et autres
Publié: (2026)
Documents similaires
-
Buffer-free Class-Incremental Learning with Out-of-Distribution Detection
par: Gupta, Srishti, et autres
Publié: (2025) -
Do LLM Decoders Listen Fairly? Benchmarking How Language Model Priors Shape Bias in Speech Recognition
par: Ginjala, Srishti, et autres
Publié: (2026) -
AudioGuard: Toward Comprehensive Audio Safety Protection Across Diverse Threat Models
par: Kang, Mintong, et autres
Publié: (2026) -
Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering
par: Glazer, Neta, et autres
Publié: (2026) -
Eureka-Audio: Triggering Audio Intelligence in Compact Language Models
par: Zhang, Dan, et autres
Publié: (2026)