PARSA-Bench: A Comprehensive Persian Audio-Language Model Benchmark
Fuente:
arXiv
Salvato in:
| Autori principali: | Kalahroodi, Mohammad Javad Ranjbar, Amini, Mohammad, Bathayan, Parmis, Faili, Heshaam, Shakery, Azadeh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PersianPunc: A Large-Scale Dataset and BERT-Based Approach for Persian Punctuation Restoration
di: Kalahroodi, Mohammad Javad Ranjbar, et al.
Pubblicazione: (2026)
di: Kalahroodi, Mohammad Javad Ranjbar, et al.
Pubblicazione: (2026)
Persian Typographical Error Type Detection Using Deep Neural Networks on Algorithmically-Generated Misspellings
di: Dehghani, Mohammad, et al.
Pubblicazione: (2023)
di: Dehghani, Mohammad, et al.
Pubblicazione: (2023)
Mismatching-Aware Unsupervised Translation Quality Estimation For Low-Resource Languages
di: Azadi, Fatemeh, et al.
Pubblicazione: (2022)
di: Azadi, Fatemeh, et al.
Pubblicazione: (2022)
PerSHOP -- A Persian dataset for shopping dialogue systems modeling
di: Mahmoudi, Keyvan, et al.
Pubblicazione: (2024)
di: Mahmoudi, Keyvan, et al.
Pubblicazione: (2024)
AudioBench: A Universal Benchmark for Audio Large Language Models
di: Wang, Bin, et al.
Pubblicazione: (2024)
di: Wang, Bin, et al.
Pubblicazione: (2024)
VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents
di: Hu, Jiliang, et al.
Pubblicazione: (2025)
di: Hu, Jiliang, et al.
Pubblicazione: (2025)
AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension
di: Yang, Qian, et al.
Pubblicazione: (2024)
di: Yang, Qian, et al.
Pubblicazione: (2024)
PSRB: A Comprehensive Benchmark for Evaluating Persian ASR Systems
di: Sedghiyeh, Nima, et al.
Pubblicazione: (2025)
di: Sedghiyeh, Nima, et al.
Pubblicazione: (2025)
Persian MusicGen: A Large-Scale Dataset and Culturally-Aware Generative Model for Persian Music
di: Sameti, Mohammad Hossein, et al.
Pubblicazione: (2026)
di: Sameti, Mohammad Hossein, et al.
Pubblicazione: (2026)
ISA-Bench: Benchmarking Instruction Sensitivity for Large Audio Language Models
di: Li, Bohan, et al.
Pubblicazione: (2025)
di: Li, Bohan, et al.
Pubblicazione: (2025)
Words at Play: Benchmarking Audio Pun Understanding in Large Audio-Language Models
di: Su, Yuchen, et al.
Pubblicazione: (2026)
di: Su, Yuchen, et al.
Pubblicazione: (2026)
SonicBench: Dissecting the Physical Perception Bottleneck in Large Audio Language Models
di: Sun, Yirong, et al.
Pubblicazione: (2026)
di: Sun, Yirong, et al.
Pubblicazione: (2026)
DeepQuestion: Systematic Generation of Real-World Challenges for Evaluating LLMs Performance
di: Khoramfar, Ali, et al.
Pubblicazione: (2025)
di: Khoramfar, Ali, et al.
Pubblicazione: (2025)
SearchInstruct: Enhancing Domain Adaptation via Retrieval-Based Instruction Dataset Creation
di: Barati, Iman, et al.
Pubblicazione: (2025)
di: Barati, Iman, et al.
Pubblicazione: (2025)
Persian Musical Instruments Classification Using Polyphonic Data Augmentation
di: Esfangereh, Diba Hadi, et al.
Pubblicazione: (2025)
di: Esfangereh, Diba Hadi, et al.
Pubblicazione: (2025)
Assessing Factual Music Comprehension in Large Audio Language Models
di: Lin, Daniel Chenyu, et al.
Pubblicazione: (2025)
di: Lin, Daniel Chenyu, et al.
Pubblicazione: (2025)
SpeechParaling-Bench: A Comprehensive Benchmark for Paralinguistic-Aware Speech Generation
di: Liu, Ruohan, et al.
Pubblicazione: (2026)
di: Liu, Ruohan, et al.
Pubblicazione: (2026)
Causal Tracing of Audio-Text Fusion in Large Audio Language Models
di: Chen, Wei-Chih, et al.
Pubblicazione: (2026)
di: Chen, Wei-Chih, et al.
Pubblicazione: (2026)
BRACE: A Benchmark for Robust Audio Caption Quality Evaluation
di: Guo, Tianyu, et al.
Pubblicazione: (2025)
di: Guo, Tianyu, et al.
Pubblicazione: (2025)
Thinking with Sound: Audio Chain-of-Thought Enables Multimodal Reasoning in Large Audio-Language Models
di: Xiong, Zhen, et al.
Pubblicazione: (2025)
di: Xiong, Zhen, et al.
Pubblicazione: (2025)
When Silence Matters: The Impact of Irrelevant Audio on Text Reasoning in Large Audio-Language Models
di: Li, Chen-An, et al.
Pubblicazione: (2025)
di: Li, Chen-An, et al.
Pubblicazione: (2025)
UALM: Unified Audio Language Model for Understanding, Generation and Reasoning
di: Tian, Jinchuan, et al.
Pubblicazione: (2025)
di: Tian, Jinchuan, et al.
Pubblicazione: (2025)
PerCul: A Story-Driven Cultural Evaluation of LLMs in Persian
di: Monazzah, Erfan Moosavi, et al.
Pubblicazione: (2025)
di: Monazzah, Erfan Moosavi, et al.
Pubblicazione: (2025)
AudioMarathon: A Comprehensive Benchmark for Long-Context Audio Understanding and Efficiency in Audio LLMs
di: He, Peize, et al.
Pubblicazione: (2025)
di: He, Peize, et al.
Pubblicazione: (2025)
BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning
di: Jang, Min, et al.
Pubblicazione: (2026)
di: Jang, Min, et al.
Pubblicazione: (2026)
HeadRouter: Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models
di: He, Peize, et al.
Pubblicazione: (2026)
di: He, Peize, et al.
Pubblicazione: (2026)
AudioTrust: Benchmarking the Multifaceted Trustworthiness of Audio Large Language Models
di: Li, Kai, et al.
Pubblicazione: (2025)
di: Li, Kai, et al.
Pubblicazione: (2025)
DIFFA-2: A Practical Diffusion Large Language Model for General Audio Understanding
di: Zhou, Jiaming, et al.
Pubblicazione: (2026)
di: Zhou, Jiaming, et al.
Pubblicazione: (2026)
Hearing the Order: Investigating Position Bias in Large Audio-Language Models
di: Lin, Yu-Xiang, et al.
Pubblicazione: (2025)
di: Lin, Yu-Xiang, et al.
Pubblicazione: (2025)
Audio-DeepThinker: Progressive Reasoning-Aware Reinforcement Learning for High-Quality Chain-of-Thought Emergence in Audio Language Models
di: He, Xiang, et al.
Pubblicazione: (2026)
di: He, Xiang, et al.
Pubblicazione: (2026)
Matina: A Large-Scale 73B Token Persian Text Corpus
di: Hosseinbeigi, Sara Bourbour, et al.
Pubblicazione: (2025)
di: Hosseinbeigi, Sara Bourbour, et al.
Pubblicazione: (2025)
Benchmarking Open-ended Audio Dialogue Understanding for Large Audio-Language Models
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
Towards Holistic Evaluation of Large Audio-Language Models: A Comprehensive Survey
di: Yang, Chih-Kai, et al.
Pubblicazione: (2025)
di: Yang, Chih-Kai, et al.
Pubblicazione: (2025)
WhisperPipe: A Resource-Efficient Streaming Architecture for Real-Time Automatic Speech Recognition
di: Ramezani, Erfan, et al.
Pubblicazione: (2026)
di: Ramezani, Erfan, et al.
Pubblicazione: (2026)
XMAD-Bench: Cross-Domain Multilingual Audio Deepfake Benchmark
di: Ciobanu, Ioan-Paul, et al.
Pubblicazione: (2025)
di: Ciobanu, Ioan-Paul, et al.
Pubblicazione: (2025)
KoALa-Bench: Evaluating Large Audio Language Models on Korean Speech Understanding and Faithfulness
di: Kim, Jinyoung, et al.
Pubblicazione: (2026)
di: Kim, Jinyoung, et al.
Pubblicazione: (2026)
MiMo-Audio: Audio Language Models are Few-Shot Learners
di: Core Team, et al.
Pubblicazione: (2025)
di: Core Team, et al.
Pubblicazione: (2025)
Not in Sync: Unveiling Temporal Bias in Audio Chat Models
di: Yao, Jiayu, et al.
Pubblicazione: (2025)
di: Yao, Jiayu, et al.
Pubblicazione: (2025)
BLAB: Brutally Long Audio Bench
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2025)
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2025)
Audio Jailbreaks in Large Audio-Language Models: Taxonomy, Attack-Defense Analysis, and Cost-Aware Evaluation
di: Feng, Bo-Han, et al.
Pubblicazione: (2026)
di: Feng, Bo-Han, et al.
Pubblicazione: (2026)
Documenti analoghi
-
PersianPunc: A Large-Scale Dataset and BERT-Based Approach for Persian Punctuation Restoration
di: Kalahroodi, Mohammad Javad Ranjbar, et al.
Pubblicazione: (2026) -
Persian Typographical Error Type Detection Using Deep Neural Networks on Algorithmically-Generated Misspellings
di: Dehghani, Mohammad, et al.
Pubblicazione: (2023) -
Mismatching-Aware Unsupervised Translation Quality Estimation For Low-Resource Languages
di: Azadi, Fatemeh, et al.
Pubblicazione: (2022) -
PerSHOP -- A Persian dataset for shopping dialogue systems modeling
di: Mahmoudi, Keyvan, et al.
Pubblicazione: (2024) -
AudioBench: A Universal Benchmark for Audio Large Language Models
di: Wang, Bin, et al.
Pubblicazione: (2024)