Pardon? Evaluating Conversational Repair in Large Audio-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Shuanghong, Xu, Jinlei, Zhou, Youchao, Zhou, Yanghao, Zhao, Xuan, Feng, Chong, Zhang, Wenxuan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SI-Bench: Benchmarking Social Intelligence of Large Language Models in Human-to-Human Conversations
par: Huang, Shuai, et autres
Publié: (2025)
par: Huang, Shuai, et autres
Publié: (2025)
Evaluating Robustness of Large Audio Language Models to Audio Injection: An Empirical Study
par: Hou, Guanyu, et autres
Publié: (2025)
par: Hou, Guanyu, et autres
Publié: (2025)
VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents
par: Hu, Jiliang, et autres
Publié: (2025)
par: Hu, Jiliang, et autres
Publié: (2025)
SeaLLMs-Audio: Large Audio-Language Models for Southeast Asia
par: Liu, Chaoqun, et autres
Publié: (2025)
par: Liu, Chaoqun, et autres
Publié: (2025)
Language of Thought Shapes Output Diversity in Large Language Models
par: Xu, Shaoyang, et autres
Publié: (2026)
par: Xu, Shaoyang, et autres
Publié: (2026)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
par: Ying, Jiahao, et autres
Publié: (2025)
par: Ying, Jiahao, et autres
Publié: (2025)
AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models
par: Shu, Dong, et autres
Publié: (2024)
par: Shu, Dong, et autres
Publié: (2024)
Mitigating the Bias of Large Language Model Evaluation
par: Zhou, Hongli, et autres
Publié: (2024)
par: Zhou, Hongli, et autres
Publié: (2024)
Safety Alignment of Large Language Models via Contrasting Safe and Harmful Distributions
par: Zhang, Xiaoyun, et autres
Publié: (2024)
par: Zhang, Xiaoyun, et autres
Publié: (2024)
Testing and Evaluation of Large Language Models: Correctness, Non-Toxicity, and Fairness
par: Wang, Wenxuan
Publié: (2024)
par: Wang, Wenxuan
Publié: (2024)
Do Retrieval Augmented Language Models Know When They Don't Know?
par: Zhou, Youchao, et autres
Publié: (2025)
par: Zhou, Youchao, et autres
Publié: (2025)
UniversalNER: Targeted Distillation from Large Language Models for Open Named Entity Recognition
par: Zhou, Wenxuan, et autres
Publié: (2023)
par: Zhou, Wenxuan, et autres
Publié: (2023)
ESC-Eval: Evaluating Emotion Support Conversations in Large Language Models
par: Zhao, Haiquan, et autres
Publié: (2024)
par: Zhao, Haiquan, et autres
Publié: (2024)
Evaluating and Enhancing Large Language Models for Conversational Reasoning on Knowledge Graphs
par: Huang, Yuxuan
Publié: (2023)
par: Huang, Yuxuan
Publié: (2023)
MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation
par: Xue, Haochen, et autres
Publié: (2025)
par: Xue, Haochen, et autres
Publié: (2025)
AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension
par: Yang, Qian, et autres
Publié: (2024)
par: Yang, Qian, et autres
Publié: (2024)
Character as a Latent Variable in Large Language Models: A Mechanistic Account of Emergent Misalignment and Conditional Safety Failures
par: Su, Yanghao, et autres
Publié: (2026)
par: Su, Yanghao, et autres
Publié: (2026)
Audio Jailbreaks in Large Audio-Language Models: Taxonomy, Attack-Defense Analysis, and Cost-Aware Evaluation
par: Feng, Bo-Han, et autres
Publié: (2026)
par: Feng, Bo-Han, et autres
Publié: (2026)
SafetyBench: Evaluating the Safety of Large Language Models
par: Zhang, Zhexin, et autres
Publié: (2023)
par: Zhang, Zhexin, et autres
Publié: (2023)
Equipping Retrieval-Augmented Large Language Models with Document Structure Awareness
par: Xu, Lingnan, et autres
Publié: (2025)
par: Xu, Lingnan, et autres
Publié: (2025)
Subtopic-aware View Sampling and Temporal Aggregation for Long-form Document Matching
par: Zhou, Youchao, et autres
Publié: (2024)
par: Zhou, Youchao, et autres
Publié: (2024)
Design, Results and Industry Implications of the World's First Insurance Large Language Model Evaluation Benchmark
par: Zhou, Hua, et autres
Publié: (2025)
par: Zhou, Hua, et autres
Publié: (2025)
Offset Unlearning for Large Language Models
par: Huang, James Y., et autres
Publié: (2024)
par: Huang, James Y., et autres
Publié: (2024)
Affect Recognition in Conversations Using Large Language Models
par: Feng, Shutong, et autres
Publié: (2023)
par: Feng, Shutong, et autres
Publié: (2023)
Calibrating the Confidence of Large Language Models by Eliciting Fidelity
par: Zhang, Mozhi, et autres
Publié: (2024)
par: Zhang, Mozhi, et autres
Publié: (2024)
Words at Play: Benchmarking Audio Pun Understanding in Large Audio-Language Models
par: Su, Yuchen, et autres
Publié: (2026)
par: Su, Yuchen, et autres
Publié: (2026)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
par: Wang, Xiaolei, et autres
Publié: (2023)
par: Wang, Xiaolei, et autres
Publié: (2023)
Causal Tracing of Audio-Text Fusion in Large Audio Language Models
par: Chen, Wei-Chih, et autres
Publié: (2026)
par: Chen, Wei-Chih, et autres
Publié: (2026)
mDPO: Conditional Preference Optimization for Multimodal Large Language Models
par: Wang, Fei, et autres
Publié: (2024)
par: Wang, Fei, et autres
Publié: (2024)
ICLEval: Evaluating In-Context Learning Ability of Large Language Models
par: Chen, Wentong, et autres
Publié: (2024)
par: Chen, Wentong, et autres
Publié: (2024)
Self-Debias: Self-correcting for Debiasing Large Language Models
par: Feng, Xuan, et autres
Publié: (2026)
par: Feng, Xuan, et autres
Publié: (2026)
Pruning General Large Language Models into Customized Expert Models
par: Zhao, Yirao, et autres
Publié: (2025)
par: Zhao, Yirao, et autres
Publié: (2025)
Evaluating Large Language Models for Radiology Natural Language Processing
par: Liu, Zhengliang, et autres
Publié: (2023)
par: Liu, Zhengliang, et autres
Publié: (2023)
DIFFA-2: A Practical Diffusion Large Language Model for General Audio Understanding
par: Zhou, Jiaming, et autres
Publié: (2026)
par: Zhou, Jiaming, et autres
Publié: (2026)
The Rise of Parameter Specialization for Knowledge Storage in Large Language Models
par: Hong, Yihuai, et autres
Publié: (2025)
par: Hong, Yihuai, et autres
Publié: (2025)
Boosting Large Language Models with Socratic Method for Conversational Mathematics Teaching
par: Ding, Yuyang, et autres
Publié: (2024)
par: Ding, Yuyang, et autres
Publié: (2024)
Multilingual Jailbreak Challenges in Large Language Models
par: Deng, Yue, et autres
Publié: (2023)
par: Deng, Yue, et autres
Publié: (2023)
How do Large Language Models Handle Multilingualism?
par: Zhao, Yiran, et autres
Publié: (2024)
par: Zhao, Yiran, et autres
Publié: (2024)
Evaluating Proactive Risk Awareness of Large Language Models
par: Luo, Xuan, et autres
Publié: (2026)
par: Luo, Xuan, et autres
Publié: (2026)
Accounting Reasoning in Large Language Models: Concepts, Evaluation, and Empirical Analysis
par: Zhou, Jie, et autres
Publié: (2025)
par: Zhou, Jie, et autres
Publié: (2025)
Documents similaires
-
SI-Bench: Benchmarking Social Intelligence of Large Language Models in Human-to-Human Conversations
par: Huang, Shuai, et autres
Publié: (2025) -
Evaluating Robustness of Large Audio Language Models to Audio Injection: An Empirical Study
par: Hou, Guanyu, et autres
Publié: (2025) -
VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents
par: Hu, Jiliang, et autres
Publié: (2025) -
SeaLLMs-Audio: Large Audio-Language Models for Southeast Asia
par: Liu, Chaoqun, et autres
Publié: (2025) -
Language of Thought Shapes Output Diversity in Large Language Models
par: Xu, Shaoyang, et autres
Publié: (2026)