SLAM-LLM: A Modular, Open-Source Multimodal Large Language Model Framework and Best Practice for Speech, Language, Audio and Music Processing

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Ma, Ziyang, Yang, Guanrou, Chen, Wenxi, Gao, Zhifu, Du, Yexing, Li, Xiquan, Zheng, Zhisheng, Zhu, Haina, Zhuo, Jianheng, Song, Zheshu, Xu, Ruiyang, Wang, Tiranrui, Yang, Yifan, Zhu, Yanqiao, Niu, Zhikang, Xue, Liumeng, Ma, Yinghao, Yuan, Ruibin, Zhang, Shiliang, Yu, Kai, Chng, Eng Siong, Chen, Xie
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!