SLAM-LLM: A Modular, Open-Source Multimodal Large Language Model Framework and Best Practice for Speech, Language, Audio and Music Processing

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Ma, Ziyang, Yang, Guanrou, Chen, Wenxi, Gao, Zhifu, Du, Yexing, Li, Xiquan, Zheng, Zhisheng, Zhu, Haina, Zhuo, Jianheng, Song, Zheshu, Xu, Ruiyang, Wang, Tiranrui, Yang, Yifan, Zhu, Yanqiao, Niu, Zhikang, Xue, Liumeng, Ma, Yinghao, Yuan, Ruibin, Zhang, Shiliang, Yu, Kai, Chng, Eng Siong, Chen, Xie
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!