OpenOmni: Advancing Open-Source Omnimodal Large Language Models with Progressive Multimodal Alignment and Real-Time Self-Aware Emotional Speech Synthesis

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Luo, Run, Lin, Ting-En, Zhang, Haonan, Wu, Yuchuan, Liu, Xiong, Yang, Min, Li, Yongbin, Chen, Longze, Li, Jiaming, Zhang, Lei, Xia, Xiaobo, Alinejad-Rokny, Hamid, Huang, Fei
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!