HumanOmni: A Large Vision-Speech Language Model for Human-Centric Video Understanding

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Zhao, Jiaxing, Yang, Qize, Peng, Yixing, Bai, Detao, Yao, Shimin, Sun, Boyuan, Chen, Xiang, Fu, Shenghao, chen, Weixuan, Wei, Xihan, Bo, Liefeng
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!