Skip to content
VuFind
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Advanced
  • Cite this
  • Text this
  • Email this
  • Print
  • Export Record
    • Export to RefWorks
    • Export to EndNoteWeb
    • Export to EndNote
  • Save to List
  • Permanent link
Cover Image

Saved in:
Bibliographic Details
Main Authors: Huang, Ailin, Li, Bingxin, Wang, Bruce, Wu, Boyong, Yan, Chao, Feng, Chengli, Wang, Heng, Zhou, Hongyu, Wang, Hongyuan, Li, Jingbei, Sun, Jianjian, Wang, Joanna, Chen, Mingrui, Liu, Peng, Miao, Ruihang, Jiang, Shilei, Fei, Tian, You, Wang, Chen, Xi, Yang, Xuerui, Huang, Yechang, Zhang, Yuxiang, Ge, Zheng, Gong, Zheng, Huang, Zhewei, Zhang, Zixin, Wang, Bin, Li, Bo, Ma, Buyun, Miao, Changxin, Wan, Changyi, Xu, Chen, Shi, Dapeng, Hu, Dingyuan, Liu, Enle, Huang, Guanzhe, Yan, Gulin, Hu, Hanpeng, Jia, Haonan, Gong, Jiahao, Wu, Jiaoren, Wu, Jie, Yang, Jie, Lin, Junzhe, Li, Kaixiang, Xia, Lei, Gu, Longlong, Li, Ming, Hao, Nie, Ming, Ranchen, Pang, Shaoliang, Liu, Siqi, Yuan, Song, Cao, Tiancheng, Li, Wen, He, Wenqing, Zhao, Xu, Zhang, Xuelin, Yu, Yanbo, Zhong, Yinmin, Zhou, Yu, Liang, Yuanwei, Lu, Yuanwei, Yang, Yuxiang, Yang, Zidong, Zhang, Zili, Jiao, Binxing, Shum, Heung-Yeung, Chen, Jiansheng, Li, Jing, Zhang, Xiangyu, Zhang, Xinhao, Zhu, Yibo, Jiang, Daxin, Zhou, Shuchang, Hu, Chen
Format: Preprint
Published: 2025
Subjects:
Sound
Computation and Language
Audio and Speech Processing
Online Access:https://arxiv.org/abs/2506.08967
Tags: Add Tag
No Tags, Be the first to tag this record!
  • Holdings
  • Description
  • Table of Contents
  • Comments
  • Similar Items
  • Staff View

Internet

https://arxiv.org/abs/2506.08967

Similar Items

  • Step-Audio 2 Technical Report
    by: Wu, Boyong, et al.
    Published: (2025)
  • Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction
    by: Huang, Ailin, et al.
    Published: (2025)
  • VividAnimator: An End-to-End Audio and Pose-driven Half-Body Human Animation Framework
    by: Huang, Donglin, et al.
    Published: (2025)
  • MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
    by: Gong, Yitian, et al.
    Published: (2026)
  • Toward Multimodal Industrial Fault Analysis: A Single-Speed Chain Conveyor Dataset with Audio and Vibration Signals
    by: Chen, Zhang, et al.
    Published: (2026)

Search Options

  • Search History
  • Advanced Search

Find More

  • Browse the Catalog
  • Browse Alphabetically
  • Explore Channels
  • Course Reserves
  • New Items

Need Help?

  • Search Tips
  • Ask a Librarian
  • FAQs