Skip to content
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Advanced
  • DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment
Cover Image

DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Lu, Ke-Han, Chen, Zhehuai, Fu, Szu-Wei, Yang, Chao-Han Huck, Huang, Sung-Feng, Yang, Chih-Kai, Yu, Chee-En, Chen, Chun-Wei, Chen, Wei-Chih, Huang, Chien-yu, Lin, Yi-Cheng, Lin, Yu-Xiang, Fu, Chi-An, Kuan, Chun-Yi, Ren, Wenze, Chen, Xuanjun, Huang, Wei-Ping, Hu, En-Pei, Lin, Tzu-Quan, Wu, Yuan-Kuei, Huang, Kuan-Po, Huang, Hsiao-Ying, Chou, Huang-Cheng, Chang, Kai-Wei, Chiang, Cheng-Han, Ginsburg, Boris, Wang, Yu-Chiang Frank, Lee, Hung-yi
Format: Preprint
Published: 2025
Subjects:
Audio and Speech Processing
Computation and Language
Sound
Online Access:
Acceder al recurso
Tags: Add Tag
No Tags, Be the first to tag this record!
  • Cite this
  • Text this
  • Email this
  • Print
  • Export Record
    • Export to RefWorks
    • Export to EndNoteWeb
    • Export to EndNote
  • Save to List
  • Permanent link
  • Holdings
  • Description
  • Comments
  • Similar Items
  • Staff View

Internet

https://arxiv.org/abs/2507.02768

Similar Items

  • DeSTA: Enhancing Speech Language Models through Descriptive Speech-Text Alignment
    by: Lu, Ke-Han, et al.
    Published: (2024)
  • DeSTA2: Developing Instruction-Following Speech Language Model Without Speech Instruction-Tuning Data
    by: Lu, Ke-Han, et al.
    Published: (2024)
  • How Auditory Knowledge in LLM Backbones Shapes Audio Language Models: A Holistic Evaluation
    by: Lu, Ke-Han, et al.
    Published: (2026)
  • Large Language Model as an Assignment Evaluator: Insights, Feedback, and Challenges in a 1000+ Student Course
    by: Chiang, Cheng-Han, et al.
    Published: (2024)
  • AQAScore: Evaluating Semantic Alignment in Text-to-Audio Generation via Audio Question Answering
    by: Kuan, Chun-Yi, et al.
    Published: (2026)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar