Building a Taiwanese Mandarin Spoken Language Model: A First Attempt
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Chih-Kai, Fu, Yu-Kuan, Li, Chen-An, Lin, Yi-Cheng, Lin, Yu-Xiang, Chen, Wei-Chih, Chung, Ho Lam, Kuan, Chun-Yi, Huang, Wei-Ping, Lu, Ke-Han, Lin, Tzu-Quan, Wang, Hsiu-Hsuan, Hu, En-Pei, Hsu, Chan-Jan, Tseng, Liang-Hsuan, Chiu, I-Hsiang, Sanga, Ulin, Chen, Xuanjun, Hsu, Po-chun, Yang, Shu-wen, Lee, Hung-yi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Age Aware Scheduling for Differentially-Private Federated Learning
di: Lin, Kuan-Yu, et al.
Pubblicazione: (2024)
di: Lin, Kuan-Yu, et al.
Pubblicazione: (2024)
Impact of violence on work morale on Taiwanese nurses: The moderator of perceived organizational support
di: Kuan‐Yang Chen, et al.
Pubblicazione: (2025)
di: Kuan‐Yang Chen, et al.
Pubblicazione: (2025)
BreezyVoice: Adapting TTS for Taiwanese Mandarin with Enhanced Polyphone Disambiguation -- Challenges and Insights
di: Hsu, Chan-Jan, et al.
Pubblicazione: (2025)
di: Hsu, Chan-Jan, et al.
Pubblicazione: (2025)
TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
di: Tseng, Liang-Hsuan, et al.
Pubblicazione: (2025)
di: Tseng, Liang-Hsuan, et al.
Pubblicazione: (2025)
Spoken Stereoset: On Evaluating Social Bias Toward Speaker in Speech Large Language Models
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)
Weakly Supervised 3D Object Detection via Multi-Level Visual Guidance
di: Huang, Kuan-Chih, et al.
Pubblicazione: (2023)
di: Huang, Kuan-Chih, et al.
Pubblicazione: (2023)
FROAV: A Framework for RAG Observation and Agent Verification -- Lowering the Barrier to LLM Agent Research
di: Lin, Tzu-Hsuan, et al.
Pubblicazione: (2026)
di: Lin, Tzu-Hsuan, et al.
Pubblicazione: (2026)
Listen and Speak Fairly: A Study on Semantic Gender Bias in Speech Integrated Large Language Models
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)
Measuring Taiwanese Mandarin Language Understanding
di: Chen, Po-Heng, et al.
Pubblicazione: (2024)
di: Chen, Po-Heng, et al.
Pubblicazione: (2024)
Investigating the Effects of Large-Scale Pseudo-Stereo Data and Different Speech Foundation Model on Dialogue Generative Spoken Language Model
di: Fu, Yu-Kuan, et al.
Pubblicazione: (2024)
di: Fu, Yu-Kuan, et al.
Pubblicazione: (2024)
Timely Information Updating for Mobile Devices Without and With ML Advice
di: Hsu, Yu-Pin, et al.
Pubblicazione: (2025)
di: Hsu, Yu-Pin, et al.
Pubblicazione: (2025)
PTT: Point-Trajectory Transformer for Efficient Temporal 3D Object Detection
di: Huang, Kuan-Chih, et al.
Pubblicazione: (2023)
di: Huang, Kuan-Chih, et al.
Pubblicazione: (2023)
AnchorSteer: Self-Discovered Concept Injection for Structure-Preserving Music Editing
di: Chang, Chih-Heng, et al.
Pubblicazione: (2026)
di: Chang, Chih-Heng, et al.
Pubblicazione: (2026)
Zero Resource Code-switched Speech Benchmark Using Speech Utterance Pairs For Multiple Spoken Languages
di: Huang, Kuan-Po, et al.
Pubblicazione: (2023)
di: Huang, Kuan-Po, et al.
Pubblicazione: (2023)
Game-Time: Evaluating Temporal Dynamics in Spoken Language Models
di: Chang, Kai-Wei, et al.
Pubblicazione: (2025)
di: Chang, Kai-Wei, et al.
Pubblicazione: (2025)
Randomized Scheduling for Periodic Multi-Source Systems with PAoI Violation Guarantees
di: Lin, Kuan-Yu, et al.
Pubblicazione: (2025)
di: Lin, Kuan-Yu, et al.
Pubblicazione: (2025)
A Preliminary Exploration with GPT-4o Voice Mode
di: Lin, Yu-Xiang, et al.
Pubblicazione: (2025)
di: Lin, Yu-Xiang, et al.
Pubblicazione: (2025)
Ranking-aware adapter for text-driven image ordering with CLIP
di: Yu, Wei-Hsiang, et al.
Pubblicazione: (2024)
di: Yu, Wei-Hsiang, et al.
Pubblicazione: (2024)
Self‐Transforming Bioadhesive Patch with Topological and Ionic Crosslinking for Adaptive Mucoadhesion and Enhanced Wound Healing
di: Shih‐Yung Liao, et al.
Pubblicazione: (2026)
di: Shih‐Yung Liao, et al.
Pubblicazione: (2026)
Training-Efficient Text-to-Music Generation with State-Space Modeling
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2026)
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2026)
Exploring State-Space-Model based Language Model in Music Generation
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025)
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
di: Hsu, Chan-Jan, et al.
Pubblicazione: (2026)
di: Hsu, Chan-Jan, et al.
Pubblicazione: (2026)
Recent Advances in Soil Stabilization and Reinforcement: A Comprehensive Review of Emerging Technologies
di: Ching Hung, et al.
Pubblicazione: (2026)
di: Ching Hung, et al.
Pubblicazione: (2026)
Factors influencing students' listening learning performance in mobile vocabulary‐assisted listening learning: An extended technology acceptance model
di: Hui‐Tzu Hsu, et al.
Pubblicazione: (2024)
di: Hui‐Tzu Hsu, et al.
Pubblicazione: (2024)
TASTE-Streaming: Towards Streamable Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
di: Tseng, Liang-Hsuan, et al.
Pubblicazione: (2026)
di: Tseng, Liang-Hsuan, et al.
Pubblicazione: (2026)
Investigating Zero-Shot Generalizability on Mandarin-English Code-Switched ASR and Speech-to-text Translation of Recent Foundation Models with Self-Supervision and Weak Supervision
di: Yang, Chih-Kai, et al.
Pubblicazione: (2023)
di: Yang, Chih-Kai, et al.
Pubblicazione: (2023)
Conditional Semi-Supervised Data Augmentation for Spam Message Detection with Low Resource Data
di: Nuha, Ulin, et al.
Pubblicazione: (2024)
di: Nuha, Ulin, et al.
Pubblicazione: (2024)
Curriculum leadership in a rural indigenous high school in Taiwan implementing the 108 Curriculum Guidelines
di: Kuan‐Pei Lin, et al.
Pubblicazione: (2024)
di: Kuan‐Pei Lin, et al.
Pubblicazione: (2024)
Néel Tensor Torque in Polycrystalline Antiferromagnets (Adv. Mater. 9/2026)
di: Chao‐Yao Yang, et al.
Pubblicazione: (2026)
di: Chao‐Yao Yang, et al.
Pubblicazione: (2026)
Néel Tensor Torque in Polycrystalline Antiferromagnets
di: Chao‐Yao Yang, et al.
Pubblicazione: (2025)
di: Chao‐Yao Yang, et al.
Pubblicazione: (2025)
TiCo: Time-Controllable Spoken Dialogue Model
di: Chang, Kai-Wei, et al.
Pubblicazione: (2026)
di: Chang, Kai-Wei, et al.
Pubblicazione: (2026)
Higher tumor mutational burden is associated with inferior outcomes among pediatric patients with neuroblastoma
di: Ya‐Hsuan Chang, et al.
Pubblicazione: (2024)
di: Ya‐Hsuan Chang, et al.
Pubblicazione: (2024)
Precision‐Targeted Injection Laryngoplasty and Longitudinal Biomaterial Effects Evaluation Using High‐resolution Ultrasonography in a Rat Model
di: Wen‐Hsuan Tseng, et al.
Pubblicazione: (2024)
di: Wen‐Hsuan Tseng, et al.
Pubblicazione: (2024)
Do You Hear What I Mean? Quantifying the Instruction-Perception Gap in Instruction-Guided Expressive Text-To-Speech Systems
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2025)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2025)
Singer separation for karaoke content generation
di: Lin, Hsuan-Yu, et al.
Pubblicazione: (2021)
di: Lin, Hsuan-Yu, et al.
Pubblicazione: (2021)
Pharmacogenomic Calling From Whole‐Exome Sequencing in the Taiwanese Population—A Real‐World Experience
di: Hsu‐Heng Lin, et al.
Pubblicazione: (2026)
di: Hsu‐Heng Lin, et al.
Pubblicazione: (2026)
Quantum-Train with Tensor Network Mapping Model and Distributed Circuit Ansatz
di: Liu, Chen-Yu, et al.
Pubblicazione: (2024)
di: Liu, Chen-Yu, et al.
Pubblicazione: (2024)
Quantum-Train Long Short-Term Memory: Application on Flood Prediction Problem
di: Lin, Chu-Hsuan Abraham, et al.
Pubblicazione: (2024)
di: Lin, Chu-Hsuan Abraham, et al.
Pubblicazione: (2024)
TTC7B Activates the AKT–JKAMP Signaling Axis to Promote Tumor Progression in Head and Neck Cancer
di: Yu‐Hsuan Lin, et al.
Pubblicazione: (2025)
di: Yu‐Hsuan Lin, et al.
Pubblicazione: (2025)
Creativity in LLM-based Multi-Agent Systems: A Survey
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2025)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Age Aware Scheduling for Differentially-Private Federated Learning
di: Lin, Kuan-Yu, et al.
Pubblicazione: (2024) -
Impact of violence on work morale on Taiwanese nurses: The moderator of perceived organizational support
di: Kuan‐Yang Chen, et al.
Pubblicazione: (2025) -
BreezyVoice: Adapting TTS for Taiwanese Mandarin with Enhanced Polyphone Disambiguation -- Challenges and Insights
di: Hsu, Chan-Jan, et al.
Pubblicazione: (2025) -
TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
di: Tseng, Liang-Hsuan, et al.
Pubblicazione: (2025) -
Spoken Stereoset: On Evaluating Social Bias Toward Speaker in Speech Large Language Models
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)