Punctuation Restoration for Singaporean Spoken Languages: English, Malay, and Mandarin
Fuente:
arXiv
Salvato in:
| Autori principali: | Rao, Abhinav, Thi-Nga, Ho, Eng-Siong, Chng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
Proactive for Uncertainty: Cause-Aware Error Diagnosis and Interactive Clarification for Spoken Dialogue Systems
di: Peng, Yizhou, et al.
Pubblicazione: (2026)
di: Peng, Yizhou, et al.
Pubblicazione: (2026)
Zero-shot Context Biasing with Trie-based Decoding using Synthetic Multi-Pronunciation
di: Liu, Changsong, et al.
Pubblicazione: (2025)
di: Liu, Changsong, et al.
Pubblicazione: (2025)
Impact of Frame Rates on Speech Tokenizer: A Case Study on Mandarin and English
di: Zhang, Haoyang, et al.
Pubblicazione: (2025)
di: Zhang, Haoyang, et al.
Pubblicazione: (2025)
Chronological Thinking in Full-Duplex Spoken Dialogue Language Models
di: Wu, Donghang, et al.
Pubblicazione: (2025)
di: Wu, Donghang, et al.
Pubblicazione: (2025)
Mind-Paced Speaking: A Dual-Brain Approach to Real-Time Reasoning in Spoken Language Models
di: Wu, Donghang, et al.
Pubblicazione: (2025)
di: Wu, Donghang, et al.
Pubblicazione: (2025)
Hierarchical Self-Supervised Representation Learning for Depression Detection from Speech
di: Li, Yuxin, et al.
Pubblicazione: (2025)
di: Li, Yuxin, et al.
Pubblicazione: (2025)
FD-Bench: A Full-Duplex Benchmarking Pipeline Designed for Full Duplex Spoken Dialogue Systems
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
Large Language Models Meet Contrastive Learning: Zero-Shot Emotion Recognition Across Languages
di: Zou, Heqing, et al.
Pubblicazione: (2025)
di: Zou, Heqing, et al.
Pubblicazione: (2025)
Improving Synthetic Data Training for Contextual Biasing Models with a Keyword-Aware Cost Function
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
Continual Learning with Embedding Layer Surgery and Task-wise Beam Search using Whisper
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
CS-Sum: A Benchmark for Code-Switching Dialogue Summarization and the Limits of Large Language Models
di: Suresh, Sathya Krishnan, et al.
Pubblicazione: (2025)
di: Suresh, Sathya Krishnan, et al.
Pubblicazione: (2025)
Continual Learning Optimizations for Auto-regressive Decoder of Multilingual ASR systems
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2024)
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2024)
Bridging Speech and Text: Enhancing ASR with Pinyin-to-Character Pre-training in LLMs
di: Yuhang, Yang, et al.
Pubblicazione: (2024)
di: Yuhang, Yang, et al.
Pubblicazione: (2024)
DiaSynth: Synthetic Dialogue Generation Framework for Low Resource Dialogue Applications
di: Suresh, Sathya Krishnan, et al.
Pubblicazione: (2024)
di: Suresh, Sathya Krishnan, et al.
Pubblicazione: (2024)
Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
Punctuation Restoration Improves Structure Understanding Without Supervision
di: Min, Junghyun, et al.
Pubblicazione: (2024)
di: Min, Junghyun, et al.
Pubblicazione: (2024)
MULTI-Bench: A Multi-Turn Interactive Benchmark for Assessing Emotional Intelligence ability of Spoken Dialogue Models
di: Deng, Yayue, et al.
Pubblicazione: (2025)
di: Deng, Yayue, et al.
Pubblicazione: (2025)
A Small and Fast BERT for Chinese Medical Punctuation Restoration
di: Ling, Tongtao, et al.
Pubblicazione: (2023)
di: Ling, Tongtao, et al.
Pubblicazione: (2023)
Building a Taiwanese Mandarin Spoken Language Model: A First Attempt
di: Yang, Chih-Kai, et al.
Pubblicazione: (2024)
di: Yang, Chih-Kai, et al.
Pubblicazione: (2024)
Introducing MELI: the Mandarin-English Language Interview Corpus
di: Liu, Suyuan, et al.
Pubblicazione: (2026)
di: Liu, Suyuan, et al.
Pubblicazione: (2026)
Robust Zero-Shot Text-to-Speech Synthesis with Reverse Inference Optimization
di: Hu, Yuchen, et al.
Pubblicazione: (2024)
di: Hu, Yuchen, et al.
Pubblicazione: (2024)
LLaMA based Punctuation Restoration With Forward Pass Only Decoding
di: Pang, Yutong, et al.
Pubblicazione: (2024)
di: Pang, Yutong, et al.
Pubblicazione: (2024)
Assessing and Improving Punctuation Robustness in English-Marathi Machine Translation
di: Shejole, Kaustubh Shivshankar, et al.
Pubblicazione: (2025)
di: Shejole, Kaustubh Shivshankar, et al.
Pubblicazione: (2025)
Explainable Disentanglement on Discrete Speech Representations for Noise-Robust ASR
di: Gopal, Shreyas, et al.
Pubblicazione: (2025)
di: Gopal, Shreyas, et al.
Pubblicazione: (2025)
Spontaneous Informal Speech Dataset for Punctuation Restoration
di: Liu, Xing Yi, et al.
Pubblicazione: (2024)
di: Liu, Xing Yi, et al.
Pubblicazione: (2024)
Language-Aware Distillation for Multilingual Instruction-Following Speech LLMs with ASR-Only Supervision
di: Gopal, Shreyas, et al.
Pubblicazione: (2026)
di: Gopal, Shreyas, et al.
Pubblicazione: (2026)
Punctuation and Predicates in Language Models
di: Chauhan, Sonakshi, et al.
Pubblicazione: (2025)
di: Chauhan, Sonakshi, et al.
Pubblicazione: (2025)
Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models
di: Hu, Yuchen, et al.
Pubblicazione: (2024)
di: Hu, Yuchen, et al.
Pubblicazione: (2024)
Enhancing Zero-shot Text-to-Speech Synthesis with Human Feedback
di: Chen, Chen, et al.
Pubblicazione: (2024)
di: Chen, Chen, et al.
Pubblicazione: (2024)
Restoring Rhythm: Punctuation Restoration Using Transformer Models for Bangla, A Low-Resource Language
di: Mamun, Md Obyedullahil, et al.
Pubblicazione: (2025)
di: Mamun, Md Obyedullahil, et al.
Pubblicazione: (2025)
Cross-modal Consistency Guidance for Robust Emotion Control in Auto-Regressive TTS Models
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
Increments in Mandarin Chinese
di: Lim, Ni Eng
Pubblicazione: (2025)
di: Lim, Ni Eng
Pubblicazione: (2025)
DepFlow: Disentangled Speech Generation to Mitigate Semantic Bias in Depression Detection
di: Li, Yuxin, et al.
Pubblicazione: (2026)
di: Li, Yuxin, et al.
Pubblicazione: (2026)
Resolving Transcription Ambiguity in Spanish: A Hybrid Acoustic-Lexical System for Punctuation Restoration
di: Zhu, Xiliang, et al.
Pubblicazione: (2024)
di: Zhu, Xiliang, et al.
Pubblicazione: (2024)
The ICASSP 2026 HumDial Challenge: Benchmarking Human-like Spoken Dialogue Systems in the LLM Era
di: Zhao, Zhixian, et al.
Pubblicazione: (2026)
di: Zhao, Zhixian, et al.
Pubblicazione: (2026)
Audio Large Language Models Can Be Descriptive Speech Quality Evaluators
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
PersianPunc: A Large-Scale Dataset and BERT-Based Approach for Persian Punctuation Restoration
di: Kalahroodi, Mohammad Javad Ranjbar, et al.
Pubblicazione: (2026)
di: Kalahroodi, Mohammad Javad Ranjbar, et al.
Pubblicazione: (2026)
Mitigating Structural Noise in Low-Resource S2TT: An Optimized Cascaded Nepali-English Pipeline with Punctuation Restoration
di: Chongbang, Tangsang, et al.
Pubblicazione: (2026)
di: Chongbang, Tangsang, et al.
Pubblicazione: (2026)
Punctuation-aware treebank tree binarization
di: Klinger, Eitan, et al.
Pubblicazione: (2025)
di: Klinger, Eitan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
di: Peng, Yizhou, et al.
Pubblicazione: (2025) -
Proactive for Uncertainty: Cause-Aware Error Diagnosis and Interactive Clarification for Spoken Dialogue Systems
di: Peng, Yizhou, et al.
Pubblicazione: (2026) -
Zero-shot Context Biasing with Trie-based Decoding using Synthetic Multi-Pronunciation
di: Liu, Changsong, et al.
Pubblicazione: (2025) -
Impact of Frame Rates on Speech Tokenizer: A Case Study on Mandarin and English
di: Zhang, Haoyang, et al.
Pubblicazione: (2025) -
Chronological Thinking in Full-Duplex Spoken Dialogue Language Models
di: Wu, Donghang, et al.
Pubblicazione: (2025)