Distinct Theta Synchrony across Speech Modes: Perceived, Spoken, Whispered, and Imagined
Fuente:
arXiv
Guardado en:
| Autores principales: | Lee, Jung-Sun, Jo, Ha-Na, Ko, Eunyeong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Unified Neural Decoding of Perceived, Spoken and Imagined Speech from EEG Signals
por: Lee, Jung-Sun, et al.
Publicado: (2024)
por: Lee, Jung-Sun, et al.
Publicado: (2024)
Lightweight Diffusion-based Framework for Online Imagined Speech Decoding in Aphasia
por: Ko, Eunyeong, et al.
Publicado: (2025)
por: Ko, Eunyeong, et al.
Publicado: (2025)
Toward Robust EEG-based Intention Decoding during Misarticulated Speech in Dysarthria
por: Jo, Ha-Na, et al.
Publicado: (2025)
por: Jo, Ha-Na, et al.
Publicado: (2025)
EEG-Based Speech Decoding: A Novel Approach Using Multi-Kernel Ensemble Diffusion Models
por: Kim, Soowon, et al.
Publicado: (2024)
por: Kim, Soowon, et al.
Publicado: (2024)
SpokenUS: A Spoken User Simulator for Task-Oriented Dialogue
por: Lee, Jonggeun, et al.
Publicado: (2026)
por: Lee, Jonggeun, et al.
Publicado: (2026)
Interventional Speech Noise Injection for ASR Generalizable Spoken Language Understanding
por: Jung, Yeonjoon, et al.
Publicado: (2024)
por: Jung, Yeonjoon, et al.
Publicado: (2024)
Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down
por: Wang, Yingzhi, et al.
Publicado: (2025)
por: Wang, Yingzhi, et al.
Publicado: (2025)
Careless Whisper: Speech-to-Text Hallucination Harms
por: Koenecke, Allison, et al.
Publicado: (2024)
por: Koenecke, Allison, et al.
Publicado: (2024)
On the Evaluation of Speech Foundation Models for Spoken Language Understanding
por: Arora, Siddhant, et al.
Publicado: (2024)
por: Arora, Siddhant, et al.
Publicado: (2024)
Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems
por: Wei, Chengwei, et al.
Publicado: (2025)
por: Wei, Chengwei, et al.
Publicado: (2025)
Scaling Spoken Language Models with Syllabic Speech Tokenization
por: Lee, Nicholas, et al.
Publicado: (2025)
por: Lee, Nicholas, et al.
Publicado: (2025)
Whisper-UT: A Unified Translation Framework for Speech and Text
por: Xiao, Cihan, et al.
Publicado: (2025)
por: Xiao, Cihan, et al.
Publicado: (2025)
PhoWhisper: Automatic Speech Recognition for Vietnamese
por: Le, Thanh-Thien, et al.
Publicado: (2024)
por: Le, Thanh-Thien, et al.
Publicado: (2024)
Languages in Whisper-Style Speech Encoders Align Both Phonetically and Semantically
por: Shim, Ryan Soh-Eun, et al.
Publicado: (2025)
por: Shim, Ryan Soh-Eun, et al.
Publicado: (2025)
SpeechDPR: End-to-End Spoken Passage Retrieval for Open-Domain Spoken Question Answering
por: Lin, Chyi-Jiunn, et al.
Publicado: (2024)
por: Lin, Chyi-Jiunn, et al.
Publicado: (2024)
ASKD-Whisper: Adaptive Self-knowledge Distillation for Efficient and Low-Latency Automatic Speech Recognition
por: Lee, Junseok, et al.
Publicado: (2026)
por: Lee, Junseok, et al.
Publicado: (2026)
TASTE-Streaming: Towards Streamable Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
por: Tseng, Liang-Hsuan, et al.
Publicado: (2026)
por: Tseng, Liang-Hsuan, et al.
Publicado: (2026)
TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
por: Tseng, Liang-Hsuan, et al.
Publicado: (2025)
por: Tseng, Liang-Hsuan, et al.
Publicado: (2025)
Whispering Context: Distilling Syntax and Semantics for Long Speech Transcripts
por: Altinok, Duygu
Publicado: (2025)
por: Altinok, Duygu
Publicado: (2025)
WhisperNER: Unified Open Named Entity and Speech Recognition
por: Ayache, Gil, et al.
Publicado: (2024)
por: Ayache, Gil, et al.
Publicado: (2024)
SpokenWOZ: A Large-Scale Speech-Text Benchmark for Spoken Task-Oriented Dialogue Agents
por: Si, Shuzheng, et al.
Publicado: (2023)
por: Si, Shuzheng, et al.
Publicado: (2023)
Indigenous Languages Spoken in Argentina: A Survey of NLP and Speech Resources
por: Ticona, Belu, et al.
Publicado: (2025)
por: Ticona, Belu, et al.
Publicado: (2025)
ZAEBUC-Spoken: A Multilingual Multidialectal Arabic-English Speech Corpus
por: Hamed, Injy, et al.
Publicado: (2024)
por: Hamed, Injy, et al.
Publicado: (2024)
Optimal Multi-Task Learning at Regularization Horizon for Speech Translation Task
por: Jung, JungHo, et al.
Publicado: (2025)
por: Jung, JungHo, et al.
Publicado: (2025)
Swedish Whispers; Leveraging a Massive Speech Corpus for Swedish Speech Recognition
por: Vesterbacka, Leonora, et al.
Publicado: (2025)
por: Vesterbacka, Leonora, et al.
Publicado: (2025)
Spoken Stereoset: On Evaluating Social Bias Toward Speaker in Speech Large Language Models
por: Lin, Yi-Cheng, et al.
Publicado: (2024)
por: Lin, Yi-Cheng, et al.
Publicado: (2024)
Zero Resource Code-switched Speech Benchmark Using Speech Utterance Pairs For Multiple Spoken Languages
por: Huang, Kuan-Po, et al.
Publicado: (2023)
por: Huang, Kuan-Po, et al.
Publicado: (2023)
Speech Discrete Tokens or Continuous Features? A Comparative Analysis for Spoken Language Understanding in SpeechLLMs
por: Wang, Dingdong, et al.
Publicado: (2025)
por: Wang, Dingdong, et al.
Publicado: (2025)
Theta Theory: operads and coloring
por: Marcolli, Matilde, et al.
Publicado: (2025)
por: Marcolli, Matilde, et al.
Publicado: (2025)
Improving Whisper's Recognition Performance for Under-Represented Language Kazakh Leveraging Unpaired Speech and Text
por: Li, Jinpeng, et al.
Publicado: (2024)
por: Li, Jinpeng, et al.
Publicado: (2024)
POWSM: A Phonetic Open Whisper-Style Speech Foundation Model
por: Li, Chin-Jou, et al.
Publicado: (2025)
por: Li, Chin-Jou, et al.
Publicado: (2025)
Long-Form Speech Generation with Spoken Language Models
por: Park, Se Jin, et al.
Publicado: (2024)
por: Park, Se Jin, et al.
Publicado: (2024)
A Character-Centric Creative Story Generation via Imagination
por: Park, Kyeongman, et al.
Publicado: (2024)
por: Park, Kyeongman, et al.
Publicado: (2024)
Optimal Transport Regularization for Speech Text Alignment in Spoken Language Models
por: Xu, Wenze, et al.
Publicado: (2025)
por: Xu, Wenze, et al.
Publicado: (2025)
Spoken Word2Vec: Learning Skipgram Embeddings from Speech
por: Sayeed, Mohammad Amaan, et al.
Publicado: (2023)
por: Sayeed, Mohammad Amaan, et al.
Publicado: (2023)
Language-Universal Speech Attributes Modeling for Zero-Shot Multilingual Spoken Keyword Recognition
por: Yen, Hao, et al.
Publicado: (2024)
por: Yen, Hao, et al.
Publicado: (2024)
Abjad AI at NADI 2025: CATT-Whisper: Multimodal Diacritic Restoration Using Text and Speech Representations
por: Ghannam, Ahmad, et al.
Publicado: (2025)
por: Ghannam, Ahmad, et al.
Publicado: (2025)
Neural Synchrony Between Socially Interacting Language Models
por: Zhang, Zhining, et al.
Publicado: (2026)
por: Zhang, Zhining, et al.
Publicado: (2026)
OWSM v3.1: Better and Faster Open Whisper-Style Speech Models based on E-Branchformer
por: Peng, Yifan, et al.
Publicado: (2024)
por: Peng, Yifan, et al.
Publicado: (2024)
WhisperPipe: A Resource-Efficient Streaming Architecture for Real-Time Automatic Speech Recognition
por: Ramezani, Erfan, et al.
Publicado: (2026)
por: Ramezani, Erfan, et al.
Publicado: (2026)
Ejemplares similares
-
Towards Unified Neural Decoding of Perceived, Spoken and Imagined Speech from EEG Signals
por: Lee, Jung-Sun, et al.
Publicado: (2024) -
Lightweight Diffusion-based Framework for Online Imagined Speech Decoding in Aphasia
por: Ko, Eunyeong, et al.
Publicado: (2025) -
Toward Robust EEG-based Intention Decoding during Misarticulated Speech in Dysarthria
por: Jo, Ha-Na, et al.
Publicado: (2025) -
EEG-Based Speech Decoding: A Novel Approach Using Multi-Kernel Ensemble Diffusion Models
por: Kim, Soowon, et al.
Publicado: (2024) -
SpokenUS: A Spoken User Simulator for Task-Oriented Dialogue
por: Lee, Jonggeun, et al.
Publicado: (2026)