MEBM-Phoneme: Multi-scale Enhanced BrainMagic for End-to-End MEG Phoneme Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jinghua, Liang, Zifeng, Zhang, Songyi, Li, Linze, Zheng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MEBM-Speech: Multi-scale Enhanced BrainMagic for Robust MEG Speech Detection
par: Songyi, Li, et autres
Publié: (2026)
par: Songyi, Li, et autres
Publié: (2026)
Phoneme-Level Feature Discrepancies: A Key to Detecting Sophisticated Speech Deepfakes
par: Zhang, Kuiyuan, et autres
Publié: (2024)
par: Zhang, Kuiyuan, et autres
Publié: (2024)
Controllable Singing Voice Synthesis using Phoneme-Level Energy Sequence
par: Ryu, Yerin, et autres
Publié: (2025)
par: Ryu, Yerin, et autres
Publié: (2025)
Self-Supervised Models for Phoneme Recognition: Applications in Children's Speech for Reading Learning
par: Medin, Lucas Block, et autres
Publié: (2025)
par: Medin, Lucas Block, et autres
Publié: (2025)
Frequency-Weighted Training Losses for Phoneme-Level DNN-based Speech Enhancement
par: Monir, Nasser-Eddine, et autres
Publié: (2025)
par: Monir, Nasser-Eddine, et autres
Publié: (2025)
Data-Efficient ASR Personalization for Non-Normative Speech Using an Uncertainty-Based Phoneme Difficulty Score for Guided Sampling
par: Pokel, Niclas, et autres
Publié: (2025)
par: Pokel, Niclas, et autres
Publié: (2025)
ProKWS: Personalized Keyword Spotting via Collaborative Learning of Phonemes and Prosody
par: Pan, Jianan, et autres
Publié: (2026)
par: Pan, Jianan, et autres
Publié: (2026)
Qifusion-Net: Layer-adapted Stream/Non-stream Model for End-to-End Multi-Accent Speech Recognition
par: Chen, Jinming, et autres
Publié: (2024)
par: Chen, Jinming, et autres
Publié: (2024)
The 2025 PNPL Competition: Speech Detection and Phoneme Classification in the LibriBrain Dataset
par: Landau, Gilad, et autres
Publié: (2025)
par: Landau, Gilad, et autres
Publié: (2025)
Harf-Speech: A Clinically Aligned Framework for Arabic Phoneme-Level Speech Assessment
par: Azad, Asif, et autres
Publié: (2026)
par: Azad, Asif, et autres
Publié: (2026)
From Modular to End-to-End Speaker Diarization
par: Landini, Federico
Publié: (2024)
par: Landini, Federico
Publié: (2024)
Time and Tokens: Benchmarking End-to-End Speech Dysfluency Detection
par: Zhou, Xuanru, et autres
Publié: (2024)
par: Zhou, Xuanru, et autres
Publié: (2024)
An End-to-End Approach for Chord-Conditioned Song Generation
par: Gao, Shuochen, et autres
Publié: (2024)
par: Gao, Shuochen, et autres
Publié: (2024)
Prosody Labeling with Phoneme-BERT and Speech Foundation Models
par: Koriyama, Tomoki
Publié: (2025)
par: Koriyama, Tomoki
Publié: (2025)
End-to-End Supervised Hierarchical Graph Clustering for Speaker Diarization
par: Singh, Prachi, et autres
Publié: (2024)
par: Singh, Prachi, et autres
Publié: (2024)
Neuro-MSBG: An End-to-End Neural Model for Hearing Loss Simulation
par: Yuan, Hui-Guan, et autres
Publié: (2025)
par: Yuan, Hui-Guan, et autres
Publié: (2025)
TSPC: A Two-Stage Phoneme-Centric Architecture for code-switching Vietnamese-English Speech Recognition
par: Anh, Tran Nguyen, et autres
Publié: (2025)
par: Anh, Tran Nguyen, et autres
Publié: (2025)
Leveraging Speaker Embeddings in End-to-End Neural Diarization for Two-Speaker Scenarios
par: Alvarez-Trejos, Juan Ignacio, et autres
Publié: (2024)
par: Alvarez-Trejos, Juan Ignacio, et autres
Publié: (2024)
End-to-End User-Defined Keyword Spotting using Shifted Delta Coefficients
par: V, Kesavaraj, et autres
Publié: (2024)
par: V, Kesavaraj, et autres
Publié: (2024)
A Phoneme-Scale Assessment of Multichannel Speech Enhancement Algorithms
par: Monir, Nasser-Eddine, et autres
Publié: (2024)
par: Monir, Nasser-Eddine, et autres
Publié: (2024)
Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection
par: Salvi, Davide, et autres
Publié: (2025)
par: Salvi, Davide, et autres
Publié: (2025)
End-to-end multi-channel speaker extraction and binaural speech synthesis
par: Chi, Cheng, et autres
Publié: (2024)
par: Chi, Cheng, et autres
Publié: (2024)
Stutter-Solver: End-to-end Multi-lingual Dysfluency Detection
par: Zhou, Xuanru, et autres
Publié: (2024)
par: Zhou, Xuanru, et autres
Publié: (2024)
Towards Accurate Phonetic Error Detection Through Phoneme Similarity Modeling
par: Zhou, Xuanru, et autres
Publié: (2025)
par: Zhou, Xuanru, et autres
Publié: (2025)
End-to-End Real-World Polyphonic Piano Audio-to-Score Transcription with Hierarchical Decoding
par: Zeng, Wei, et autres
Publié: (2024)
par: Zeng, Wei, et autres
Publié: (2024)
Disambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-trained BERT
par: Dai, Dongyang, et autres
Publié: (2025)
par: Dai, Dongyang, et autres
Publié: (2025)
Wave-U-Mamba: An End-To-End Framework For High-Quality And Efficient Speech Super Resolution
par: Lee, Yongjoon, et autres
Publié: (2024)
par: Lee, Yongjoon, et autres
Publié: (2024)
Phoneme-based speech recognition driven by large language models and sampling marginalization
par: Ma, Te, et autres
Publié: (2025)
par: Ma, Te, et autres
Publié: (2025)
Phoneme-Level Contrastive Learning for User-Defined Keyword Spotting with Flexible Enrollment
par: Kewei, Li, et autres
Publié: (2024)
par: Kewei, Li, et autres
Publié: (2024)
PMF-CEC: Phoneme-augmented Multimodal Fusion for Context-aware ASR Error Correction with Error-specific Selective Decoding
par: He, Jiajun, et autres
Publié: (2025)
par: He, Jiajun, et autres
Publié: (2025)
Evaluating Multichannel Speech Enhancement Algorithms at the Phoneme Scale Across Genders
par: Monir, Nasser-Eddine, et autres
Publié: (2025)
par: Monir, Nasser-Eddine, et autres
Publié: (2025)
VAE-based Phoneme Alignment Using Gradient Annealing and SSL Acoustic Features
par: Koriyama, Tomoki
Publié: (2024)
par: Koriyama, Tomoki
Publié: (2024)
Speaker- and Text-Independent Estimation of Articulatory Movements and Phoneme Alignments from Speech
par: Weise, Tobias, et autres
Publié: (2024)
par: Weise, Tobias, et autres
Publié: (2024)
MUDAS: Mote-scale Unsupervised Domain Adaptation in Multi-label Sound Classification
par: Yun, Jihoon, et autres
Publié: (2025)
par: Yun, Jihoon, et autres
Publié: (2025)
Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio
par: He, Xinlu, et autres
Publié: (2025)
par: He, Xinlu, et autres
Publié: (2025)
Toward Fully-End-to-End Listened Speech Decoding from EEG Signals
par: Lee, Jihwan, et autres
Publié: (2024)
par: Lee, Jihwan, et autres
Publié: (2024)
ConPCO: Preserving Phoneme Characteristics for Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization
par: Yan, Bi-Cheng, et autres
Publié: (2024)
par: Yan, Bi-Cheng, et autres
Publié: (2024)
SongPrep: A Preprocessing Framework and End-to-end Model for Full-song Structure Parsing and Lyrics Transcription
par: Tan, Wei, et autres
Publié: (2025)
par: Tan, Wei, et autres
Publié: (2025)
TTS-Transducer: End-to-End Speech Synthesis with Neural Transducer
par: Bataev, Vladimir, et autres
Publié: (2025)
par: Bataev, Vladimir, et autres
Publié: (2025)
LearnAFE: Circuit-Algorithm Co-design Framework for Learnable Audio Analog Front-End
par: Hu, Jinhai, et autres
Publié: (2025)
par: Hu, Jinhai, et autres
Publié: (2025)
Documents similaires
-
MEBM-Speech: Multi-scale Enhanced BrainMagic for Robust MEG Speech Detection
par: Songyi, Li, et autres
Publié: (2026) -
Phoneme-Level Feature Discrepancies: A Key to Detecting Sophisticated Speech Deepfakes
par: Zhang, Kuiyuan, et autres
Publié: (2024) -
Controllable Singing Voice Synthesis using Phoneme-Level Energy Sequence
par: Ryu, Yerin, et autres
Publié: (2025) -
Self-Supervised Models for Phoneme Recognition: Applications in Children's Speech for Reading Learning
par: Medin, Lucas Block, et autres
Publié: (2025) -
Frequency-Weighted Training Losses for Phoneme-Level DNN-based Speech Enhancement
par: Monir, Nasser-Eddine, et autres
Publié: (2025)