A 1000-hour EEG-EMG-audio dataset of Japanese speech production
Fuente:
arXiv
Salvato in:
| Autori principali: | Sato, Motoshige, Horiguchi, Ilya, Inoue, Masakazu, Tomeoka, Kenichi, Hatakeyama, Eri, Kita, Yuya, Yamamoto, Atsushi, Fujisawa, Ippei, Sasai, Shuntaro |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Silent Speech Decoding System from EEG and EMG with Heterogenous Electrode Configurations
di: Inoue, Masakazu, et al.
Pubblicazione: (2025)
di: Inoue, Masakazu, et al.
Pubblicazione: (2025)
Scaling Law in Neural Data: Non-Invasive Speech Decoding with 175 Hours of EEG Data
di: Sato, Motoshige, et al.
Pubblicazione: (2024)
di: Sato, Motoshige, et al.
Pubblicazione: (2024)
Spectrogram features for audio and speech analysis
di: McLoughlin, Ian, et al.
Pubblicazione: (2026)
di: McLoughlin, Ian, et al.
Pubblicazione: (2026)
EEG-EMG FAConformer: Frequency Aware Conv-Transformer for the fusion of EEG and EMG
di: He, ZhengXiao, et al.
Pubblicazione: (2024)
di: He, ZhengXiao, et al.
Pubblicazione: (2024)
Assessing speech quality metrics for evaluation of neural audio codecs under clean speech conditions
di: Mack, Wolfgang, et al.
Pubblicazione: (2025)
di: Mack, Wolfgang, et al.
Pubblicazione: (2025)
The EAVI EMG/EEG Board: Hybrid physiological sensing
di: Tanaka, Atau, et al.
Pubblicazione: (2024)
di: Tanaka, Atau, et al.
Pubblicazione: (2024)
The role of audio-visual integration in the time course of phonetic encoding in self-supervised speech models
di: Wang, Yi, et al.
Pubblicazione: (2025)
di: Wang, Yi, et al.
Pubblicazione: (2025)
Enhancement by postfiltering for speech and audio coding in ad-hoc sensor networks
di: Das, Sneha, et al.
Pubblicazione: (2020)
di: Das, Sneha, et al.
Pubblicazione: (2020)
An automatic mixing speech enhancement system for multi-track audio
di: Liu, Xiaojing, et al.
Pubblicazione: (2024)
di: Liu, Xiaojing, et al.
Pubblicazione: (2024)
Modeling strategies for speech enhancement in the latent space of a neural audio codec
di: Kammoun, Sofiene, et al.
Pubblicazione: (2025)
di: Kammoun, Sofiene, et al.
Pubblicazione: (2025)
Voice Impression Control in Zero-Shot TTS
di: Fujita, Kenichi, et al.
Pubblicazione: (2025)
di: Fujita, Kenichi, et al.
Pubblicazione: (2025)
Confidence-Based Self-Training for EMG-to-Speech: Leveraging Synthetic EMG for Robust Modeling
di: Chen, Xiaodan, et al.
Pubblicazione: (2025)
di: Chen, Xiaodan, et al.
Pubblicazione: (2025)
Multimodal wearable EEG, EMG and accelerometry measurements improve the accuracy of tonic-clonic seizure detection in-hospital
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
di: Zhang, Jingwei, et al.
Pubblicazione: (2024)
Can large audio language models understand child stuttering speech? speech summarization, and source separation
di: Okocha, Chibuzor, et al.
Pubblicazione: (2025)
di: Okocha, Chibuzor, et al.
Pubblicazione: (2025)
Self-supervised speech representation and contextual text embedding for match-mismatch classification with EEG recording
di: Wang, Bo, et al.
Pubblicazione: (2024)
di: Wang, Bo, et al.
Pubblicazione: (2024)
Predicting speech intelligibility in older adults for speech enhancement using the Gammachirp Envelope Similarity Index, GESI
di: Yamamoto, Ayako, et al.
Pubblicazione: (2025)
di: Yamamoto, Ayako, et al.
Pubblicazione: (2025)
LRS-VoxMM: A benchmark for in-the-wild audio-visual speech recognition
di: Kwak, Doyeop, et al.
Pubblicazione: (2026)
di: Kwak, Doyeop, et al.
Pubblicazione: (2026)
Late fusion ensembles for speech recognition on diverse input audio representations
di: Jezidžić, Marin, et al.
Pubblicazione: (2024)
di: Jezidžić, Marin, et al.
Pubblicazione: (2024)
Real-time speech enhancement in noise for throat microphone using neural audio codec as foundation model
di: Hauret, Julien, et al.
Pubblicazione: (2025)
di: Hauret, Julien, et al.
Pubblicazione: (2025)
Pretraining Multi-Speaker Identification for Neural Speaker Diarization
di: Horiguchi, Shota, et al.
Pubblicazione: (2025)
di: Horiguchi, Shota, et al.
Pubblicazione: (2025)
Audio-conditioned phonemic and prosodic annotation for building text-to-speech models from unlabeled speech data
di: Shirahata, Yuma, et al.
Pubblicazione: (2024)
di: Shirahata, Yuma, et al.
Pubblicazione: (2024)
EEG-to-Voice Decoding of Spoken and Imagined speech Using Non-Invasive EEG
di: Park, Hanbeot, et al.
Pubblicazione: (2025)
di: Park, Hanbeot, et al.
Pubblicazione: (2025)
Forensic deepfake audio detection using segmental speech features
di: Yang, Tianle, et al.
Pubblicazione: (2025)
di: Yang, Tianle, et al.
Pubblicazione: (2025)
BIONIX: A Wireless, Low-Cost Prosthetic Arm with Dual-Signal EEG and EMG Control
di: Kumar, Pranesh Sathish
Pubblicazione: (2025)
di: Kumar, Pranesh Sathish
Pubblicazione: (2025)
Wavetable Synthesis Using CVAE for Timbre Control Based on Semantic Label
di: Yutani, Tsugumasa, et al.
Pubblicazione: (2024)
di: Yutani, Tsugumasa, et al.
Pubblicazione: (2024)
Audio-visual video-to-speech synthesis with synthesized input audio
di: Kefalas, Triantafyllos, et al.
Pubblicazione: (2023)
di: Kefalas, Triantafyllos, et al.
Pubblicazione: (2023)
Factor-Conditioned Speaking-Style Captioning
di: Ando, Atsushi, et al.
Pubblicazione: (2024)
di: Ando, Atsushi, et al.
Pubblicazione: (2024)
Can We Really Repurpose Multi-Speaker ASR Corpus for Speaker Diarization?
di: Horiguchi, Shota, et al.
Pubblicazione: (2025)
di: Horiguchi, Shota, et al.
Pubblicazione: (2025)
Mitigating Non-Target Speaker Bias in Guided Speaker Embedding
di: Horiguchi, Shota, et al.
Pubblicazione: (2025)
di: Horiguchi, Shota, et al.
Pubblicazione: (2025)
1000 African Voices: Advancing inclusive multi-speaker multi-accent speech synthesis
di: Ogun, Sewade, et al.
Pubblicazione: (2024)
di: Ogun, Sewade, et al.
Pubblicazione: (2024)
Human perception of audio deepfakes: the role of language and speaking style
di: Segundo, Eugenia San, et al.
Pubblicazione: (2025)
di: Segundo, Eugenia San, et al.
Pubblicazione: (2025)
A Statistical Mixture-of-Experts Framework for EMG Artifact Removal in EEG: Empirical Insights and a Proof-of-Concept Application
di: Choi, Benjamin J., et al.
Pubblicazione: (2025)
di: Choi, Benjamin J., et al.
Pubblicazione: (2025)
Comparison of linear and nonlinear methods for decoding selective attention to speech from ear-EEG recordings
di: Thornton, Mike, et al.
Pubblicazione: (2024)
di: Thornton, Mike, et al.
Pubblicazione: (2024)
Large-scale unsupervised audio pre-training for video-to-speech synthesis
di: Kefalas, Triantafyllos, et al.
Pubblicazione: (2023)
di: Kefalas, Triantafyllos, et al.
Pubblicazione: (2023)
SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling
di: Sato, Hiroshi, et al.
Pubblicazione: (2024)
di: Sato, Hiroshi, et al.
Pubblicazione: (2024)
Design of Fiber-Longitudinal Optical Power Monitor
di: Sasai, Takeo, et al.
Pubblicazione: (2024)
di: Sasai, Takeo, et al.
Pubblicazione: (2024)
SyncNet: correlating objective for time delay estimation in audio signals
di: Raina, Akshay, et al.
Pubblicazione: (2022)
di: Raina, Akshay, et al.
Pubblicazione: (2022)
Online incremental learning for audio classification using a pretrained audio model
di: Mulimani, Manjunath, et al.
Pubblicazione: (2025)
di: Mulimani, Manjunath, et al.
Pubblicazione: (2025)
CPEP: Contrastive Pose-EMG Pre-training Enhances Gesture Generalization on EMG Signals
di: Cui, Wenhui, et al.
Pubblicazione: (2025)
di: Cui, Wenhui, et al.
Pubblicazione: (2025)
Disentangling peripheral hearing loss from central and cognitive effects on speech intelligibility in older adults
di: Irino, Toshio, et al.
Pubblicazione: (2025)
di: Irino, Toshio, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Silent Speech Decoding System from EEG and EMG with Heterogenous Electrode Configurations
di: Inoue, Masakazu, et al.
Pubblicazione: (2025) -
Scaling Law in Neural Data: Non-Invasive Speech Decoding with 175 Hours of EEG Data
di: Sato, Motoshige, et al.
Pubblicazione: (2024) -
Spectrogram features for audio and speech analysis
di: McLoughlin, Ian, et al.
Pubblicazione: (2026) -
EEG-EMG FAConformer: Frequency Aware Conv-Transformer for the fusion of EEG and EMG
di: He, ZhengXiao, et al.
Pubblicazione: (2024) -
Assessing speech quality metrics for evaluation of neural audio codecs under clean speech conditions
di: Mack, Wolfgang, et al.
Pubblicazione: (2025)