LightBeam: An Accurate and Memory-Efficient CTC Decoder for Speech Neuroprostheses
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Feghhi, Ebrahim, Hu, Junlin, Hadidi, Nima, Kao, Jonathan C. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Time-Masked Transformers with Lightweight Test-Time Adaptation for Neural Speech Decoding
par: Feghhi, Ebrahim, et autres
Publié: (2025)
par: Feghhi, Ebrahim, et autres
Publié: (2025)
SplashNet: Split-and-Share Encoders for Accurate and Efficient Typing with Surface Electromyography
par: Hadidi, Nima, et autres
Publié: (2025)
par: Hadidi, Nima, et autres
Publié: (2025)
Re-evaluating Position and Velocity Decoding for Hand Pose Estimation with Surface Electromyography
par: Hadidi, Nima, et autres
Publié: (2026)
par: Hadidi, Nima, et autres
Publié: (2026)
Three-Class Emotion Classification for Audiovisual Scenes Based on Ensemble Learning Scheme
par: Xiong, Xiangrui, et autres
Publié: (2025)
par: Xiong, Xiangrui, et autres
Publié: (2025)
SACM: SEEG-Audio Contrastive Matching for Chinese Speech Decoding
par: Wang, Hongbin, et autres
Publié: (2025)
par: Wang, Hongbin, et autres
Publié: (2025)
Improved Dysarthric Speech to Text Conversion via TTS Personalization
par: Mihajlik, Péter, et autres
Publié: (2025)
par: Mihajlik, Péter, et autres
Publié: (2025)
A Semantically Consistent Dataset for Data-Efficient Query-Based Universal Sound Separation
par: Li, Kai, et autres
Publié: (2026)
par: Li, Kai, et autres
Publié: (2026)
SpeechCompass: Enhancing Mobile Captioning with Diarization and Directional Guidance via Multi-Microphone Localization
par: Dementyev, Artem, et autres
Publié: (2025)
par: Dementyev, Artem, et autres
Publié: (2025)
NeuroIncept Decoder for High-Fidelity Speech Reconstruction from Neural Activity
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
TalkSketch: Multimodal Generative AI for Real-time Sketch Ideation with Speech
par: Shi, Weiyan, et autres
Publié: (2025)
par: Shi, Weiyan, et autres
Publié: (2025)
Exploring Gender Bias in Alzheimer's Disease Detection: Insights from Mandarin and Greek Speech Perception
par: He, Liu, et autres
Publié: (2025)
par: He, Liu, et autres
Publié: (2025)
Adapting Whisper for Lightweight and Efficient Automatic Speech Recognition of Children for On-device Edge Applications
par: Dutta, Satwik, et autres
Publié: (2025)
par: Dutta, Satwik, et autres
Publié: (2025)
FireRedChat: A Pluggable, Full-Duplex Voice Interaction System with Cascaded and Semi-Cascaded Implementations
par: Chen, Junjie, et autres
Publié: (2025)
par: Chen, Junjie, et autres
Publié: (2025)
Recreating Neural Activity During Speech Production with Language and Speech Model Embeddings
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
Towards LLM-Empowered Fine-Grained Speech Descriptors for Explainable Emotion Recognition
par: Chen, Youjun, et autres
Publié: (2025)
par: Chen, Youjun, et autres
Publié: (2025)
EmoAugNet: A Signal-Augmented Hybrid CNN-LSTM Framework for Speech Emotion Recognition
par: Paul, Durjoy Chandra, et autres
Publié: (2025)
par: Paul, Durjoy Chandra, et autres
Publié: (2025)
Scaling Law in Neural Data: Non-Invasive Speech Decoding with 175 Hours of EEG Data
par: Sato, Motoshige, et autres
Publié: (2024)
par: Sato, Motoshige, et autres
Publié: (2024)
Bridging the Gap between Micro-scale Traffic Simulation and 4D Digital Cityscapes
par: Jiao, Longxiang, et autres
Publié: (2026)
par: Jiao, Longxiang, et autres
Publié: (2026)
Accessible Fine-grained Data Representation via Spatial Audio
par: Liu, Can, et autres
Publié: (2026)
par: Liu, Can, et autres
Publié: (2026)
FlueBricks: A Construction Kit of Flute-like Instruments for Acoustic Reasoning
par: Chen, Bo-Yu, et autres
Publié: (2026)
par: Chen, Bo-Yu, et autres
Publié: (2026)
EarResp-ANS : Audio-Based On-Device Respiration Rate Estimation on Earphones with Adaptive Noise Suppression
par: Küttner, Michael, et autres
Publié: (2026)
par: Küttner, Michael, et autres
Publié: (2026)
Opening the Design Space: Two Years of Performance with Intelligent Musical Instruments
par: Martin, Charles Patrick
Publié: (2026)
par: Martin, Charles Patrick
Publié: (2026)
Erie: A Declarative Grammar for Data Sonification
par: Kim, Hyeok, et autres
Publié: (2024)
par: Kim, Hyeok, et autres
Publié: (2024)
Effect of Avatar Head Movement on Communication Behaviour, Experience of Presence and Conversation Success in Triadic Conversations
par: Kothe, Angelika, et autres
Publié: (2025)
par: Kothe, Angelika, et autres
Publié: (2025)
AuthGlass: Benchmarking Voice Liveness Detection and Authentication on Smart Glasses via Comprehensive Acoustic Features
par: Xu, Weiye, et autres
Publié: (2025)
par: Xu, Weiye, et autres
Publié: (2025)
USpeech: Ultrasound-Enhanced Speech with Minimal Human Effort via Cross-Modal Synthesis
par: Yu, Luca Jiang-Tao, et autres
Publié: (2024)
par: Yu, Luca Jiang-Tao, et autres
Publié: (2024)
A Near-Real-Time Processing Ego Speech Filtering Pipeline Designed for Speech Interruption During Human-Robot Interaction
par: Li, Yue, et autres
Publié: (2024)
par: Li, Yue, et autres
Publié: (2024)
Towards Temporally Explainable Dysarthric Speech Clarity Assessment
par: Park, Seohyun, et autres
Publié: (2025)
par: Park, Seohyun, et autres
Publié: (2025)
Directional Source Separation for Robust Speech Recognition on Smart Glasses
par: Feng, Tiantian, et autres
Publié: (2023)
par: Feng, Tiantian, et autres
Publié: (2023)
VoiceX: A Text-To-Speech Framework for Custom Voices
par: Mertes, Silvan, et autres
Publié: (2024)
par: Mertes, Silvan, et autres
Publié: (2024)
VoiceFlow: Efficient Text-to-Speech with Rectified Flow Matching
par: Guo, Yiwei, et autres
Publié: (2023)
par: Guo, Yiwei, et autres
Publié: (2023)
Psychophysiology-aided Perceptually Fluent Speech Analysis of Children Who Stutter
par: Xiao, Yi, et autres
Publié: (2022)
par: Xiao, Yi, et autres
Publié: (2022)
Using Confidence Scores to Improve Eyes-free Detection of Speech Recognition Errors
par: Nowrin, Sadia, et autres
Publié: (2024)
par: Nowrin, Sadia, et autres
Publié: (2024)
Towards Decoding Brain Activity During Passive Listening of Speech
par: Fodor, Milán András, et autres
Publié: (2024)
par: Fodor, Milán András, et autres
Publié: (2024)
Speech vs. Transcript: Does It Matter for Human Annotators in Speech Summarization?
par: Sharma, Roshan, et autres
Publié: (2024)
par: Sharma, Roshan, et autres
Publié: (2024)
How Private is Low-Frequency Speech Audio in the Wild? An Analysis of Verbal Intelligibility by Humans and Machines
par: Liu, Ailin, et autres
Publié: (2024)
par: Liu, Ailin, et autres
Publié: (2024)
Do AI Voices Learn Social Nuances? A Case of Politeness and Speech Rate
par: Rabin, Eyal, et autres
Publié: (2025)
par: Rabin, Eyal, et autres
Publié: (2025)
AVE Speech: A Comprehensive Multi-Modal Dataset for Speech Recognition Integrating Audio, Visual, and Electromyographic Signals
par: Zhou, Dongliang, et autres
Publié: (2025)
par: Zhou, Dongliang, et autres
Publié: (2025)
Semi-Automatic Flute Robot and Its Acoustic Sensing
par: Kuriyama, Hikari, et autres
Publié: (2026)
par: Kuriyama, Hikari, et autres
Publié: (2026)
Sound Clouds: Exploring ambient intelligence in public spaces to elicit deep human experience of awe, wonder, and beauty
par: Zhang, Chengzhi, et autres
Publié: (2025)
par: Zhang, Chengzhi, et autres
Publié: (2025)
Documents similaires
-
Time-Masked Transformers with Lightweight Test-Time Adaptation for Neural Speech Decoding
par: Feghhi, Ebrahim, et autres
Publié: (2025) -
SplashNet: Split-and-Share Encoders for Accurate and Efficient Typing with Surface Electromyography
par: Hadidi, Nima, et autres
Publié: (2025) -
Re-evaluating Position and Velocity Decoding for Hand Pose Estimation with Surface Electromyography
par: Hadidi, Nima, et autres
Publié: (2026) -
Three-Class Emotion Classification for Audiovisual Scenes Based on Ensemble Learning Scheme
par: Xiong, Xiangrui, et autres
Publié: (2025) -
SACM: SEEG-Audio Contrastive Matching for Chinese Speech Decoding
par: Wang, Hongbin, et autres
Publié: (2025)