Collecting Prosody in the Wild: A Content-Controlled, Privacy-First Smartphone Protocol and Empirical Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Koch, Timo K., Bemmann, Florian, Schoedel, Ramona, Buehner, Markus, Stachl, Clemens |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Putting Language into Context Using Smartphone-Based Keyboard Logging
par: Bemmann, Florian, et autres
Publié: (2024)
par: Bemmann, Florian, et autres
Publié: (2024)
How Private is Low-Frequency Speech Audio in the Wild? An Analysis of Verbal Intelligibility by Humans and Machines
par: Liu, Ailin, et autres
Publié: (2024)
par: Liu, Ailin, et autres
Publié: (2024)
SonicSieve: Bringing Directional Speech Extraction to Smartphones Using Acoustic Microstructures
par: Yuan, Kuang, et autres
Publié: (2025)
par: Yuan, Kuang, et autres
Publié: (2025)
A Near-Real-Time Processing Ego Speech Filtering Pipeline Designed for Speech Interruption During Human-Robot Interaction
par: Li, Yue, et autres
Publié: (2024)
par: Li, Yue, et autres
Publié: (2024)
Evolving Performance Practices in Beethoven's Cello Sonatas: Tempo, Portamento, and Historical Interpretation of the First Movements
par: Sole, Ignasi
Publié: (2025)
par: Sole, Ignasi
Publié: (2025)
Evaluating Spatialized Auditory Cues for Rapid Attention Capture in XR
par: Kim, Yoonsang, et autres
Publié: (2026)
par: Kim, Yoonsang, et autres
Publié: (2026)
Poster: Recognizing Hidden-in-the-Ear Private Key for Reliable Silent Speech Interface Using Multi-Task Learning
par: Dong, Xuefu, et autres
Publié: (2025)
par: Dong, Xuefu, et autres
Publié: (2025)
Cluster-to-Predict Affect Contours from Speech
par: Kuşçu, Gökhan, et autres
Publié: (2024)
par: Kuşçu, Gökhan, et autres
Publié: (2024)
Silent Speech Sentence Recognition with Six-Axis Accelerometers using Conformer and CTC Algorithm
par: Xie, Yudong, et autres
Publié: (2025)
par: Xie, Yudong, et autres
Publié: (2025)
Toward using Speech to Sense Student Emotion in Remote Learning Environments
par: Vyas, Sargam, et autres
Publié: (2026)
par: Vyas, Sargam, et autres
Publié: (2026)
Timbre-Aware LLM-based Direct Speech-to-Speech Translation Extendable to Multiple Language Pairs
par: Arya, Lalaram, et autres
Publié: (2026)
par: Arya, Lalaram, et autres
Publié: (2026)
Real-Time Auralization for First-Person Vocal Interaction in Immersive Virtual Environments
par: Flores-Vargas, Mauricio, et autres
Publié: (2025)
par: Flores-Vargas, Mauricio, et autres
Publié: (2025)
Robotic Blended Sonification: Consequential Robot Sound as Creative Material for Human-Robot Interaction
par: Johansen, Stine S., et autres
Publié: (2024)
par: Johansen, Stine S., et autres
Publié: (2024)
Tipping Points, Pulse Elasticity and Tonal Tension: An Empirical Study on What Generates Tipping Points
par: Naik, Canishk, et autres
Publié: (2024)
par: Naik, Canishk, et autres
Publié: (2024)
Multimodal Large Language Models with Fusion Low Rank Adaptation for Device Directed Speech Detection
par: Palaskar, Shruti, et autres
Publié: (2024)
par: Palaskar, Shruti, et autres
Publié: (2024)
NeuroIncept Decoder for High-Fidelity Speech Reconstruction from Neural Activity
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
Recreating Neural Activity During Speech Production with Language and Speech Model Embeddings
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
par: Khanday, Owais Mujtaba, et autres
Publié: (2025)
Sound2Hap: Learning Audio-to-Vibrotactile Haptic Generation from Human Ratings
par: Li, Yinan, et autres
Publié: (2026)
par: Li, Yinan, et autres
Publié: (2026)
A Mapping Strategy for Interacting with Latent Audio Synthesis Using Artistic Materials
par: Zheng, Shuoyang, et autres
Publié: (2024)
par: Zheng, Shuoyang, et autres
Publié: (2024)
Enhancing DMI Interactions by Integrating Haptic Feedback for Intricate Vibrato Technique
par: Piao, Ziyue, et autres
Publié: (2024)
par: Piao, Ziyue, et autres
Publié: (2024)
Towards Temporally Explainable Dysarthric Speech Clarity Assessment
par: Park, Seohyun, et autres
Publié: (2025)
par: Park, Seohyun, et autres
Publié: (2025)
Enhancing the NAO: Extending Capabilities of Legacy Robots for Long-Term Research
par: Wilson, Austin, et autres
Publié: (2025)
par: Wilson, Austin, et autres
Publié: (2025)
A cross-talk robust multichannel VAD model for multiparty agent interactions trained using synthetic re-recordings
par: Han, Hyewon, et autres
Publié: (2024)
par: Han, Hyewon, et autres
Publié: (2024)
Interactive Sonification for Health and Energy using ChucK and Unity
par: Zhao, Yichun, et autres
Publié: (2024)
par: Zhao, Yichun, et autres
Publié: (2024)
USpeech: Ultrasound-Enhanced Speech with Minimal Human Effort via Cross-Modal Synthesis
par: Yu, Luca Jiang-Tao, et autres
Publié: (2024)
par: Yu, Luca Jiang-Tao, et autres
Publié: (2024)
Seeing Beyond Sound: Visualization and Abstraction in Audio Data Representation
par: Blum'e, Ashlae
Publié: (2025)
par: Blum'e, Ashlae
Publié: (2025)
Early Detection of Furniture-Infesting Wood-Boring Beetles Using CNN-LSTM Networks and MFCC-Based Acoustic Features
par: Manukalpa, J. M. Chan Sri, et autres
Publié: (2025)
par: Manukalpa, J. M. Chan Sri, et autres
Publié: (2025)
Interfacing with history: Curating with audio augmented objects
par: Cliffe, Laurence
Publié: (2024)
par: Cliffe, Laurence
Publié: (2024)
Transhuman Ansambl - Voice Beyond Language
par: Ivsic, Lucija, et autres
Publié: (2024)
par: Ivsic, Lucija, et autres
Publié: (2024)
Cervical Auscultation Machine Learning for Dysphagia Assessment
par: Chia, An An, et autres
Publié: (2024)
par: Chia, An An, et autres
Publié: (2024)
ExSampling: a system for the real-time ensemble performance of field-recorded environmental sounds
par: Kobayashi, Atsuya, et autres
Publié: (2020)
par: Kobayashi, Atsuya, et autres
Publié: (2020)
Adapting Whisper for Lightweight and Efficient Automatic Speech Recognition of Children for On-device Edge Applications
par: Dutta, Satwik, et autres
Publié: (2025)
par: Dutta, Satwik, et autres
Publié: (2025)
Real-time Generation of Various Types of Nodding for Avatar Attentive Listening System
par: Kato, Kazushi, et autres
Publié: (2025)
par: Kato, Kazushi, et autres
Publié: (2025)
BioSonix: Can Physics-Based Sonification Perceptualize Tissue Deformations From Tool Interactions?
par: Ruozzi, Veronica, et autres
Publié: (2025)
par: Ruozzi, Veronica, et autres
Publié: (2025)
Springboard, Roadblock or "Crutch"?: How Transgender Users Leverage Voice Changers for Gender Presentation in Social Virtual Reality
par: Povinelli, Kassie, et autres
Publié: (2024)
par: Povinelli, Kassie, et autres
Publié: (2024)
SCDiar: a streaming diarization system based on speaker change detection and speech recognition
par: Zheng, Naijun, et autres
Publié: (2025)
par: Zheng, Naijun, et autres
Publié: (2025)
Teach Me How to ImproVISe: Co-Designing an Augmented Piano Training System for Improvisation
par: Deja, Jordan Aiko, et autres
Publié: (2024)
par: Deja, Jordan Aiko, et autres
Publié: (2024)
Open vocabulary keyword spotting through transfer learning from speech synthesis
par: V, Kesavaraj, et autres
Publié: (2024)
par: V, Kesavaraj, et autres
Publié: (2024)
The effect of self-motion and room familiarity on sound source localization in virtual environments
par: Isserstedt, Niklas, et autres
Publié: (2024)
par: Isserstedt, Niklas, et autres
Publié: (2024)
NeckCare: Preventing Tech Neck using Hearable-based Multimodal Sensing
par: Chhaglani, Bhawana, et autres
Publié: (2024)
par: Chhaglani, Bhawana, et autres
Publié: (2024)
Documents similaires
-
Putting Language into Context Using Smartphone-Based Keyboard Logging
par: Bemmann, Florian, et autres
Publié: (2024) -
How Private is Low-Frequency Speech Audio in the Wild? An Analysis of Verbal Intelligibility by Humans and Machines
par: Liu, Ailin, et autres
Publié: (2024) -
SonicSieve: Bringing Directional Speech Extraction to Smartphones Using Acoustic Microstructures
par: Yuan, Kuang, et autres
Publié: (2025) -
A Near-Real-Time Processing Ego Speech Filtering Pipeline Designed for Speech Interruption During Human-Robot Interaction
par: Li, Yue, et autres
Publié: (2024) -
Evolving Performance Practices in Beethoven's Cello Sonatas: Tempo, Portamento, and Historical Interpretation of the First Movements
par: Sole, Ignasi
Publié: (2025)