NeoLightning: A Modern Reimagination of Gesture-Based Sound Design
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Yonghyun, Park, Sangheon, Parker, Marcus, Seu, Donghoon, Smith, Alexandria |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Freetalker: Controllable Speech and Text-Driven Gesture Generation Based on Diffusion Models for Enhanced Speaker Naturalness
par: Yang, Sicheng, et autres
Publié: (2024)
par: Yang, Sicheng, et autres
Publié: (2024)
Assessing the Viability of Wave Field Synthesis in VR-Based Cognitive Research
par: Kahl, Benjamin
Publié: (2025)
par: Kahl, Benjamin
Publié: (2025)
Real-Time Word-Level Temporal Segmentation in Streaming Speech Recognition
par: Nishida, Naoto, et autres
Publié: (2025)
par: Nishida, Naoto, et autres
Publié: (2025)
Capturing Cancer as Music: Cancer Mechanisms Expressed through Musification
par: Hnatyshyn, Rostyslav, et autres
Publié: (2024)
par: Hnatyshyn, Rostyslav, et autres
Publié: (2024)
Creating Aesthetic Sonifications on the Web with SIREN
par: Peng, Tristan, et autres
Publié: (2024)
par: Peng, Tristan, et autres
Publié: (2024)
Robust Dual-Modal Speech Keyword Spotting for XR Headsets
par: Cai, Zhuojiang, et autres
Publié: (2024)
par: Cai, Zhuojiang, et autres
Publié: (2024)
MR-DAW: Towards Collaborative Digital Audio Workstations in Mixed Reality
par: Hopkins, Torin, et autres
Publié: (2026)
par: Hopkins, Torin, et autres
Publié: (2026)
AVE Speech: A Comprehensive Multi-Modal Dataset for Speech Recognition Integrating Audio, Visual, and Electromyographic Signals
par: Zhou, Dongliang, et autres
Publié: (2025)
par: Zhou, Dongliang, et autres
Publié: (2025)
VidTune: Creating Video Soundtracks with Generative Music and Contextual Thumbnails
par: Huh, Mina, et autres
Publié: (2026)
par: Huh, Mina, et autres
Publié: (2026)
DiM-Gestor: Co-Speech Gesture Generation with Adaptive Layer Normalization Mamba-2
par: Zhang, Fan, et autres
Publié: (2024)
par: Zhang, Fan, et autres
Publié: (2024)
AI TrackMate: Finally, Someone Who Will Give Your Music More Than Just "Sounds Great!"
par: Jiang, Yi-Lin, et autres
Publié: (2024)
par: Jiang, Yi-Lin, et autres
Publié: (2024)
Flowers Revisited: A Preliminary Replication of Flowers et al. 1997
par: Enge, Kajetan, et autres
Publié: (2024)
par: Enge, Kajetan, et autres
Publié: (2024)
Workflow-Based Evaluation of Music Generation Systems
par: Dadman, Shayan, et autres
Publié: (2025)
par: Dadman, Shayan, et autres
Publié: (2025)
Acoustic Wave Modeling Using 2D FDTD: Applications in Unreal Engine For Dynamic Sound Rendering
par: Samsurya, Bilkent
Publié: (2025)
par: Samsurya, Bilkent
Publié: (2025)
Soundify: Matching Sound Effects to Video
par: Lin, David Chuan-En, et autres
Publié: (2021)
par: Lin, David Chuan-En, et autres
Publié: (2021)
MetaBGM: Dynamic Soundtrack Transformation For Continuous Multi-Scene Experiences With Ambient Awareness And Personalization
par: Liu, Haoxuan, et autres
Publié: (2024)
par: Liu, Haoxuan, et autres
Publié: (2024)
Proceedings of The second international workshop on eXplainable AI for the Arts (XAIxArts)
par: Bryan-Kinns, Nick, et autres
Publié: (2024)
par: Bryan-Kinns, Nick, et autres
Publié: (2024)
A Multi-Agent AI Framework for Immersive Audiobook Production through Spatial Audio and Neural Narration
par: Selvamani, Shaja Arul, et autres
Publié: (2025)
par: Selvamani, Shaja Arul, et autres
Publié: (2025)
Towards Reliable Large Audio Language Model
par: Ma, Ziyang, et autres
Publié: (2025)
par: Ma, Ziyang, et autres
Publié: (2025)
G-STAR: End-to-End Global Speaker-Tracking Attributed Recognition
par: Peng, Jing, et autres
Publié: (2026)
par: Peng, Jing, et autres
Publié: (2026)
Sound-Based Recognition of Touch Gestures and Emotions for Enhanced Human-Robot Interaction
par: Hou, Yuanbo, et autres
Publié: (2024)
par: Hou, Yuanbo, et autres
Publié: (2024)
FastTalker: Jointly Generating Speech and Conversational Gestures from Text
par: Guo, Zixin, et autres
Publié: (2024)
par: Guo, Zixin, et autres
Publié: (2024)
MIST: Multimodal Interactive Speech-based Tool-calling Conversational Assistants for Smart Homes
par: Chen, Maximillian, et autres
Publié: (2026)
par: Chen, Maximillian, et autres
Publié: (2026)
Revival: Collaborative Artistic Creation through Human-AI Interactions in Musical Creativity
par: Lee, Keon Ju M., et autres
Publié: (2025)
par: Lee, Keon Ju M., et autres
Publié: (2025)
HiCMAE: Hierarchical Contrastive Masked Autoencoder for Self-Supervised Audio-Visual Emotion Recognition
par: Sun, Licai, et autres
Publié: (2024)
par: Sun, Licai, et autres
Publié: (2024)
SoundShift: Exploring Sound Manipulations for Accessible Mixed-Reality Awareness
par: Chang, Ruei-Che, et autres
Publié: (2024)
par: Chang, Ruei-Che, et autres
Publié: (2024)
SonicVisionLM: Playing Sound with Vision Language Models
par: Xie, Zhifeng, et autres
Publié: (2024)
par: Xie, Zhifeng, et autres
Publié: (2024)
Sound-VECaps: Improving Audio Generation with Visual Enhanced Captions
par: Yuan, Yi, et autres
Publié: (2024)
par: Yuan, Yi, et autres
Publié: (2024)
RVCBench: Benchmarking the Robustness of Voice Cloning Across Modern Audio Generation Models
par: Jin, Ruinan, et autres
Publié: (2026)
par: Jin, Ruinan, et autres
Publié: (2026)
Cross-Modal Watermarking for Authentic Audio Recovery and Tamper Localization in Synthesized Audiovisual Forgeries
par: Kim, Minyoung, et autres
Publié: (2025)
par: Kim, Minyoung, et autres
Publié: (2025)
Seeing Beyond Sound: Visualization and Abstraction in Audio Data Representation
par: Blum'e, Ashlae
Publié: (2025)
par: Blum'e, Ashlae
Publié: (2025)
Sound2Hap: Learning Audio-to-Vibrotactile Haptic Generation from Human Ratings
par: Li, Yinan, et autres
Publié: (2026)
par: Li, Yinan, et autres
Publié: (2026)
UltrasonicSpheres: Localized, Multi-Channel Sound Spheres Using Off-the-Shelf Speakers and Earables
par: Küttner, Michael, et autres
Publié: (2025)
par: Küttner, Michael, et autres
Publié: (2025)
Sound Judgment: Properties of Consequential Sounds Affecting Human-Perception of Robots
par: Allen, Aimee, et autres
Publié: (2025)
par: Allen, Aimee, et autres
Publié: (2025)
Reimagining Dance: Real-time Music Co-creation between Dancers and AI
par: Vechtomova, Olga, et autres
Publié: (2025)
par: Vechtomova, Olga, et autres
Publié: (2025)
Microphone Conversion: Mitigating Device Variability in Sound Event Classification
par: Ryu, Myeonghoon, et autres
Publié: (2024)
par: Ryu, Myeonghoon, et autres
Publié: (2024)
CatchPhrase: EXPrompt-Guided Encoder Adaptation for Audio-to-Image Generation
par: Oh, Hyunwoo, et autres
Publié: (2025)
par: Oh, Hyunwoo, et autres
Publié: (2025)
Multimodal Emotion Coupling via Speech-to-Facial and Bodily Gestures in Dyadic Interaction
par: Herbuela, Von Ralph Dane Marquez, et autres
Publié: (2025)
par: Herbuela, Von Ralph Dane Marquez, et autres
Publié: (2025)
Teach Me How to ImproVISe: Co-Designing an Augmented Piano Training System for Improvisation
par: Deja, Jordan Aiko, et autres
Publié: (2024)
par: Deja, Jordan Aiko, et autres
Publié: (2024)
Trusted Fake Audio Detection Based on Dirichlet Distribution
par: Ding, Chi, et autres
Publié: (2025)
par: Ding, Chi, et autres
Publié: (2025)
Documents similaires
-
Freetalker: Controllable Speech and Text-Driven Gesture Generation Based on Diffusion Models for Enhanced Speaker Naturalness
par: Yang, Sicheng, et autres
Publié: (2024) -
Assessing the Viability of Wave Field Synthesis in VR-Based Cognitive Research
par: Kahl, Benjamin
Publié: (2025) -
Real-Time Word-Level Temporal Segmentation in Streaming Speech Recognition
par: Nishida, Naoto, et autres
Publié: (2025) -
Capturing Cancer as Music: Cancer Mechanisms Expressed through Musification
par: Hnatyshyn, Rostyslav, et autres
Publié: (2024) -
Creating Aesthetic Sonifications on the Web with SIREN
par: Peng, Tristan, et autres
Publié: (2024)