Salvato in:
| Autori principali: | He, Xian, Zeng, Wei, Wang, Ye |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2510.10175 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Disentangling Score Content and Performance Style for Joint Piano Rendering and Transcription
di: Zeng, Wei, et al.
Pubblicazione: (2025)
di: Zeng, Wei, et al.
Pubblicazione: (2025)
End-to-End Real-World Polyphonic Piano Audio-to-Score Transcription with Hierarchical Decoding
di: Zeng, Wei, et al.
Pubblicazione: (2024)
di: Zeng, Wei, et al.
Pubblicazione: (2024)
Towards An Integrated Approach for Expressive Piano Performance Synthesis from Music Scores
di: Tang, Jingjing, et al.
Pubblicazione: (2025)
di: Tang, Jingjing, et al.
Pubblicazione: (2025)
Revisiting and Improving Scoring Fusion for Spoofing-aware Speaker Verification Using Compositional Data Analysis
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
CosyAudio: Improving Audio Generation with Confidence Scores and Synthetic Captions
di: Zhu, Xinfa, et al.
Pubblicazione: (2025)
di: Zhu, Xinfa, et al.
Pubblicazione: (2025)
A Study on Synthesizing Expressive Violin Performances: Approaches and Comparisons
di: Hung, Tzu-Yun, et al.
Pubblicazione: (2024)
di: Hung, Tzu-Yun, et al.
Pubblicazione: (2024)
Discriminative-Generative Target Speaker Extraction with Decoder-Only Language Models
di: Zeng, Bang, et al.
Pubblicazione: (2026)
di: Zeng, Bang, et al.
Pubblicazione: (2026)
Sounding Out Reconstruction Error-Based Evaluation of Generative Models of Expressive Performance
di: Peter, Silvan David, et al.
Pubblicazione: (2023)
di: Peter, Silvan David, et al.
Pubblicazione: (2023)
ELGAR: Expressive Cello Performance Motion Generation for Audio Rendition
di: Qiu, Zhiping, et al.
Pubblicazione: (2025)
di: Qiu, Zhiping, et al.
Pubblicazione: (2025)
Improving Unsupervised Clean-to-Rendered Guitar Tone Transformation Using GANs and Integrated Unaligned Clean Data
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
DiffSound: Differentiable Modal Sound Rendering and Inverse Rendering for Diverse Inference Tasks
di: Jin, Xutong, et al.
Pubblicazione: (2024)
di: Jin, Xutong, et al.
Pubblicazione: (2024)
Expressivity-aware Music Performance Retrieval using Mid-level Perceptual Features and Emotion Word Embeddings
di: Chowdhury, Shreyan, et al.
Pubblicazione: (2024)
di: Chowdhury, Shreyan, et al.
Pubblicazione: (2024)
MIDI-VALLE: Improving Expressive Piano Performance Synthesis Through Neural Codec Language Modelling
di: Tang, Jingjing, et al.
Pubblicazione: (2025)
di: Tang, Jingjing, et al.
Pubblicazione: (2025)
Improving Acoustic Scene Classification in Low-Resource Conditions
di: Chen, Zhi, et al.
Pubblicazione: (2024)
di: Chen, Zhi, et al.
Pubblicazione: (2024)
CONTUNER: Singing Voice Beautifying with Pitch and Expressiveness Condition
di: Wang, Jianzong, et al.
Pubblicazione: (2024)
di: Wang, Jianzong, et al.
Pubblicazione: (2024)
Hierarchical Control of Emotion Rendering in Speech Synthesis
di: Inoue, Sho, et al.
Pubblicazione: (2024)
di: Inoue, Sho, et al.
Pubblicazione: (2024)
Comparative Analysis Of Discriminative Deep Learning-Based Noise Reduction Methods In Low SNR Scenarios
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
Towards Expressive Zero-Shot Speech Synthesis with Hierarchical Prosody Modeling
di: Jiang, Yuepeng, et al.
Pubblicazione: (2024)
di: Jiang, Yuepeng, et al.
Pubblicazione: (2024)
Expressive MIDI-format Piano Performance Generation
di: Liu, Jingwei
Pubblicazione: (2024)
di: Liu, Jingwei
Pubblicazione: (2024)
Melodic and Metrical Elements of Expressiveness in Hindustani Vocal Music
di: Bhake, Yash, et al.
Pubblicazione: (2025)
di: Bhake, Yash, et al.
Pubblicazione: (2025)
Score-informed Music Source Separation: Improving Synthetic-to-real Generalization in Classical Music
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
MSceneSpeech: A Multi-Scene Speech Dataset For Expressive Speech Synthesis
di: Yang, Qian, et al.
Pubblicazione: (2024)
di: Yang, Qian, et al.
Pubblicazione: (2024)
Learning Expressive Disentangled Speech Representations with Soft Speech Units and Adversarial Style Augmentation
di: Deng, Yimin, et al.
Pubblicazione: (2024)
di: Deng, Yimin, et al.
Pubblicazione: (2024)
Score-Informed Transformer for Refining MIDI Velocity in Automatic Music Transcription
di: He, Zhanhong, et al.
Pubblicazione: (2025)
di: He, Zhanhong, et al.
Pubblicazione: (2025)
MelodyT5: A Unified Score-to-Score Transformer for Symbolic Music Processing
di: Wu, Shangda, et al.
Pubblicazione: (2024)
di: Wu, Shangda, et al.
Pubblicazione: (2024)
Acoustic Volume Rendering for Neural Impulse Response Fields
di: Lan, Zitong, et al.
Pubblicazione: (2024)
di: Lan, Zitong, et al.
Pubblicazione: (2024)
Expressive paragraph text-to-speech synthesis with multi-step variational autoencoder
di: Li, Xuyuan, et al.
Pubblicazione: (2023)
di: Li, Xuyuan, et al.
Pubblicazione: (2023)
Pureformer-VC: Non-parallel Voice Conversion with Pure Stylized Transformer Blocks and Triplet Discriminative Training
di: Yao, Wenhan, et al.
Pubblicazione: (2025)
di: Yao, Wenhan, et al.
Pubblicazione: (2025)
MM-TTS: Multi-modal Prompt based Style Transfer for Expressive Text-to-Speech Synthesis
di: Guan, Wenhao, et al.
Pubblicazione: (2023)
di: Guan, Wenhao, et al.
Pubblicazione: (2023)
Ambisonics Binaural Rendering via Masked Magnitude Least Squares
di: Berebi, Or, et al.
Pubblicazione: (2025)
di: Berebi, Or, et al.
Pubblicazione: (2025)
DrawSpeech: Expressive Speech Synthesis Using Prosodic Sketches as Control Conditions
di: Chen, Weidong, et al.
Pubblicazione: (2025)
di: Chen, Weidong, et al.
Pubblicazione: (2025)
Enhancing Expressive Voice Conversion with Discrete Pitch-Conditioned Flow Matching Model
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
di: Zuo, Jialong, et al.
Pubblicazione: (2025)
Boosting Multi-Speaker Expressive Speech Synthesis with Semi-supervised Contrastive Learning
di: Zhu, Xinfa, et al.
Pubblicazione: (2023)
di: Zhu, Xinfa, et al.
Pubblicazione: (2023)
Chain-Talker: Chain Understanding and Rendering for Empathetic Conversational Speech Synthesis
di: Hu, Yifan, et al.
Pubblicazione: (2025)
di: Hu, Yifan, et al.
Pubblicazione: (2025)
MuseAgent-1: Interactive Grounded Multimodal Understanding of Music Scores and Performance Audio
di: Zhao, Qihao, et al.
Pubblicazione: (2026)
di: Zhao, Qihao, et al.
Pubblicazione: (2026)
Enhancing Expressiveness in Dance Generation via Integrating Frequency and Music Style Information
di: Huang, Qiaochu, et al.
Pubblicazione: (2024)
di: Huang, Qiaochu, et al.
Pubblicazione: (2024)
SaD: A Scenario-Aware Discriminator for Speech Enhancement
di: Yuan, Xihao, et al.
Pubblicazione: (2025)
di: Yuan, Xihao, et al.
Pubblicazione: (2025)
A Hybrid Discriminative and Generative System for Universal Speech Enhancement
di: Liu, Yinghao, et al.
Pubblicazione: (2026)
di: Liu, Yinghao, et al.
Pubblicazione: (2026)
Streaming Keyword Spotting Boosted by Cross-layer Discrimination Consistency
di: Xi, Yu, et al.
Pubblicazione: (2024)
di: Xi, Yu, et al.
Pubblicazione: (2024)
SHroom: A Python Framework for Ambisonics Room Acoustics Simulation and Binaural Rendering
di: Gayer, Yhonatan
Pubblicazione: (2026)
di: Gayer, Yhonatan
Pubblicazione: (2026)
Documenti analoghi
-
Disentangling Score Content and Performance Style for Joint Piano Rendering and Transcription
di: Zeng, Wei, et al.
Pubblicazione: (2025) -
End-to-End Real-World Polyphonic Piano Audio-to-Score Transcription with Hierarchical Decoding
di: Zeng, Wei, et al.
Pubblicazione: (2024) -
Towards An Integrated Approach for Expressive Piano Performance Synthesis from Music Scores
di: Tang, Jingjing, et al.
Pubblicazione: (2025) -
Revisiting and Improving Scoring Fusion for Spoofing-aware Speaker Verification Using Compositional Data Analysis
di: Wang, Xin, et al.
Pubblicazione: (2024) -
CosyAudio: Improving Audio Generation with Confidence Scores and Synthetic Captions
di: Zhu, Xinfa, et al.
Pubblicazione: (2025)