Guardado en:
| Autores principales: | Freye, Arthur, Müller, Jannis |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2402.01773 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Qubit Instrumentation of Entanglement
por: Carney, Mark
Publicado: (2025)
por: Carney, Mark
Publicado: (2025)
Bayesian Speech Synthesizers Can Learn from Multiple Teachers
por: Zhang, Ziyang, et al.
Publicado: (2025)
por: Zhang, Ziyang, et al.
Publicado: (2025)
Layer-wise Analysis for Quality of Multilingual Synthesized Speech
por: Cooper, Erica, et al.
Publicado: (2025)
por: Cooper, Erica, et al.
Publicado: (2025)
Bridge-SR: Schrödinger Bridge for Efficient SR
por: Li, Chang, et al.
Publicado: (2025)
por: Li, Chang, et al.
Publicado: (2025)
Creating Personalized Synthetic Voices from Articulation Impaired Speech Using Augmented Reconstruction Loss
por: Tian, Yusheng, et al.
Publicado: (2024)
por: Tian, Yusheng, et al.
Publicado: (2024)
Schrödinger Bridge Consistency Trajectory Models for Speech Enhancement
por: Nishigori, Shuichiro, et al.
Publicado: (2025)
por: Nishigori, Shuichiro, et al.
Publicado: (2025)
Intro to Quantum Harmony: Chords in Superposition
por: Dobrian, Christopher, et al.
Publicado: (2024)
por: Dobrian, Christopher, et al.
Publicado: (2024)
Quantum-Trained Convolutional Neural Network for Deepfake Audio Detection
por: Lin, Chu-Hsuan Abraham, et al.
Publicado: (2024)
por: Lin, Chu-Hsuan Abraham, et al.
Publicado: (2024)
Techniques for Quantum-Computing-Aided Algorithmic Composition: Experiments in Rhythm, Timbre, Harmony, and Space
por: Dobrian, Christopher, et al.
Publicado: (2025)
por: Dobrian, Christopher, et al.
Publicado: (2025)
From Qubits to Rhythm: Exploring Quantum Random Walks in Rhythmspaces
por: Aguado-Yáñez, María, et al.
Publicado: (2025)
por: Aguado-Yáñez, María, et al.
Publicado: (2025)
Control Surfaces: Using the Commodore 64 and Analog Synthesizer to Expand Musical Boundaries
por: McKemie, Daniel
Publicado: (2025)
por: McKemie, Daniel
Publicado: (2025)
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement
por: Nasretdinov, Rauf, et al.
Publicado: (2025)
por: Nasretdinov, Rauf, et al.
Publicado: (2025)
Few-step Adversarial Schrödinger Bridge for Generative Speech Enhancement
por: Han, Seungu, et al.
Publicado: (2025)
por: Han, Seungu, et al.
Publicado: (2025)
Diffusion-based Speech Enhancement with Schrödinger Bridge and Symmetric Noise Schedule
por: Wang, Siyi, et al.
Publicado: (2024)
por: Wang, Siyi, et al.
Publicado: (2024)
A Bandpass Twin-T Active Filter Used in the Buchla 200 Electric Music Box Synthesizer
por: Lanterman, Aaron D.
Publicado: (2024)
por: Lanterman, Aaron D.
Publicado: (2024)
MuSE-SVS: Multi-Singer Emotional Singing Voice Synthesizer that Controls Emotional Intensity
por: Kim, Sungjae, et al.
Publicado: (2022)
por: Kim, Sungjae, et al.
Publicado: (2022)
SynthCloner: Synthesizer-style Audio Transfer via Factorized Codec with ADSR Envelope Control
por: Liu, Jeng-Yue, et al.
Publicado: (2025)
por: Liu, Jeng-Yue, et al.
Publicado: (2025)
VS-Singer: Vision-Guided Stereo Singing Voice Synthesis with Consistency Schrödinger Bridge
por: Zhao, Zijing, et al.
Publicado: (2025)
por: Zhao, Zijing, et al.
Publicado: (2025)
A Survey on 30+ Years of Automatic Singing Assessment and Singing Information Processing
por: Santos, Arthur N. dos, et al.
Publicado: (2026)
por: Santos, Arthur N. dos, et al.
Publicado: (2026)
String Sound Synthesizer on GPU-accelerated Finite Difference Scheme
por: Lee, Jin Woo, et al.
Publicado: (2023)
por: Lee, Jin Woo, et al.
Publicado: (2023)
Exploring the Potential of Data-Driven Spatial Audio Enhancement Using a Single-Channel Model
por: Santos, Arthur N. dos, et al.
Publicado: (2024)
por: Santos, Arthur N. dos, et al.
Publicado: (2024)
A Study on Synthesizing Expressive Violin Performances: Approaches and Comparisons
por: Hung, Tzu-Yun, et al.
Publicado: (2024)
por: Hung, Tzu-Yun, et al.
Publicado: (2024)
Robust AI-Synthesized Speech Detection Using Feature Decomposition Learning and Synthesizer Feature Augmentation
por: Zhang, Kuiyuan, et al.
Publicado: (2024)
por: Zhang, Kuiyuan, et al.
Publicado: (2024)
Cross-Modal Watermarking for Authentic Audio Recovery and Tamper Localization in Synthesized Audiovisual Forgeries
por: Kim, Minyoung, et al.
Publicado: (2025)
por: Kim, Minyoung, et al.
Publicado: (2025)
DiffMoog: a Differentiable Modular Synthesizer for Sound Matching
por: Uzrad, Noy, et al.
Publicado: (2024)
por: Uzrad, Noy, et al.
Publicado: (2024)
Pitch Contour Exploration Across Audio Domains: A Vision-Based Transfer Learning Approach
por: Abeßer, Jakob, et al.
Publicado: (2025)
por: Abeßer, Jakob, et al.
Publicado: (2025)
Improving Generalization for AI-Synthesized Voice Detection
por: Ren, Hainan, et al.
Publicado: (2024)
por: Ren, Hainan, et al.
Publicado: (2024)
An Efficient End-to-End Approach to Noise Invariant Speech Features via Multi-Task Learning
por: Guimarães, Heitor R., et al.
Publicado: (2024)
por: Guimarães, Heitor R., et al.
Publicado: (2024)
Creating a Good Teacher for Knowledge Distillation in Acoustic Scene Classification
por: Morocutti, Tobias, et al.
Publicado: (2025)
por: Morocutti, Tobias, et al.
Publicado: (2025)
MLAAD: The Multi-Language Audio Anti-Spoofing Dataset
por: Müller, Nicolas M., et al.
Publicado: (2024)
por: Müller, Nicolas M., et al.
Publicado: (2024)
Creative Text-to-Audio Generation via Synthesizer Programming
por: Cherep, Manuel, et al.
Publicado: (2024)
por: Cherep, Manuel, et al.
Publicado: (2024)
Synthesizer Sound Matching Using Audio Spectrogram Transformers
por: Bruford, Fred, et al.
Publicado: (2024)
por: Bruford, Fred, et al.
Publicado: (2024)
Diffusion Synthesizer for Efficient Multilingual Speech to Speech Translation
por: Hirschkind, Nameer, et al.
Publicado: (2024)
por: Hirschkind, Nameer, et al.
Publicado: (2024)
Standardized Evaluation of Fetal Phonocardiography Processing Methods
por: Müller, Kristóf, et al.
Publicado: (2025)
por: Müller, Kristóf, et al.
Publicado: (2025)
A Steered Response Power Method for Sound Source Localization With Generic Acoustic Models
por: Müller, Kaspar, et al.
Publicado: (2025)
por: Müller, Kaspar, et al.
Publicado: (2025)
Head Orientation Estimation with Distributed Microphones Using Speech Radiation Patterns
por: Müller, Kaspar, et al.
Publicado: (2023)
por: Müller, Kaspar, et al.
Publicado: (2023)
An accurate measurement of parametric array using a spurious sound filter topologically equivalent to a half-wavelength resonator
por: Kim, Woongji, et al.
Publicado: (2025)
por: Kim, Woongji, et al.
Publicado: (2025)
Utilizing TTS Synthesized Data for Efficient Development of Keyword Spotting Model
por: Park, Hyun Jin, et al.
Publicado: (2024)
por: Park, Hyun Jin, et al.
Publicado: (2024)
emg2speech: Synthesizing speech from electromyography using self-supervised speech models
por: Gowda, Harshavardhana T., et al.
Publicado: (2025)
por: Gowda, Harshavardhana T., et al.
Publicado: (2025)
Design, analysis, and experimental validation of a stepped plate parametric array loudspeaker
por: Kim, Woongji, et al.
Publicado: (2025)
por: Kim, Woongji, et al.
Publicado: (2025)
Ejemplares similares
-
Qubit Instrumentation of Entanglement
por: Carney, Mark
Publicado: (2025) -
Bayesian Speech Synthesizers Can Learn from Multiple Teachers
por: Zhang, Ziyang, et al.
Publicado: (2025) -
Layer-wise Analysis for Quality of Multilingual Synthesized Speech
por: Cooper, Erica, et al.
Publicado: (2025) -
Bridge-SR: Schrödinger Bridge for Efficient SR
por: Li, Chang, et al.
Publicado: (2025) -
Creating Personalized Synthetic Voices from Articulation Impaired Speech Using Augmented Reconstruction Loss
por: Tian, Yusheng, et al.
Publicado: (2024)