Bridge-SR: Schrödinger Bridge for Efficient SR
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Chang, Chen, Zehua, Bao, Fan, Zhu, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Schrodinger Bridges Beat Diffusion Models on Text-to-Speech Synthesis
par: Chen, Zehua, et autres
Publié: (2023)
par: Chen, Zehua, et autres
Publié: (2023)
VoiceBridge: General Speech Restoration with One-step Latent Bridge Models
par: Zhang, Chi, et autres
Publié: (2025)
par: Zhang, Chi, et autres
Publié: (2025)
Schrödinger Bridge Consistency Trajectory Models for Speech Enhancement
par: Nishigori, Shuichiro, et autres
Publié: (2025)
par: Nishigori, Shuichiro, et autres
Publié: (2025)
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement
par: Nasretdinov, Rauf, et autres
Publié: (2025)
par: Nasretdinov, Rauf, et autres
Publié: (2025)
Few-step Adversarial Schrödinger Bridge for Generative Speech Enhancement
par: Han, Seungu, et autres
Publié: (2025)
par: Han, Seungu, et autres
Publié: (2025)
FlashSR: One-step Versatile Audio Super-resolution via Diffusion Distillation
par: Im, Jaekwon, et autres
Publié: (2025)
par: Im, Jaekwon, et autres
Publié: (2025)
Diffusion-based Speech Enhancement with Schrödinger Bridge and Symmetric Noise Schedule
par: Wang, Siyi, et autres
Publié: (2024)
par: Wang, Siyi, et autres
Publié: (2024)
VS-Singer: Vision-Guided Stereo Singing Voice Synthesis with Consistency Schrödinger Bridge
par: Zhao, Zijing, et autres
Publié: (2025)
par: Zhao, Zijing, et autres
Publié: (2025)
HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution
par: Zhao, Shengkui, et autres
Publié: (2025)
par: Zhao, Shengkui, et autres
Publié: (2025)
DiffGAP: A Lightweight Diffusion Module in Contrastive Space for Bridging Cross-Model Gap
par: Mo, Shentong, et autres
Publié: (2025)
par: Mo, Shentong, et autres
Publié: (2025)
A2SB: Audio-to-Audio Schrodinger Bridges
par: Kong, Zhifeng, et autres
Publié: (2025)
par: Kong, Zhifeng, et autres
Publié: (2025)
Schrödinger Bridge Mamba for One-Step Speech Enhancement
par: Yang, Jing, et autres
Publié: (2025)
par: Yang, Jing, et autres
Publié: (2025)
EmoOmni: Bridging Emotional Understanding and Expression in Omni-Modal LLMs
par: Tian, Wenjie, et autres
Publié: (2026)
par: Tian, Wenjie, et autres
Publié: (2026)
Bridging the gap between training and inference in LM-based TTS models
par: Zhang, Ruonan, et autres
Publié: (2025)
par: Zhang, Ruonan, et autres
Publié: (2025)
Language-Codec: Bridging Discrete Codec Representations and Speech Language Models
par: Ji, Shengpeng, et autres
Publié: (2024)
par: Ji, Shengpeng, et autres
Publié: (2024)
ClearerVoice-Studio: Bridging Advanced Speech Processing Research and Practical Deployment
par: Zhao, Shengkui, et autres
Publié: (2025)
par: Zhao, Shengkui, et autres
Publié: (2025)
Bridging Speech Emotion Recognition and Personality: Dataset and Temporal Interaction Condition Network
par: Gao, Yuan, et autres
Publié: (2025)
par: Gao, Yuan, et autres
Publié: (2025)
UniverSR: Unified and Versatile Audio Super-Resolution via Vocoder-Free Flow Matching
par: Choi, Woongjib, et autres
Publié: (2025)
par: Choi, Woongjib, et autres
Publié: (2025)
Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection
par: Huang, Shangkun, et autres
Publié: (2025)
par: Huang, Shangkun, et autres
Publié: (2025)
MaskSR: Masked Language Model for Full-band Speech Restoration
par: Li, Xu, et autres
Publié: (2024)
par: Li, Xu, et autres
Publié: (2024)
The Whole Is Greater than the Sum of Its Parts: Improving Music Source Separation by Bridging Network
par: Sawata, Ryosuke, et autres
Publié: (2023)
par: Sawata, Ryosuke, et autres
Publié: (2023)
Bridging the Gap: Integrating Pre-trained Speech Enhancement and Recognition Models for Robust Speech Recognition
par: Wang, Kuan-Chen, et autres
Publié: (2024)
par: Wang, Kuan-Chen, et autres
Publié: (2024)
DualStream Contextual Fusion Network: Efficient Target Speaker Extraction by Leveraging Mixture and Enrollment Interactions
par: Xue, Ke, et autres
Publié: (2025)
par: Xue, Ke, et autres
Publié: (2025)
Reducing the Gap Between Pretrained Speech Enhancement and Recognition Models Using a Real Speech-Trained Bridging Module
par: Cui, Zhongjian, et autres
Publié: (2025)
par: Cui, Zhongjian, et autres
Publié: (2025)
FreeAudio: Training-Free Timing Planning for Controllable Long-Form Text-to-Audio Generation
par: Jiang, Yuxuan, et autres
Publié: (2025)
par: Jiang, Yuxuan, et autres
Publié: (2025)
Zero-Shot Fake Video Detection by Audio-Visual Consistency
par: Li, Xiaolou, et autres
Publié: (2024)
par: Li, Xiaolou, et autres
Publié: (2024)
Whisper-PMFA: Partial Multi-Scale Feature Aggregation for Speaker Verification using Whisper Models
par: Zhao, Yiyang, et autres
Publié: (2024)
par: Zhao, Yiyang, et autres
Publié: (2024)
Bridging the Perception Gap: A Lightweight Coarse-to-Fine Architecture for Edge Audio Systems
par: Zhang, Hengfan, et autres
Publié: (2026)
par: Zhang, Hengfan, et autres
Publié: (2026)
Deep Learning for Personalized Binaural Audio Reproduction
par: Lu, Xikun, et autres
Publié: (2025)
par: Lu, Xikun, et autres
Publié: (2025)
Bridging Language Gaps in Audio-Text Retrieval
par: Yan, Zhiyong, et autres
Publié: (2024)
par: Yan, Zhiyong, et autres
Publié: (2024)
Advancing Singlish Understanding: Bridging the Gap with Datasets and Multimodal Models
par: Wang, Bin, et autres
Publié: (2025)
par: Wang, Bin, et autres
Publié: (2025)
Bridging The Multi-Modality Gaps of Audio, Visual and Linguistic for Speech Enhancement
par: Lin, Meng-Ping, et autres
Publié: (2025)
par: Lin, Meng-Ping, et autres
Publié: (2025)
Frequency-mix Knowledge Distillation for Fake Speech Detection
par: Fan, Cunhang, et autres
Publié: (2024)
par: Fan, Cunhang, et autres
Publié: (2024)
Gaussian Flow Bridges for Audio Domain Transfer with Unpaired Data
par: Moliner, Eloi, et autres
Publié: (2024)
par: Moliner, Eloi, et autres
Publié: (2024)
Enhancing Automatic Chord Recognition through LLM Chain-of-Thought Reasoning
par: Chang, Chih-Cheng, et autres
Publié: (2025)
par: Chang, Chih-Cheng, et autres
Publié: (2025)
Omni-directional attention mechanism based on Mamba for speech separation
par: Xue, Ke, et autres
Publié: (2026)
par: Xue, Ke, et autres
Publié: (2026)
Data-Efficient Low-Complexity Acoustic Scene Classification via Distilling and Progressive Pruning
par: Han, Bing, et autres
Publié: (2024)
par: Han, Bing, et autres
Publié: (2024)
CORD: Bridging the Audio-Text Reasoning Gap via Weighted On-policy Cross-modal Distillation
par: Hu, Jing, et autres
Publié: (2026)
par: Hu, Jing, et autres
Publié: (2026)
BEAST: Online Joint Beat and Downbeat Tracking Based on Streaming Transformer
par: Chang, Chih-Cheng, et autres
Publié: (2023)
par: Chang, Chih-Cheng, et autres
Publié: (2023)
SA-SOT: Speaker-Aware Serialized Output Training for Multi-Talker ASR
par: Fan, Zhiyun, et autres
Publié: (2024)
par: Fan, Zhiyun, et autres
Publié: (2024)
Documents similaires
-
Schrodinger Bridges Beat Diffusion Models on Text-to-Speech Synthesis
par: Chen, Zehua, et autres
Publié: (2023) -
VoiceBridge: General Speech Restoration with One-step Latent Bridge Models
par: Zhang, Chi, et autres
Publié: (2025) -
Schrödinger Bridge Consistency Trajectory Models for Speech Enhancement
par: Nishigori, Shuichiro, et autres
Publié: (2025) -
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement
par: Nasretdinov, Rauf, et autres
Publié: (2025) -
Few-step Adversarial Schrödinger Bridge for Generative Speech Enhancement
par: Han, Seungu, et autres
Publié: (2025)