RFM-Editing: Rectified Flow Matching for Text-guided Audio Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Gao, Liting, Yuan, Yi, Chen, Yaru, Cheng, Yuelan, Li, Zhenbo, Wen, Juan, Zhang, Shubin, Wang, Wenwu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion
di: Zhao, Junqi, et al.
Pubblicazione: (2025)
di: Zhao, Junqi, et al.
Pubblicazione: (2025)
COMET: Concept Space Dissection of the Modality Gap in Audio-Text Multimodal Contrastive Embeddings
di: Zhu, Yonggang, et al.
Pubblicazione: (2026)
di: Zhu, Yonggang, et al.
Pubblicazione: (2026)
Audio Prompt Adapter: Unleashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning
di: Tsai, Fang-Duo, et al.
Pubblicazione: (2024)
di: Tsai, Fang-Duo, et al.
Pubblicazione: (2024)
Unifying Speech Editing Detection and Content Localization via Prior-Enhanced Audio LLMs
di: Xue, Jun, et al.
Pubblicazione: (2026)
di: Xue, Jun, et al.
Pubblicazione: (2026)
MusRec: Zero-Shot Text-to-Music Editing via Rectified Flow and Diffusion Transformers
di: Boudaghi, Ali, et al.
Pubblicazione: (2025)
di: Boudaghi, Ali, et al.
Pubblicazione: (2025)
VoiceFlow: Efficient Text-to-Speech with Rectified Flow Matching
di: Guo, Yiwei, et al.
Pubblicazione: (2023)
di: Guo, Yiwei, et al.
Pubblicazione: (2023)
Prompt-guided Precise Audio Editing with Diffusion Models
di: Xu, Manjie, et al.
Pubblicazione: (2024)
di: Xu, Manjie, et al.
Pubblicazione: (2024)
DreamAudio: Customized Text-to-Audio Generation with Diffusion Models
di: Yuan, Yi, et al.
Pubblicazione: (2025)
di: Yuan, Yi, et al.
Pubblicazione: (2025)
Audio ControlNet for Fine-Grained Audio Generation and Editing
di: Zhu, Haina, et al.
Pubblicazione: (2026)
di: Zhu, Haina, et al.
Pubblicazione: (2026)
SlimSpeech: Lightweight and Efficient Text-to-Speech with Slim Rectified Flow
di: Wang, Kaidi, et al.
Pubblicazione: (2025)
di: Wang, Kaidi, et al.
Pubblicazione: (2025)
MeanAudio: Fast and Faithful Text-to-Audio Generation with Mean Flows
di: Li, Xiquan, et al.
Pubblicazione: (2025)
di: Li, Xiquan, et al.
Pubblicazione: (2025)
Retrieval-Augmented Text-to-Audio Generation
di: Yuan, Yi, et al.
Pubblicazione: (2023)
di: Yuan, Yi, et al.
Pubblicazione: (2023)
Voice Attribute Editing with Text Prompt
di: Sheng, Zhengyan, et al.
Pubblicazione: (2024)
di: Sheng, Zhengyan, et al.
Pubblicazione: (2024)
Audio-Omni: Extending Multi-modal Understanding to Versatile Audio Generation and Editing
di: Tian, Zeyue, et al.
Pubblicazione: (2026)
di: Tian, Zeyue, et al.
Pubblicazione: (2026)
RFWave: Multi-band Rectified Flow for Audio Waveform Reconstruction
di: Liu, Peng, et al.
Pubblicazione: (2024)
di: Liu, Peng, et al.
Pubblicazione: (2024)
Guiding Audio Editing with Audio Language Model
di: Lan, Zitong, et al.
Pubblicazione: (2025)
di: Lan, Zitong, et al.
Pubblicazione: (2025)
AST: Adaptive, Seamless, and Training-Free Precise Speech Editing
di: Lv, Sihan, et al.
Pubblicazione: (2026)
di: Lv, Sihan, et al.
Pubblicazione: (2026)
AnchorSteer: Self-Discovered Concept Injection for Structure-Preserving Music Editing
di: Chang, Chih-Heng, et al.
Pubblicazione: (2026)
di: Chang, Chih-Heng, et al.
Pubblicazione: (2026)
FlowSep: Language-Queried Sound Separation with Rectified Flow Matching
di: Yuan, Yi, et al.
Pubblicazione: (2024)
di: Yuan, Yi, et al.
Pubblicazione: (2024)
SAKE: Towards Editing Auditory Attribute Knowledge of Large Audio-Language Models
di: Yang, Chih-Kai, et al.
Pubblicazione: (2025)
di: Yang, Chih-Kai, et al.
Pubblicazione: (2025)
Ming-UniAudio: Speech LLM for Joint Understanding, Generation and Editing with Unified Representation
di: Yan, Canxiang, et al.
Pubblicazione: (2025)
di: Yan, Canxiang, et al.
Pubblicazione: (2025)
In-the-wild Audio Spatialization with Flexible Text-guided Localization
di: Pan, Tianrui, et al.
Pubblicazione: (2025)
di: Pan, Tianrui, et al.
Pubblicazione: (2025)
YingMusic-Singer: Zero-shot Singing Voice Synthesis and Editing with Annotation-free Melody Guidance
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
di: Lin, Liwei, et al.
Pubblicazione: (2024)
di: Lin, Liwei, et al.
Pubblicazione: (2024)
ATIR: Towards Audio-Text Interleaved Contextual Retrieval
di: Zhao, Tong, et al.
Pubblicazione: (2026)
di: Zhao, Tong, et al.
Pubblicazione: (2026)
EditGen: Harnessing Cross-Attention Control for Instruction-Based Auto-Regressive Audio Editing
di: Sioros, Vassilis, et al.
Pubblicazione: (2025)
di: Sioros, Vassilis, et al.
Pubblicazione: (2025)
PhyAVBench: A Challenging Audio Physics-Sensitivity Benchmark for Physically Grounded Text-to-Audio-Video Generation
di: Xie, Tianxin, et al.
Pubblicazione: (2025)
di: Xie, Tianxin, et al.
Pubblicazione: (2025)
Universal Sound Separation with Self-Supervised Audio Masked Autoencoder
di: Zhao, Junqi, et al.
Pubblicazione: (2024)
di: Zhao, Junqi, et al.
Pubblicazione: (2024)
MOSS-Audio Technical Report
di: Yang, Chen, et al.
Pubblicazione: (2026)
di: Yang, Chen, et al.
Pubblicazione: (2026)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
MuseCPBench: an Empirical Study of Music Editing Methods through Music Context Preservation
di: Vishe, Yash, et al.
Pubblicazione: (2025)
di: Vishe, Yash, et al.
Pubblicazione: (2025)
AudioScene: Integrating Object-Event Audio into 3D Scenes
di: Yuan, Shuaihang, et al.
Pubblicazione: (2025)
di: Yuan, Shuaihang, et al.
Pubblicazione: (2025)
Leveraging Pre-trained AudioLDM for Sound Generation: A Benchmark Study
di: Yuan, Yi, et al.
Pubblicazione: (2023)
di: Yuan, Yi, et al.
Pubblicazione: (2023)
Audio-Maestro: Enhancing Large Audio-Language Models with Tool-Augmented Reasoning
di: Lee, Kuan-Yi, et al.
Pubblicazione: (2025)
di: Lee, Kuan-Yi, et al.
Pubblicazione: (2025)
AudioMoG: Guiding Audio Generation with Mixture-of-Guidance
di: Wang, Junyou, et al.
Pubblicazione: (2025)
di: Wang, Junyou, et al.
Pubblicazione: (2025)
MusicFlow: Cascaded Flow Matching for Text Guided Music Generation
di: Prajwal, K R, et al.
Pubblicazione: (2024)
di: Prajwal, K R, et al.
Pubblicazione: (2024)
Flamed-TTS: Flow Matching Attention-Free Models for Efficient Generating and Dynamic Pacing Zero-shot Text-to-Speech
di: Huynh-Nguyen, Hieu-Nghia, et al.
Pubblicazione: (2025)
di: Huynh-Nguyen, Hieu-Nghia, et al.
Pubblicazione: (2025)
Latent-Mark: An Audio Watermark Robust to Neural Resynthesis
di: Chen, Yen-Shan, et al.
Pubblicazione: (2026)
di: Chen, Yen-Shan, et al.
Pubblicazione: (2026)
Robust TTS Training via Self-Purifying Flow Matching for the WildSpoof 2026 TTS Track
di: Yi, June Young, et al.
Pubblicazione: (2025)
di: Yi, June Young, et al.
Pubblicazione: (2025)
VoiceCraft: Zero-Shot Speech Editing and Text-to-Speech in the Wild
di: Peng, Puyuan, et al.
Pubblicazione: (2024)
di: Peng, Puyuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AudioTurbo: Fast Text-to-Audio Generation with Rectified Diffusion
di: Zhao, Junqi, et al.
Pubblicazione: (2025) -
COMET: Concept Space Dissection of the Modality Gap in Audio-Text Multimodal Contrastive Embeddings
di: Zhu, Yonggang, et al.
Pubblicazione: (2026) -
Audio Prompt Adapter: Unleashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning
di: Tsai, Fang-Duo, et al.
Pubblicazione: (2024) -
Unifying Speech Editing Detection and Content Localization via Prior-Enhanced Audio LLMs
di: Xue, Jun, et al.
Pubblicazione: (2026) -
MusRec: Zero-Shot Text-to-Music Editing via Rectified Flow and Diffusion Transformers
di: Boudaghi, Ali, et al.
Pubblicazione: (2025)