AnchorSteer: Self-Discovered Concept Injection for Structure-Preserving Music Editing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chang, Chih-Heng, Ho, Keng-Seng, Tsai, Chih-Yu, Chen, Kuan-Lin, Yang, Yi-Hsuan, Ding, Jian-Jiun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Training-Efficient Text-to-Music Generation with State-Space Modeling
par: Lee, Wei-Jaw, et autres
Publié: (2026)
par: Lee, Wei-Jaw, et autres
Publié: (2026)
Discovering and Steering Interpretable Concepts in Large Generative Music Models
par: Singh, Nikhil, et autres
Publié: (2025)
par: Singh, Nikhil, et autres
Publié: (2025)
Exploring State-Space-Model based Language Model in Music Generation
par: Lee, Wei-Jaw, et autres
Publié: (2025)
par: Lee, Wei-Jaw, et autres
Publié: (2025)
MusicWeaver: Composer-Style Structural Editing and Minute-Scale Coherent Music Generation
par: Wang, Xuanchen, et autres
Publié: (2025)
par: Wang, Xuanchen, et autres
Publié: (2025)
Segment-Factorized Full-Song Generation on Symbolic Piano Music
par: Chen, Ping-Yi, et autres
Publié: (2025)
par: Chen, Ping-Yi, et autres
Publié: (2025)
Steer-by-prior Editing of Symbolic Music Loops
par: Jonason, Nicolas, et autres
Publié: (2024)
par: Jonason, Nicolas, et autres
Publié: (2024)
LargeSHS: A large-scale dataset of music adaptation
par: Tan, Chih-Pin, et autres
Publié: (2025)
par: Tan, Chih-Pin, et autres
Publié: (2025)
Audio Prompt Adapter: Unleashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning
par: Tsai, Fang-Duo, et autres
Publié: (2024)
par: Tsai, Fang-Duo, et autres
Publié: (2024)
Academic Text-to-Music Grand Challenge: Datasets, Baselines, and Evaluation Methods
par: Hsieh, Fang-Chih, et autres
Publié: (2026)
par: Hsieh, Fang-Chih, et autres
Publié: (2026)
SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
par: Niu, Xinlei, et autres
Publié: (2025)
par: Niu, Xinlei, et autres
Publié: (2025)
MuseCPBench: an Empirical Study of Music Editing Methods through Music Context Preservation
par: Vishe, Yash, et autres
Publié: (2025)
par: Vishe, Yash, et autres
Publié: (2025)
SeamlessEdit: Background Noise Aware Zero-Shot Speech Editing with in-Context Enhancement
par: Chen, Kuan-Yu, et autres
Publié: (2025)
par: Chen, Kuan-Yu, et autres
Publié: (2025)
PiCoGen: Generate Piano Covers with a Two-stage Approach
par: Tan, Chih-Pin, et autres
Publié: (2024)
par: Tan, Chih-Pin, et autres
Publié: (2024)
PiCoGen2: Piano cover generation with transfer learning approach and weakly aligned data
par: Tan, Chih-Pin, et autres
Publié: (2024)
par: Tan, Chih-Pin, et autres
Publié: (2024)
The Arrow of Time in Music -- Revisiting the Temporal Structure of Music with Distinguishability and Unique Orientability as the Anchor Point
par: Xu, Qi
Publié: (2023)
par: Xu, Qi
Publié: (2023)
Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning
par: Wilkins, Julia, et autres
Publié: (2025)
par: Wilkins, Julia, et autres
Publié: (2025)
Activation Patching for Interpretable Steering in Music Generation
par: Facchiano, Simone, et autres
Publié: (2025)
par: Facchiano, Simone, et autres
Publié: (2025)
BEAST: Online Joint Beat and Downbeat Tracking Based on Streaming Transformer
par: Chang, Chih-Cheng, et autres
Publié: (2023)
par: Chang, Chih-Cheng, et autres
Publié: (2023)
MAGE: Modality-Agnostic Music Generation and Editing
par: Saleem, Muhammad Usama, et autres
Publié: (2026)
par: Saleem, Muhammad Usama, et autres
Publié: (2026)
The Binding Effect: Analyzing How Multi-Dimensional Cues Form Gender Bias in Instruction TTS
par: Chen, Kuan-Yu, et autres
Publié: (2026)
par: Chen, Kuan-Yu, et autres
Publié: (2026)
Edit Content, Preserve Acoustics: Imperceptible Text-Based Speech Editing via Self-Consistency Rewards
par: Ren, Yong, et autres
Publié: (2026)
par: Ren, Yong, et autres
Publié: (2026)
Do Prompts Really Prompt? Exploring the Prompt Understanding Capability of Whisper
par: Yang, Chih-Kai, et autres
Publié: (2024)
par: Yang, Chih-Kai, et autres
Publié: (2024)
METEOR: Melody-aware Texture-controllable Symbolic Orchestral Music Generation via Transformer VAE
par: Le, Dinh-Viet-Toan, et autres
Publié: (2024)
par: Le, Dinh-Viet-Toan, et autres
Publié: (2024)
Discovering "Words" in Music: Unsupervised Learning of Compositional Sparse Code for Symbolic Music
par: Wang, Tianle, et autres
Publié: (2025)
par: Wang, Tianle, et autres
Publié: (2025)
MOSA: Music Motion with Semantic Annotation Dataset for Cross-Modal Music Processing
par: Huang, Yu-Fen, et autres
Publié: (2024)
par: Huang, Yu-Fen, et autres
Publié: (2024)
Structuring Concept Space with the Musical Circle of Fifths by Utilizing Music Grammar Based Activations
par: Moyo, Tofara, et autres
Publié: (2024)
par: Moyo, Tofara, et autres
Publié: (2024)
Facing the Music: Tackling Singing Voice Separation in Cinematic Audio Source Separation
par: Watcharasupat, Karn N., et autres
Publié: (2024)
par: Watcharasupat, Karn N., et autres
Publié: (2024)
Music2Fail: Transfer Music to Failed Recorder Style
par: Leong, Chon In, et autres
Publié: (2024)
par: Leong, Chon In, et autres
Publié: (2024)
BERT-like Pre-training for Symbolic Piano Music Classification Tasks
par: Chou, Yi-Hui, et autres
Publié: (2021)
par: Chou, Yi-Hui, et autres
Publié: (2021)
Zero Resource Code-switched Speech Benchmark Using Speech Utterance Pairs For Multiple Spoken Languages
par: Huang, Kuan-Po, et autres
Publié: (2023)
par: Huang, Kuan-Po, et autres
Publié: (2023)
Melodia: Training-Free Music Editing Guided by Attention Probing in Diffusion Models
par: Yang, Yi, et autres
Publié: (2025)
par: Yang, Yi, et autres
Publié: (2025)
MuseControlLite: Multifunctional Music Generation with Lightweight Conditioners
par: Tsai, Fang-Duo, et autres
Publié: (2025)
par: Tsai, Fang-Duo, et autres
Publié: (2025)
YingMusic-Singer: Zero-shot Singing Voice Synthesis and Editing with Annotation-free Melody Guidance
par: Zheng, Junjie, et autres
Publié: (2025)
par: Zheng, Junjie, et autres
Publié: (2025)
EDMFormer: Genre-Specific Self-Supervised Learning for Music Structure Segmentation
par: Sajeer, Sahal, et autres
Publié: (2026)
par: Sajeer, Sahal, et autres
Publié: (2026)
Emotion-driven Piano Music Generation via Two-stage Disentanglement and Functional Representation
par: Huang, Jingyue, et autres
Publié: (2024)
par: Huang, Jingyue, et autres
Publié: (2024)
Genre Controlled Music Generation via Activation Steering
par: Narashiman, Swathi, et autres
Publié: (2025)
par: Narashiman, Swathi, et autres
Publié: (2025)
Speech-Copilot: Leveraging Large Language Models for Speech Processing via Task Decomposition, Modularization, and Program Generation
par: Kuan, Chun-Yi, et autres
Publié: (2024)
par: Kuan, Chun-Yi, et autres
Publié: (2024)
High Fidelity Text-Guided Music Editing via Single-Stage Flow Matching
par: Lan, Gael Le, et autres
Publié: (2024)
par: Lan, Gael Le, et autres
Publié: (2024)
Timed text extraction from Taiwanese Kua-á-hì TV series
par: Huang, Tzu-Hung, et autres
Publié: (2026)
par: Huang, Tzu-Hung, et autres
Publié: (2026)
A Self-Refining Framework for Enhancing ASR Using TTS-Synthesized Data
par: Chou, Cheng-Kang, et autres
Publié: (2025)
par: Chou, Cheng-Kang, et autres
Publié: (2025)
Documents similaires
-
Training-Efficient Text-to-Music Generation with State-Space Modeling
par: Lee, Wei-Jaw, et autres
Publié: (2026) -
Discovering and Steering Interpretable Concepts in Large Generative Music Models
par: Singh, Nikhil, et autres
Publié: (2025) -
Exploring State-Space-Model based Language Model in Music Generation
par: Lee, Wei-Jaw, et autres
Publié: (2025) -
MusicWeaver: Composer-Style Structural Editing and Minute-Scale Coherent Music Generation
par: Wang, Xuanchen, et autres
Publié: (2025) -
Segment-Factorized Full-Song Generation on Symbolic Piano Music
par: Chen, Ping-Yi, et autres
Publié: (2025)