Guardado en:
| Autores principales: | Wang, Jianzong, Li, Pengcheng, Zhang, Xulong, Cheng, Ning, Xiao, Jing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2403.05000 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MAIN-VC: Lightweight Speech Representation Disentanglement for One-shot Voice Conversion
por: Li, Pengcheng, et al.
Publicado: (2024)
por: Li, Pengcheng, et al.
Publicado: (2024)
Learning Expressive Disentangled Speech Representations with Soft Speech Units and Adversarial Style Augmentation
por: Deng, Yimin, et al.
Publicado: (2024)
por: Deng, Yimin, et al.
Publicado: (2024)
Learning Disentangled Speech Representations with Contrastive Learning and Time-Invariant Retrieval
por: Deng, Yimin, et al.
Publicado: (2024)
por: Deng, Yimin, et al.
Publicado: (2024)
DQR-TTS: Semi-supervised Text-to-speech Synthesis with Dynamic Quantized Representation
por: Wang, Jianzong, et al.
Publicado: (2023)
por: Wang, Jianzong, et al.
Publicado: (2023)
From Inheritance to Saturation: Disentangling the Evolution of Visual Redundancy for Architecture-Aware MLLM Inference Acceleration
por: Shi, Jiaqi, et al.
Publicado: (2026)
por: Shi, Jiaqi, et al.
Publicado: (2026)
CONTUNER: Singing Voice Beautifying with Pitch and Expressiveness Condition
por: Wang, Jianzong, et al.
Publicado: (2024)
por: Wang, Jianzong, et al.
Publicado: (2024)
EAD-VC: Enhancing Speech Auto-Disentanglement for Voice Conversion with IFUB Estimator and Joint Text-Guided Consistent Learning
por: Liang, Ziqi, et al.
Publicado: (2024)
por: Liang, Ziqi, et al.
Publicado: (2024)
EfficientASR: Speech Recognition Network Compression via Attention Redundancy and Chunk-Level FFN Optimization
por: Wang, Jianzong, et al.
Publicado: (2024)
por: Wang, Jianzong, et al.
Publicado: (2024)
IDEAW: Robust Neural Audio Watermarking with Invertible Dual-Embedding
por: Li, Pengcheng, et al.
Publicado: (2024)
por: Li, Pengcheng, et al.
Publicado: (2024)
ED-TTS: Multi-Scale Emotion Modeling using Cross-Domain Emotion Diarization for Emotional Speech Synthesis
por: Tang, Haobin, et al.
Publicado: (2024)
por: Tang, Haobin, et al.
Publicado: (2024)
RSET: Remapping-based Sorting Method for Emotion Transfer Speech Synthesis
por: Shi, Haoxiang, et al.
Publicado: (2024)
por: Shi, Haoxiang, et al.
Publicado: (2024)
Efficient Multi-Model Fusion with Adversarial Complementary Representation Learning
por: Kang, Zuheng, et al.
Publicado: (2024)
por: Kang, Zuheng, et al.
Publicado: (2024)
EmoTalker: Emotionally Editable Talking Face Generation via Diffusion Model
por: Zhang, Bingyuan, et al.
Publicado: (2024)
por: Zhang, Bingyuan, et al.
Publicado: (2024)
DisenSemi: Semi-supervised Graph Classification via Disentangled Representation Learning
por: Wang, Yifan, et al.
Publicado: (2024)
por: Wang, Yifan, et al.
Publicado: (2024)
P2DT: Mitigating Forgetting in task-incremental Learning with progressive prompt Decision Transformer
por: Wang, Zhiyuan, et al.
Publicado: (2024)
por: Wang, Zhiyuan, et al.
Publicado: (2024)
MF-Speech: Achieving Fine-Grained and Compositional Control in Speech Generation via Factor Disentanglement
por: Yu, Xinyue, et al.
Publicado: (2025)
por: Yu, Xinyue, et al.
Publicado: (2025)
Task-agnostic Decision Transformer for Multi-type Agent Control with Federated Split Training
por: Wang, Zhiyuan, et al.
Publicado: (2024)
por: Wang, Zhiyuan, et al.
Publicado: (2024)
Task as Context Prompting for Accurate Medical Symptom Coding Using Large Language Models
por: He, Chengyang, et al.
Publicado: (2025)
por: He, Chengyang, et al.
Publicado: (2025)
RREH: Reconstruction Relations Embedded Hashing for Semi-Paired Cross-Modal Retrieval
por: Wang, Jianzong, et al.
Publicado: (2024)
por: Wang, Jianzong, et al.
Publicado: (2024)
ESARM: 3D Emotional Speech-to-Animation via Reward Model from Automatically-Ranked Demonstrations
por: Zhang, Xulong, et al.
Publicado: (2024)
por: Zhang, Xulong, et al.
Publicado: (2024)
Disentangled Representation Learning for Causal Inference with Instruments
por: Cheng, Debo, et al.
Publicado: (2024)
por: Cheng, Debo, et al.
Publicado: (2024)
ACCon: Angle-Compensated Contrastive Regularizer for Deep Regression
por: Zhao, Botao, et al.
Publicado: (2025)
por: Zhao, Botao, et al.
Publicado: (2025)
Learning Interpretable Rules for Scalable Data Representation and Classification
por: Wang, Zhuo, et al.
Publicado: (2023)
por: Wang, Zhuo, et al.
Publicado: (2023)
Disentangling Policy from Offline Task Representation Learning via Adversarial Data Augmentation
por: Jia, Chengxing, et al.
Publicado: (2024)
por: Jia, Chengxing, et al.
Publicado: (2024)
DART: Disentanglement of Accent and Speaker Representation in Multispeaker Text-to-Speech
por: Melechovsky, Jan, et al.
Publicado: (2024)
por: Melechovsky, Jan, et al.
Publicado: (2024)
Boosting Semi-Supervised Medical Image Segmentation via Masked Image Consistency and Discrepancy Learning
por: Zhou, Pengcheng, et al.
Publicado: (2025)
por: Zhou, Pengcheng, et al.
Publicado: (2025)
Disentangled Representation Learning
por: Wang, Xin, et al.
Publicado: (2022)
por: Wang, Xin, et al.
Publicado: (2022)
Cross-Camera Cow Identification via Disentangled Representation Learning
por: Wang, Runcheng, et al.
Publicado: (2026)
por: Wang, Runcheng, et al.
Publicado: (2026)
Rethinking LLM-as-a-Judge: Representation-as-a-Judge with Small Language Models via Semantic Capacity Asymmetry
por: Li, Zhuochun, et al.
Publicado: (2026)
por: Li, Zhuochun, et al.
Publicado: (2026)
Adaptive Disentangled Representation Learning for Incomplete Multi-View Multi-Label Classification
por: Li, Quanjiang, et al.
Publicado: (2026)
por: Li, Quanjiang, et al.
Publicado: (2026)
MIRRORTALK: Forging Personalized Avatars Via Disentangled Style and Hierarchical Motion Control
por: Lu, Renjie, et al.
Publicado: (2026)
por: Lu, Renjie, et al.
Publicado: (2026)
Disentangled Generative Graph Representation Learning
por: Hu, Xinyue, et al.
Publicado: (2024)
por: Hu, Xinyue, et al.
Publicado: (2024)
Disentanglement in Difference: Directly Learning Semantically Disentangled Representations by Maximizing Inter-Factor Differences
por: Zhang, Xingshen, et al.
Publicado: (2025)
por: Zhang, Xingshen, et al.
Publicado: (2025)
Enhancing Emotion Recognition in Conversation through Emotional Cross-Modal Fusion and Inter-class Contrastive Learning
por: Shi, Haoxiang, et al.
Publicado: (2024)
por: Shi, Haoxiang, et al.
Publicado: (2024)
Boosting Medical Image Synthesis via Registration-guided Consistency and Disentanglement Learning
por: Li, Chuanpu, et al.
Publicado: (2024)
por: Li, Chuanpu, et al.
Publicado: (2024)
Interpretable Operator Learning for Inverse Problems via Adaptive Spectral Filtering: Convergence and Discretization Invariance
por: Dong, Hang-Cheng, et al.
Publicado: (2026)
por: Dong, Hang-Cheng, et al.
Publicado: (2026)
Self-Supervised Disentangled Representation Learning for Robust Target Speech Extraction
por: Mu, Zhaoxi, et al.
Publicado: (2023)
por: Mu, Zhaoxi, et al.
Publicado: (2023)
Towards the Next Frontier in Speech Representation Learning Using Disentanglement
por: Krishna, Varun, et al.
Publicado: (2024)
por: Krishna, Varun, et al.
Publicado: (2024)
Disentangling Preference Representation and Text Generation for Efficient Individual Preference Alignment
por: Zhang, Jianfei, et al.
Publicado: (2024)
por: Zhang, Jianfei, et al.
Publicado: (2024)
CARE: Multi-Task Pretraining for Latent Continuous Action Representation in Robot Control
por: Shi, Jiaqi, et al.
Publicado: (2026)
por: Shi, Jiaqi, et al.
Publicado: (2026)
Ejemplares similares
-
MAIN-VC: Lightweight Speech Representation Disentanglement for One-shot Voice Conversion
por: Li, Pengcheng, et al.
Publicado: (2024) -
Learning Expressive Disentangled Speech Representations with Soft Speech Units and Adversarial Style Augmentation
por: Deng, Yimin, et al.
Publicado: (2024) -
Learning Disentangled Speech Representations with Contrastive Learning and Time-Invariant Retrieval
por: Deng, Yimin, et al.
Publicado: (2024) -
DQR-TTS: Semi-supervised Text-to-speech Synthesis with Dynamic Quantized Representation
por: Wang, Jianzong, et al.
Publicado: (2023) -
From Inheritance to Saturation: Disentangling the Evolution of Visual Redundancy for Architecture-Aware MLLM Inference Acceleration
por: Shi, Jiaqi, et al.
Publicado: (2026)