TextLDM: Language Modeling with Continuous Latent Diffusion
Fuente:
arXiv
Saved in:
| Main Authors: | Jiang, Jiaxiu, Ren, Jingjing, Li, Wenbo, Wang, Bo, Sun, Haoze, Yang, Yijun, Liu, Jianhui, Zhang, Yanbing, Zheng, Shenghe, Zhang, Yuan, Huang, Haoyang, Duan, Nan, Zuo, Wangmeng |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Thinking with Novel Views: A Systematic Analysis of Generative-Augmented Spatial Intelligence
by: Zhang, Yanbing, et al.
Published: (2026)
by: Zhang, Yanbing, et al.
Published: (2026)
OpenSpatial: A Principled Data Engine for Empowering Spatial Intelligence
by: Liu, Jianhui, et al.
Published: (2026)
by: Liu, Jianhui, et al.
Published: (2026)
LoViC: Efficient Long Video Generation with Context Compression
by: Jiang, Jiaxiu, et al.
Published: (2025)
by: Jiang, Jiaxiu, et al.
Published: (2025)
JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation
by: Song, Lin, et al.
Published: (2026)
by: Song, Lin, et al.
Published: (2026)
MC$^2$: Multi-concept Guidance for Customized Multi-concept Generation
by: Jiang, Jiaxiu, et al.
Published: (2024)
by: Jiang, Jiaxiu, et al.
Published: (2024)
V-Bridge: Bridging Video Generative Priors to Versatile Few-shot Image Restoration
by: Zheng, Shenghe, et al.
Published: (2026)
by: Zheng, Shenghe, et al.
Published: (2026)
UnfoldLDM: Degradation-Aware Unfolding with Iterative Latent Diffusion Priors for Blind Image Restoration
by: He, Chunming, et al.
Published: (2025)
by: He, Chunming, et al.
Published: (2025)
Latent Code Augmentation Based on Stable Diffusion for Data-free Substitute Attacks
by: Shao, Mingwen, et al.
Published: (2023)
by: Shao, Mingwen, et al.
Published: (2023)
SWA-LDM: Toward Stealthy Watermarks for Latent Diffusion Models
by: Yang, Zhonghao, et al.
Published: (2025)
by: Yang, Zhonghao, et al.
Published: (2025)
SAT-LDM: Provably Generalizable Image Watermarking for Latent Diffusion Models with Self-Augmented Training
by: Zhang, Lu, et al.
Published: (2024)
by: Zhang, Lu, et al.
Published: (2024)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
by: Zhang, Yabo, et al.
Published: (2024)
by: Zhang, Yabo, et al.
Published: (2024)
PRO‐LDM: A Conditional Latent Diffusion Model for Protein Sequence Design and Functional Optimization
by: Sitao Zhang, et al.
Published: (2025)
by: Sitao Zhang, et al.
Published: (2025)
DreamPhysics: Learning Physics-Based 3D Dynamics with Video Diffusion Priors
by: Huang, Tianyu, et al.
Published: (2024)
by: Huang, Tianyu, et al.
Published: (2024)
TimeLDM: Latent Diffusion Model for Unconditional Time Series Generation
by: Qian, Jian, et al.
Published: (2024)
by: Qian, Jian, et al.
Published: (2024)
ZoomLDM: Latent Diffusion Model for multi-scale image generation
by: Yellapragada, Srikar, et al.
Published: (2024)
by: Yellapragada, Srikar, et al.
Published: (2024)
StructLDM: Structured Latent Diffusion for 3D Human Generation
by: Hu, Tao, et al.
Published: (2024)
by: Hu, Tao, et al.
Published: (2024)
TrustLDM: Benchmarking Trustworthiness in Language Diffusion Models
by: Mo, Yichuan, et al.
Published: (2026)
by: Mo, Yichuan, et al.
Published: (2026)
HapticLDM: A Diffusion Model for Text-to-Vibrotactile Generation
by: Xiong, Jiahao, et al.
Published: (2026)
by: Xiong, Jiahao, et al.
Published: (2026)
Teacher-Feature Drifting: One-Step Diffusion Distillation with Pretrained Diffusion Representations
by: Zhang, Yuan, et al.
Published: (2026)
by: Zhang, Yuan, et al.
Published: (2026)
MGE-LDM: Joint Latent Diffusion for Simultaneous Music Generation and Source Extraction
by: Chae, Yunkee, et al.
Published: (2025)
by: Chae, Yunkee, et al.
Published: (2025)
MM-LDM: Multi-Modal Latent Diffusion Model for Sounding Video Generation
by: Sun, Mingzhen, et al.
Published: (2024)
by: Sun, Mingzhen, et al.
Published: (2024)
LDM-ISP: Enhancing Neural ISP for Low Light with Latent Diffusion Models
by: Wen, Qiang, et al.
Published: (2023)
by: Wen, Qiang, et al.
Published: (2023)
PuYun-LDM: A Latent Diffusion Model for High-Resolution Ensemble Weather Forecasts
by: Wu, Lianjun, et al.
Published: (2026)
by: Wu, Lianjun, et al.
Published: (2026)
Generative Pre-trained Autoregressive Diffusion Transformer
by: Zhang, Yuan, et al.
Published: (2025)
by: Zhang, Yuan, et al.
Published: (2025)
Bridging Geometry-Coherent Text-to-3D Generation with Multi-View Diffusion Priors and Gaussian Splatting
by: Yang, Feng, et al.
Published: (2025)
by: Yang, Feng, et al.
Published: (2025)
PhysChoreo: Physics-Controllable Video Generation with Part-Aware Semantic Grounding
by: Zhang, Haoze, et al.
Published: (2025)
by: Zhang, Haoze, et al.
Published: (2025)
SG-LDM: Semantic-Guided LiDAR Generation via Latent-Aligned Diffusion
by: Xiang, Zhengkang, et al.
Published: (2025)
by: Xiang, Zhengkang, et al.
Published: (2025)
Multi-Track MusicLDM: Towards Versatile Music Generation with Latent Diffusion Model
by: Karchkhadze, Tornike, et al.
Published: (2024)
by: Karchkhadze, Tornike, et al.
Published: (2024)
ConSept: Continual Semantic Segmentation via Adapter-based Vision Transformer
by: Dong, Bowen, et al.
Published: (2024)
by: Dong, Bowen, et al.
Published: (2024)
PhraseVAE and PhraseLDM: Latent Diffusion for Full-Song Multitrack Symbolic Music Generation
by: Ou, Longshen, et al.
Published: (2025)
by: Ou, Longshen, et al.
Published: (2025)
DP-DocLDM: Differentially Private Document Image Generation using Latent Diffusion Models
by: Saifullah, Saifullah, et al.
Published: (2025)
by: Saifullah, Saifullah, et al.
Published: (2025)
ORL-LDM: Offline Reinforcement Learning Guided Latent Diffusion Model Super-Resolution Reconstruction
by: Lyu, Shijie
Published: (2025)
by: Lyu, Shijie
Published: (2025)
GraspLDM: Generative 6-DoF Grasp Synthesis using Latent Diffusion Models
by: Barad, Kuldeep R, et al.
Published: (2023)
by: Barad, Kuldeep R, et al.
Published: (2023)
ReF-LDM: A Latent Diffusion Model for Reference-based Face Image Restoration
by: Hsiao, Chi-Wei, et al.
Published: (2024)
by: Hsiao, Chi-Wei, et al.
Published: (2024)
TraceMark-LDM: Authenticatable Watermarking for Latent Diffusion Models via Binary-Guided Rearrangement
by: Luo, Wenhao, et al.
Published: (2025)
by: Luo, Wenhao, et al.
Published: (2025)
MV-VTON: Multi-View Virtual Try-On with Diffusion Models
by: Wang, Haoyu, et al.
Published: (2024)
by: Wang, Haoyu, et al.
Published: (2024)
LDM-SVC: Latent Diffusion Model Based Zero-Shot Any-to-Any Singing Voice Conversion with Singer Guidance
by: Chen, Shihao, et al.
Published: (2024)
by: Chen, Shihao, et al.
Published: (2024)
ScrollScape: Unlocking 32K Image Generation With Video Diffusion Priors
by: Yu, Haodong, et al.
Published: (2026)
by: Yu, Haodong, et al.
Published: (2026)
BS-LDM: Effective Bone Suppression in High-Resolution Chest X-Ray Images with Conditional Latent Diffusion Models
by: Sun, Yifei, et al.
Published: (2024)
by: Sun, Yifei, et al.
Published: (2024)
Enhanced Generative Structure Prior for Chinese Text Image Super-resolution
by: Li, Xiaoming, et al.
Published: (2025)
by: Li, Xiaoming, et al.
Published: (2025)
Similar Items
-
Thinking with Novel Views: A Systematic Analysis of Generative-Augmented Spatial Intelligence
by: Zhang, Yanbing, et al.
Published: (2026) -
OpenSpatial: A Principled Data Engine for Empowering Spatial Intelligence
by: Liu, Jianhui, et al.
Published: (2026) -
LoViC: Efficient Long Video Generation with Context Compression
by: Jiang, Jiaxiu, et al.
Published: (2025) -
JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation
by: Song, Lin, et al.
Published: (2026) -
MC$^2$: Multi-concept Guidance for Customized Multi-concept Generation
by: Jiang, Jiaxiu, et al.
Published: (2024)