Continuously Augmented Discrete Diffusion model for Categorical Generative Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Huangjie, Gong, Shansan, Zhang, Ruixiang, Chen, Tianrong, Gu, Jiatao, Zhou, Mingyuan, Jaitly, Navdeep, Zhang, Yizhe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation
di: Gong, Shansan, et al.
Pubblicazione: (2025)
di: Gong, Shansan, et al.
Pubblicazione: (2025)
Flexible Language Modeling in Continuous Space with Transformer-based Autoregressive Flows
di: Zhang, Ruixiang, et al.
Pubblicazione: (2025)
di: Zhang, Ruixiang, et al.
Pubblicazione: (2025)
Normalizing Flows are Capable Generative Models
di: Zhai, Shuangfei, et al.
Pubblicazione: (2024)
di: Zhai, Shuangfei, et al.
Pubblicazione: (2024)
Matryoshka Diffusion Models
di: Gu, Jiatao, et al.
Pubblicazione: (2023)
di: Gu, Jiatao, et al.
Pubblicazione: (2023)
Improving GFlowNets for Text-to-Image Diffusion Alignment
di: Zhang, Dinghuai, et al.
Pubblicazione: (2024)
di: Zhang, Dinghuai, et al.
Pubblicazione: (2024)
TADA: Improved Diffusion Sampling with Training-free Augmented Dynamics
di: Chen, Tianrong, et al.
Pubblicazione: (2025)
di: Chen, Tianrong, et al.
Pubblicazione: (2025)
Target Concrete Score Matching: A Holistic Framework for Discrete Diffusion
di: Zhang, Ruixiang, et al.
Pubblicazione: (2025)
di: Zhang, Ruixiang, et al.
Pubblicazione: (2025)
What Makes the Preferred Thinking Direction for LLMs in Multiple-choice Questions?
di: Zhang, Yizhe, et al.
Pubblicazione: (2025)
di: Zhang, Yizhe, et al.
Pubblicazione: (2025)
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
ChipChat: Low-Latency Cascaded Conversational Agent in MLX
di: Likhomanenko, Tatiana, et al.
Pubblicazione: (2025)
di: Likhomanenko, Tatiana, et al.
Pubblicazione: (2025)
Divide-or-Conquer? Which Part Should You Distill Your LLM?
di: Wu, Zhuofeng, et al.
Pubblicazione: (2024)
di: Wu, Zhuofeng, et al.
Pubblicazione: (2024)
Probing the Multi-turn Planning Capabilities of LLMs via 20 Question Games
di: Zhang, Yizhe, et al.
Pubblicazione: (2023)
di: Zhang, Yizhe, et al.
Pubblicazione: (2023)
Embarrassingly Simple Self-Distillation Improves Code Generation
di: Zhang, Ruixiang, et al.
Pubblicazione: (2026)
di: Zhang, Ruixiang, et al.
Pubblicazione: (2026)
SAGE: Steering Dialog Generation with Future-Aware State-Action Augmentation
di: Zhang, Yizhe, et al.
Pubblicazione: (2025)
di: Zhang, Yizhe, et al.
Pubblicazione: (2025)
PLANNER: Generating Diversified Paragraph via Latent Language Diffusion Model
di: Zhang, Yizhe, et al.
Pubblicazione: (2023)
di: Zhang, Yizhe, et al.
Pubblicazione: (2023)
TypeScore: A Text Fidelity Metric for Text-to-Image Generative Models
di: Sampaio, Georgia Gabriela, et al.
Pubblicazione: (2024)
di: Sampaio, Georgia Gabriela, et al.
Pubblicazione: (2024)
STARFlow: Scaling Latent Normalizing Flows for High-resolution Image Synthesis
di: Gu, Jiatao, et al.
Pubblicazione: (2025)
di: Gu, Jiatao, et al.
Pubblicazione: (2025)
KGLens: Towards Efficient and Effective Knowledge Probing of Large Language Models with Knowledge Graphs
di: Zheng, Shangshang, et al.
Pubblicazione: (2023)
di: Zheng, Shangshang, et al.
Pubblicazione: (2023)
Kaleido Diffusion: Improving Conditional Diffusion Models with Autoregressive Latent Modeling
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
Score Distillation of Flow Matching Models
di: Zhou, Mingyuan, et al.
Pubblicazione: (2025)
di: Zhou, Mingyuan, et al.
Pubblicazione: (2025)
How Far Are We from Intelligent Visual Deductive Reasoning?
di: Zhang, Yizhe, et al.
Pubblicazione: (2024)
di: Zhang, Yizhe, et al.
Pubblicazione: (2024)
Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation
di: Zhou, Mingyuan, et al.
Pubblicazione: (2024)
di: Zhou, Mingyuan, et al.
Pubblicazione: (2024)
LaDiR: Latent Diffusion Enhances LLMs for Text Reasoning
di: Kang, Haoqiang, et al.
Pubblicazione: (2025)
di: Kang, Haoqiang, et al.
Pubblicazione: (2025)
Generative Modeling with Phase Stochastic Bridges
di: Chen, Tianrong, et al.
Pubblicazione: (2023)
di: Chen, Tianrong, et al.
Pubblicazione: (2023)
STARFlow2: Bridging Language Models and Normalizing Flows for Unified Multimodal Generation
di: Shen, Ying, et al.
Pubblicazione: (2026)
di: Shen, Ying, et al.
Pubblicazione: (2026)
Omni-Router: Sharing Routing Decisions in Sparse Mixture-of-Experts for Speech Recognition
di: Gu, Zijin, et al.
Pubblicazione: (2025)
di: Gu, Zijin, et al.
Pubblicazione: (2025)
Beyond Autoregression: Discrete Diffusion for Complex Reasoning and Planning
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models
di: Qiu, Yifu, et al.
Pubblicazione: (2025)
di: Qiu, Yifu, et al.
Pubblicazione: (2025)
Adversarial Score identity Distillation: Rapidly Surpassing the Teacher in One Step
di: Zhou, Mingyuan, et al.
Pubblicazione: (2024)
di: Zhou, Mingyuan, et al.
Pubblicazione: (2024)
Scaling Properties of Continuous Diffusion Spoken Language Models
di: Ramapuram, Jason, et al.
Pubblicazione: (2026)
di: Ramapuram, Jason, et al.
Pubblicazione: (2026)
Guided Score identity Distillation for Data-Free One-Step Text-to-Image Generation
di: Zhou, Mingyuan, et al.
Pubblicazione: (2024)
di: Zhou, Mingyuan, et al.
Pubblicazione: (2024)
Path-Constrained Mixture-of-Experts
di: Gu, Zijin, et al.
Pubblicazione: (2026)
di: Gu, Zijin, et al.
Pubblicazione: (2026)
Normalizing Trajectory Models
di: Gu, Jiatao, et al.
Pubblicazione: (2026)
di: Gu, Jiatao, et al.
Pubblicazione: (2026)
DLM-One: Diffusion Language Models for One-Step Sequence Generation
di: Chen, Tianqi, et al.
Pubblicazione: (2025)
di: Chen, Tianqi, et al.
Pubblicazione: (2025)
SpeakStream: Streaming Text-to-Speech with Interleaved Data
di: Bai, Richard He, et al.
Pubblicazione: (2025)
di: Bai, Richard He, et al.
Pubblicazione: (2025)
Convergence of Score-Based Discrete Diffusion Models: A Discrete-Time Analysis
di: Zhang, Zikun, et al.
Pubblicazione: (2024)
di: Zhang, Zikun, et al.
Pubblicazione: (2024)
Unified Discrete Diffusion for Categorical Data
di: Zhao, Lingxiao, et al.
Pubblicazione: (2024)
di: Zhao, Lingxiao, et al.
Pubblicazione: (2024)
Learning Stackable and Skippable LEGO Bricks for Efficient, Reconfigurable, and Variable-Resolution Diffusion Modeling
di: Zheng, Huangjie, et al.
Pubblicazione: (2023)
di: Zheng, Huangjie, et al.
Pubblicazione: (2023)
CANDI: Hybrid Discrete-Continuous Diffusion Models
di: Pynadath, Patrick, et al.
Pubblicazione: (2025)
di: Pynadath, Patrick, et al.
Pubblicazione: (2025)
Aggregate-and-Adapt Natural Language Prompts for Downstream Generalization of CLIP
di: Huang, Chen, et al.
Pubblicazione: (2024)
di: Huang, Chen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation
di: Gong, Shansan, et al.
Pubblicazione: (2025) -
Flexible Language Modeling in Continuous Space with Transformer-based Autoregressive Flows
di: Zhang, Ruixiang, et al.
Pubblicazione: (2025) -
Normalizing Flows are Capable Generative Models
di: Zhai, Shuangfei, et al.
Pubblicazione: (2024) -
Matryoshka Diffusion Models
di: Gu, Jiatao, et al.
Pubblicazione: (2023) -
Improving GFlowNets for Text-to-Image Diffusion Alignment
di: Zhang, Dinghuai, et al.
Pubblicazione: (2024)