Think While You Generate: Discrete Diffusion with Planned Denoising
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Sulin, Nam, Juno, Campbell, Andrew, Stärk, Hannes, Xu, Yilun, Jaakkola, Tommi, Gómez-Bombarelli, Rafael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DisCo-Diff: Enhancing Continuous Diffusion Models with Discrete Latents
di: Xu, Yilun, et al.
Pubblicazione: (2024)
di: Xu, Yilun, et al.
Pubblicazione: (2024)
FragmentFlow: Scalable Transition State Generation for Large Molecules
di: Shprints, Ron, et al.
Pubblicazione: (2026)
di: Shprints, Ron, et al.
Pubblicazione: (2026)
Correcting Diffusion Generation through Resampling
di: Liu, Yujian, et al.
Pubblicazione: (2023)
di: Liu, Yujian, et al.
Pubblicazione: (2023)
Flow Matching for Accelerated Simulation of Atomic Transport in Crystalline Materials
di: Nam, Juno, et al.
Pubblicazione: (2024)
di: Nam, Juno, et al.
Pubblicazione: (2024)
Scaling Autoregressive Models for Lattice Thermodynamics
di: Du, Xiaochen, et al.
Pubblicazione: (2026)
di: Du, Xiaochen, et al.
Pubblicazione: (2026)
Think While You Write: Hypothesis Verification Promotes Faithful Knowledge-to-Text Generation
di: Qiu, Yifu, et al.
Pubblicazione: (2023)
di: Qiu, Yifu, et al.
Pubblicazione: (2023)
Multimodal Representation Alignment for Image Generation: Text-Image Interleaved Control Is Easier Than You Think
di: Chen, Liang, et al.
Pubblicazione: (2025)
di: Chen, Liang, et al.
Pubblicazione: (2025)
Fictitious Synthetic Data Can Improve LLM Factuality via Prerequisite Learning
di: Liu, Yujian, et al.
Pubblicazione: (2024)
di: Liu, Yujian, et al.
Pubblicazione: (2024)
Revisiting Who's Harry Potter: Towards Targeted Unlearning from a Causal Intervention Perspective
di: Liu, Yujian, et al.
Pubblicazione: (2024)
di: Liu, Yujian, et al.
Pubblicazione: (2024)
Coevolutionary Continuous Discrete Diffusion: Make Your Diffusion Language Model a Latent Reasoner
di: Zhou, Cai, et al.
Pubblicazione: (2025)
di: Zhou, Cai, et al.
Pubblicazione: (2025)
VideoScore2: Think before You Score in Generative Video Evaluation
di: He, Xuan, et al.
Pubblicazione: (2025)
di: He, Xuan, et al.
Pubblicazione: (2025)
Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps
di: Ma, Nanye, et al.
Pubblicazione: (2025)
di: Ma, Nanye, et al.
Pubblicazione: (2025)
Think-While-Generating: On-the-Fly Reasoning for Personalized Long-Form Generation
di: Wang, Chengbing, et al.
Pubblicazione: (2025)
di: Wang, Chengbing, et al.
Pubblicazione: (2025)
Diffusion models in protein structure and docking
di: Jason Yim, et al.
Pubblicazione: (2024)
di: Jason Yim, et al.
Pubblicazione: (2024)
Think While Watching: Online Streaming Segment-Level Memory for Multi-Turn Video Reasoning in Multimodal Large Language Models
di: Wang, Lu, et al.
Pubblicazione: (2026)
di: Wang, Lu, et al.
Pubblicazione: (2026)
Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models
di: Li, Yunxin, et al.
Pubblicazione: (2025)
di: Li, Yunxin, et al.
Pubblicazione: (2025)
Reasoning with Sampling: Your Base Model is Smarter Than You Think
di: Karan, Aayush, et al.
Pubblicazione: (2025)
di: Karan, Aayush, et al.
Pubblicazione: (2025)
Fine-tuning MLLMs Without Forgetting Is Easier Than You Think
di: Li, He, et al.
Pubblicazione: (2026)
di: Li, He, et al.
Pubblicazione: (2026)
Visual Planning: Let's Think Only with Images
di: Xu, Yi, et al.
Pubblicazione: (2025)
di: Xu, Yi, et al.
Pubblicazione: (2025)
Flexible-length Text Infilling for Discrete Diffusion Models
di: Zhang, Andrew, et al.
Pubblicazione: (2025)
di: Zhang, Andrew, et al.
Pubblicazione: (2025)
How Well Do Agentic Skills Work in the Wild: Benchmarking LLM Skill Usage in Realistic Settings
di: Liu, Yujian, et al.
Pubblicazione: (2026)
di: Liu, Yujian, et al.
Pubblicazione: (2026)
Thinking with Generated Images
di: Chern, Ethan, et al.
Pubblicazione: (2025)
di: Chern, Ethan, et al.
Pubblicazione: (2025)
HarnessLLM: Automatic Testing Harness Generation via Reinforcement Learning
di: Liu, Yujian, et al.
Pubblicazione: (2025)
di: Liu, Yujian, et al.
Pubblicazione: (2025)
Next Semantic Scale Prediction via Hierarchical Diffusion Language Models
di: Zhou, Cai, et al.
Pubblicazione: (2025)
di: Zhou, Cai, et al.
Pubblicazione: (2025)
Hide to See: Reasoning-prefix Masking for Visual-anchored Thinking in VLM Distillation
di: Yu, Seonghoon, et al.
Pubblicazione: (2026)
di: Yu, Seonghoon, et al.
Pubblicazione: (2026)
Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm
di: Tong, Jingqi, et al.
Pubblicazione: (2025)
di: Tong, Jingqi, et al.
Pubblicazione: (2025)
Flow Map Distillation Without Data
di: Tong, Shangyuan, et al.
Pubblicazione: (2025)
di: Tong, Shangyuan, et al.
Pubblicazione: (2025)
Thinking with Programming Vision: Towards a Unified View for Thinking with Images
di: Guo, Zirun, et al.
Pubblicazione: (2025)
di: Guo, Zirun, et al.
Pubblicazione: (2025)
Speak While Watching: Unleashing TRUE Real-Time Video Understanding Capability of Multimodal Large Language Models
di: Lin, Junyan, et al.
Pubblicazione: (2026)
di: Lin, Junyan, et al.
Pubblicazione: (2026)
VF-Eval: Evaluating Multimodal LLMs for Generating Feedback on AIGC Videos
di: Song, Tingyu, et al.
Pubblicazione: (2025)
di: Song, Tingyu, et al.
Pubblicazione: (2025)
DogLayout: Denoising Diffusion GAN for Discrete and Continuous Layout Generation
di: Gan, Zhaoxing, et al.
Pubblicazione: (2024)
di: Gan, Zhaoxing, et al.
Pubblicazione: (2024)
StreamingThinker: Large Language Models Can Think While Reading
di: Tong, Junlong, et al.
Pubblicazione: (2025)
di: Tong, Junlong, et al.
Pubblicazione: (2025)
Think Before You Diffuse: Infusing Physical Rules into Video Diffusion
di: Zhang, Ke, et al.
Pubblicazione: (2025)
di: Zhang, Ke, et al.
Pubblicazione: (2025)
In-Situ Tweedie Discrete Diffusion Models
di: Li, Xiao, et al.
Pubblicazione: (2025)
di: Li, Xiao, et al.
Pubblicazione: (2025)
DiSA: Diffusion Step Annealing in Autoregressive Image Generation
di: Zhao, Qinyu, et al.
Pubblicazione: (2025)
di: Zhao, Qinyu, et al.
Pubblicazione: (2025)
EgoThink: Evaluating First-Person Perspective Thinking Capability of Vision-Language Models
di: Cheng, Sijie, et al.
Pubblicazione: (2023)
di: Cheng, Sijie, et al.
Pubblicazione: (2023)
When to Think and When to Look: Uncertainty-Guided Lookback
di: Bi, Jing, et al.
Pubblicazione: (2025)
di: Bi, Jing, et al.
Pubblicazione: (2025)
Thinking-while-Generating: Interleaving Textual Reasoning throughout Visual Generation
di: Guo, Ziyu, et al.
Pubblicazione: (2025)
di: Guo, Ziyu, et al.
Pubblicazione: (2025)
AgenticOCR: Parsing Only What You Need for Efficient Retrieval-Augmented Generation
di: Wang, Zhengren, et al.
Pubblicazione: (2026)
di: Wang, Zhengren, et al.
Pubblicazione: (2026)
Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation
di: Shi, Dingyuan, et al.
Pubblicazione: (2024)
di: Shi, Dingyuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DisCo-Diff: Enhancing Continuous Diffusion Models with Discrete Latents
di: Xu, Yilun, et al.
Pubblicazione: (2024) -
FragmentFlow: Scalable Transition State Generation for Large Molecules
di: Shprints, Ron, et al.
Pubblicazione: (2026) -
Correcting Diffusion Generation through Resampling
di: Liu, Yujian, et al.
Pubblicazione: (2023) -
Flow Matching for Accelerated Simulation of Atomic Transport in Crystalline Materials
di: Nam, Juno, et al.
Pubblicazione: (2024) -
Scaling Autoregressive Models for Lattice Thermodynamics
di: Du, Xiaochen, et al.
Pubblicazione: (2026)