LLaDA2.1: Speeding Up Text Diffusion via Token Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Bie, Tiwei, Cao, Maosong, Cao, Xiang, Chen, Bingsen, Chen, Fuyuan, Chen, Kun, Du, Lun, Feng, Daozhuo, Feng, Haibo, Gong, Mingliang, Gong, Zhuocheng, Gu, Yanmei, Guan, Jian, Guan, Kaiyuan, He, Hongliang, Huang, Zenan, Jiang, Juyong, Jiang, Zhonghui, Lan, Zhenzhong, Li, Chengxi, Li, Jianguo, Li, Zehuan, Liu, Huabin, Liu, Lin, Lu, Guoshan, Lu, Yuan, Ma, Yuxin, Mou, Xingyu, Pan, Zhenxuan, Qiu, Kaida, Ren, Yuji, Tan, Jianfeng, Tian, Yiding, Wang, Zian, Wei, Lanning, Wu, Tao, Xing, Yipeng, Ye, Wentao, Zha, Liangyu, Zhang, Tianze, Zhang, Xiaolu, Zhao, Junbo, Zheng, Da, Zhong, Hao, Zhong, Wanli, Zhou, Jun, Zhou, Junlin, Zhu, Liwang, Zhu, Muzhi, Zhuang, Yihong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLaDA2.0: Scaling Up Diffusion Language Models to 100B
di: Bie, Tiwei, et al.
Pubblicazione: (2025)
di: Bie, Tiwei, et al.
Pubblicazione: (2025)
LLaDA-MoE: A Sparse MoE Diffusion Language Model
di: Zhu, Fengqi, et al.
Pubblicazione: (2025)
di: Zhu, Fengqi, et al.
Pubblicazione: (2025)
Disturbance Observer–Based Adaptive Dynamic Event‐Triggered Control for a Class of Nonlinear Systems With Input Saturation
di: Lu Chen, et al.
Pubblicazione: (2025)
di: Lu Chen, et al.
Pubblicazione: (2025)
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
di: AI, Inclusion, et al.
Pubblicazione: (2026)
di: AI, Inclusion, et al.
Pubblicazione: (2026)
Exploring Bacteria‐Based Cancer Immunotherapy: Comment on “Discovery of Intratumoral Oncolytic Bacteria Toward Targeted Anticancer Theranostics”
di: Chen‐xi Li, et al.
Pubblicazione: (2025)
di: Chen‐xi Li, et al.
Pubblicazione: (2025)
Does Porphyromonas gingivalis truly inhibit the oral carcinogenesis?
di: Chen‐xi Li, et al.
Pubblicazione: (2025)
di: Chen‐xi Li, et al.
Pubblicazione: (2025)
Latent Preference Coding: Aligning Large Language Models via Discrete Latent Codes
di: Gong, Zhuocheng, et al.
Pubblicazione: (2025)
di: Gong, Zhuocheng, et al.
Pubblicazione: (2025)
PromptCoT 2.0: Scaling Prompt Synthesis for Large Language Model Reasoning
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
Obstacle Avoidance Path Planning of a 4-DOF Weapon Arm Based on Improved RRT (RRT-H) Algorithm
di: Kaifan Zou, et al.
Pubblicazione: (2024)
di: Kaifan Zou, et al.
Pubblicazione: (2024)
Calibration‐free physics‐informed neural networks for adaptive state inference in bioprocesses
di: Hongtao Zhu, et al.
Pubblicazione: (2026)
di: Hongtao Zhu, et al.
Pubblicazione: (2026)
From Canteen Food to Daily Meals: Generalizing Food Recognition to More Practical Scenarios
di: Liu, Guoshan, et al.
Pubblicazione: (2024)
di: Liu, Guoshan, et al.
Pubblicazione: (2024)
SKA sensitivity for possible radio emission from dark matter in Omega Centauri
di: Wang, Guan-Sen, et al.
Pubblicazione: (2023)
di: Wang, Guan-Sen, et al.
Pubblicazione: (2023)
Enhancing Action and Ingredient Modeling for Semantically Grounded Recipe Generation
di: Liu, Guoshan, et al.
Pubblicazione: (2026)
di: Liu, Guoshan, et al.
Pubblicazione: (2026)
SparseLGS: Sparse View Language Embedded Gaussian Splatting
di: Hu, Jun, et al.
Pubblicazione: (2024)
di: Hu, Jun, et al.
Pubblicazione: (2024)
LLaDA-MedV: Exploring Large Language Diffusion Models for Biomedical Image Understanding
di: Dong, Xuanzhao, et al.
Pubblicazione: (2025)
di: Dong, Xuanzhao, et al.
Pubblicazione: (2025)
Chorusing Synchronization Signals for Ambient 5G Backscatter
di: Feng, Yunyun, et al.
Pubblicazione: (2026)
di: Feng, Yunyun, et al.
Pubblicazione: (2026)
Few-Shot Identity Adaptation for 3D Talking Heads via Global Gaussian Field
di: Nie, Hong, et al.
Pubblicazione: (2025)
di: Nie, Hong, et al.
Pubblicazione: (2025)
PITE: Multi-Prototype Alignment for Individual Treatment Effect Estimation
di: Cao, Fuyuan, et al.
Pubblicazione: (2025)
di: Cao, Fuyuan, et al.
Pubblicazione: (2025)
Efficient Token Pruning for LLaDA-V
di: Wan, Zhewen, et al.
Pubblicazione: (2026)
di: Wan, Zhewen, et al.
Pubblicazione: (2026)
Integrating metagenomics and high-throughput screening for bioprospecting marine producers of polyhydroxyalkanoates.
di: Zhong, Naicai, et al.
Pubblicazione: (2025)
di: Zhong, Naicai, et al.
Pubblicazione: (2025)
TwiSTAR:Think Fast, Think Slow, Then Act,Generative Recommendation with Adaptive Reasoning
di: Cao, Shiteng, et al.
Pubblicazione: (2026)
di: Cao, Shiteng, et al.
Pubblicazione: (2026)
BrainQN: Enhancing the Robustness of Deep Reinforcement Learning with Spiking Neural Networks
di: Shuo Feng, et al.
Pubblicazione: (2024)
di: Shuo Feng, et al.
Pubblicazione: (2024)
Development and validation of health‐oriented personal evaluation for the community‐dwelling older person based on the International Classification of Functioning, Disability and Health
di: Liang Zhou, et al.
Pubblicazione: (2024)
di: Liang Zhou, et al.
Pubblicazione: (2024)
AnimaX: Animating the Inanimate in 3D with Joint Video-Pose Diffusion Models
di: Huang, Zehuan, et al.
Pubblicazione: (2025)
di: Huang, Zehuan, et al.
Pubblicazione: (2025)
Charge and spin instabilities in superconducting La$_3$Ni$_2$O$_7$
di: Chen, Xuejiao, et al.
Pubblicazione: (2023)
di: Chen, Xuejiao, et al.
Pubblicazione: (2023)
Personalize Anything for Free with Diffusion Transformer
di: Feng, Haoran, et al.
Pubblicazione: (2025)
di: Feng, Haoran, et al.
Pubblicazione: (2025)
Serine/Threonine Kinase 33 as a Novel Target of Bufalin in Treatment of Triple‐Negative Breast Cancer
di: Shilong Jiang, et al.
Pubblicazione: (2025)
di: Shilong Jiang, et al.
Pubblicazione: (2025)
Learning from Scratch: Structurally-masked Transformer for Next Generation Lib-free Simulation
di: Huang, Junlang, et al.
Pubblicazione: (2025)
di: Huang, Junlang, et al.
Pubblicazione: (2025)
Enhancing Sa2VA for Referent Video Object Segmentation: 2nd Solution for 7th LSVOS RVOS Track
di: Hong, Ran, et al.
Pubblicazione: (2025)
di: Hong, Ran, et al.
Pubblicazione: (2025)
Pseudo-Label Enhanced Cascaded Framework: 2nd Technical Report for LSVOS 2025 VOS Track
di: Yan, An, et al.
Pubblicazione: (2025)
di: Yan, An, et al.
Pubblicazione: (2025)
Emergent Superconductivity and Competing Charge Orders in Hole-Doped Square-Lattice $t$-$J$ Model
di: Lu, Xin, et al.
Pubblicazione: (2023)
di: Lu, Xin, et al.
Pubblicazione: (2023)
Pure momentum-shift bulk photovoltaic effect in ferroelectric flat-band Mott insulators
di: Lu, Zhuocheng, et al.
Pubblicazione: (2025)
di: Lu, Zhuocheng, et al.
Pubblicazione: (2025)
VoxHammer: Training-Free Precise and Coherent 3D Editing in Native 3D Space
di: Li, Lin, et al.
Pubblicazione: (2025)
di: Li, Lin, et al.
Pubblicazione: (2025)
Contribution of interleukins in the regulation of teleost fish immunity: A review from the perspective of regulating macrophages.
di: Cao, Jia-Feng, et al.
Pubblicazione: (2025)
di: Cao, Jia-Feng, et al.
Pubblicazione: (2025)
LLaDA 1.5: Variance-Reduced Preference Optimization for Large Language Diffusion Models
di: Zhu, Fengqi, et al.
Pubblicazione: (2025)
di: Zhu, Fengqi, et al.
Pubblicazione: (2025)
LLaDA-V: Large Language Diffusion Models with Visual Instruction Tuning
di: You, Zebin, et al.
Pubblicazione: (2025)
di: You, Zebin, et al.
Pubblicazione: (2025)
Where to Look: Can Foundation Models Reach a Target Viewpoint Through Active Exploration?
di: Li, Liyang, et al.
Pubblicazione: (2026)
di: Li, Liyang, et al.
Pubblicazione: (2026)
iShapEditing: Intelligent Shape Editing with Diffusion Models
di: Jing Li, et al.
Pubblicazione: (2024)
di: Jing Li, et al.
Pubblicazione: (2024)
Implicit Bonded Discrete Element Method with Manifold Optimization
di: Lu, Jia-Ming, et al.
Pubblicazione: (2023)
di: Lu, Jia-Ming, et al.
Pubblicazione: (2023)
Exploring Talking Head Models With Adjacent Frame Prior for Speech-Preserving Facial Expression Manipulation
di: Lu, Zhenxuan, et al.
Pubblicazione: (2026)
di: Lu, Zhenxuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LLaDA2.0: Scaling Up Diffusion Language Models to 100B
di: Bie, Tiwei, et al.
Pubblicazione: (2025) -
LLaDA-MoE: A Sparse MoE Diffusion Language Model
di: Zhu, Fengqi, et al.
Pubblicazione: (2025) -
Disturbance Observer–Based Adaptive Dynamic Event‐Triggered Control for a Class of Nonlinear Systems With Input Saturation
di: Lu Chen, et al.
Pubblicazione: (2025) -
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
di: AI, Inclusion, et al.
Pubblicazione: (2026) -
Exploring Bacteria‐Based Cancer Immunotherapy: Comment on “Discovery of Intratumoral Oncolytic Bacteria Toward Targeted Anticancer Theranostics”
di: Chen‐xi Li, et al.
Pubblicazione: (2025)