d3LLM: Ultra-Fast Diffusion LLM using Pseudo-Trajectory Distillation
Fuente:
arXiv
Guardado en:
| Autores principales: | Qian, Yu-Yang, Su, Junda, Hu, Lanxiang, Zhang, Peiyuan, Deng, Zhijie, Zhao, Peng, Zhang, Hao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TrimLLM: Progressive Layer Dropping for Domain-Specific LLMs
por: Hu, Lanxiang, et al.
Publicado: (2024)
por: Hu, Lanxiang, et al.
Publicado: (2024)
General Modular Harness for LLM Agents in Multi-Turn Gaming Environments
por: Zhang, Yuxuan, et al.
Publicado: (2025)
por: Zhang, Yuxuan, et al.
Publicado: (2025)
CLLMs: Consistency Large Language Models
por: Kou, Siqi, et al.
Publicado: (2024)
por: Kou, Siqi, et al.
Publicado: (2024)
TAD: Temporal-Aware Trajectory Self-Distillation for Fast and Accurate Diffusion LLM
por: Zhou, Haoyang, et al.
Publicado: (2026)
por: Zhou, Haoyang, et al.
Publicado: (2026)
Online Speculative Decoding
por: Liu, Xiaoxuan, et al.
Publicado: (2023)
por: Liu, Xiaoxuan, et al.
Publicado: (2023)
GameArena: Evaluating LLM Reasoning through Live Computer Games
por: Hu, Lanxiang, et al.
Publicado: (2024)
por: Hu, Lanxiang, et al.
Publicado: (2024)
Efficient Detection of LLM-generated Texts with a Bayesian Surrogate Model
por: Miao, Yibo, et al.
Publicado: (2023)
por: Miao, Yibo, et al.
Publicado: (2023)
Internalizing Agency from Reflective Experience
por: Ge, Rui, et al.
Publicado: (2026)
por: Ge, Rui, et al.
Publicado: (2026)
Fast and Accurate Causal Parallel Decoding using Jacobi Forcing
por: Hu, Lanxiang, et al.
Publicado: (2025)
por: Hu, Lanxiang, et al.
Publicado: (2025)
ChatThero: An LLM-Supported Chatbot for Behavior Change and Therapeutic Support in Addiction Recovery
por: Wang, Junda, et al.
Publicado: (2025)
por: Wang, Junda, et al.
Publicado: (2025)
Towards Interpretable and Inference-Optimal COT Reasoning with Sparse Autoencoder-Guided Generation
por: Zhao, Daniel, et al.
Publicado: (2025)
por: Zhao, Daniel, et al.
Publicado: (2025)
Distilling LLM Reasoning into Graph of Concept Predictors
por: Yu, Ziyang, et al.
Publicado: (2026)
por: Yu, Ziyang, et al.
Publicado: (2026)
Fast On-device LLM Inference with NPUs
por: Xu, Daliang, et al.
Publicado: (2024)
por: Xu, Daliang, et al.
Publicado: (2024)
ODIA: Oriented Distillation for Inline Acceleration of LLM-based Function Calling
por: Zhang, Hanlong, et al.
Publicado: (2025)
por: Zhang, Hanlong, et al.
Publicado: (2025)
SIFT: Grounding LLM Reasoning in Contexts via Stickers
por: Zeng, Zihao, et al.
Publicado: (2025)
por: Zeng, Zihao, et al.
Publicado: (2025)
DualFast: Dual-Speedup Framework for Fast Sampling of Diffusion Models
por: Yu, Hu, et al.
Publicado: (2025)
por: Yu, Hu, et al.
Publicado: (2025)
dUltra: Ultra-Fast Diffusion Language Models via Reinforcement Learning
por: Chen, Shirui, et al.
Publicado: (2025)
por: Chen, Shirui, et al.
Publicado: (2025)
Reinforcement-aware Knowledge Distillation for LLM Reasoning
por: Zhang, Zhaoyang, et al.
Publicado: (2026)
por: Zhang, Zhaoyang, et al.
Publicado: (2026)
LLM and GNN are Complementary: Distilling LLM for Multimodal Graph Learning
por: Xu, Junjie, et al.
Publicado: (2024)
por: Xu, Junjie, et al.
Publicado: (2024)
dLLM-Cache: Accelerating Diffusion Large Language Models with Adaptive Caching
por: Liu, Zhiyuan, et al.
Publicado: (2025)
por: Liu, Zhiyuan, et al.
Publicado: (2025)
LLM-Oriented Token-Adaptive Knowledge Distillation
por: Xie, Xurong, et al.
Publicado: (2025)
por: Xie, Xurong, et al.
Publicado: (2025)
ClawTrace: Cost-Aware Tracing for LLM Agent Skill Distillation
por: Yuan, Boqin, et al.
Publicado: (2026)
por: Yuan, Boqin, et al.
Publicado: (2026)
AdaBlock-dLLM: Semantic-Aware Diffusion LLM Inference via Adaptive Block Size
por: Lu, Guanxi, et al.
Publicado: (2025)
por: Lu, Guanxi, et al.
Publicado: (2025)
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
por: Ding, Hangliang, et al.
Publicado: (2025)
por: Ding, Hangliang, et al.
Publicado: (2025)
UltraSketchLLM: Saliency-Driven Sketching for Ultra-Low Bit LLM Compression
por: Zou, Sunan, et al.
Publicado: (2025)
por: Zou, Sunan, et al.
Publicado: (2025)
AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air
por: Yang, Shiyi, et al.
Publicado: (2025)
por: Yang, Shiyi, et al.
Publicado: (2025)
LLM-MRD: LLM-Guided Multi-View Reasoning Distillation for Fake News Detection
por: Zhou, Weilin, et al.
Publicado: (2026)
por: Zhou, Weilin, et al.
Publicado: (2026)
Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration
por: Chen, Zhipeng, et al.
Publicado: (2026)
por: Chen, Zhipeng, et al.
Publicado: (2026)
Skill-Conditioned Gated Self-Distillation for LLM Reasoning
por: Huang, Jiazhen, et al.
Publicado: (2026)
por: Huang, Jiazhen, et al.
Publicado: (2026)
Diffusion LLMs Can Do Faster-Than-AR Inference via Discrete Diffusion Forcing
por: Wang, Xu, et al.
Publicado: (2025)
por: Wang, Xu, et al.
Publicado: (2025)
TrajAD: Trajectory Anomaly Detection for Trustworthy LLM Agents
por: Liu, Yibing, et al.
Publicado: (2026)
por: Liu, Yibing, et al.
Publicado: (2026)
Fast-dLLM v2: Efficient Block-Diffusion LLM
por: Wu, Chengyue, et al.
Publicado: (2025)
por: Wu, Chengyue, et al.
Publicado: (2025)
dTRPO: Trajectory Reduction in Policy Optimization of Diffusion Large Language Models
por: Zhang, Wenxuan, et al.
Publicado: (2026)
por: Zhang, Wenxuan, et al.
Publicado: (2026)
Membership and Memorization in LLM Knowledge Distillation
por: Zhang, Ziqi, et al.
Publicado: (2025)
por: Zhang, Ziqi, et al.
Publicado: (2025)
SkillBrew: Multi-Objective Curation of Skill Banks for LLM Agents
por: Hu, Wentao, et al.
Publicado: (2026)
por: Hu, Wentao, et al.
Publicado: (2026)
Benchmarking Scientific Understanding and Reasoning for Video Generation using VideoScience-Bench
por: Hu, Lanxiang, et al.
Publicado: (2025)
por: Hu, Lanxiang, et al.
Publicado: (2025)
Reducing Cost of LLM Agents with Trajectory Reduction
por: Xiao, Yuan-An, et al.
Publicado: (2025)
por: Xiao, Yuan-An, et al.
Publicado: (2025)
TurboSpec: Closed-loop Speculation Control System for Optimizing LLM Serving Goodput
por: Liu, Xiaoxuan, et al.
Publicado: (2024)
por: Liu, Xiaoxuan, et al.
Publicado: (2024)
Intention-Aware Diffusion Model for Pedestrian Trajectory Prediction
por: Liu, Yu, et al.
Publicado: (2025)
por: Liu, Yu, et al.
Publicado: (2025)
Pseudo-Knowledge Graph: Meta-Path Guided Retrieval and In-Graph Text for RAG-Equipped LLM
por: Yang, Yuxin, et al.
Publicado: (2025)
por: Yang, Yuxin, et al.
Publicado: (2025)
Ejemplares similares
-
TrimLLM: Progressive Layer Dropping for Domain-Specific LLMs
por: Hu, Lanxiang, et al.
Publicado: (2024) -
General Modular Harness for LLM Agents in Multi-Turn Gaming Environments
por: Zhang, Yuxuan, et al.
Publicado: (2025) -
CLLMs: Consistency Large Language Models
por: Kou, Siqi, et al.
Publicado: (2024) -
TAD: Temporal-Aware Trajectory Self-Distillation for Fast and Accurate Diffusion LLM
por: Zhou, Haoyang, et al.
Publicado: (2026) -
Online Speculative Decoding
por: Liu, Xiaoxuan, et al.
Publicado: (2023)