Accelerating Inference of Discrete Autoregressive Normalizing Flows by Selective Jacobi Decoding
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Jiaru, Lu, Juanwu, Wu, Xiaoyu, Wang, Ziran, Zhang, Ruqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On Variance Reduction in Learning Mean Flows
di: Lu, Juanwu, et al.
Pubblicazione: (2026)
di: Lu, Juanwu, et al.
Pubblicazione: (2026)
Analytical Correction for Subsampling Bias in Drifting Models
di: Zhang, Jiaru, et al.
Pubblicazione: (2026)
di: Zhang, Jiaru, et al.
Pubblicazione: (2026)
One-Step Diffusion Samplers via Self-Distillation and Deterministic Flow
di: Jutras-Dube, Pascal, et al.
Pubblicazione: (2025)
di: Jutras-Dube, Pascal, et al.
Pubblicazione: (2025)
Latent Bayesian Optimization via Autoregressive Normalizing Flows
di: Lee, Seunghun, et al.
Pubblicazione: (2025)
di: Lee, Seunghun, et al.
Pubblicazione: (2025)
Leveraging Model Guidance to Extract Training Data from Personalized Diffusion Models
di: Wu, Xiaoyu, et al.
Pubblicazione: (2024)
di: Wu, Xiaoyu, et al.
Pubblicazione: (2024)
CAS-Spec: Cascade Adaptive Self-Speculative Decoding for On-the-Fly Lossless Inference Acceleration of LLMs
di: Ning, Zhiyuan, et al.
Pubblicazione: (2025)
di: Ning, Zhiyuan, et al.
Pubblicazione: (2025)
FedMomentum: Preserving LoRA Training Momentum in Federated Fine-Tuning
di: Yan, Peishen, et al.
Pubblicazione: (2026)
di: Yan, Peishen, et al.
Pubblicazione: (2026)
Model Merging on Loss Landscape: A Geometry Perspective
di: Lu, Juanwu, et al.
Pubblicazione: (2026)
di: Lu, Juanwu, et al.
Pubblicazione: (2026)
Distilling Autoregressive Models to Obtain High-Performance Non-Autoregressive Solvers for Vehicle Routing Problems with Faster Inference Speed
di: Xiao, Yubin, et al.
Pubblicazione: (2023)
di: Xiao, Yubin, et al.
Pubblicazione: (2023)
DIVERSED: Relaxed Speculative Decoding via Dynamic Ensemble Verification
di: Wang, Ziyi, et al.
Pubblicazione: (2026)
di: Wang, Ziyi, et al.
Pubblicazione: (2026)
A Universal and Robust Framework for Multiple Gas Recognition Based-on Spherical Normalization-Coupled Mahalanobis Algorithm
di: Chen, Shuai, et al.
Pubblicazione: (2025)
di: Chen, Shuai, et al.
Pubblicazione: (2025)
Autoregressive Visual Decoding from EEG Signals
di: Dai, Sicheng, et al.
Pubblicazione: (2026)
di: Dai, Sicheng, et al.
Pubblicazione: (2026)
Learning Discrete Autoregressive Priors with Wasserstein Gradient Flow
di: Zheng, Bowen, et al.
Pubblicazione: (2026)
di: Zheng, Bowen, et al.
Pubblicazione: (2026)
Accelerating Large-Scale Reasoning Model Inference with Sparse Self-Speculative Decoding
di: Zhao, Yilong, et al.
Pubblicazione: (2025)
di: Zhao, Yilong, et al.
Pubblicazione: (2025)
Recursive Speculative Decoding: Accelerating LLM Inference via Sampling Without Replacement
di: Jeon, Wonseok, et al.
Pubblicazione: (2024)
di: Jeon, Wonseok, et al.
Pubblicazione: (2024)
Accelerating Transformer Inference for Translation via Parallel Decoding
di: Santilli, Andrea, et al.
Pubblicazione: (2023)
di: Santilli, Andrea, et al.
Pubblicazione: (2023)
PromptIntern: Saving Inference Costs by Internalizing Recurrent Prompt during Large Language Model Fine-tuning
di: Zou, Jiaru, et al.
Pubblicazione: (2024)
di: Zou, Jiaru, et al.
Pubblicazione: (2024)
Latent-DARM: Bridging Discrete Diffusion And Autoregressive Models For Reasoning
di: Berrayana, Lina, et al.
Pubblicazione: (2026)
di: Berrayana, Lina, et al.
Pubblicazione: (2026)
A Theoretical Analysis of Discrete Flow Matching Generative Models
di: Su, Maojiang, et al.
Pubblicazione: (2025)
di: Su, Maojiang, et al.
Pubblicazione: (2025)
Discrete Flow Matching
di: Gat, Itai, et al.
Pubblicazione: (2024)
di: Gat, Itai, et al.
Pubblicazione: (2024)
Accelerating LLM Inference with Lossless Speculative Decoding Algorithms for Heterogeneous Vocabularies
di: Timor, Nadav, et al.
Pubblicazione: (2025)
di: Timor, Nadav, et al.
Pubblicazione: (2025)
Speculative Decoding with CTC-based Draft Model for LLM Inference Acceleration
di: Wen, Zhuofan, et al.
Pubblicazione: (2024)
di: Wen, Zhuofan, et al.
Pubblicazione: (2024)
Context-Aware Assistant Selection for Improved Inference Acceleration with Large Language Models
di: Huang, Jerry, et al.
Pubblicazione: (2024)
di: Huang, Jerry, et al.
Pubblicazione: (2024)
DepCap: Adaptive Block-Wise Parallel Decoding for Efficient Diffusion LM Inference
di: Xia, Xiang, et al.
Pubblicazione: (2026)
di: Xia, Xiang, et al.
Pubblicazione: (2026)
Linear Transformers as VAR Models: Aligning Autoregressive Attention Mechanisms with Autoregressive Forecasting
di: Lu, Jiecheng, et al.
Pubblicazione: (2025)
di: Lu, Jiecheng, et al.
Pubblicazione: (2025)
TPLA: Tensor Parallel Latent Attention for Efficient Disaggregated Prefill and Decode Inference
di: Tang, Xiaojuan, et al.
Pubblicazione: (2025)
di: Tang, Xiaojuan, et al.
Pubblicazione: (2025)
PAHQ: Accelerating Automated Circuit Discovery through Mixed-Precision Inference Optimization
di: Wang, Xinhai, et al.
Pubblicazione: (2025)
di: Wang, Xinhai, et al.
Pubblicazione: (2025)
Controlled LLM Decoding via Discrete Auto-regressive Biasing
di: Pynadath, Patrick, et al.
Pubblicazione: (2025)
di: Pynadath, Patrick, et al.
Pubblicazione: (2025)
Attention Drift: What Autoregressive Speculative Decoding Models Learn
di: Eldenk, Doğaç, et al.
Pubblicazione: (2026)
di: Eldenk, Doğaç, et al.
Pubblicazione: (2026)
From Values to Tokens: An LLM-Driven Framework for Context-aware Time Series Forecasting via Symbolic Discretization
di: Tao, Xiaoyu, et al.
Pubblicazione: (2025)
di: Tao, Xiaoyu, et al.
Pubblicazione: (2025)
ASTRA: Communication-Efficient Acceleration for Multi-Device Transformer Inference
di: Liu, Xiao, et al.
Pubblicazione: (2025)
di: Liu, Xiao, et al.
Pubblicazione: (2025)
Diffusion LLMs Can Do Faster-Than-AR Inference via Discrete Diffusion Forcing
di: Wang, Xu, et al.
Pubblicazione: (2025)
di: Wang, Xu, et al.
Pubblicazione: (2025)
Efficient Regression-Based Training of Normalizing Flows for Boltzmann Generators
di: Rehman, Danyal, et al.
Pubblicazione: (2025)
di: Rehman, Danyal, et al.
Pubblicazione: (2025)
Exploring Diffusion Models' Corruption Stage in Few-Shot Fine-tuning and Mitigating with Bayesian Neural Networks
di: Wu, Xiaoyu, et al.
Pubblicazione: (2024)
di: Wu, Xiaoyu, et al.
Pubblicazione: (2024)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
Amortized Sampling with Transferable Normalizing Flows
di: Tan, Charlie B., et al.
Pubblicazione: (2025)
di: Tan, Charlie B., et al.
Pubblicazione: (2025)
Knowledge Graph Embedding by Normalizing Flows
di: Xiao, Changyi, et al.
Pubblicazione: (2024)
di: Xiao, Changyi, et al.
Pubblicazione: (2024)
Personalized Federated Learning via Learning Dynamic Graphs
di: Zhou, Ziran, et al.
Pubblicazione: (2025)
di: Zhou, Ziran, et al.
Pubblicazione: (2025)
Annealed Relaxation of Speculative Decoding for Faster Autoregressive Image Generation
di: Li, Xingyao, et al.
Pubblicazione: (2026)
di: Li, Xingyao, et al.
Pubblicazione: (2026)
FlowPG: Action-constrained Policy Gradient with Normalizing Flows
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2024)
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2024)
Documenti analoghi
-
On Variance Reduction in Learning Mean Flows
di: Lu, Juanwu, et al.
Pubblicazione: (2026) -
Analytical Correction for Subsampling Bias in Drifting Models
di: Zhang, Jiaru, et al.
Pubblicazione: (2026) -
One-Step Diffusion Samplers via Self-Distillation and Deterministic Flow
di: Jutras-Dube, Pascal, et al.
Pubblicazione: (2025) -
Latent Bayesian Optimization via Autoregressive Normalizing Flows
di: Lee, Seunghun, et al.
Pubblicazione: (2025) -
Leveraging Model Guidance to Extract Training Data from Personalized Diffusion Models
di: Wu, Xiaoyu, et al.
Pubblicazione: (2024)