LANTERN++: Enhancing Relaxed Speculative Decoding with Static Tree Drafting for Visual Auto-regressive Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Park, Sihwan, Jang, Doohyuk, Kim, Sungyub, Kundu, Souvik, Yang, Eunho |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LANTERN: Accelerating Visual Autoregressive Models with Relaxed Speculative Decoding
di: Jang, Doohyuk, et al.
Pubblicazione: (2024)
di: Jang, Doohyuk, et al.
Pubblicazione: (2024)
Med-PerSAM: One-Shot Visual Prompt Tuning for Personalized Segment Anything Model in Medical Domain
di: Yoon, Hangyul, et al.
Pubblicazione: (2024)
di: Yoon, Hangyul, et al.
Pubblicazione: (2024)
TTD: Text-Tag Self-Distillation Enhancing Image-Text Alignment in CLIP to Alleviate Single Tag Bias
di: Jo, Sanghyun, et al.
Pubblicazione: (2024)
di: Jo, Sanghyun, et al.
Pubblicazione: (2024)
Speculative Coupled Decoding for Training-Free Lossless Acceleration of Autoregressive Visual Generation
di: So, Junhyuk, et al.
Pubblicazione: (2025)
di: So, Junhyuk, et al.
Pubblicazione: (2025)
Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding
di: Teng, Yao, et al.
Pubblicazione: (2024)
di: Teng, Yao, et al.
Pubblicazione: (2024)
SJD++: Improved Speculative Jacobi Decoding for Training-free Acceleration of Discrete Auto-regressive Text-to-Image Generation
di: Teng, Yao, et al.
Pubblicazione: (2025)
di: Teng, Yao, et al.
Pubblicazione: (2025)
SJD-PAC: Accelerating Speculative Jacobi Decoding via Proactive Drafting and Adaptive Continuation
di: Kang, Jialiang, et al.
Pubblicazione: (2026)
di: Kang, Jialiang, et al.
Pubblicazione: (2026)
Unveiling the Response of Large Vision-Language Models to Visually Absent Tokens
di: Kim, Sohee, et al.
Pubblicazione: (2025)
di: Kim, Sohee, et al.
Pubblicazione: (2025)
Progress by Pieces: Test-Time Scaling for Autoregressive Image Generation
di: Park, Joonhyung, et al.
Pubblicazione: (2025)
di: Park, Joonhyung, et al.
Pubblicazione: (2025)
CASCADE: Context-Aware Relaxation for Speculative Image Decoding
di: Yildirim, Selin, et al.
Pubblicazione: (2026)
di: Yildirim, Selin, et al.
Pubblicazione: (2026)
CollabVR: Collaborative Video Reasoning with Vision-Language and Video Generation Models
di: Kim, Joowon, et al.
Pubblicazione: (2026)
di: Kim, Joowon, et al.
Pubblicazione: (2026)
Draft and Refine with Visual Experts
di: Jeong, Sungheon, et al.
Pubblicazione: (2025)
di: Jeong, Sungheon, et al.
Pubblicazione: (2025)
Grouped Speculative Decoding for Autoregressive Image Generation
di: So, Junhyuk, et al.
Pubblicazione: (2025)
di: So, Junhyuk, et al.
Pubblicazione: (2025)
Annealed Relaxation of Speculative Decoding for Faster Autoregressive Image Generation
di: Li, Xingyao, et al.
Pubblicazione: (2026)
di: Li, Xingyao, et al.
Pubblicazione: (2026)
Collaborative Decoding Makes Visual Auto-Regressive Modeling Efficient
di: Chen, Zigeng, et al.
Pubblicazione: (2024)
di: Chen, Zigeng, et al.
Pubblicazione: (2024)
Thinking with Drafts: Speculative Temporal Reasoning for Efficient Long Video Understanding
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
di: Hu, Pengfei, et al.
Pubblicazione: (2025)
Multi-modal Auto-regressive Modeling via Visual Words
di: Peng, Tianshuo, et al.
Pubblicazione: (2024)
di: Peng, Tianshuo, et al.
Pubblicazione: (2024)
Fork-Merge Decoding: Enhancing Multimodal Understanding in Audio-Visual Large Language Models
di: Jung, Chaeyoung, et al.
Pubblicazione: (2025)
di: Jung, Chaeyoung, et al.
Pubblicazione: (2025)
Small Drafts, Big Verdict: Information-Intensive Visual Reasoning via Speculation
di: Liu, Yuhan, et al.
Pubblicazione: (2025)
di: Liu, Yuhan, et al.
Pubblicazione: (2025)
Class-Distribution Guided Active Learning for 3D Occupancy Prediction in Autonomous Driving
di: Kim, Wonjune, et al.
Pubblicazione: (2026)
di: Kim, Wonjune, et al.
Pubblicazione: (2026)
LabelDistill: Label-guided Cross-modal Knowledge Distillation for Camera-based 3D Object Detection
di: Kim, Sanmin, et al.
Pubblicazione: (2024)
di: Kim, Sanmin, et al.
Pubblicazione: (2024)
Continuous Speculative Decoding for Autoregressive Image Generation
di: Wang, Zili, et al.
Pubblicazione: (2024)
di: Wang, Zili, et al.
Pubblicazione: (2024)
MMSpec: Benchmarking Speculative Decoding for Vision-Language Models
di: Shen, Hui, et al.
Pubblicazione: (2026)
di: Shen, Hui, et al.
Pubblicazione: (2026)
Fast Inference of Visual Autoregressive Model with Adjacency-Adaptive Dynamical Draft Trees
di: Lei, Haodong, et al.
Pubblicazione: (2025)
di: Lei, Haodong, et al.
Pubblicazione: (2025)
Distilled Decoding 1: One-step Sampling of Image Auto-regressive Models with Flow Matching
di: Liu, Enshu, et al.
Pubblicazione: (2024)
di: Liu, Enshu, et al.
Pubblicazione: (2024)
CloudFixer: Test-Time Adaptation for 3D Point Clouds via Diffusion-Guided Geometric Transformation
di: Shim, Hajin, et al.
Pubblicazione: (2024)
di: Shim, Hajin, et al.
Pubblicazione: (2024)
CRAB: Camera-Radar Fusion for Reducing Depth Ambiguity in Backward Projection based View Transformation
di: Lee, In-Jae, et al.
Pubblicazione: (2025)
di: Lee, In-Jae, et al.
Pubblicazione: (2025)
ParallelVLM: Lossless Video-LLM Acceleration with Visual Alignment Aware Parallel Speculative Decoding
di: Kong, Quan, et al.
Pubblicazione: (2026)
di: Kong, Quan, et al.
Pubblicazione: (2026)
Why and When Visual Token Pruning Fails? A Study on Relevant Visual Information Shift in MLLMs Decoding
di: Kim, Jiwan, et al.
Pubblicazione: (2026)
di: Kim, Jiwan, et al.
Pubblicazione: (2026)
Many-to-many Image Generation with Auto-regressive Diffusion Models
di: Shen, Ying, et al.
Pubblicazione: (2024)
di: Shen, Ying, et al.
Pubblicazione: (2024)
SpecVLM: Fast Speculative Decoding in Vision-Language Models
di: Huang, Haiduo, et al.
Pubblicazione: (2025)
di: Huang, Haiduo, et al.
Pubblicazione: (2025)
EdgeRunner: Auto-regressive Auto-encoder for Artistic Mesh Generation
di: Tang, Jiaxiang, et al.
Pubblicazione: (2024)
di: Tang, Jiaxiang, et al.
Pubblicazione: (2024)
Integrating Multimodal Large Language Model Knowledge into Amodal Completion
di: Yun, Heecheol, et al.
Pubblicazione: (2026)
di: Yun, Heecheol, et al.
Pubblicazione: (2026)
AVCD: Mitigating Hallucinations in Audio-Visual Large Language Models through Contrastive Decoding
di: Jung, Chaeyoung, et al.
Pubblicazione: (2025)
di: Jung, Chaeyoung, et al.
Pubblicazione: (2025)
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
di: Xu, Jingqi, et al.
Pubblicazione: (2025)
di: Xu, Jingqi, et al.
Pubblicazione: (2025)
AAMDM: Accelerated Auto-regressive Motion Diffusion Model
di: Li, Tianyu, et al.
Pubblicazione: (2023)
di: Li, Tianyu, et al.
Pubblicazione: (2023)
GenQ: Quantization in Low Data Regimes with Generative Synthetic Data
di: Li, Yuhang, et al.
Pubblicazione: (2023)
di: Li, Yuhang, et al.
Pubblicazione: (2023)
Speculative Decoding Reimagined for Multimodal Large Language Models
di: Lin, Luxi, et al.
Pubblicazione: (2025)
di: Lin, Luxi, et al.
Pubblicazione: (2025)
Multi-Scale Local Speculative Decoding for Image Generation
di: Peruzzo, Elia, et al.
Pubblicazione: (2026)
di: Peruzzo, Elia, et al.
Pubblicazione: (2026)
Open-MAGVIT2: An Open-Source Project Toward Democratizing Auto-regressive Visual Generation
di: Luo, Zhuoyan, et al.
Pubblicazione: (2024)
di: Luo, Zhuoyan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LANTERN: Accelerating Visual Autoregressive Models with Relaxed Speculative Decoding
di: Jang, Doohyuk, et al.
Pubblicazione: (2024) -
Med-PerSAM: One-Shot Visual Prompt Tuning for Personalized Segment Anything Model in Medical Domain
di: Yoon, Hangyul, et al.
Pubblicazione: (2024) -
TTD: Text-Tag Self-Distillation Enhancing Image-Text Alignment in CLIP to Alleviate Single Tag Bias
di: Jo, Sanghyun, et al.
Pubblicazione: (2024) -
Speculative Coupled Decoding for Training-Free Lossless Acceleration of Autoregressive Visual Generation
di: So, Junhyuk, et al.
Pubblicazione: (2025) -
Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding
di: Teng, Yao, et al.
Pubblicazione: (2024)