DualSpec: Accelerating Deep Research Agents via Dual-Process Action Speculation
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhong, Shuzhang, Lu, Baotong, Chen, Qi, Liu, Chuanjie, Yang, Fan, Li, Meng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration
por: Zhong, Shuzhang, et al.
Publicado: (2026)
por: Zhong, Shuzhang, et al.
Publicado: (2026)
SpecExit: Accelerating Large Reasoning Model via Speculative Exit
por: Yang, Rubing, et al.
Publicado: (2025)
por: Yang, Rubing, et al.
Publicado: (2025)
DualSpec: Text-to-spatial-audio Generation via Dual-Spectrogram Guided Diffusion Model
por: Zhao, Lei, et al.
Publicado: (2025)
por: Zhao, Lei, et al.
Publicado: (2025)
SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding
por: Wei, Linye, et al.
Publicado: (2025)
por: Wei, Linye, et al.
Publicado: (2025)
SpecPipe: Accelerating Pipeline Parallelism-based LLM Inference with Speculative Decoding
por: Yin, Haofei, et al.
Publicado: (2025)
por: Yin, Haofei, et al.
Publicado: (2025)
TriSpec: Ternary Speculative Decoding via Lightweight Proxy Verification
por: Jiang, Haoyun, et al.
Publicado: (2026)
por: Jiang, Haoyun, et al.
Publicado: (2026)
SpecDiff: Accelerating Diffusion Model Inference with Self-Speculation
por: Pan, Jiayi, et al.
Publicado: (2025)
por: Pan, Jiayi, et al.
Publicado: (2025)
FR-Spec: Accelerating Large-Vocabulary Language Models via Frequency-Ranked Speculative Sampling
por: Zhao, Weilin, et al.
Publicado: (2025)
por: Zhao, Weilin, et al.
Publicado: (2025)
BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning
por: Xu, Yuhang, et al.
Publicado: (2026)
por: Xu, Yuhang, et al.
Publicado: (2026)
Spec-VLA: Speculative Decoding for Vision-Language-Action Models with Relaxed Acceptance
por: Wang, Songsheng, et al.
Publicado: (2025)
por: Wang, Songsheng, et al.
Publicado: (2025)
BanditSpec: Adaptive Speculative Decoding via Bandit Algorithms
por: Hou, Yunlong, et al.
Publicado: (2025)
por: Hou, Yunlong, et al.
Publicado: (2025)
SlimSpec: Low-Rank Draft LM-Head for Accelerated Speculative Decoding
por: Plaksin, Anton, et al.
Publicado: (2026)
por: Plaksin, Anton, et al.
Publicado: (2026)
RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval
por: Liu, Di, et al.
Publicado: (2024)
por: Liu, Di, et al.
Publicado: (2024)
CAS-Spec: Cascade Adaptive Self-Speculative Decoding for On-the-Fly Lossless Inference Acceleration of LLMs
por: Ning, Zhiyuan, et al.
Publicado: (2025)
por: Ning, Zhiyuan, et al.
Publicado: (2025)
MoE-Spec: Expert Budgeting for Efficient Speculative Decoding
por: McDanel, Bradley, et al.
Publicado: (2026)
por: McDanel, Bradley, et al.
Publicado: (2026)
SpecAttn: Speculating Sparse Attention
por: Shah, Harsh
Publicado: (2025)
por: Shah, Harsh
Publicado: (2025)
SpecMemo: Speculative Decoding is in Your Pocket
por: Yildirim, Selin, et al.
Publicado: (2025)
por: Yildirim, Selin, et al.
Publicado: (2025)
DySpec: Faster Speculative Decoding with Dynamic Token Tree Structure
por: Xiong, Yunfan, et al.
Publicado: (2024)
por: Xiong, Yunfan, et al.
Publicado: (2024)
ReSpec: Towards Optimizing Speculative Decoding in Reinforcement Learning Systems
por: Chen, Qiaoling, et al.
Publicado: (2025)
por: Chen, Qiaoling, et al.
Publicado: (2025)
DistillSpec: Improving Speculative Decoding via Knowledge Distillation
por: Zhou, Yongchao, et al.
Publicado: (2023)
por: Zhou, Yongchao, et al.
Publicado: (2023)
CopySpec: Accelerating LLMs with Speculative Copy-and-Paste Without Compromising Quality
por: Dumitru, Razvan-Gabriel, et al.
Publicado: (2025)
por: Dumitru, Razvan-Gabriel, et al.
Publicado: (2025)
ParallelSpec: Parallel Drafter for Efficient Speculative Decoding
por: Xiao, Zilin, et al.
Publicado: (2024)
por: Xiao, Zilin, et al.
Publicado: (2024)
MARS: Co-evolving Dual-System Deep Research via Multi-Agent Reinforcement Learning
por: Chen, Guoxin, et al.
Publicado: (2025)
por: Chen, Guoxin, et al.
Publicado: (2025)
KnapSpec: Self-Speculative Decoding via Adaptive Layer Selection as a Knapsack Problem
por: Cha, Seongjin, et al.
Publicado: (2026)
por: Cha, Seongjin, et al.
Publicado: (2026)
HiSpec: Hierarchical Speculative Decoding for LLMs
por: Kumar, Avinash, et al.
Publicado: (2025)
por: Kumar, Avinash, et al.
Publicado: (2025)
SpecReason: Fast and Accurate Inference-Time Compute via Speculative Reasoning
por: Pan, Rui, et al.
Publicado: (2025)
por: Pan, Rui, et al.
Publicado: (2025)
SpecPV: Improving Self-Speculative Decoding for Long-Context Generation via Partial Verification
por: Tan, Zhendong, et al.
Publicado: (2025)
por: Tan, Zhendong, et al.
Publicado: (2025)
SpecDec++: Boosting Speculative Decoding via Adaptive Candidate Lengths
por: Huang, Kaixuan, et al.
Publicado: (2024)
por: Huang, Kaixuan, et al.
Publicado: (2024)
SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification
por: Miao, Xupeng, et al.
Publicado: (2023)
por: Miao, Xupeng, et al.
Publicado: (2023)
SpecMD: A Comprehensive Study On Speculative Expert Prefetching
por: Hoang, Duc, et al.
Publicado: (2026)
por: Hoang, Duc, et al.
Publicado: (2026)
SpecTr: Fast Speculative Decoding via Optimal Transport
por: Sun, Ziteng, et al.
Publicado: (2023)
por: Sun, Ziteng, et al.
Publicado: (2023)
SpecForge: A Flexible and Efficient Open-Source Training Framework for Speculative Decoding
por: Li, Shenggui, et al.
Publicado: (2026)
por: Li, Shenggui, et al.
Publicado: (2026)
Mistletoe: Stealthy Acceleration-Collapse Attacks on Speculative Decoding
por: Sun, Shuoyang, et al.
Publicado: (2026)
por: Sun, Shuoyang, et al.
Publicado: (2026)
SpecMER: Fast Protein Generation with K-mer Guided Speculative Decoding
por: Walton, Thomas, et al.
Publicado: (2025)
por: Walton, Thomas, et al.
Publicado: (2025)
SpecBound: Adaptive Bounded Self-Speculation with Layer-wise Confidence Calibration
por: Wen, Zhuofan, et al.
Publicado: (2026)
por: Wen, Zhuofan, et al.
Publicado: (2026)
Actor-Accelerated Policy Dual Averaging for Reinforcement Learning in Continuous Action Spaces
por: Gao, Ji, et al.
Publicado: (2026)
por: Gao, Ji, et al.
Publicado: (2026)
ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding
por: Zhong, Shuzhang, et al.
Publicado: (2024)
por: Zhong, Shuzhang, et al.
Publicado: (2024)
QuantSpec: Self-Speculative Decoding with Hierarchical Quantized KV Cache
por: Tiwari, Rishabh, et al.
Publicado: (2025)
por: Tiwari, Rishabh, et al.
Publicado: (2025)
Accelerated Diffusion Models via Speculative Sampling
por: De Bortoli, Valentin, et al.
Publicado: (2025)
por: De Bortoli, Valentin, et al.
Publicado: (2025)
EasySpec: Layer-Parallel Speculative Decoding for Efficient Multi-GPU Utilization
por: Wu, Yize, et al.
Publicado: (2025)
por: Wu, Yize, et al.
Publicado: (2025)
Ejemplares similares
-
Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration
por: Zhong, Shuzhang, et al.
Publicado: (2026) -
SpecExit: Accelerating Large Reasoning Model via Speculative Exit
por: Yang, Rubing, et al.
Publicado: (2025) -
DualSpec: Text-to-spatial-audio Generation via Dual-Spectrogram Guided Diffusion Model
por: Zhao, Lei, et al.
Publicado: (2025) -
SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding
por: Wei, Linye, et al.
Publicado: (2025) -
SpecPipe: Accelerating Pipeline Parallelism-based LLM Inference with Speculative Decoding
por: Yin, Haofei, et al.
Publicado: (2025)