Enregistré dans:
| Auteurs principaux: | Nie, Wenhua, Meng, Zijie, Zou, Kun, Lin, Zheng, Li, Ziwei, Zheng, Haoran, Jang, Jyh-Shing Roger, Zhang, Hao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.07698 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Coupling Tax: How Shared Token Budgets Undermine Visible Chain-of-Thought Under Fixed Output Limits
par: Nie, Wenhua, et autres
Publié: (2026)
par: Nie, Wenhua, et autres
Publié: (2026)
Equilibrium Residuals Expose Three Regimes of Matrix-Game Strategic Reasoning in Language Models
par: Nie, Wenhua, et autres
Publié: (2026)
par: Nie, Wenhua, et autres
Publié: (2026)
Gradient Starvation in Binary-Reward GRPO: Why Group-Mean Centering Fails and Why the Simplest Fix Works
par: Nie, Wenhua, et autres
Publié: (2026)
par: Nie, Wenhua, et autres
Publié: (2026)
Identified-Set Geometry of Distributional Model Extraction under Top-$K$ Censored API Access
par: Nie, Wenhua, et autres
Publié: (2026)
par: Nie, Wenhua, et autres
Publié: (2026)
BLAPose: Enhancing 3D Human Pose Estimation with Bone Length Adjustment
par: Hsu, Chih-Hsiang, et autres
Publié: (2024)
par: Hsu, Chih-Hsiang, et autres
Publié: (2024)
CodaRAG: Connecting the Dots with Associativity Inspired by Complementary Learning
par: Li, Cheng-Yen, et autres
Publié: (2026)
par: Li, Cheng-Yen, et autres
Publié: (2026)
Primary Raw Marine PPSDH Sequences and Validation Summaries for Phase-Faithful Spatiotemporal Compression
par: Liu, Xinran, et autres
Publié: (2026)
par: Liu, Xinran, et autres
Publié: (2026)
Speculative Contrastive Decoding
par: Yuan, Hongyi, et autres
Publié: (2023)
par: Yuan, Hongyi, et autres
Publié: (2023)
Singer separation for karaoke content generation
par: Lin, Hsuan-Yu, et autres
Publié: (2021)
par: Lin, Hsuan-Yu, et autres
Publié: (2021)
Context-Aware Decoding for Faithful Vision-Language Generation
par: Fazli, Mehrdad, et autres
Publié: (2026)
par: Fazli, Mehrdad, et autres
Publié: (2026)
A Statistical Mechanics Model to Decode Tissue Crosstalk During Graft Formation
par: Ang Dong, et autres
Publié: (2026)
par: Ang Dong, et autres
Publié: (2026)
Dynamic Grid Trading Strategy: From Zero Expectation to Market Outperformance
par: Chen, Kai-Yuan, et autres
Publié: (2025)
par: Chen, Kai-Yuan, et autres
Publié: (2025)
Calibrated Speculative Decoding: Frequency-Guided Candidate Selection for Efficient Inference
par: Zhou, Xuwen, et autres
Publié: (2026)
par: Zhou, Xuwen, et autres
Publié: (2026)
Batch Speculative Decoding Done Right
par: Zhang, Ranran Haoran, et autres
Publié: (2025)
par: Zhang, Ranran Haoran, et autres
Publié: (2025)
Speculative Speculative Decoding
par: Kumar, Tanishq, et autres
Publié: (2026)
par: Kumar, Tanishq, et autres
Publié: (2026)
Singing Voice Graph Modeling for SingFake Detection
par: Chen, Xuanjun, et autres
Publié: (2024)
par: Chen, Xuanjun, et autres
Publié: (2024)
Steering Pretrained Drafters during Speculative Decoding
par: Berdoz, Frédéric, et autres
Publié: (2025)
par: Berdoz, Frédéric, et autres
Publié: (2025)
Online Speculative Decoding
par: Liu, Xiaoxuan, et autres
Publié: (2023)
par: Liu, Xiaoxuan, et autres
Publié: (2023)
Impossible Videos
par: Bai, Zechen, et autres
Publié: (2025)
par: Bai, Zechen, et autres
Publié: (2025)
Communication-Efficient Collaborative LLM Inference via Distributed Speculative Decoding
par: Zheng, Ce, et autres
Publié: (2025)
par: Zheng, Ce, et autres
Publié: (2025)
RASD: Retrieval-Augmented Speculative Decoding
par: Quan, Guofeng, et autres
Publié: (2025)
par: Quan, Guofeng, et autres
Publié: (2025)
Decoding Speculative Decoding
par: Yan, Minghao, et autres
Publié: (2024)
par: Yan, Minghao, et autres
Publié: (2024)
Adversarial Speaker Distillation for Countermeasure Model on Automatic Speaker Verification
par: Liao, Yen-Lun, et autres
Publié: (2022)
par: Liao, Yen-Lun, et autres
Publié: (2022)
Grammar-Aligned Decoding
par: Park, Kanghee, et autres
Publié: (2024)
par: Park, Kanghee, et autres
Publié: (2024)
Estimation of Semiparametric Factor Models with Missing Data
par: Zheng, Sijie
Publié: (2025)
par: Zheng, Sijie
Publié: (2025)
Towards Optimal Multi-draft Speculative Decoding
par: Hu, Zhengmian, et autres
Publié: (2025)
par: Hu, Zhengmian, et autres
Publié: (2025)
Continuous Speculative Decoding for Autoregressive Image Generation
par: Wang, Zili, et autres
Publié: (2024)
par: Wang, Zili, et autres
Publié: (2024)
Fast Collaborative Inference via Distributed Speculative Decoding
par: Zheng, Ce, et autres
Publié: (2025)
par: Zheng, Ce, et autres
Publié: (2025)
Speculative Decoding with a Speculative Vocabulary
par: Williams, Miles, et autres
Publié: (2026)
par: Williams, Miles, et autres
Publié: (2026)
Polybasic Speculative Decoding Through a Theoretical Perspective
par: Wang, Ruilin, et autres
Publié: (2025)
par: Wang, Ruilin, et autres
Publié: (2025)
The Attribution Impossibility: No Feature Ranking Is Faithful, Stable, and Complete Under Collinearity
par: Caraker, Drake, et autres
Publié: (2026)
par: Caraker, Drake, et autres
Publié: (2026)
Scaling Speculative Decoding with Lookahead Reasoning
par: Fu, Yichao, et autres
Publié: (2025)
par: Fu, Yichao, et autres
Publié: (2025)
Neural Codec-based Adversarial Sample Detection for Speaker Verification
par: Chen, Xuanjun, et autres
Publié: (2024)
par: Chen, Xuanjun, et autres
Publié: (2024)
Knowledge Retrieval Based on Generative AI
par: Yang, Te-Lun, et autres
Publié: (2025)
par: Yang, Te-Lun, et autres
Publié: (2025)
Clover: Regressive Lightweight Speculative Decoding with Sequential Knowledge
par: Xiao, Bin, et autres
Publié: (2024)
par: Xiao, Bin, et autres
Publié: (2024)
Decoding on Graphs: Faithful and Sound Reasoning on Knowledge Graphs through Generation of Well-Formed Chains
par: Li, Kun, et autres
Publié: (2024)
par: Li, Kun, et autres
Publié: (2024)
Speculative Coupled Decoding for Training-Free Lossless Acceleration of Autoregressive Visual Generation
par: So, Junhyuk, et autres
Publié: (2025)
par: So, Junhyuk, et autres
Publié: (2025)
DSDE: Dynamic Speculative Decoding with KLD Stability for Real-World Serving
par: Yang, Mingyu, et autres
Publié: (2025)
par: Yang, Mingyu, et autres
Publié: (2025)
Hyperbolic $P(Φ)_2$-model on the plane
par: Oh, Tadahiro, et autres
Publié: (2022)
par: Oh, Tadahiro, et autres
Publié: (2022)
SwiftSpec: Ultra-Low Latency LLM Decoding by Scaling Asynchronous Speculative Decoding
par: Zhang, Ziyi, et autres
Publié: (2025)
par: Zhang, Ziyi, et autres
Publié: (2025)
Documents similaires
-
The Coupling Tax: How Shared Token Budgets Undermine Visible Chain-of-Thought Under Fixed Output Limits
par: Nie, Wenhua, et autres
Publié: (2026) -
Equilibrium Residuals Expose Three Regimes of Matrix-Game Strategic Reasoning in Language Models
par: Nie, Wenhua, et autres
Publié: (2026) -
Gradient Starvation in Binary-Reward GRPO: Why Group-Mean Centering Fails and Why the Simplest Fix Works
par: Nie, Wenhua, et autres
Publié: (2026) -
Identified-Set Geometry of Distributional Model Extraction under Top-$K$ Censored API Access
par: Nie, Wenhua, et autres
Publié: (2026) -
BLAPose: Enhancing 3D Human Pose Estimation with Bone Length Adjustment
par: Hsu, Chih-Hsiang, et autres
Publié: (2024)