Efficient Parallel Samplers for Recurrent-Depth Models and Their Connection to Diffusion Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Geiping, Jonas, Yang, Xinyu, Su, Guinan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Stream LLMs: Unblocking Language Models with Parallel Streams of Thoughts, Inputs and Outputs
par: Su, Guinan, et autres
Publié: (2026)
par: Su, Guinan, et autres
Publié: (2026)
Sample Smart, Not Hard: Correctness-First Decoding for Better Reasoning in LLMs
par: Li, Xueyan, et autres
Publié: (2025)
par: Li, Xueyan, et autres
Publié: (2025)
Fine, I'll Merge It Myself: A Multi-Fidelity Framework for Automated Model Merging
par: Su, Guinan, et autres
Publié: (2025)
par: Su, Guinan, et autres
Publié: (2025)
Attention-Based Sampler for Diffusion Language Models
par: Zhou, Yuyan, et autres
Publié: (2026)
par: Zhou, Yuyan, et autres
Publié: (2026)
Efficiently Dispatching Flash Attention For Partially Filled Attention Masks
par: Sharma, Agniv, et autres
Publié: (2024)
par: Sharma, Agniv, et autres
Publié: (2024)
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
par: Geiping, Jonas, et autres
Publié: (2025)
par: Geiping, Jonas, et autres
Publié: (2025)
DOS: Dependency-Oriented Sampler for Masked Diffusion Language Models
par: Zhou, Xueyu, et autres
Publié: (2026)
par: Zhou, Xueyu, et autres
Publié: (2026)
Teaching Pretrained Language Models to Think Deeper with Retrofitted Recurrence
par: McLeish, Sean, et autres
Publié: (2025)
par: McLeish, Sean, et autres
Publié: (2025)
GPTailor: Large Language Model Pruning Through Layer Cutting and Stitching
par: Su, Guinan, et autres
Publié: (2025)
par: Su, Guinan, et autres
Publié: (2025)
Answer Matching Outperforms Multiple Choice for Language Model Evaluation
par: Chandak, Nikhil, et autres
Publié: (2025)
par: Chandak, Nikhil, et autres
Publié: (2025)
A Watermark for Large Language Models
par: Kirchenbauer, John, et autres
Publié: (2023)
par: Kirchenbauer, John, et autres
Publié: (2023)
LMD3: Language Model Data Density Dependence
par: Kirchenbauer, John, et autres
Publié: (2024)
par: Kirchenbauer, John, et autres
Publié: (2024)
An Interpretable N-gram Perplexity Threat Model for Large Language Model Jailbreaks
par: Boreiko, Valentyn, et autres
Publié: (2024)
par: Boreiko, Valentyn, et autres
Publié: (2024)
Diffusion Language Models are Provably Optimal Parallel Samplers
par: Jiang, Haozhe, et autres
Publié: (2025)
par: Jiang, Haozhe, et autres
Publié: (2025)
How Much Is One Recurrence Worth? Iso-Depth Scaling Laws for Looped Language Models
par: Schwethelm, Kristian, et autres
Publié: (2026)
par: Schwethelm, Kristian, et autres
Publié: (2026)
DenseMamba: State Space Models with Dense Hidden Connection for Efficient Large Language Models
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
Parallel Scaling Law for Language Models
par: Chen, Mouxiang, et autres
Publié: (2025)
par: Chen, Mouxiang, et autres
Publié: (2025)
On the Reliability of Watermarks for Large Language Models
par: Kirchenbauer, John, et autres
Publié: (2023)
par: Kirchenbauer, John, et autres
Publié: (2023)
Scaling Open-Ended Reasoning to Predict the Future
par: Chandak, Nikhil, et autres
Publié: (2025)
par: Chandak, Nikhil, et autres
Publié: (2025)
Locally Coherent Parallel Decoding in Diffusion Language Models
par: Hersche, Michael, et autres
Publié: (2026)
par: Hersche, Michael, et autres
Publié: (2026)
Griffin: Mixing Gated Linear Recurrences with Local Attention for Efficient Language Models
par: De, Soham, et autres
Publié: (2024)
par: De, Soham, et autres
Publié: (2024)
Efficient Test-Time Inference via Deterministic Exploration of Truncated Decoding Trees
par: Li, Xueyan, et autres
Publié: (2026)
par: Li, Xueyan, et autres
Publié: (2026)
Parallel Token Prediction for Language Models
par: Draxler, Felix, et autres
Publié: (2025)
par: Draxler, Felix, et autres
Publié: (2025)
On the Representational Capacity of Recurrent Neural Language Models
par: Nowak, Franz, et autres
Publié: (2023)
par: Nowak, Franz, et autres
Publié: (2023)
Depth-Recurrent Attention Mixtures: Giving Latent Reasoning the Attention it Deserves
par: Knupp, Jonas, et autres
Publié: (2026)
par: Knupp, Jonas, et autres
Publié: (2026)
DPad: Efficient Diffusion Language Models with Suffix Dropout
par: Chen, Xinhua, et autres
Publié: (2025)
par: Chen, Xinhua, et autres
Publié: (2025)
Discrete Diffusion Language Model for Efficient Text Summarization
par: Dat, Do Huu, et autres
Publié: (2024)
par: Dat, Do Huu, et autres
Publié: (2024)
Rewiring Experts on the Fly:Continuous Rerouting for Better Online Adaptation in Mixture-of-Expert models
par: Su, Guinan, et autres
Publié: (2025)
par: Su, Guinan, et autres
Publié: (2025)
RecurrentGemma: Moving Past Transformers for Efficient Open Language Models
par: Botev, Aleksandar, et autres
Publié: (2024)
par: Botev, Aleksandar, et autres
Publié: (2024)
Structured Recurrent Mixers for Massively Parallelized Sequence Generation
par: Badger, Benjamin L.
Publié: (2026)
par: Badger, Benjamin L.
Publié: (2026)
ThreadWeaver: Adaptive Threading for Efficient Parallel Reasoning in Language Models
par: Lian, Long, et autres
Publié: (2025)
par: Lian, Long, et autres
Publié: (2025)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
par: Li, Jia-Nan, et autres
Publié: (2025)
par: Li, Jia-Nan, et autres
Publié: (2025)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
par: Cheng, Yunfei, et autres
Publié: (2024)
par: Cheng, Yunfei, et autres
Publié: (2024)
Capability-Based Scaling Trends for LLM-Based Red-Teaming
par: Panfilov, Alexander, et autres
Publié: (2025)
par: Panfilov, Alexander, et autres
Publié: (2025)
Datasets for Fairness in Language Models: An In-Depth Survey
par: Zhang, Jiale, et autres
Publié: (2025)
par: Zhang, Jiale, et autres
Publié: (2025)
Parallel Sampling from Masked Diffusion Models via Conditional Independence Testing
par: Azangulov, Iskander, et autres
Publié: (2025)
par: Azangulov, Iskander, et autres
Publié: (2025)
Latent Chain-of-Thought? Decoding the Depth-Recurrent Transformer
par: Lu, Wenquan, et autres
Publié: (2025)
par: Lu, Wenquan, et autres
Publié: (2025)
An Algebraic View of the Expressivity of Recurrent Language Models
par: Nowak, Franz, et autres
Publié: (2026)
par: Nowak, Franz, et autres
Publié: (2026)
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
par: Li, Miao, et autres
Publié: (2026)
par: Li, Miao, et autres
Publié: (2026)
Parallelism and Generation Order in Masked Diffusion Language Models: Limits Today, Potential Tomorrow
par: Zhong, Yangyang, et autres
Publié: (2026)
par: Zhong, Yangyang, et autres
Publié: (2026)
Documents similaires
-
Multi-Stream LLMs: Unblocking Language Models with Parallel Streams of Thoughts, Inputs and Outputs
par: Su, Guinan, et autres
Publié: (2026) -
Sample Smart, Not Hard: Correctness-First Decoding for Better Reasoning in LLMs
par: Li, Xueyan, et autres
Publié: (2025) -
Fine, I'll Merge It Myself: A Multi-Fidelity Framework for Automated Model Merging
par: Su, Guinan, et autres
Publié: (2025) -
Attention-Based Sampler for Diffusion Language Models
par: Zhou, Yuyan, et autres
Publié: (2026) -
Efficiently Dispatching Flash Attention For Partially Filled Attention Masks
par: Sharma, Agniv, et autres
Publié: (2024)