Salvato in:
| Autore principale: | Labovich, Asher |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2604.15259 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Block-Based Double Decoders
di: Labovich, Asher, et al.
Pubblicazione: (2026)
di: Labovich, Asher, et al.
Pubblicazione: (2026)
A Case for Library-Level k-Means Binning in Histogram Gradient-Boosted Trees
di: Labovich, Asher
Pubblicazione: (2025)
di: Labovich, Asher
Pubblicazione: (2025)
LoopQ: Quantization for Recursive Transformers
di: Fang, Rui, et al.
Pubblicazione: (2026)
di: Fang, Rui, et al.
Pubblicazione: (2026)
To CoT or To Loop? A Formal Comparison Between Chain-of-Thought and Looped Transformers
di: Xu, Kevin, et al.
Pubblicazione: (2025)
di: Xu, Kevin, et al.
Pubblicazione: (2025)
Loop, Think, & Generalize: Implicit Reasoning in Recurrent-Depth Transformers
di: Kohli, Harsh, et al.
Pubblicazione: (2026)
di: Kohli, Harsh, et al.
Pubblicazione: (2026)
Relational Preference Encoding in Looped Transformer Internal States
di: Kirin, Jan
Pubblicazione: (2026)
di: Kirin, Jan
Pubblicazione: (2026)
Analyzing limits for in-context learning
di: Naim, Omar, et al.
Pubblicazione: (2025)
di: Naim, Omar, et al.
Pubblicazione: (2025)
Foundation Models for AI-Enabled Biological Design
di: Moldwin, Asher, et al.
Pubblicazione: (2025)
di: Moldwin, Asher, et al.
Pubblicazione: (2025)
Noise Stability of Transformer Models
di: Haris, Themistoklis, et al.
Pubblicazione: (2026)
di: Haris, Themistoklis, et al.
Pubblicazione: (2026)
Stabilizing Recurrent Dynamics for Test-Time Scalable Latent Reasoning in Looped Language Models
di: Yang, Xiao-Wen, et al.
Pubblicazione: (2026)
di: Yang, Xiao-Wen, et al.
Pubblicazione: (2026)
Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
di: Vendrell, Victor Conchello, et al.
Pubblicazione: (2026)
di: Vendrell, Victor Conchello, et al.
Pubblicazione: (2026)
Reasoning with Latent Thoughts: On the Power of Looped Transformers
di: Saunshi, Nikunj, et al.
Pubblicazione: (2025)
di: Saunshi, Nikunj, et al.
Pubblicazione: (2025)
Inner Loop Inference for Pretrained Transformers: Unlocking Latent Capabilities Without Training
di: Lys, Jonathan, et al.
Pubblicazione: (2026)
di: Lys, Jonathan, et al.
Pubblicazione: (2026)
What Makes Looped Transformers Perform Better Than Non-Recursive Ones
di: Gong, Zixuan, et al.
Pubblicazione: (2025)
di: Gong, Zixuan, et al.
Pubblicazione: (2025)
Simulation of Graph Algorithms with Looped Transformers
di: de Luca, Artur Back, et al.
Pubblicazione: (2024)
di: de Luca, Artur Back, et al.
Pubblicazione: (2024)
From SHAP Scores to Feature Importance Scores
di: Letoffe, Olivier, et al.
Pubblicazione: (2024)
di: Letoffe, Olivier, et al.
Pubblicazione: (2024)
Looping Back to Move Forward: Recursive Transformers for Efficient and Flexible Large Multimodal Models
di: Xu, Ruihan, et al.
Pubblicazione: (2026)
di: Xu, Ruihan, et al.
Pubblicazione: (2026)
Can Looped Transformers Learn to Implement Multi-step Gradient Descent for In-context Learning?
di: Gatmiry, Khashayar, et al.
Pubblicazione: (2024)
di: Gatmiry, Khashayar, et al.
Pubblicazione: (2024)
Exact Attention Sensitivity and the Geometry of Transformer Stability
di: Emadi, Seyed Morteza
Pubblicazione: (2026)
di: Emadi, Seyed Morteza
Pubblicazione: (2026)
Bypassing the Exponential Dependency: Looped Transformers Efficiently Learn In-context by Multi-step Gradient Descent
di: Chen, Bo, et al.
Pubblicazione: (2024)
di: Chen, Bo, et al.
Pubblicazione: (2024)
Loop Corrections to the Training Error and Generalization Gap of Random Feature Models
di: Kim, Taeyoung
Pubblicazione: (2026)
di: Kim, Taeyoung
Pubblicazione: (2026)
Entropy-Guided Loop: Achieving Reasoning through Uncertainty-Aware Generation
di: Correa, Andrew G. A., et al.
Pubblicazione: (2025)
di: Correa, Andrew G. A., et al.
Pubblicazione: (2025)
LoopUS: Recasting Pretrained LLMs into Looped Latent Refinement Models
di: Park, Taekhyun, et al.
Pubblicazione: (2026)
di: Park, Taekhyun, et al.
Pubblicazione: (2026)
Mimetic Initialization of MLPs
di: Trockman, Asher, et al.
Pubblicazione: (2026)
di: Trockman, Asher, et al.
Pubblicazione: (2026)
Clover: Closed-Loop Verifiable Code Generation
di: Sun, Chuyue, et al.
Pubblicazione: (2023)
di: Sun, Chuyue, et al.
Pubblicazione: (2023)
Neural Algorithmic Reasoning for Hypergraphs with Looped Transformers
di: Huang, Zekai, et al.
Pubblicazione: (2025)
di: Huang, Zekai, et al.
Pubblicazione: (2025)
Stability of Transformers under Layer Normalization
di: Kan, Kelvin, et al.
Pubblicazione: (2025)
di: Kan, Kelvin, et al.
Pubblicazione: (2025)
Taking the GP Out of the Loop
di: Bafna, Mehul, et al.
Pubblicazione: (2025)
di: Bafna, Mehul, et al.
Pubblicazione: (2025)
Generalized Category Discovery with Large Language Models in the Loop
di: An, Wenbin, et al.
Pubblicazione: (2023)
di: An, Wenbin, et al.
Pubblicazione: (2023)
Sharper Generalization Bounds for Transformer
di: Li, Yawen, et al.
Pubblicazione: (2026)
di: Li, Yawen, et al.
Pubblicazione: (2026)
Traj-Transformer: Diffusion Models with Transformer for GPS Trajectory Generation
di: Zhang, Zhiyang, et al.
Pubblicazione: (2025)
di: Zhang, Zhiyang, et al.
Pubblicazione: (2025)
In-Context Credit Assignment via the Core
di: Harris, Keegan, et al.
Pubblicazione: (2026)
di: Harris, Keegan, et al.
Pubblicazione: (2026)
EnTransformer: A Deep Generative Transformer for Multivariate Probabilistic Forecasting
di: Pathak, Rajdeep, et al.
Pubblicazione: (2026)
di: Pathak, Rajdeep, et al.
Pubblicazione: (2026)
On the Stability and Generalization of First-order Bilevel Minimax Optimization
di: Zhang, Xuelin, et al.
Pubblicazione: (2026)
di: Zhang, Xuelin, et al.
Pubblicazione: (2026)
A Sharper Picture of Generalization in Transformers
di: Lintilhac, Paul, et al.
Pubblicazione: (2026)
di: Lintilhac, Paul, et al.
Pubblicazione: (2026)
Generalized Graph Transformer Variational Autoencoder
di: Karki, Siddhant
Pubblicazione: (2025)
di: Karki, Siddhant
Pubblicazione: (2025)
On Vanishing Variance in Transformer Length Generalization
di: Li, Ruining, et al.
Pubblicazione: (2025)
di: Li, Ruining, et al.
Pubblicazione: (2025)
Graph Generative Pre-trained Transformer
di: Chen, Xiaohui, et al.
Pubblicazione: (2025)
di: Chen, Xiaohui, et al.
Pubblicazione: (2025)
LLINBO: Trustworthy LLM-in-the-Loop Bayesian Optimization
di: Chang, Chih-Yu, et al.
Pubblicazione: (2025)
di: Chang, Chih-Yu, et al.
Pubblicazione: (2025)
Fine-grained Analysis of Stability and Generalization for Stochastic Bilevel Optimization
di: Zhang, Xuelin, et al.
Pubblicazione: (2026)
di: Zhang, Xuelin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Block-Based Double Decoders
di: Labovich, Asher, et al.
Pubblicazione: (2026) -
A Case for Library-Level k-Means Binning in Histogram Gradient-Boosted Trees
di: Labovich, Asher
Pubblicazione: (2025) -
LoopQ: Quantization for Recursive Transformers
di: Fang, Rui, et al.
Pubblicazione: (2026) -
To CoT or To Loop? A Formal Comparison Between Chain-of-Thought and Looped Transformers
di: Xu, Kevin, et al.
Pubblicazione: (2025) -
Loop, Think, & Generalize: Implicit Reasoning in Recurrent-Depth Transformers
di: Kohli, Harsh, et al.
Pubblicazione: (2026)