Advancing Regular Language Reasoning in Linear Recurrent Neural Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Fan, Ting-Han, Chi, Ta-Chung, Rudnicky, Alexander I. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Revisiting Bi-Linear State Transitions in Recurrent Neural Networks
di: Ebrahimi, M. Reza, et al.
Pubblicazione: (2025)
di: Ebrahimi, M. Reza, et al.
Pubblicazione: (2025)
A Variational Framework for Improving Naturalness in Generative Spoken Language Models
di: Chen, Li-Wei, et al.
Pubblicazione: (2025)
di: Chen, Li-Wei, et al.
Pubblicazione: (2025)
On the Representational Capacity of Recurrent Neural Language Models
di: Nowak, Franz, et al.
Pubblicazione: (2023)
di: Nowak, Franz, et al.
Pubblicazione: (2023)
Principled Fine-tuning of LLMs from User-Edits: A Medley of Preference, Supervision, and Reward
di: Misra, Dipendra, et al.
Pubblicazione: (2026)
di: Misra, Dipendra, et al.
Pubblicazione: (2026)
Griffin: Mixing Gated Linear Recurrences with Local Attention for Efficient Language Models
di: De, Soham, et al.
Pubblicazione: (2024)
di: De, Soham, et al.
Pubblicazione: (2024)
VisualRWKV: Exploring Recurrent Neural Networks for Visual Language Models
di: Hou, Haowen, et al.
Pubblicazione: (2024)
di: Hou, Haowen, et al.
Pubblicazione: (2024)
A Minimum Description Length Approach to Regularization in Neural Networks
di: Abudy, Matan, et al.
Pubblicazione: (2025)
di: Abudy, Matan, et al.
Pubblicazione: (2025)
Liger: Linearizing Large Language Models to Gated Recurrent Structures
di: Lan, Disen, et al.
Pubblicazione: (2025)
di: Lan, Disen, et al.
Pubblicazione: (2025)
Graph Linearization Methods for Reasoning on Graphs with Large Language Models
di: Xypolopoulos, Christos, et al.
Pubblicazione: (2024)
di: Xypolopoulos, Christos, et al.
Pubblicazione: (2024)
AF-KAN: Activation Function-Based Kolmogorov-Arnold Networks for Efficient Representation Learning
di: Ta, Hoang-Thang, et al.
Pubblicazione: (2025)
di: Ta, Hoang-Thang, et al.
Pubblicazione: (2025)
DivLogicEval: A Framework for Benchmarking Logical Reasoning Evaluation in Large Language Models
di: Chung, Tsz Ting, et al.
Pubblicazione: (2025)
di: Chung, Tsz Ting, et al.
Pubblicazione: (2025)
Rethinking State Tracking in Recurrent Models Through Error Control Dynamics
di: Chung, Jiwan, et al.
Pubblicazione: (2026)
di: Chung, Jiwan, et al.
Pubblicazione: (2026)
Neural Diversity Regularizes Hallucinations in Language Models
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2025)
di: Chakrabarti, Kushal, et al.
Pubblicazione: (2025)
On the Design of KL-Regularized Policy Gradient Algorithms for LLM Reasoning
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
di: Zhang, Yifan, et al.
Pubblicazione: (2025)
Optimal Decay Spectra for Linear Recurrences
di: Cao, Yang
Pubblicazione: (2026)
di: Cao, Yang
Pubblicazione: (2026)
FC-KAN: Function Combinations in Kolmogorov-Arnold Networks
di: Ta, Hoang-Thang, et al.
Pubblicazione: (2024)
di: Ta, Hoang-Thang, et al.
Pubblicazione: (2024)
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
di: Hou, Zhenyu, et al.
Pubblicazione: (2025)
di: Hou, Zhenyu, et al.
Pubblicazione: (2025)
Large Language Models for Conducting Advanced Text Analytics Information Systems Research
di: Ampel, Benjamin M., et al.
Pubblicazione: (2023)
di: Ampel, Benjamin M., et al.
Pubblicazione: (2023)
PCL-Reasoner-V1.5: Advancing Math Reasoning with Offline Reinforcement Learning
di: Lu, Yao, et al.
Pubblicazione: (2026)
di: Lu, Yao, et al.
Pubblicazione: (2026)
Hybrid Quantum-Classical Recurrent Neural Networks
di: Xu, Wenduan
Pubblicazione: (2025)
di: Xu, Wenduan
Pubblicazione: (2025)
Dissecting Linear Recurrent Models: How Different Gating Strategies Drive Selectivity and Generalization
di: Bouhadjar, Younes, et al.
Pubblicazione: (2026)
di: Bouhadjar, Younes, et al.
Pubblicazione: (2026)
DSDR: Dual-Scale Diversity Regularization for Exploration in LLM Reasoning
di: Wan, Zhongwei, et al.
Pubblicazione: (2026)
di: Wan, Zhongwei, et al.
Pubblicazione: (2026)
Training Neural Networks as Recognizers of Formal Languages
di: Butoi, Alexandra, et al.
Pubblicazione: (2024)
di: Butoi, Alexandra, et al.
Pubblicazione: (2024)
Self-guided Knowledgeable Network of Thoughts: Amplifying Reasoning with Large Language Models
di: Chen, Chao-Chi, et al.
Pubblicazione: (2024)
di: Chen, Chao-Chi, et al.
Pubblicazione: (2024)
Depression detection from Social Media Bangla Text Using Recurrent Neural Networks
di: Ahmed, Sultan, et al.
Pubblicazione: (2024)
di: Ahmed, Sultan, et al.
Pubblicazione: (2024)
Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach
di: Geiping, Jonas, et al.
Pubblicazione: (2025)
di: Geiping, Jonas, et al.
Pubblicazione: (2025)
Advanced Text Analytics -- Graph Neural Network for Fake News Detection in Social Media
di: Patel, Anantram, et al.
Pubblicazione: (2025)
di: Patel, Anantram, et al.
Pubblicazione: (2025)
Self-playing Adversarial Language Game Enhances LLM Reasoning
di: Cheng, Pengyu, et al.
Pubblicazione: (2024)
di: Cheng, Pengyu, et al.
Pubblicazione: (2024)
CosmicFish-HRM: Adaptive Reasoning via Hierarchical Recurrent Mechanisms in Compact Language Models
di: Lakkapragada, Venkat Akhil
Pubblicazione: (2026)
di: Lakkapragada, Venkat Akhil
Pubblicazione: (2026)
A Novel Recurrent Neural Network Framework for Prediction and Treatment of Oncogenic Mutation Progression
di: Parthasarathy, Rishab, et al.
Pubblicazione: (2025)
di: Parthasarathy, Rishab, et al.
Pubblicazione: (2025)
Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?
di: Chi, Haoang, et al.
Pubblicazione: (2025)
di: Chi, Haoang, et al.
Pubblicazione: (2025)
Large Language Models on Graphs: A Comprehensive Survey
di: Jin, Bowen, et al.
Pubblicazione: (2023)
di: Jin, Bowen, et al.
Pubblicazione: (2023)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
di: Cheng, Yunfei, et al.
Pubblicazione: (2024)
di: Cheng, Yunfei, et al.
Pubblicazione: (2024)
Discrete Neural Algorithmic Reasoning
di: Rodionov, Gleb, et al.
Pubblicazione: (2024)
di: Rodionov, Gleb, et al.
Pubblicazione: (2024)
Weight-of-Thought Reasoning: Exploring Neural Network Weights for Enhanced LLM Reasoning
di: Punjwani, Saif, et al.
Pubblicazione: (2025)
di: Punjwani, Saif, et al.
Pubblicazione: (2025)
State Stream Transformer (SST) V2: Parallel Training of Nonlinear Recurrence for Latent Space Reasoning
di: Aviss, Thea
Pubblicazione: (2026)
di: Aviss, Thea
Pubblicazione: (2026)
CREAM: Consistency Regularized Self-Rewarding Language Models
di: Wang, Zhaoyang, et al.
Pubblicazione: (2024)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2024)
Reasoning Beyond Limits: Advances and Open Problems for LLMs
di: Ferrag, Mohamed Amine, et al.
Pubblicazione: (2025)
di: Ferrag, Mohamed Amine, et al.
Pubblicazione: (2025)
On Efficiently Representing Regular Languages as RNNs
di: Svete, Anej, et al.
Pubblicazione: (2024)
di: Svete, Anej, et al.
Pubblicazione: (2024)
Transformers meet Neural Algorithmic Reasoners
di: Bounsi, Wilfried, et al.
Pubblicazione: (2024)
di: Bounsi, Wilfried, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Revisiting Bi-Linear State Transitions in Recurrent Neural Networks
di: Ebrahimi, M. Reza, et al.
Pubblicazione: (2025) -
A Variational Framework for Improving Naturalness in Generative Spoken Language Models
di: Chen, Li-Wei, et al.
Pubblicazione: (2025) -
On the Representational Capacity of Recurrent Neural Language Models
di: Nowak, Franz, et al.
Pubblicazione: (2023) -
Principled Fine-tuning of LLMs from User-Edits: A Medley of Preference, Supervision, and Reward
di: Misra, Dipendra, et al.
Pubblicazione: (2026) -
Griffin: Mixing Gated Linear Recurrences with Local Attention for Efficient Language Models
di: De, Soham, et al.
Pubblicazione: (2024)