Syntactic Learnability of Echo State Neural Language Models at Scale
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ueda, Ryo, Kuribayashi, Tatsuki, Kando, Shunsuke, Inui, Kentaro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Analyzing Feed-Forward Blocks in Transformers through the Lens of Attention Maps
par: Kobayashi, Goro, et autres
Publié: (2023)
par: Kobayashi, Goro, et autres
Publié: (2023)
Large Language Models Are Human-Like Internally
par: Kuribayashi, Tatsuki, et autres
Publié: (2025)
par: Kuribayashi, Tatsuki, et autres
Publié: (2025)
Emergent Word Order Universals from Cognitively-Motivated Language Models
par: Kuribayashi, Tatsuki, et autres
Publié: (2024)
par: Kuribayashi, Tatsuki, et autres
Publié: (2024)
To Drop or Not to Drop? Predicting Argument Ellipsis Judgments: A Case Study in Japanese
par: Ishizuki, Yukiko, et autres
Publié: (2024)
par: Ishizuki, Yukiko, et autres
Publié: (2024)
First Heuristic Then Rational: Dynamic Use of Heuristics in Language Model Reasoning
par: Aoki, Yoichi, et autres
Publié: (2024)
par: Aoki, Yoichi, et autres
Publié: (2024)
Does Vision Accelerate Hierarchical Generalization in Neural Language Learners?
par: Kuribayashi, Tatsuki, et autres
Publié: (2023)
par: Kuribayashi, Tatsuki, et autres
Publié: (2023)
An Existence Proof for Neural Language Models That Can Explain Garden-Path Effects via Surprisal
par: Yoshida, Ryo, et autres
Publié: (2026)
par: Yoshida, Ryo, et autres
Publié: (2026)
On Representational Dissociation of Language and Arithmetic in Large Language Models
par: Kisako, Riku, et autres
Publié: (2025)
par: Kisako, Riku, et autres
Publié: (2025)
Do Self-Supervised Speech Models Exhibit the Critical Period Effects in Language Acquisition?
par: Koga, Yurie, et autres
Publié: (2025)
par: Koga, Yurie, et autres
Publié: (2025)
What Kind of Language is Easy to Language-Model Under Curriculum Learning?
par: El-Naggar, Nadine, et autres
Publié: (2026)
par: El-Naggar, Nadine, et autres
Publié: (2026)
Psychometric Predictive Power of Large Language Models
par: Kuribayashi, Tatsuki, et autres
Publié: (2023)
par: Kuribayashi, Tatsuki, et autres
Publié: (2023)
Monotonic Representation of Numeric Properties in Language Models
par: Heinzerling, Benjamin, et autres
Publié: (2024)
par: Heinzerling, Benjamin, et autres
Publié: (2024)
LLMs Faithfully and Iteratively Compute Answers During CoT: A Systematic Analysis With Multi-step Arithmetics
par: Kudo, Keito, et autres
Publié: (2024)
par: Kudo, Keito, et autres
Publié: (2024)
Repetition Neurons: How Do Language Models Produce Repetitions?
par: Hiraoka, Tatsuya, et autres
Publié: (2024)
par: Hiraoka, Tatsuya, et autres
Publié: (2024)
Exploring the Effect of Segmentation and Vocabulary Size on Speech Tokenization for Speech Language Models
par: Kando, Shunsuke, et autres
Publié: (2025)
par: Kando, Shunsuke, et autres
Publié: (2025)
Which Word Orders Facilitate Length Generalization in LMs? An Investigation with GCG-Based Artificial Languages
par: El-Naggar, Nadine, et autres
Publié: (2025)
par: El-Naggar, Nadine, et autres
Publié: (2025)
Representational Analysis of Binding in Language Models
par: Dai, Qin, et autres
Publié: (2024)
par: Dai, Qin, et autres
Publié: (2024)
Dual Alignment Between Language Model Layers and Human Sentence Processing
par: Kuribayashi, Tatsuki, et autres
Publié: (2026)
par: Kuribayashi, Tatsuki, et autres
Publié: (2026)
Cell-Based Representation of Relational Binding in Language Models
par: Dai, Qin, et autres
Publié: (2026)
par: Dai, Qin, et autres
Publié: (2026)
Can Language Models Learn Typologically Implausible Languages?
par: Xu, Tianyang, et autres
Publié: (2025)
par: Xu, Tianyang, et autres
Publié: (2025)
Derivational Probing: Unveiling the Layer-wise Derivation of Syntactic Structures in Neural Language Models
par: Someya, Taiga, et autres
Publié: (2025)
par: Someya, Taiga, et autres
Publié: (2025)
TopK Language Models
par: Takahashi, Ryosuke, et autres
Publié: (2025)
par: Takahashi, Ryosuke, et autres
Publié: (2025)
Analysing the Language of Neural Audio Codecs
par: Park, Joonyong, et autres
Publié: (2025)
par: Park, Joonyong, et autres
Publié: (2025)
Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters
par: Hiraoka, Tatsuya, et autres
Publié: (2025)
par: Hiraoka, Tatsuya, et autres
Publié: (2025)
Textless Dependency Parsing by Labeled Sequence Prediction
par: Kando, Shunsuke, et autres
Publié: (2024)
par: Kando, Shunsuke, et autres
Publié: (2024)
Tree-Planted Transformers: Unidirectional Transformer Language Models with Implicit Syntactic Supervision
par: Yoshida, Ryo, et autres
Publié: (2024)
par: Yoshida, Ryo, et autres
Publié: (2024)
Can Input Attributions Explain Inductive Reasoning in In-Context Learning?
par: Ye, Mengyu, et autres
Publié: (2024)
par: Ye, Mengyu, et autres
Publié: (2024)
On Entity Identification in Language Models
par: Sakata, Masaki, et autres
Publié: (2025)
par: Sakata, Masaki, et autres
Publié: (2025)
Understanding Fact Recall in Language Models: Why Two-Stage Training Encourages Memorization but Mixed Training Teaches Knowledge
par: Zhang, Ying, et autres
Publié: (2025)
par: Zhang, Ying, et autres
Publié: (2025)
Linear Representations of Hierarchical Concepts in Language Models
par: Sakata, Masaki, et autres
Publié: (2026)
par: Sakata, Masaki, et autres
Publié: (2026)
Rectifying Belief Space via Unlearning to Harness LLMs' Reasoning
par: Niwa, Ayana, et autres
Publié: (2025)
par: Niwa, Ayana, et autres
Publié: (2025)
The Curse of Popularity: Popular Entities have Catastrophic Side Effects when Deleting Knowledge from Language Models
par: Takahashi, Ryosuke, et autres
Publié: (2024)
par: Takahashi, Ryosuke, et autres
Publié: (2024)
A Large Collection of Model-generated Contradictory Responses for Consistency-aware Dialogue Systems
par: Sato, Shiki, et autres
Publié: (2024)
par: Sato, Shiki, et autres
Publié: (2024)
How Individual Traits and Language Styles Shape Preferences In Open-ended User-LLM Interaction: A Preliminary Study
par: Chevi, Rendi, et autres
Publié: (2025)
par: Chevi, Rendi, et autres
Publié: (2025)
Understanding and Controlling Repetition Neurons and Induction Heads in In-Context Learning
par: Doan, Nhi Hoai, et autres
Publié: (2025)
par: Doan, Nhi Hoai, et autres
Publié: (2025)
Weight-based Analysis of Detokenization in Language Models: Understanding the First Stage of Inference Without Inference
par: Kamoda, Go, et autres
Publié: (2025)
par: Kamoda, Go, et autres
Publié: (2025)
The Geometry of Numerical Reasoning: Language Models Compare Numeric Properties in Linear Subspaces
par: El-Shangiti, Ahmed Oumar, et autres
Publié: (2024)
par: El-Shangiti, Ahmed Oumar, et autres
Publié: (2024)
Generative Pretrained Structured Transformers: Unsupervised Syntactic Language Models at Scale
par: Hu, Xiang, et autres
Publié: (2024)
par: Hu, Xiang, et autres
Publié: (2024)
PheMT: A Phenomenon-wise Dataset for Machine Translation Robustness on User-Generated Contents
par: Fujii, Ryo, et autres
Publié: (2020)
par: Fujii, Ryo, et autres
Publié: (2020)
J-UniMorph: Japanese Morphological Annotation through the Universal Feature Schema
par: Matsuzaki, Kosuke, et autres
Publié: (2024)
par: Matsuzaki, Kosuke, et autres
Publié: (2024)
Documents similaires
-
Analyzing Feed-Forward Blocks in Transformers through the Lens of Attention Maps
par: Kobayashi, Goro, et autres
Publié: (2023) -
Large Language Models Are Human-Like Internally
par: Kuribayashi, Tatsuki, et autres
Publié: (2025) -
Emergent Word Order Universals from Cognitively-Motivated Language Models
par: Kuribayashi, Tatsuki, et autres
Publié: (2024) -
To Drop or Not to Drop? Predicting Argument Ellipsis Judgments: A Case Study in Japanese
par: Ishizuki, Yukiko, et autres
Publié: (2024) -
First Heuristic Then Rational: Dynamic Use of Heuristics in Language Model Reasoning
par: Aoki, Yoichi, et autres
Publié: (2024)