What Languages are Easy to Language-Model? A Perspective from Learning Probabilistic Regular Languages
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Borenstein, Nadav, Svete, Anej, Chan, Robin, Valvoda, Josef, Nowak, Franz, Augenstein, Isabelle, Chodroff, Eleanor, Cotterell, Ryan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Can Transformers Learn $n$-gram Language Models?
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
On Efficiently Representing Regular Languages as RNNs
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
On the Representational Capacity of Neural Language Models with Chain-of-Thought Reasoning
par: Nowak, Franz, et autres
Publié: (2024)
par: Nowak, Franz, et autres
Publié: (2024)
On the Representational Capacity of Recurrent Neural Language Models
par: Nowak, Franz, et autres
Publié: (2023)
par: Nowak, Franz, et autres
Publié: (2023)
Transformers Can Represent $n$-gram Language Models
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
Lower Bounds on the Expressivity of Recurrent Neural Language Models
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
An $\mathbf{L^*}$ Algorithm for Deterministic Weighted Regular Languages
par: Pasti, Clemente, et autres
Publié: (2024)
par: Pasti, Clemente, et autres
Publié: (2024)
Training Neural Networks as Recognizers of Formal Languages
par: Butoi, Alexandra, et autres
Publié: (2024)
par: Butoi, Alexandra, et autres
Publié: (2024)
A Probability--Quality Trade-off in Aligned Language Models and its Relation to Sampling Adaptors
par: Tan, Naaman, et autres
Publié: (2024)
par: Tan, Naaman, et autres
Publié: (2024)
Gumbel Counterfactual Generation From Language Models
par: Ravfogel, Shauli, et autres
Publié: (2024)
par: Ravfogel, Shauli, et autres
Publié: (2024)
Formal Aspects of Language Modeling
par: Cotterell, Ryan, et autres
Publié: (2023)
par: Cotterell, Ryan, et autres
Publié: (2023)
Towards Explainability in Legal Outcome Prediction Models
par: Valvoda, Josef, et autres
Publié: (2024)
par: Valvoda, Josef, et autres
Publié: (2024)
On the Reasoning Abilities of Masked Diffusion Language Models
par: Svete, Anej, et autres
Publié: (2025)
par: Svete, Anej, et autres
Publié: (2025)
Revisiting Noise in Natural Language Processing for Computational Social Science
par: Borenstein, Nadav
Publié: (2025)
par: Borenstein, Nadav
Publié: (2025)
Revealing Fine-Grained Values and Opinions in Large Language Models
par: Wright, Dustin, et autres
Publié: (2024)
par: Wright, Dustin, et autres
Publié: (2024)
Unique Hard Attention: A Tale of Two Sides
par: Jerad, Selim, et autres
Publié: (2025)
par: Jerad, Selim, et autres
Publié: (2025)
An Algebraic View of the Expressivity of Recurrent Language Models
par: Nowak, Franz, et autres
Publié: (2026)
par: Nowak, Franz, et autres
Publié: (2026)
Revisiting Padded Transformer Expressivity: Which Architectural Choices Matter and Which Don't
par: Svete, Anej, et autres
Publié: (2026)
par: Svete, Anej, et autres
Publié: (2026)
Information Locality as an Inductive Bias for Neural Language Models
par: Someya, Taiga, et autres
Publié: (2025)
par: Someya, Taiga, et autres
Publié: (2025)
Can Community Notes Replace Professional Fact-Checkers?
par: Borenstein, Nadav, et autres
Publié: (2025)
par: Borenstein, Nadav, et autres
Publié: (2025)
A Geometric Notion of Causal Probing
par: Guerner, Clément, et autres
Publié: (2023)
par: Guerner, Clément, et autres
Publié: (2023)
Context-Free Recognition with Transformers
par: Jerad, Selim, et autres
Publié: (2026)
par: Jerad, Selim, et autres
Publié: (2026)
On Affine Homotopy between Language Encoders
par: Chan, Robin SM, et autres
Publié: (2024)
par: Chan, Robin SM, et autres
Publié: (2024)
On the Role of Context in Reading Time Prediction
par: Opedal, Andreas, et autres
Publié: (2024)
par: Opedal, Andreas, et autres
Publié: (2024)
The Role of $n$-gram Smoothing in the Age of Neural Networks
par: Malagutti, Luca, et autres
Publié: (2024)
par: Malagutti, Luca, et autres
Publié: (2024)
A Fast Algorithm for Computing Prefix Probabilities
par: Nowak, Franz, et autres
Publié: (2023)
par: Nowak, Franz, et autres
Publié: (2023)
A Distributional Perspective on Word Learning in Neural Language Models
par: Ficarra, Filippo, et autres
Publié: (2025)
par: Ficarra, Filippo, et autres
Publié: (2025)
Probability Distributions Computed by Autoregressive Transformers
par: Yang, Andy, et autres
Publié: (2025)
par: Yang, Andy, et autres
Publié: (2025)
What Do Language Models Learn in Context? The Structured Task Hypothesis
par: Li, Jiaoda, et autres
Publié: (2024)
par: Li, Jiaoda, et autres
Publié: (2024)
Measuring and Benchmarking Large Language Models' Capabilities to Generate Persuasive Language
par: Pauli, Amalie Brogaard, et autres
Publié: (2024)
par: Pauli, Amalie Brogaard, et autres
Publié: (2024)
A Latent-Variable Model for Intrinsic Probing
par: Stańczak, Karolina, et autres
Publié: (2022)
par: Stańczak, Karolina, et autres
Publié: (2022)
BiasGym: A Simple and Generalizable Framework for Analyzing and Removing Biases through Elicitation
par: Islam, Sekh Mainul, et autres
Publié: (2025)
par: Islam, Sekh Mainul, et autres
Publié: (2025)
Characterizing the Expressivity of Fixed-Precision Transformer Language Models
par: Li, Jiaoda, et autres
Publié: (2025)
par: Li, Jiaoda, et autres
Publié: (2025)
The Causal Influence of Grammatical Gender on Distributional Semantics
par: Stańczak, Karolina, et autres
Publié: (2023)
par: Stańczak, Karolina, et autres
Publié: (2023)
What Kind of Language is Easy to Language-Model Under Curriculum Learning?
par: El-Naggar, Nadine, et autres
Publié: (2026)
par: El-Naggar, Nadine, et autres
Publié: (2026)
Probing Pre-Trained Language Models for Cross-Cultural Differences in Values
par: Arora, Arnav, et autres
Publié: (2022)
par: Arora, Arnav, et autres
Publié: (2022)
Can Language Models Learn Typologically Implausible Languages?
par: Xu, Tianyang, et autres
Publié: (2025)
par: Xu, Tianyang, et autres
Publié: (2025)
Investigating Human Values in Online Communities
par: Borenstein, Nadav, et autres
Publié: (2024)
par: Borenstein, Nadav, et autres
Publié: (2024)
Social Bias Probing: Fairness Benchmarking for Language Models
par: Manerba, Marta Marchiori, et autres
Publié: (2023)
par: Manerba, Marta Marchiori, et autres
Publié: (2023)
Investigating Critical Period Effects in Language Acquisition through Neural Language Models
par: Constantinescu, Ionut, et autres
Publié: (2024)
par: Constantinescu, Ionut, et autres
Publié: (2024)
Documents similaires
-
Can Transformers Learn $n$-gram Language Models?
par: Svete, Anej, et autres
Publié: (2024) -
On Efficiently Representing Regular Languages as RNNs
par: Svete, Anej, et autres
Publié: (2024) -
On the Representational Capacity of Neural Language Models with Chain-of-Thought Reasoning
par: Nowak, Franz, et autres
Publié: (2024) -
On the Representational Capacity of Recurrent Neural Language Models
par: Nowak, Franz, et autres
Publié: (2023) -
Transformers Can Represent $n$-gram Language Models
par: Svete, Anej, et autres
Publié: (2024)