A Distributional Perspective on Word Learning in Neural Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ficarra, Filippo, Cotterell, Ryan, Warstadt, Alex |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Investigating Critical Period Effects in Language Acquisition through Neural Language Models
di: Constantinescu, Ionut, et al.
Pubblicazione: (2024)
di: Constantinescu, Ionut, et al.
Pubblicazione: (2024)
Can Language Models Learn Typologically Implausible Languages?
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
Towards Explainability in Legal Outcome Prediction Models
di: Valvoda, Josef, et al.
Pubblicazione: (2024)
di: Valvoda, Josef, et al.
Pubblicazione: (2024)
Transformers Can Represent $n$-gram Language Models
di: Svete, Anej, et al.
Pubblicazione: (2024)
di: Svete, Anej, et al.
Pubblicazione: (2024)
Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models
di: Stöpler, Lennart, et al.
Pubblicazione: (2025)
di: Stöpler, Lennart, et al.
Pubblicazione: (2025)
Better Estimation of the Kullback--Leibler Divergence Between Language Models
di: Amini, Afra, et al.
Pubblicazione: (2025)
di: Amini, Afra, et al.
Pubblicazione: (2025)
Syntactic Control of Language Models by Posterior Inference
di: Xefteri, Vicky, et al.
Pubblicazione: (2025)
di: Xefteri, Vicky, et al.
Pubblicazione: (2025)
Gumbel Counterfactual Generation From Language Models
di: Ravfogel, Shauli, et al.
Pubblicazione: (2024)
di: Ravfogel, Shauli, et al.
Pubblicazione: (2024)
Activation Scaling for Steering and Interpreting Language Models
di: Stoehr, Niklas, et al.
Pubblicazione: (2024)
di: Stoehr, Niklas, et al.
Pubblicazione: (2024)
Post-Training Language Models for Crosslingual Consistency
di: Liu, Tianyu, et al.
Pubblicazione: (2026)
di: Liu, Tianyu, et al.
Pubblicazione: (2026)
Generalized Measures of Anticipation and Responsivity in Online Language Processing
di: Giulianelli, Mario, et al.
Pubblicazione: (2024)
di: Giulianelli, Mario, et al.
Pubblicazione: (2024)
Structured Voronoi Sampling
di: Amini, Afra, et al.
Pubblicazione: (2023)
di: Amini, Afra, et al.
Pubblicazione: (2023)
Are Language Models Efficient Reasoners? A Perspective from Logic Programming
di: Opedal, Andreas, et al.
Pubblicazione: (2025)
di: Opedal, Andreas, et al.
Pubblicazione: (2025)
A Neural Model for Word Repetition
di: Dager, Daniel, et al.
Pubblicazione: (2025)
di: Dager, Daniel, et al.
Pubblicazione: (2025)
Locally Typical Sampling
di: Meister, Clara, et al.
Pubblicazione: (2022)
di: Meister, Clara, et al.
Pubblicazione: (2022)
From Language Models over Tokens to Language Models over Characters
di: Vieira, Tim, et al.
Pubblicazione: (2024)
di: Vieira, Tim, et al.
Pubblicazione: (2024)
Direct Preference Optimization with an Offset
di: Amini, Afra, et al.
Pubblicazione: (2024)
di: Amini, Afra, et al.
Pubblicazione: (2024)
How Persuasive is Your Context?
di: Nguyen, Tu, et al.
Pubblicazione: (2025)
di: Nguyen, Tu, et al.
Pubblicazione: (2025)
Word Meanings in Transformer Language Models
di: Grindrod, Jumbly, et al.
Pubblicazione: (2025)
di: Grindrod, Jumbly, et al.
Pubblicazione: (2025)
ALIGN: Word Association Learning for Cultural Alignment in Large Language Models
di: Liu, Chunhua, et al.
Pubblicazione: (2025)
di: Liu, Chunhua, et al.
Pubblicazione: (2025)
Function Words as Statistical Cues for Language Learning
di: Yang, Xiulin, et al.
Pubblicazione: (2026)
di: Yang, Xiulin, et al.
Pubblicazione: (2026)
Learning to Reason Efficiently with A* Post-Training
di: Opedal, Andreas, et al.
Pubblicazione: (2026)
di: Opedal, Andreas, et al.
Pubblicazione: (2026)
Variational Best-of-N Alignment
di: Amini, Afra, et al.
Pubblicazione: (2024)
di: Amini, Afra, et al.
Pubblicazione: (2024)
Do Large Language Models Understand Word Senses?
di: Meconi, Domenico, et al.
Pubblicazione: (2025)
di: Meconi, Domenico, et al.
Pubblicazione: (2025)
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
di: Opedal, Andreas, et al.
Pubblicazione: (2024)
di: Opedal, Andreas, et al.
Pubblicazione: (2024)
CLASH: Evaluating Language Models on Judging High-Stakes Dilemmas from Multiple Perspectives
di: Lee, Ayoung, et al.
Pubblicazione: (2025)
di: Lee, Ayoung, et al.
Pubblicazione: (2025)
Using Perspectival Words Is Harder Than Vocabulary Words for Humans and Even More So for Multimodal Language Models
di: Dong, Dota Tianai, et al.
Pubblicazione: (2025)
di: Dong, Dota Tianai, et al.
Pubblicazione: (2025)
Integrating Symbolic Natural Language Understanding and Language Models for Word Sense Disambiguation
di: Zhao, Kexin, et al.
Pubblicazione: (2025)
di: Zhao, Kexin, et al.
Pubblicazione: (2025)
Exploring the Word Sense Disambiguation Capabilities of Large Language Models
di: Basile, Pierpaolo, et al.
Pubblicazione: (2025)
di: Basile, Pierpaolo, et al.
Pubblicazione: (2025)
Exploring Large Language Models for Word Games:Who is the Spy?
di: Wei, Chentian, et al.
Pubblicazione: (2025)
di: Wei, Chentian, et al.
Pubblicazione: (2025)
N-gram Prediction and Word Difference Representations for Language Modeling
di: Heo, DongNyeong, et al.
Pubblicazione: (2024)
di: Heo, DongNyeong, et al.
Pubblicazione: (2024)
Language Models as Knowledge Bases for Visual Word Sense Disambiguation
di: Kritharoula, Anastasia, et al.
Pubblicazione: (2023)
di: Kritharoula, Anastasia, et al.
Pubblicazione: (2023)
What Artificial Neural Networks Can Tell Us About Human Language Acquisition
di: Warstadt, Alex, et al.
Pubblicazione: (2022)
di: Warstadt, Alex, et al.
Pubblicazione: (2022)
Learning to Substitute Words with Model-based Score Ranking
di: Liu, Hongye, et al.
Pubblicazione: (2025)
di: Liu, Hongye, et al.
Pubblicazione: (2025)
CWTM: Leveraging Contextualized Word Embeddings from BERT for Neural Topic Modeling
di: Fang, Zheng, et al.
Pubblicazione: (2023)
di: Fang, Zheng, et al.
Pubblicazione: (2023)
Language Model Distillation: A Temporal Difference Imitation Learning Perspective
di: Yu, Zishun, et al.
Pubblicazione: (2025)
di: Yu, Zishun, et al.
Pubblicazione: (2025)
Learning Tractable Distributions Of Language Model Continuations
di: Yidou-Weng, Gwen, et al.
Pubblicazione: (2025)
di: Yidou-Weng, Gwen, et al.
Pubblicazione: (2025)
A Geometric Notion of Causal Probing
di: Guerner, Clément, et al.
Pubblicazione: (2023)
di: Guerner, Clément, et al.
Pubblicazione: (2023)
Surprise! Uniform Information Density Isn't the Whole Story: Predicting Surprisal Contours in Long-form Discourse
di: Tsipidi, Eleftheria, et al.
Pubblicazione: (2024)
di: Tsipidi, Eleftheria, et al.
Pubblicazione: (2024)
Ensembling Language Models with Sequential Monte Carlo
di: Chan, Robin Shing Moon, et al.
Pubblicazione: (2026)
di: Chan, Robin Shing Moon, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Investigating Critical Period Effects in Language Acquisition through Neural Language Models
di: Constantinescu, Ionut, et al.
Pubblicazione: (2024) -
Can Language Models Learn Typologically Implausible Languages?
di: Xu, Tianyang, et al.
Pubblicazione: (2025) -
Towards Explainability in Legal Outcome Prediction Models
di: Valvoda, Josef, et al.
Pubblicazione: (2024) -
Transformers Can Represent $n$-gram Language Models
di: Svete, Anej, et al.
Pubblicazione: (2024) -
Towards Developmentally Plausible Rewards: Communicative Success as a Learning Signal for Interactive Language Models
di: Stöpler, Lennart, et al.
Pubblicazione: (2025)