Do Construction Distributions Shape Formal Language Learning In German BabyLMs?
Fuente:
arXiv
Salvato in:
| Autori principali: | Bunzeck, Bastian, Duran, Daniel, Zarrieß, Sina |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Child-directed speech facilitates production, not comprehension, in BabyLMs
di: Bunzeck, Bastian, et al.
Pubblicazione: (2026)
di: Bunzeck, Bastian, et al.
Pubblicazione: (2026)
Small Language Models Also Work With Small Vocabularies: Probing the Linguistic Abilities of Grapheme- and Phoneme-Based Baby Llamas
di: Bunzeck, Bastian, et al.
Pubblicazione: (2024)
di: Bunzeck, Bastian, et al.
Pubblicazione: (2024)
Dialogue Is Not Enough to Make a Communicative BabyLM (But Neither Is Developmentally Inspired Reinforcement Learning)
di: Padovani, Francesca, et al.
Pubblicazione: (2025)
di: Padovani, Francesca, et al.
Pubblicazione: (2025)
Are BabyLMs Deaf to Gricean Maxims? A Pragmatic Evaluation of Sample-efficient Language Models
di: Askari, Raha, et al.
Pubblicazione: (2025)
di: Askari, Raha, et al.
Pubblicazione: (2025)
Subword models struggle with word learning, but surprisal hides it
di: Bunzeck, Bastian, et al.
Pubblicazione: (2025)
di: Bunzeck, Bastian, et al.
Pubblicazione: (2025)
Are BabyLMs Second Language Learners?
di: Edman, Lukas, et al.
Pubblicazione: (2024)
di: Edman, Lukas, et al.
Pubblicazione: (2024)
Mask and You Shall Receive: Optimizing Masked Language Modeling For Pretraining BabyLMs
di: Edman, Lukas, et al.
Pubblicazione: (2025)
di: Edman, Lukas, et al.
Pubblicazione: (2025)
CLASS-IT: Conversational and Lecture-Aligned Small-Scale Instruction Tuning for BabyLMs
di: Capone, Luca, et al.
Pubblicazione: (2025)
di: Capone, Luca, et al.
Pubblicazione: (2025)
BabyLMs for isiXhosa: Data-Efficient Language Modelling in a Low-Resource Context
di: Matzopoulos, Alexis, et al.
Pubblicazione: (2025)
di: Matzopoulos, Alexis, et al.
Pubblicazione: (2025)
BabyLM Turns 3: Call for papers for the 2025 BabyLM workshop
di: Charpentier, Lucas, et al.
Pubblicazione: (2025)
di: Charpentier, Lucas, et al.
Pubblicazione: (2025)
BabyLM Turns 4 and Goes Multilingual: Call for Papers for the 2026 BabyLM Workshop
di: Choshen, Leshem, et al.
Pubblicazione: (2026)
di: Choshen, Leshem, et al.
Pubblicazione: (2026)
Bias Dynamics in BabyLMs: Towards a Compute-Efficient Sandbox for Democratising Pre-Training Debiasing
di: Trhlik, Filip, et al.
Pubblicazione: (2026)
di: Trhlik, Filip, et al.
Pubblicazione: (2026)
BabyLM's First Constructions: Causal probing provides a signal of learning
di: Rozner, Joshua, et al.
Pubblicazione: (2025)
di: Rozner, Joshua, et al.
Pubblicazione: (2025)
BabyLM Challenge: Exploring the Effect of Variation Sets on Language Model Training Efficiency
di: Haga, Akari, et al.
Pubblicazione: (2024)
di: Haga, Akari, et al.
Pubblicazione: (2024)
The Frequency Confound in Language-Model Surprisal and Metaphor Novelty
di: Momen, Omar, et al.
Pubblicazione: (2026)
di: Momen, Omar, et al.
Pubblicazione: (2026)
BAMBINO-LM: (Bilingual-)Human-Inspired Continual Pretraining of BabyLM
di: Shen, Zhewen, et al.
Pubblicazione: (2024)
di: Shen, Zhewen, et al.
Pubblicazione: (2024)
How Hypocritical Is Your LLM judge? Listener-Speaker Asymmetries in the Pragmatic Competence of Large Language Models
di: Sieker, Judith, et al.
Pubblicazione: (2026)
di: Sieker, Judith, et al.
Pubblicazione: (2026)
Findings of the BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora
di: Warstadt, Alex, et al.
Pubblicazione: (2025)
di: Warstadt, Alex, et al.
Pubblicazione: (2025)
BabyLM's First Words: Word Segmentation as a Phonological Probing Task
di: Goriely, Zébulon, et al.
Pubblicazione: (2025)
di: Goriely, Zébulon, et al.
Pubblicazione: (2025)
Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora
di: Hu, Michael Y., et al.
Pubblicazione: (2024)
di: Hu, Michael Y., et al.
Pubblicazione: (2024)
SceneGram: Conceptualizing and Describing Tangrams in Scene Context
di: Junker, Simeon, et al.
Pubblicazione: (2025)
di: Junker, Simeon, et al.
Pubblicazione: (2025)
Resilience through Scene Context in Visual Referring Expression Generation
di: Junker, Simeon, et al.
Pubblicazione: (2024)
di: Junker, Simeon, et al.
Pubblicazione: (2024)
Teacher Demonstrations in a BabyLM's Zone of Proximal Development for Contingent Multi-Turn Interaction
di: Salhan, Suchir, et al.
Pubblicazione: (2025)
di: Salhan, Suchir, et al.
Pubblicazione: (2025)
Rationalizing Transformer Predictions via End-To-End Differentiable Self-Training
di: Brinner, Marc, et al.
Pubblicazione: (2025)
di: Brinner, Marc, et al.
Pubblicazione: (2025)
Enhancing Domain-Specific Encoder Models with LLM-Generated Data: How to Leverage Ontologies, and How to Do Without Them
di: Brinner, Marc, et al.
Pubblicazione: (2025)
di: Brinner, Marc, et al.
Pubblicazione: (2025)
Efficient Scientific Full Text Classification: The Case of EICAT Impact Assessments
di: Brinner, Marc Felix, et al.
Pubblicazione: (2025)
di: Brinner, Marc Felix, et al.
Pubblicazione: (2025)
[Call for Papers] The 2nd BabyLM Challenge: Sample-efficient pretraining on a developmentally plausible corpus
di: Choshen, Leshem, et al.
Pubblicazione: (2024)
di: Choshen, Leshem, et al.
Pubblicazione: (2024)
Bringing Up a Bilingual BabyLM: Investigating Multilingual Language Acquisition Using Small-Scale Models
di: Zeng, Linda, et al.
Pubblicazione: (2026)
di: Zeng, Linda, et al.
Pubblicazione: (2026)
Model Interpretability and Rationale Extraction by Input Mask Optimization
di: Brinner, Marc, et al.
Pubblicazione: (2025)
di: Brinner, Marc, et al.
Pubblicazione: (2025)
SemCSE: Semantic Contrastive Sentence Embeddings Using LLM-Generated Summaries For Scientific Abstracts
di: Brinner, Marc, et al.
Pubblicazione: (2025)
di: Brinner, Marc, et al.
Pubblicazione: (2025)
LLMs Struggle to Reject False Presuppositions when Misinformation Stakes are High
di: Sieker, Judith, et al.
Pubblicazione: (2025)
di: Sieker, Judith, et al.
Pubblicazione: (2025)
SemCSE-Multi: Multifaceted and Decodable Embeddings for Aspect-Specific and Interpretable Scientific Domain Mapping
di: Brinner, Marc, et al.
Pubblicazione: (2025)
di: Brinner, Marc, et al.
Pubblicazione: (2025)
Can LLMs Ground when they (Don't) Know: A Study on Direct and Loaded Political Questions
di: Lachenmaier, Clara, et al.
Pubblicazione: (2025)
di: Lachenmaier, Clara, et al.
Pubblicazione: (2025)
Talking to a Know-It-All GPT or a Second-Guesser Claude? How Repair reveals unreliable Multi-Turn Behavior in LLMs
di: Lachenmaier, Clara, et al.
Pubblicazione: (2026)
di: Lachenmaier, Clara, et al.
Pubblicazione: (2026)
Are Multimodal Large Language Models Pragmatically Competent Listeners in Simple Reference Resolution Tasks?
di: Junker, Simeon, et al.
Pubblicazione: (2025)
di: Junker, Simeon, et al.
Pubblicazione: (2025)
Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities
di: Kankowski, Florian, et al.
Pubblicazione: (2025)
di: Kankowski, Florian, et al.
Pubblicazione: (2025)
Reference Games as a Testbed for the Alignment of Model Uncertainty and Clarification Requests
di: Ali, Manar, et al.
Pubblicazione: (2026)
di: Ali, Manar, et al.
Pubblicazione: (2026)
Evaluating Diversity in Automatic Poetry Generation
di: Chen, Yanran, et al.
Pubblicazione: (2024)
di: Chen, Yanran, et al.
Pubblicazione: (2024)
CAIT: A Syntactic Parsing Toolkit for Child-Adult InTeractions
di: Padovani, Francesca, et al.
Pubblicazione: (2026)
di: Padovani, Francesca, et al.
Pubblicazione: (2026)
The InviTE Corpus: Annotating Invectives in Tudor English Texts for Computational Modeling
di: Spliethoff, Sophie, et al.
Pubblicazione: (2025)
di: Spliethoff, Sophie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Child-directed speech facilitates production, not comprehension, in BabyLMs
di: Bunzeck, Bastian, et al.
Pubblicazione: (2026) -
Small Language Models Also Work With Small Vocabularies: Probing the Linguistic Abilities of Grapheme- and Phoneme-Based Baby Llamas
di: Bunzeck, Bastian, et al.
Pubblicazione: (2024) -
Dialogue Is Not Enough to Make a Communicative BabyLM (But Neither Is Developmentally Inspired Reinforcement Learning)
di: Padovani, Francesca, et al.
Pubblicazione: (2025) -
Are BabyLMs Deaf to Gricean Maxims? A Pragmatic Evaluation of Sample-efficient Language Models
di: Askari, Raha, et al.
Pubblicazione: (2025) -
Subword models struggle with word learning, but surprisal hides it
di: Bunzeck, Bastian, et al.
Pubblicazione: (2025)