BAMBI: Developing Baby Language Models for Italian
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Suozzi, Alice, Capone, Luca, Lebani, Gianluca E., Lenci, Alessandro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CLASS-IT: Conversational and Lecture-Aligned Small-Scale Instruction Tuning for BabyLMs
par: Capone, Luca, et autres
Publié: (2025)
par: Capone, Luca, et autres
Publié: (2025)
Doing Things with Words: Rethinking Theory of Mind Simulation in Large Language Models
par: Lombardi, Agnese, et autres
Publié: (2025)
par: Lombardi, Agnese, et autres
Publié: (2025)
Collocation in the Mind: Investigating Collocational Priming in Second Language Speakers of Italian
par: Irene Fioravanti, et autres
Publié: (2024)
par: Irene Fioravanti, et autres
Publié: (2024)
The acquisition of the clitic ci among typically developing Italian preschoolers: preliminary data *
par: Alice Suozzi
Publié: (2022)
par: Alice Suozzi
Publié: (2022)
The quasi-semantic competence of LLMs: a case study on the part-whole relation
par: Proietti, Mattia, et autres
Publié: (2025)
par: Proietti, Mattia, et autres
Publié: (2025)
Prompting Encoder Models for Zero-Shot Classification: A Cross-Domain Study in Italian
par: Auriemma, Serena, et autres
Publié: (2024)
par: Auriemma, Serena, et autres
Publié: (2024)
Log Probabilities Are a Reliable Estimate of Semantic Plausibility in Base and Instruction-Tuned Language Models
par: Kauf, Carina, et autres
Publié: (2024)
par: Kauf, Carina, et autres
Publié: (2024)
Composing or Not Composing? Towards Distributional Construction Grammars
par: Blache, Philippe, et autres
Publié: (2024)
par: Blache, Philippe, et autres
Publié: (2024)
Domain Embeddings for Generating Complex Descriptions of Concepts in Italian Language
par: Maisto, Alessandro
Publié: (2024)
par: Maisto, Alessandro
Publié: (2024)
Evaluating the Impact of Compression Techniques on Task-Specific Performance of Large Language Models
par: Khanal, Bishwash, et autres
Publié: (2024)
par: Khanal, Bishwash, et autres
Publié: (2024)
Probing for the Usage of Grammatical Number
par: Lasri, Karim, et autres
Publié: (2022)
par: Lasri, Karim, et autres
Publié: (2022)
Are BabyLMs Second Language Learners?
par: Edman, Lukas, et autres
Publié: (2024)
par: Edman, Lukas, et autres
Publié: (2024)
BabyHGRN: Exploring RNNs for Sample-Efficient Training of Language Models
par: Haller, Patrick, et autres
Publié: (2024)
par: Haller, Patrick, et autres
Publié: (2024)
ExpliCa: Evaluating Explicit Causal Reasoning in Large Language Models
par: Miliani, Martina, et autres
Publié: (2025)
par: Miliani, Martina, et autres
Publié: (2025)
From Speech to Subtitles: Evaluating ASR Models in Subtitling Italian Television Programs
par: Lucca, Alessandro, et autres
Publié: (2025)
par: Lucca, Alessandro, et autres
Publié: (2025)
MedBench-IT: A Comprehensive Benchmark for Evaluating Large Language Models on Italian Medical Entrance Examinations
par: Lazzaroni, Ruggero Marino, et autres
Publié: (2025)
par: Lazzaroni, Ruggero Marino, et autres
Publié: (2025)
BabyVision: Visual Reasoning Beyond Language
par: Chen, Liang, et autres
Publié: (2026)
par: Chen, Liang, et autres
Publié: (2026)
Mask and You Shall Receive: Optimizing Masked Language Modeling For Pretraining BabyLMs
par: Edman, Lukas, et autres
Publié: (2025)
par: Edman, Lukas, et autres
Publié: (2025)
BabyLM Challenge: Exploring the Effect of Variation Sets on Language Model Training Efficiency
par: Haga, Akari, et autres
Publié: (2024)
par: Haga, Akari, et autres
Publié: (2024)
All-in-one: Understanding and Generation in Multimodal Reasoning with the MAIA Benchmark
par: Testa, Davide, et autres
Publié: (2025)
par: Testa, Davide, et autres
Publié: (2025)
BabyLM Turns 3: Call for papers for the 2025 BabyLM workshop
par: Charpentier, Lucas, et autres
Publié: (2025)
par: Charpentier, Lucas, et autres
Publié: (2025)
BabyLMs for isiXhosa: Data-Efficient Language Modelling in a Low-Resource Context
par: Matzopoulos, Alexis, et autres
Publié: (2025)
par: Matzopoulos, Alexis, et autres
Publié: (2025)
Are BabyLMs Deaf to Gricean Maxims? A Pragmatic Evaluation of Sample-efficient Language Models
par: Askari, Raha, et autres
Publié: (2025)
par: Askari, Raha, et autres
Publié: (2025)
Evalita-LLM: Benchmarking Large Language Models on Italian
par: Magnini, Bernardo, et autres
Publié: (2025)
par: Magnini, Bernardo, et autres
Publié: (2025)
BabyLM Turns 4 and Goes Multilingual: Call for Papers for the 2026 BabyLM Workshop
par: Choshen, Leshem, et autres
Publié: (2026)
par: Choshen, Leshem, et autres
Publié: (2026)
Do Construction Distributions Shape Formal Language Learning In German BabyLMs?
par: Bunzeck, Bastian, et autres
Publié: (2025)
par: Bunzeck, Bastian, et autres
Publié: (2025)
Challenging the Abilities of Large Language Models in Italian: a Community Initiative
par: Nissim, Malvina, et autres
Publié: (2025)
par: Nissim, Malvina, et autres
Publié: (2025)
Baby Scale: Investigating Models Trained on Individual Children's Language Input
par: Feng, Steven Y., et autres
Publié: (2026)
par: Feng, Steven Y., et autres
Publié: (2026)
Teacher Demonstrations in a BabyLM's Zone of Proximal Development for Contingent Multi-Turn Interaction
par: Salhan, Suchir, et autres
Publié: (2025)
par: Salhan, Suchir, et autres
Publié: (2025)
Choosy Babies Need One Coach: Inducing Mode-Seeking Behavior in BabyLlama with Reverse KL Divergence
par: Shi, Shaozhen, et autres
Publié: (2024)
par: Shi, Shaozhen, et autres
Publié: (2024)
Unipa-GPT: Large Language Models for university-oriented QA in Italian
par: Siragusa, Irene, et autres
Publié: (2024)
par: Siragusa, Irene, et autres
Publié: (2024)
GiusBERTo: A Legal Language Model for Personal Data De-identification in Italian Court of Auditors Decisions
par: Salierno, Giulio, et autres
Publié: (2024)
par: Salierno, Giulio, et autres
Publié: (2024)
BabyReasoningBench: Generating Developmentally-Inspired Reasoning Tasks for Evaluating Baby Language Models
par: Dhole, Kaustubh D.
Publié: (2026)
par: Dhole, Kaustubh D.
Publié: (2026)
Typoglycemia under the Hood: Investigating Language Models' Understanding of Scrambled Words
par: Sperduti, Gianluca, et autres
Publié: (2025)
par: Sperduti, Gianluca, et autres
Publié: (2025)
Small Language Models Also Work With Small Vocabularies: Probing the Linguistic Abilities of Grapheme- and Phoneme-Based Baby Llamas
par: Bunzeck, Bastian, et autres
Publié: (2024)
par: Bunzeck, Bastian, et autres
Publié: (2024)
Compromesso! Italian Many-Shot Jailbreaks Undermine the Safety of Large Language Models
par: Pernisi, Fabio, et autres
Publié: (2024)
par: Pernisi, Fabio, et autres
Publié: (2024)
The Invalsi Benchmarks: measuring Linguistic and Mathematical understanding of Large Language Models in Italian
par: Puccetti, Giovanni, et autres
Publié: (2024)
par: Puccetti, Giovanni, et autres
Publié: (2024)
Politicians vs ChatGPT. A study of presuppositions in French and Italian political communication
par: Garassino, Davide, et autres
Publié: (2024)
par: Garassino, Davide, et autres
Publié: (2024)
MiningGPT -- A Domain-Specific Large Language Model for the Mining Industry
par: Demartini, Kurukulasooriya Fernando ana Gianluca
Publié: (2024)
par: Demartini, Kurukulasooriya Fernando ana Gianluca
Publié: (2024)
When Babies Teach Babies: Can student knowledge sharing outperform Teacher-Guided Distillation on small datasets?
par: Iyer, Srikrishna
Publié: (2024)
par: Iyer, Srikrishna
Publié: (2024)
Documents similaires
-
CLASS-IT: Conversational and Lecture-Aligned Small-Scale Instruction Tuning for BabyLMs
par: Capone, Luca, et autres
Publié: (2025) -
Doing Things with Words: Rethinking Theory of Mind Simulation in Large Language Models
par: Lombardi, Agnese, et autres
Publié: (2025) -
Collocation in the Mind: Investigating Collocational Priming in Second Language Speakers of Italian
par: Irene Fioravanti, et autres
Publié: (2024) -
The acquisition of the clitic ci among typically developing Italian preschoolers: preliminary data *
par: Alice Suozzi
Publié: (2022) -
The quasi-semantic competence of LLMs: a case study on the part-whole relation
par: Proietti, Mattia, et autres
Publié: (2025)