What Goes Into a LM Acceptability Judgment? Rethinking the Impact of Frequency and Length
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tjuatja, Lindia, Neubig, Graham, Linzen, Tal, Hao, Sophie |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BehaviorBox: Automated Discovery of Fine-Grained Performance Differences Between Language Models
par: Tjuatja, Lindia, et autres
Publié: (2025)
par: Tjuatja, Lindia, et autres
Publié: (2025)
GlossLM: A Massively Multilingual Corpus and Pretrained Model for Interlinear Glossed Text
par: Ginn, Michael, et autres
Publié: (2024)
par: Ginn, Michael, et autres
Publié: (2024)
Do LLMs exhibit human-like response biases? A case study in survey design
par: Tjuatja, Lindia, et autres
Publié: (2023)
par: Tjuatja, Lindia, et autres
Publié: (2023)
What do Language Models Learn and When? The Implicit Curriculum Hypothesis
par: Liu, Emmy, et autres
Publié: (2026)
par: Liu, Emmy, et autres
Publié: (2026)
CMULAB: An Open-Source Framework for Training and Deployment of Natural Language Processing Models
par: Sheikh, Zaid, et autres
Publié: (2024)
par: Sheikh, Zaid, et autres
Publié: (2024)
BabyLM Turns 4 and Goes Multilingual: Call for Papers for the 2026 BabyLM Workshop
par: Choshen, Leshem, et autres
Publié: (2026)
par: Choshen, Leshem, et autres
Publié: (2026)
Massively Multilingual Joint Segmentation and Glossing
par: Ginn, Michael, et autres
Publié: (2026)
par: Ginn, Michael, et autres
Publié: (2026)
Wav2Gloss: Generating Interlinear Glossed Text from Speech
par: He, Taiqi, et autres
Publié: (2024)
par: He, Taiqi, et autres
Publié: (2024)
Not-Just-Scaling Laws: Towards a Better Understanding of the Downstream Impact of Language Model Design Decisions
par: Liu, Emmy, et autres
Publié: (2025)
par: Liu, Emmy, et autres
Publié: (2025)
SPAWNing Structural Priming Predictions from a Cognitively Motivated Parser
par: Prasad, Grusha, et autres
Publié: (2024)
par: Prasad, Grusha, et autres
Publié: (2024)
Do Language Models' Words Refer?
par: Mandelkern, Matthew, et autres
Publié: (2023)
par: Mandelkern, Matthew, et autres
Publié: (2023)
Manipulating language models' training data to study syntactic constraint learning: the case of English passivization
par: Leong, Cara Su-Yi, et autres
Publié: (2024)
par: Leong, Cara Su-Yi, et autres
Publié: (2024)
Entailment Semantics Can Be Extracted from an Ideal Language Model
par: Merrill, William, et autres
Publié: (2022)
par: Merrill, William, et autres
Publié: (2022)
Deconstructing sentence disambiguation by joint latent modeling of reading paradigms: LLM surprisal is not enough
par: Paape, Dario, et autres
Publié: (2026)
par: Paape, Dario, et autres
Publié: (2026)
Why are language models less surprised than humans? Testing the Parse Multiplicity Mismatch Hypothesis
par: Timkey, William, et autres
Publié: (2026)
par: Timkey, William, et autres
Publié: (2026)
If Probable, Then Acceptable? Understanding Conditional Acceptability Judgments in Large Language Models
par: Orth, Jasmin, et autres
Publié: (2025)
par: Orth, Jasmin, et autres
Publié: (2025)
Evaluating In-Context Translation with Synchronous Context-Free Grammar Transduction
par: Petty, Jackson, et autres
Publié: (2026)
par: Petty, Jackson, et autres
Publié: (2026)
What Is Missing in Multilingual Visual Reasoning and How to Fix It
par: Song, Yueqi, et autres
Publié: (2024)
par: Song, Yueqi, et autres
Publié: (2024)
BabyLM Turns 3: Call for papers for the 2025 BabyLM workshop
par: Charpentier, Lucas, et autres
Publié: (2025)
par: Charpentier, Lucas, et autres
Publié: (2025)
Synthetic Socratic Debates: Examining Persona Effects on Moral Decision and Persuasion Dynamics
par: Liu, Jiarui, et autres
Publié: (2025)
par: Liu, Jiarui, et autres
Publié: (2025)
In-context Learning Generalizes, But Not Always Robustly: The Case of Syntax
par: Mueller, Aaron, et autres
Publié: (2023)
par: Mueller, Aaron, et autres
Publié: (2023)
How Does Code Pretraining Affect Language Model Task Performance?
par: Petty, Jackson, et autres
Publié: (2024)
par: Petty, Jackson, et autres
Publié: (2024)
Multilingual Prompting for Improving LLM Generation Diversity
par: Wang, Qihan, et autres
Publié: (2025)
par: Wang, Qihan, et autres
Publié: (2025)
Predicting Sentence Acceptability Judgments in Multimodal Contexts
par: Jang, Hyewon, et autres
Publié: (2026)
par: Jang, Hyewon, et autres
Publié: (2026)
Findings of the BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora
par: Warstadt, Alex, et autres
Publié: (2025)
par: Warstadt, Alex, et autres
Publié: (2025)
[Call for Papers] The 2nd BabyLM Challenge: Sample-efficient pretraining on a developmentally plausible corpus
par: Choshen, Leshem, et autres
Publié: (2024)
par: Choshen, Leshem, et autres
Publié: (2024)
The Impact of Depth on Compositional Generalization in Transformer Language Models
par: Petty, Jackson, et autres
Publié: (2023)
par: Petty, Jackson, et autres
Publié: (2023)
Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora
par: Hu, Michael Y., et autres
Publié: (2024)
par: Hu, Michael Y., et autres
Publié: (2024)
What Are Tools Anyway? A Survey from the Language Model Perspective
par: Wang, Zhiruo, et autres
Publié: (2024)
par: Wang, Zhiruo, et autres
Publié: (2024)
QFrCoLA: a Quebec-French Corpus of Linguistic Acceptability Judgments
par: Beauchemin, David, et autres
Publié: (2025)
par: Beauchemin, David, et autres
Publié: (2025)
Go-Browse: Training Web Agents with Structured Exploration
par: Gandhi, Apurva, et autres
Publié: (2025)
par: Gandhi, Apurva, et autres
Publié: (2025)
How to Make the Most of LLMs' Grammatical Knowledge for Acceptability Judgments
par: Ide, Yusuke, et autres
Publié: (2024)
par: Ide, Yusuke, et autres
Publié: (2024)
Can You Learn Semantics Through Next-Word Prediction? The Case of Entailment
par: Merrill, William, et autres
Publié: (2024)
par: Merrill, William, et autres
Publié: (2024)
Emergence of Linear Truth Encodings in Language Models
par: Ravfogel, Shauli, et autres
Publié: (2025)
par: Ravfogel, Shauli, et autres
Publié: (2025)
Language Models Struggle to Use Representations Learned In-Context
par: Lepori, Michael A., et autres
Publié: (2026)
par: Lepori, Michael A., et autres
Publié: (2026)
SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model
par: Allal, Loubna Ben, et autres
Publié: (2025)
par: Allal, Loubna Ben, et autres
Publié: (2025)
Explain-then-Process: Using Grammar Prompting to Enhance Grammatical Acceptability Judgments
par: Scheinberg, Russell, et autres
Publié: (2025)
par: Scheinberg, Russell, et autres
Publié: (2025)
Effective Strategies for Asynchronous Software Engineering Agents
par: Geng, Jiayi, et autres
Publié: (2026)
par: Geng, Jiayi, et autres
Publié: (2026)
ExLM: Rethinking the Impact of [MASK] Tokens in Masked Language Models
par: Zheng, Kangjie, et autres
Publié: (2025)
par: Zheng, Kangjie, et autres
Publié: (2025)
Rapid Word Learning Through Meta In-Context Learning
par: Wang, Wentao, et autres
Publié: (2025)
par: Wang, Wentao, et autres
Publié: (2025)
Documents similaires
-
BehaviorBox: Automated Discovery of Fine-Grained Performance Differences Between Language Models
par: Tjuatja, Lindia, et autres
Publié: (2025) -
GlossLM: A Massively Multilingual Corpus and Pretrained Model for Interlinear Glossed Text
par: Ginn, Michael, et autres
Publié: (2024) -
Do LLMs exhibit human-like response biases? A case study in survey design
par: Tjuatja, Lindia, et autres
Publié: (2023) -
What do Language Models Learn and When? The Implicit Curriculum Hypothesis
par: Liu, Emmy, et autres
Publié: (2026) -
CMULAB: An Open-Source Framework for Training and Deployment of Natural Language Processing Models
par: Sheikh, Zaid, et autres
Publié: (2024)