What Do Language Models Learn in Context? The Structured Task Hypothesis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jiaoda, Hou, Yifan, Sachan, Mrinmaya, Cotterell, Ryan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Transformer with Stack Attention
par: Li, Jiaoda, et autres
Publié: (2024)
par: Li, Jiaoda, et autres
Publié: (2024)
Characterizing the Expressivity of Fixed-Precision Transformer Language Models
par: Li, Jiaoda, et autres
Publié: (2025)
par: Li, Jiaoda, et autres
Publié: (2025)
Efficiently Computing Susceptibility to Context in Language Models
par: Liu, Tianyu, et autres
Publié: (2024)
par: Liu, Tianyu, et autres
Publié: (2024)
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
par: Opedal, Andreas, et autres
Publié: (2024)
par: Opedal, Andreas, et autres
Publié: (2024)
Unique Hard Attention: A Tale of Two Sides
par: Jerad, Selim, et autres
Publié: (2025)
par: Jerad, Selim, et autres
Publié: (2025)
Learning to Reason Efficiently with A* Post-Training
par: Opedal, Andreas, et autres
Publié: (2026)
par: Opedal, Andreas, et autres
Publié: (2026)
Characterizing the Expressivity of Local Attention in Transformers
par: Li, Jiaoda, et autres
Publié: (2026)
par: Li, Jiaoda, et autres
Publié: (2026)
Pointwise Mutual Information as a Performance Gauge for Retrieval-Augmented Generation
par: Liu, Tianyu, et autres
Publié: (2024)
par: Liu, Tianyu, et autres
Publié: (2024)
Exploring the Linear Subspace Hypothesis in Gender Bias Mitigation
par: Vargas, Francisco, et autres
Publié: (2020)
par: Vargas, Francisco, et autres
Publié: (2020)
Are Language Models Efficient Reasoners? A Perspective from Logic Programming
par: Opedal, Andreas, et autres
Publié: (2025)
par: Opedal, Andreas, et autres
Publié: (2025)
Automated Knowledge Concept Annotation and Question Representation Learning for Knowledge Tracing
par: Ozyurt, Yilmazcan, et autres
Publié: (2024)
par: Ozyurt, Yilmazcan, et autres
Publié: (2024)
Improving Large Language Model Safety with Contrastive Representation Learning
par: Simko, Samuel, et autres
Publié: (2025)
par: Simko, Samuel, et autres
Publié: (2025)
Do Vision-Language Models Really Understand Visual Language?
par: Hou, Yifan, et autres
Publié: (2024)
par: Hou, Yifan, et autres
Publié: (2024)
Investigating the Zone of Proximal Development of Language Models for In-Context Learning
par: Cui, Peng, et autres
Publié: (2025)
par: Cui, Peng, et autres
Publié: (2025)
Towards Aligning Language Models with Textual Feedback
par: Lloret, Saüc Abadal, et autres
Publié: (2024)
par: Lloret, Saüc Abadal, et autres
Publié: (2024)
Sample Smart, Not Hard: Correctness-First Decoding for Better Reasoning in LLMs
par: Li, Xueyan, et autres
Publié: (2025)
par: Li, Xueyan, et autres
Publié: (2025)
On Affine Homotopy between Language Encoders
par: Chan, Robin SM, et autres
Publié: (2024)
par: Chan, Robin SM, et autres
Publié: (2024)
Unveiling the Visual Counting Bottleneck in Vision-Language Models
par: Pang, Xingzhou, et autres
Publié: (2026)
par: Pang, Xingzhou, et autres
Publié: (2026)
Stepwise Verification and Remediation of Student Reasoning Errors with Large Language Model Tutors
par: Daheim, Nico, et autres
Publié: (2024)
par: Daheim, Nico, et autres
Publié: (2024)
Simulating Students or Sycophantic Problem Solving? On Misconception Faithfulness of LLM Simulators
par: Do, Heejin, et autres
Publié: (2026)
par: Do, Heejin, et autres
Publié: (2026)
Can Language Models Learn Typologically Implausible Languages?
par: Xu, Tianyang, et autres
Publié: (2025)
par: Xu, Tianyang, et autres
Publié: (2025)
On the Representational Capacity of Recurrent Neural Language Models
par: Nowak, Franz, et autres
Publié: (2023)
par: Nowak, Franz, et autres
Publié: (2023)
Transformers Can Represent $n$-gram Language Models
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
An Algebraic View of the Expressivity of Recurrent Language Models
par: Nowak, Franz, et autres
Publié: (2026)
par: Nowak, Franz, et autres
Publié: (2026)
On the Role of Context in Reading Time Prediction
par: Opedal, Andreas, et autres
Publié: (2024)
par: Opedal, Andreas, et autres
Publié: (2024)
Confidence Regulation Neurons in Language Models
par: Stolfo, Alessandro, et autres
Publié: (2024)
par: Stolfo, Alessandro, et autres
Publié: (2024)
Post-Training Language Models for Crosslingual Consistency
par: Liu, Tianyu, et autres
Publié: (2026)
par: Liu, Tianyu, et autres
Publié: (2026)
Diversity Matters: Revisiting Test-Time Compute in Vision-Language Models
par: Tong, Yijie, et autres
Publié: (2026)
par: Tong, Yijie, et autres
Publié: (2026)
Better Estimation of the Kullback--Leibler Divergence Between Language Models
par: Amini, Afra, et autres
Publié: (2025)
par: Amini, Afra, et autres
Publié: (2025)
LLM-based Cognitive Models of Students with Misconceptions
par: Sonkar, Shashank, et autres
Publié: (2024)
par: Sonkar, Shashank, et autres
Publié: (2024)
Gumbel Counterfactual Generation From Language Models
par: Ravfogel, Shauli, et autres
Publié: (2024)
par: Ravfogel, Shauli, et autres
Publié: (2024)
Syntactic Control of Language Models by Posterior Inference
par: Xefteri, Vicky, et autres
Publié: (2025)
par: Xefteri, Vicky, et autres
Publié: (2025)
Can Large Language Models Infer Causation from Correlation?
par: Jin, Zhijing, et autres
Publié: (2023)
par: Jin, Zhijing, et autres
Publié: (2023)
Context-Free Recognition with Transformers
par: Jerad, Selim, et autres
Publié: (2026)
par: Jerad, Selim, et autres
Publié: (2026)
MathGAP: Out-of-Distribution Evaluation on Problems with Arbitrarily Complex Proofs
par: Opedal, Andreas, et autres
Publié: (2024)
par: Opedal, Andreas, et autres
Publié: (2024)
On Efficiently Representing Regular Languages as RNNs
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
Can Vision-Language Models Solve Visual Math Equations?
par: Choudhury, Monjoy Narayan, et autres
Publié: (2025)
par: Choudhury, Monjoy Narayan, et autres
Publié: (2025)
Autoformalizing Natural Language to First-Order Logic: A Case Study in Logical Fallacy Detection
par: Lalwani, Abhinav, et autres
Publié: (2024)
par: Lalwani, Abhinav, et autres
Publié: (2024)
A Discriminative Latent-Variable Model for Bilingual Lexicon Induction
par: Ruder, Sebastian, et autres
Publié: (2018)
par: Ruder, Sebastian, et autres
Publié: (2018)
Log-linear Guardedness and its Implications
par: Ravfogel, Shauli, et autres
Publié: (2022)
par: Ravfogel, Shauli, et autres
Publié: (2022)
Documents similaires
-
A Transformer with Stack Attention
par: Li, Jiaoda, et autres
Publié: (2024) -
Characterizing the Expressivity of Fixed-Precision Transformer Language Models
par: Li, Jiaoda, et autres
Publié: (2025) -
Efficiently Computing Susceptibility to Context in Language Models
par: Liu, Tianyu, et autres
Publié: (2024) -
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
par: Opedal, Andreas, et autres
Publié: (2024) -
Unique Hard Attention: A Tale of Two Sides
par: Jerad, Selim, et autres
Publié: (2025)