Are LLMs Models of Distributional Semantics? A Case Study on Quantifiers
Fuente:
arXiv
Guardado en:
| Autores principales: | Enyan, Zhang, Wang, Zewei, Lepori, Michael A., Pavlick, Ellie, Aparicio, Helena |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Uncovering Intermediate Variables in Transformers using Circuit Probing
por: Lepori, Michael A., et al.
Publicado: (2023)
por: Lepori, Michael A., et al.
Publicado: (2023)
Instilling Inductive Biases with Subnetworks
por: Zhang, Enyan, et al.
Publicado: (2023)
por: Zhang, Enyan, et al.
Publicado: (2023)
Dual Process Learning: Controlling Use of In-Context vs. In-Weights Strategies with Weight Forgetting
por: Anand, Suraj, et al.
Publicado: (2024)
por: Anand, Suraj, et al.
Publicado: (2024)
LLMs as Models for Analogical Reasoning
por: Musker, Sam, et al.
Publicado: (2024)
por: Musker, Sam, et al.
Publicado: (2024)
Does Training on Synthetic Data Make Models Less Robust?
por: Zhang, Lingze, et al.
Publicado: (2025)
por: Zhang, Lingze, et al.
Publicado: (2025)
How Do Language Models Compose Functions?
por: Khandelwal, Apoorv, et al.
Publicado: (2025)
por: Khandelwal, Apoorv, et al.
Publicado: (2025)
Is This Just Fantasy? Language Model Representations Reflect Human Judgments of Event Plausibility
por: Lepori, Michael A., et al.
Publicado: (2025)
por: Lepori, Michael A., et al.
Publicado: (2025)
Source-Modality Monitoring in Vision-Language Models
por: Hua, Etha Tianze, et al.
Publicado: (2026)
por: Hua, Etha Tianze, et al.
Publicado: (2026)
Circuit Component Reuse Across Tasks in Transformer Language Models
por: Merullo, Jack, et al.
Publicado: (2023)
por: Merullo, Jack, et al.
Publicado: (2023)
Talking Heads: Understanding Inter-layer Communication in Transformer Language Models
por: Merullo, Jack, et al.
Publicado: (2024)
por: Merullo, Jack, et al.
Publicado: (2024)
What is an "Abstract Reasoner"? Revisiting Experiments and Arguments about Large Language Models
por: Yun, Tian, et al.
Publicado: (2025)
por: Yun, Tian, et al.
Publicado: (2025)
Language Models Implement Simple Word2Vec-style Vector Arithmetic
por: Merullo, Jack, et al.
Publicado: (2023)
por: Merullo, Jack, et al.
Publicado: (2023)
mOthello: When Do Cross-Lingual Representation Alignment and Cross-Lingual Transfer Emerge in Multilingual Models?
por: Hua, Tianze, et al.
Publicado: (2024)
por: Hua, Tianze, et al.
Publicado: (2024)
How Do Vision-Language Models Process Conflicting Information Across Modalities?
por: Hua, Tianze, et al.
Publicado: (2025)
por: Hua, Tianze, et al.
Publicado: (2025)
Paths Not Taken: Understanding and Mending the Multilingual Factual Recall Pipeline
por: Lu, Meng, et al.
Publicado: (2025)
por: Lu, Meng, et al.
Publicado: (2025)
Transferring Linear Features Across Language Models With Model Stitching
por: Chen, Alan, et al.
Publicado: (2025)
por: Chen, Alan, et al.
Publicado: (2025)
A Knapsack by Any Other Name: Presentation impacts LLM performance on NP-hard problems
por: Duchnowski, Alex, et al.
Publicado: (2025)
por: Duchnowski, Alex, et al.
Publicado: (2025)
The Same But Different: Structural Similarities and Differences in Multilingual Language Modeling
por: Zhang, Ruochen, et al.
Publicado: (2024)
por: Zhang, Ruochen, et al.
Publicado: (2024)
Bayesian Preference Elicitation with Language Models
por: Handa, Kunal, et al.
Publicado: (2024)
por: Handa, Kunal, et al.
Publicado: (2024)
Can LLMs subtract numbers?
por: Jobanputra, Mayank, et al.
Publicado: (2025)
por: Jobanputra, Mayank, et al.
Publicado: (2025)
Born a Transformer -- Always a Transformer? On the Effect of Pretraining on Architectural Abilities
por: Jobanputra, Mayank, et al.
Publicado: (2025)
por: Jobanputra, Mayank, et al.
Publicado: (2025)
Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases
por: Qiu, Pengcheng, et al.
Publicado: (2025)
por: Qiu, Pengcheng, et al.
Publicado: (2025)
Shared Lexical Task Representations Explain Behavioral Variability In LLMs
por: Yang, Zhuonan, et al.
Publicado: (2026)
por: Yang, Zhuonan, et al.
Publicado: (2026)
Semantic Volume: Quantifying and Detecting both External and Internal Uncertainty in LLMs
por: Li, Xiaomin, et al.
Publicado: (2025)
por: Li, Xiaomin, et al.
Publicado: (2025)
Potential and Limitations of LLMs in Capturing Structured Semantics: A Case Study on SRL
por: Cheng, Ning, et al.
Publicado: (2024)
por: Cheng, Ning, et al.
Publicado: (2024)
DuFFin: A Dual-Level Fingerprinting Framework for LLMs IP Protection
por: Yan, Yuliang, et al.
Publicado: (2025)
por: Yan, Yuliang, et al.
Publicado: (2025)
Racing Thoughts: Explaining Contextualization Errors in Large Language Models
por: Lepori, Michael A., et al.
Publicado: (2024)
por: Lepori, Michael A., et al.
Publicado: (2024)
Quantifying Semantic Emergence in Language Models
por: Chen, Hang, et al.
Publicado: (2024)
por: Chen, Hang, et al.
Publicado: (2024)
Does CLIP Bind Concepts? Probing Compositionality in Large Image Models
por: Lewis, Martha, et al.
Publicado: (2022)
por: Lewis, Martha, et al.
Publicado: (2022)
Cognitive Modeling with Scaffolded LLMs: A Case Study of Referential Expression Generation
por: Tsvilodub, Polina, et al.
Publicado: (2024)
por: Tsvilodub, Polina, et al.
Publicado: (2024)
Acting Flatterers via LLMs Sycophancy: Combating Clickbait with LLMs Opposing-Stance Reasoning
por: Zhang, Chaowei, et al.
Publicado: (2026)
por: Zhang, Chaowei, et al.
Publicado: (2026)
Is It JUST Semantics? A Case Study of Discourse Particle Understanding in LLMs
por: Sheffield, William, et al.
Publicado: (2025)
por: Sheffield, William, et al.
Publicado: (2025)
HawkesLLM: Semantic Uncertainty Propagation in Agentic Text Simulation
por: Deng, Zewei, et al.
Publicado: (2026)
por: Deng, Zewei, et al.
Publicado: (2026)
Quantifying Fairness in LLMs Beyond Tokens: A Semantic and Statistical Perspective
por: Xu, Weijie, et al.
Publicado: (2025)
por: Xu, Weijie, et al.
Publicado: (2025)
$100K or 100 Days: Trade-offs when Pre-Training with Academic Resources
por: Khandelwal, Apoorv, et al.
Publicado: (2024)
por: Khandelwal, Apoorv, et al.
Publicado: (2024)
A Semantic-based Optimization Approach for Repairing LLMs: Case Study on Code Generation
por: Gu, Jian, et al.
Publicado: (2025)
por: Gu, Jian, et al.
Publicado: (2025)
Signatures of human-like processing in Transformer forward passes
por: Hu, Jennifer, et al.
Publicado: (2025)
por: Hu, Jennifer, et al.
Publicado: (2025)
Language Models Struggle to Use Representations Learned In-Context
por: Lepori, Michael A., et al.
Publicado: (2026)
por: Lepori, Michael A., et al.
Publicado: (2026)
SHIELD: Semantic Heterogeneity Integrated Embedding for Latent Discovery in Clinical Trial Safety Signals
por: Vandenhende, Francois, et al.
Publicado: (2026)
por: Vandenhende, Francois, et al.
Publicado: (2026)
How LLMs Comprehend Temporal Meaning in Narratives: A Case Study in Cognitive Evaluation of LLMs
por: de Langis, Karin, et al.
Publicado: (2025)
por: de Langis, Karin, et al.
Publicado: (2025)
Ejemplares similares
-
Uncovering Intermediate Variables in Transformers using Circuit Probing
por: Lepori, Michael A., et al.
Publicado: (2023) -
Instilling Inductive Biases with Subnetworks
por: Zhang, Enyan, et al.
Publicado: (2023) -
Dual Process Learning: Controlling Use of In-Context vs. In-Weights Strategies with Weight Forgetting
por: Anand, Suraj, et al.
Publicado: (2024) -
LLMs as Models for Analogical Reasoning
por: Musker, Sam, et al.
Publicado: (2024) -
Does Training on Synthetic Data Make Models Less Robust?
por: Zhang, Lingze, et al.
Publicado: (2025)