How do Language Models Bind Entities in Context?
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Jiahai, Steinhardt, Jacob |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning a Generative Meta-Model of LLM Activations
di: Luo, Grace, et al.
Pubblicazione: (2026)
di: Luo, Grace, et al.
Pubblicazione: (2026)
Monitoring Latent World States in Language Models with Propositional Probes
di: Feng, Jiahai, et al.
Pubblicazione: (2024)
di: Feng, Jiahai, et al.
Pubblicazione: (2024)
Which Attention Heads Matter for In-Context Learning?
di: Yin, Kayo, et al.
Pubblicazione: (2025)
di: Yin, Kayo, et al.
Pubblicazione: (2025)
Feedback Loops With Language Models Drive In-Context Reward Hacking
di: Pan, Alexander, et al.
Pubblicazione: (2024)
di: Pan, Alexander, et al.
Pubblicazione: (2024)
Extractive Structures Learned in Pretraining Enable Generalization on Finetuned Facts
di: Feng, Jiahai, et al.
Pubblicazione: (2024)
di: Feng, Jiahai, et al.
Pubblicazione: (2024)
Overthinking the Truth: Understanding how Language Models Process False Demonstrations
di: Halawi, Danny, et al.
Pubblicazione: (2023)
di: Halawi, Danny, et al.
Pubblicazione: (2023)
Discovering Latent Knowledge in Language Models Without Supervision
di: Burns, Collin, et al.
Pubblicazione: (2022)
di: Burns, Collin, et al.
Pubblicazione: (2022)
Explaining Datasets in Words: Statistical Models with Natural Language Parameters
di: Zhong, Ruiqi, et al.
Pubblicazione: (2024)
di: Zhong, Ruiqi, et al.
Pubblicazione: (2024)
Training Language Models to Explain Their Own Computations
di: Li, Belinda Z., et al.
Pubblicazione: (2025)
di: Li, Belinda Z., et al.
Pubblicazione: (2025)
Iterative Label Refinement Matters More than Preference Optimization under Weak Supervision
di: Ye, Yaowen, et al.
Pubblicazione: (2025)
di: Ye, Yaowen, et al.
Pubblicazione: (2025)
Approaching Human-Level Forecasting with Language Models
di: Halawi, Danny, et al.
Pubblicazione: (2024)
di: Halawi, Danny, et al.
Pubblicazione: (2024)
Eliciting Language Model Behaviors with Investigator Agents
di: Li, Xiang Lisa, et al.
Pubblicazione: (2025)
di: Li, Xiang Lisa, et al.
Pubblicazione: (2025)
(How) Do Language Models Track State?
di: Li, Belinda Z., et al.
Pubblicazione: (2025)
di: Li, Belinda Z., et al.
Pubblicazione: (2025)
Cultural Binding Heads in Language Models
di: Floro, Avrile, et al.
Pubblicazione: (2026)
di: Floro, Avrile, et al.
Pubblicazione: (2026)
Understanding In-context Learning of Addition via Activation Subspaces
di: Hu, Xinyan, et al.
Pubblicazione: (2025)
di: Hu, Xinyan, et al.
Pubblicazione: (2025)
Predictive Concept Decoders: Training Scalable End-to-End Interpretability Assistants
di: Huang, Vincent, et al.
Pubblicazione: (2025)
di: Huang, Vincent, et al.
Pubblicazione: (2025)
Do I Know This Entity? Knowledge Awareness and Hallucinations in Language Models
di: Ferrando, Javier, et al.
Pubblicazione: (2024)
di: Ferrando, Javier, et al.
Pubblicazione: (2024)
How Do Transformers Learn Variable Binding in Symbolic Programs?
di: Wu, Yiwei, et al.
Pubblicazione: (2025)
di: Wu, Yiwei, et al.
Pubblicazione: (2025)
Large Language Models Struggle in Token-Level Clinical Named Entity Recognition
di: Lu, Qiuhao, et al.
Pubblicazione: (2024)
di: Lu, Qiuhao, et al.
Pubblicazione: (2024)
Revisiting In-Context Learning with Long Context Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
ERBench: An Entity-Relationship based Automatically Verifiable Hallucination Benchmark for Large Language Models
di: Oh, Jio, et al.
Pubblicazione: (2024)
di: Oh, Jio, et al.
Pubblicazione: (2024)
Cross-lingual Named Entity Corpus for Slavic Languages
di: Piskorski, Jakub, et al.
Pubblicazione: (2024)
di: Piskorski, Jakub, et al.
Pubblicazione: (2024)
Uncovering Gaps in How Humans and LLMs Interpret Subjective Language
di: Jones, Erik, et al.
Pubblicazione: (2025)
di: Jones, Erik, et al.
Pubblicazione: (2025)
LEIA: Facilitating Cross-lingual Knowledge Transfer in Language Models with Entity-based Data Augmentation
di: Yamada, Ikuya, et al.
Pubblicazione: (2024)
di: Yamada, Ikuya, et al.
Pubblicazione: (2024)
Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models
di: Zhang, Qizheng, et al.
Pubblicazione: (2025)
di: Zhang, Qizheng, et al.
Pubblicazione: (2025)
Toward In-Context Teaching: Adapting Examples to Students' Misconceptions
di: Ross, Alexis, et al.
Pubblicazione: (2024)
di: Ross, Alexis, et al.
Pubblicazione: (2024)
Improving Context-Aware Preference Modeling for Language Models
di: Pitis, Silviu, et al.
Pubblicazione: (2024)
di: Pitis, Silviu, et al.
Pubblicazione: (2024)
Large Language Models are Miscalibrated In-Context Learners
di: Li, Chengzu, et al.
Pubblicazione: (2023)
di: Li, Chengzu, et al.
Pubblicazione: (2023)
Context Dependence and Reliability in Autoregressive Language Models
di: Sengupta, Poushali, et al.
Pubblicazione: (2026)
di: Sengupta, Poushali, et al.
Pubblicazione: (2026)
How do Large Language Models Navigate Conflicts between Honesty and Helpfulness?
di: Liu, Ryan, et al.
Pubblicazione: (2024)
di: Liu, Ryan, et al.
Pubblicazione: (2024)
Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation
di: Halawi, Danny, et al.
Pubblicazione: (2024)
di: Halawi, Danny, et al.
Pubblicazione: (2024)
RePo: Language Models with Context Re-Positioning
di: Li, Huayang, et al.
Pubblicazione: (2025)
di: Li, Huayang, et al.
Pubblicazione: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
di: Xiao, Wenyang, et al.
Pubblicazione: (2025)
di: Xiao, Wenyang, et al.
Pubblicazione: (2025)
Lexicon-Level Contrastive Visual-Grounding Improves Language Modeling
di: Zhuang, Chengxu, et al.
Pubblicazione: (2024)
di: Zhuang, Chengxu, et al.
Pubblicazione: (2024)
In-context Autoencoder for Context Compression in a Large Language Model
di: Ge, Tao, et al.
Pubblicazione: (2023)
di: Ge, Tao, et al.
Pubblicazione: (2023)
Unlocking In-Context Learning for Natural Datasets Beyond Language Modelling
di: Bratulić, Jelena, et al.
Pubblicazione: (2025)
di: Bratulić, Jelena, et al.
Pubblicazione: (2025)
AfroBench: How Good are Large Language Models on African Languages?
di: Ojo, Jessica, et al.
Pubblicazione: (2023)
di: Ojo, Jessica, et al.
Pubblicazione: (2023)
Reference-less Analysis of Context Specificity in Translation with Personalised Language Models
di: Vincent, Sebastian, et al.
Pubblicazione: (2023)
di: Vincent, Sebastian, et al.
Pubblicazione: (2023)
YaRN: Efficient Context Window Extension of Large Language Models
di: Peng, Bowen, et al.
Pubblicazione: (2023)
di: Peng, Bowen, et al.
Pubblicazione: (2023)
RAVEN: In-Context Learning with Retrieval-Augmented Encoder-Decoder Language Models
di: Huang, Jie, et al.
Pubblicazione: (2023)
di: Huang, Jie, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Learning a Generative Meta-Model of LLM Activations
di: Luo, Grace, et al.
Pubblicazione: (2026) -
Monitoring Latent World States in Language Models with Propositional Probes
di: Feng, Jiahai, et al.
Pubblicazione: (2024) -
Which Attention Heads Matter for In-Context Learning?
di: Yin, Kayo, et al.
Pubblicazione: (2025) -
Feedback Loops With Language Models Drive In-Context Reward Hacking
di: Pan, Alexander, et al.
Pubblicazione: (2024) -
Extractive Structures Learned in Pretraining Enable Generalization on Finetuned Facts
di: Feng, Jiahai, et al.
Pubblicazione: (2024)