Guardado en:
| Autores principales: | Yu, Zeping, Ananiadou, Sophia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2402.02872 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Neuron-Level Knowledge Attribution in Large Language Models
por: Yu, Zeping, et al.
Publicado: (2023)
por: Yu, Zeping, et al.
Publicado: (2023)
Interpreting Arithmetic Mechanism in Large Language Models through Comparative Neuron Analysis
por: Yu, Zeping, et al.
Publicado: (2024)
por: Yu, Zeping, et al.
Publicado: (2024)
Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models
por: Yu, Zeping, et al.
Publicado: (2025)
por: Yu, Zeping, et al.
Publicado: (2025)
Understanding Multimodal LLMs: the Mechanistic Interpretability of Llava in Visual Question Answering
por: Yu, Zeping, et al.
Publicado: (2024)
por: Yu, Zeping, et al.
Publicado: (2024)
Understanding and Mitigating Gender Bias in LLMs via Interpretable Neuron Editing
por: Yu, Zeping, et al.
Publicado: (2025)
por: Yu, Zeping, et al.
Publicado: (2025)
Locate-then-Merge: Neuron-Level Parameter Fusion for Mitigating Catastrophic Forgetting in Multimodal LLMs
por: Yu, Zeping, et al.
Publicado: (2025)
por: Yu, Zeping, et al.
Publicado: (2025)
The Atlas of In-Context Learning: How Attention Heads Shape In-Context Retrieval Augmentation
por: Kahardipraja, Patrick, et al.
Publicado: (2025)
por: Kahardipraja, Patrick, et al.
Publicado: (2025)
Uncertainty Quantification for In-Context Learning of Large Language Models
por: Ling, Chen, et al.
Publicado: (2024)
por: Ling, Chen, et al.
Publicado: (2024)
Unraveling Syntax: How Language Models Learn Context-Free Grammars
por: Schulz, Laura Ying, et al.
Publicado: (2025)
por: Schulz, Laura Ying, et al.
Publicado: (2025)
A Context-Aware Dual-Metric Framework for Confidence Estimation in Large Language Models
por: Yuan, Mingruo, et al.
Publicado: (2025)
por: Yuan, Mingruo, et al.
Publicado: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
por: Xiao, Wenyang, et al.
Publicado: (2025)
por: Xiao, Wenyang, et al.
Publicado: (2025)
Which Attention Heads Matter for In-Context Learning?
por: Yin, Kayo, et al.
Publicado: (2025)
por: Yin, Kayo, et al.
Publicado: (2025)
Revisiting In-Context Learning with Long Context Language Models
por: Baek, Jinheon, et al.
Publicado: (2024)
por: Baek, Jinheon, et al.
Publicado: (2024)
How do Language Models Bind Entities in Context?
por: Feng, Jiahai, et al.
Publicado: (2023)
por: Feng, Jiahai, et al.
Publicado: (2023)
Beyond the Prompt in Large Language Models: Comprehension, In-Context Learning, and Chain-of-Thought
por: Jiao, Yuling, et al.
Publicado: (2026)
por: Jiao, Yuling, et al.
Publicado: (2026)
Hijacking Large Language Models via Adversarial In-Context Learning
por: Zhou, Xiangyu, et al.
Publicado: (2023)
por: Zhou, Xiangyu, et al.
Publicado: (2023)
Privacy Preserving In-Context-Learning Framework for Large Language Models
por: Bhusal, Bishnu, et al.
Publicado: (2025)
por: Bhusal, Bishnu, et al.
Publicado: (2025)
How to Train Long-Context Language Models (Effectively)
por: Gao, Tianyu, et al.
Publicado: (2024)
por: Gao, Tianyu, et al.
Publicado: (2024)
In-Context Language Learning: Architectures and Algorithms
por: Akyürek, Ekin, et al.
Publicado: (2024)
por: Akyürek, Ekin, et al.
Publicado: (2024)
Uncovering Emergent Physics Representations Learned In-Context by Large Language Models
por: Song, Yeongwoo, et al.
Publicado: (2025)
por: Song, Yeongwoo, et al.
Publicado: (2025)
Out-of-Context Reasoning in Large Language Models
por: Shaki, Jonathan, et al.
Publicado: (2025)
por: Shaki, Jonathan, et al.
Publicado: (2025)
Dynamic Attention-Guided Context Decoding for Mitigating Context Faithfulness Hallucinations in Large Language Models
por: Huang, Yanwen, et al.
Publicado: (2025)
por: Huang, Yanwen, et al.
Publicado: (2025)
Long Context RAG Performance of Large Language Models
por: Leng, Quinn, et al.
Publicado: (2024)
por: Leng, Quinn, et al.
Publicado: (2024)
What Do Language Models Learn in Context? The Structured Task Hypothesis
por: Li, Jiaoda, et al.
Publicado: (2024)
por: Li, Jiaoda, et al.
Publicado: (2024)
Brewing Knowledge in Context: Distillation Perspectives on In-Context Learning
por: Li, Chengye, et al.
Publicado: (2025)
por: Li, Chengye, et al.
Publicado: (2025)
Core Context Aware Transformers for Long Context Language Modeling
por: Chen, Yaofo, et al.
Publicado: (2024)
por: Chen, Yaofo, et al.
Publicado: (2024)
Large Language Models Are Latent Variable Models: Explaining and Finding Good Demonstrations for In-Context Learning
por: Wang, Xinyi, et al.
Publicado: (2023)
por: Wang, Xinyi, et al.
Publicado: (2023)
From n-gram to Attention: How Model Architectures Learn and Propagate Bias in Language Modeling
por: Kabir, Mohsinul, et al.
Publicado: (2025)
por: Kabir, Mohsinul, et al.
Publicado: (2025)
Large Language Models are Miscalibrated In-Context Learners
por: Li, Chengzu, et al.
Publicado: (2023)
por: Li, Chengzu, et al.
Publicado: (2023)
Is In-Context Learning Learning?
por: de Wynter, Adrian
Publicado: (2025)
por: de Wynter, Adrian
Publicado: (2025)
Unlocking In-Context Learning for Natural Datasets Beyond Language Modelling
por: Bratulić, Jelena, et al.
Publicado: (2025)
por: Bratulić, Jelena, et al.
Publicado: (2025)
COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics
por: Sharma, Kartik, et al.
Publicado: (2026)
por: Sharma, Kartik, et al.
Publicado: (2026)
Leveraging Large Language Models for Wireless Symbol Detection via In-Context Learning
por: Abbas, Momin, et al.
Publicado: (2024)
por: Abbas, Momin, et al.
Publicado: (2024)
In-Context Symbolic Regression: Leveraging Large Language Models for Function Discovery
por: Merler, Matteo, et al.
Publicado: (2024)
por: Merler, Matteo, et al.
Publicado: (2024)
Learning Task Representations from In-Context Learning
por: Saglam, Baturay, et al.
Publicado: (2025)
por: Saglam, Baturay, et al.
Publicado: (2025)
Cost-Optimal Grouped-Query Attention for Long-Context Modeling
por: Chen, Yingfa, et al.
Publicado: (2025)
por: Chen, Yingfa, et al.
Publicado: (2025)
ScoNe: Benchmarking Negation Reasoning in Language Models With Fine-Tuning and In-Context Learning
por: She, Jingyuan Selena, et al.
Publicado: (2023)
por: She, Jingyuan Selena, et al.
Publicado: (2023)
Unveiling Simplicities of Attention: Adaptive Long-Context Head Identification
por: Donhauser, Konstantin, et al.
Publicado: (2025)
por: Donhauser, Konstantin, et al.
Publicado: (2025)
Towards Better Understanding of In-Context Learning Ability from In-Context Uncertainty Quantification
por: Liu, Shang, et al.
Publicado: (2024)
por: Liu, Shang, et al.
Publicado: (2024)
RAVEN: In-Context Learning with Retrieval-Augmented Encoder-Decoder Language Models
por: Huang, Jie, et al.
Publicado: (2023)
por: Huang, Jie, et al.
Publicado: (2023)
Ejemplares similares
-
Neuron-Level Knowledge Attribution in Large Language Models
por: Yu, Zeping, et al.
Publicado: (2023) -
Interpreting Arithmetic Mechanism in Large Language Models through Comparative Neuron Analysis
por: Yu, Zeping, et al.
Publicado: (2024) -
Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models
por: Yu, Zeping, et al.
Publicado: (2025) -
Understanding Multimodal LLMs: the Mechanistic Interpretability of Llava in Visual Question Answering
por: Yu, Zeping, et al.
Publicado: (2024) -
Understanding and Mitigating Gender Bias in LLMs via Interpretable Neuron Editing
por: Yu, Zeping, et al.
Publicado: (2025)