In-Context Learning Strategies Emerge Rationally
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wurgaft, Daniel, Lubana, Ekdeep Singh, Park, Core Francisco, Tanaka, Hidenori, Reddy, Gautam, Goodman, Noah D. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Belief Dynamics Reveal the Dual Nature of In-Context Learning and Activation Steering
par: Bigelow, Eric, et autres
Publié: (2025)
par: Bigelow, Eric, et autres
Publié: (2025)
Emergence of Hidden Capabilities: Exploring Learning Dynamics in Concept Space
par: Park, Core Francisco, et autres
Publié: (2024)
par: Park, Core Francisco, et autres
Publié: (2024)
ICLR: In-Context Learning of Representations
par: Park, Core Francisco, et autres
Publié: (2024)
par: Park, Core Francisco, et autres
Publié: (2024)
Competition Dynamics Shape Algorithmic Phases of In-Context Learning
par: Park, Core Francisco, et autres
Publié: (2024)
par: Park, Core Francisco, et autres
Publié: (2024)
In-Context Learning Dynamics with Random Binary Sequences
par: Bigelow, Eric J., et autres
Publié: (2023)
par: Bigelow, Eric J., et autres
Publié: (2023)
A Percolation Model of Emergence: Analyzing Transformers Trained on a Formal Language
par: Lubana, Ekdeep Singh, et autres
Publié: (2024)
par: Lubana, Ekdeep Singh, et autres
Publié: (2024)
Stories in Space: In-Context Learning Trajectories in Conceptual Belief Space
par: Bigelow, Eric, et autres
Publié: (2026)
par: Bigelow, Eric, et autres
Publié: (2026)
Swing-by Dynamics in Concept Learning and Compositional Generalization
par: Yang, Yongyi, et autres
Publié: (2024)
par: Yang, Yongyi, et autres
Publié: (2024)
$\textit{New News}$: System-2 Fine-tuning for Robust Integration of New Knowledge
par: Park, Core Francisco, et autres
Publié: (2025)
par: Park, Core Francisco, et autres
Publié: (2025)
Compositional Abilities Emerge Multiplicatively: Exploring Diffusion Models on a Synthetic Task
par: Okawa, Maya, et autres
Publié: (2023)
par: Okawa, Maya, et autres
Publié: (2023)
Towards an Understanding of Stepwise Inference in Transformers: A Synthetic Graph Navigation Model
par: Khona, Mikail, et autres
Publié: (2024)
par: Khona, Mikail, et autres
Publié: (2024)
How Do LLMs Persuade? Linear Probes Can Uncover Persuasion Dynamics in Multi-Turn Conversations
par: Jaipersaud, Brandon, et autres
Publié: (2025)
par: Jaipersaud, Brandon, et autres
Publié: (2025)
Emergence of Hierarchical Emotion Organization in Large Language Models
par: Zhao, Bo, et autres
Publié: (2025)
par: Zhao, Bo, et autres
Publié: (2025)
Convergent World Representations and Divergent Tasks
par: Park, Core Francisco
Publié: (2026)
par: Park, Core Francisco
Publié: (2026)
Projecting Assumptions: The Duality Between Sparse Autoencoders and Concept Geometry
par: Hindupur, Sai Sumedh R., et autres
Publié: (2025)
par: Hindupur, Sai Sumedh R., et autres
Publié: (2025)
Do Sparse Autoencoders Capture Concept Manifolds?
par: Bhalla, Usha, et autres
Publié: (2026)
par: Bhalla, Usha, et autres
Publié: (2026)
The Impact of Off-Policy Training Data on Probe Generalisation
par: Kirch, Nathalie, et autres
Publié: (2025)
par: Kirch, Nathalie, et autres
Publié: (2025)
From Isolation to Entanglement: When Do Interpretability Methods Identify and Disentangle Known Concepts?
par: Mueller, Aaron, et autres
Publié: (2025)
par: Mueller, Aaron, et autres
Publié: (2025)
Compositional Capabilities of Autoregressive Transformers: A Study on Synthetic, Interpretable Tasks
par: Ramesh, Rahul, et autres
Publié: (2023)
par: Ramesh, Rahul, et autres
Publié: (2023)
Decomposing Elements of Problem Solving: What "Math" Does RL Teach?
par: Qin, Tian, et autres
Publié: (2025)
par: Qin, Tian, et autres
Publié: (2025)
Representation Shattering in Transformers: A Synthetic Study with Knowledge Editing
par: Nishi, Kento, et autres
Publié: (2024)
par: Nishi, Kento, et autres
Publié: (2024)
Abrupt Learning in Transformers: A Case Study on Matrix Completion
par: Gopalani, Pulkit, et autres
Publié: (2024)
par: Gopalani, Pulkit, et autres
Publié: (2024)
Continuous-Time Analysis of Adaptive Optimization and Normalization
par: Gould, Rhys, et autres
Publié: (2024)
par: Gould, Rhys, et autres
Publié: (2024)
Emergent Symbol-like Number Variables in Artificial Neural Networks
par: Grant, Satchel, et autres
Publié: (2025)
par: Grant, Satchel, et autres
Publié: (2025)
Distinct Computations Emerge From Compositional Curricula in In-Context Learning
par: Lee, Jin Hwa, et autres
Publié: (2025)
par: Lee, Jin Hwa, et autres
Publié: (2025)
Large Language Model Reasoning Failures
par: Song, Peiyang, et autres
Publié: (2026)
par: Song, Peiyang, et autres
Publié: (2026)
Why Larger Models Learn More: Effects of Capacity, Interference, and Rare-Task Retention
par: Huang, Jing, et autres
Publié: (2026)
par: Huang, Jing, et autres
Publié: (2026)
Fast Forward: Accelerating LLM Prefill with Predictive FFN Sparsity
par: Gautam, Aayush, et autres
Publié: (2026)
par: Gautam, Aayush, et autres
Publié: (2026)
Is Child-Directed Speech Effective Training Data for Language Models?
par: Feng, Steven Y., et autres
Publié: (2024)
par: Feng, Steven Y., et autres
Publié: (2024)
Are language models aware of the road not taken? Token-level uncertainty and hidden state dynamics
par: Zur, Amir, et autres
Publié: (2025)
par: Zur, Amir, et autres
Publié: (2025)
Analyzing (In)Abilities of SAEs via Formal Languages
par: Menon, Abhinav, et autres
Publié: (2024)
par: Menon, Abhinav, et autres
Publié: (2024)
Towards Reliable Evaluation of Behavior Steering Interventions in LLMs
par: Pres, Itamar, et autres
Publié: (2024)
par: Pres, Itamar, et autres
Publié: (2024)
Discourse-Aware In-Context Learning for Temporal Expression Normalization
par: Gautam, Akash Kumar, et autres
Publié: (2024)
par: Gautam, Akash Kumar, et autres
Publié: (2024)
RAMP: Reinforcement Adaptive Mixed Precision Quantization for Efficient On Device LLM Inference
par: Gautam, Arpit Singh, et autres
Publié: (2026)
par: Gautam, Arpit Singh, et autres
Publié: (2026)
Stream of Search (SoS): Learning to Search in Language
par: Gandhi, Kanishk, et autres
Publié: (2024)
par: Gandhi, Kanishk, et autres
Publié: (2024)
Token-Driven GammaTune: Adaptive Calibration for Enhanced Speculative Decoding
par: Gautam, Aayush, et autres
Publié: (2025)
par: Gautam, Aayush, et autres
Publié: (2025)
Mechanistically analyzing the effects of fine-tuning on procedurally defined tasks
par: Jain, Samyak, et autres
Publié: (2023)
par: Jain, Samyak, et autres
Publié: (2023)
Forking Paths in Neural Text Generation
par: Bigelow, Eric, et autres
Publié: (2024)
par: Bigelow, Eric, et autres
Publié: (2024)
CriticAL: Critic Automation with Language Models
par: Li, Michael Y., et autres
Publié: (2024)
par: Li, Michael Y., et autres
Publié: (2024)
Uncovering Conceptual Blindspots in Generative Image Models Using Sparse Autoencoders
par: Bohacek, Matyas, et autres
Publié: (2025)
par: Bohacek, Matyas, et autres
Publié: (2025)
Documents similaires
-
Belief Dynamics Reveal the Dual Nature of In-Context Learning and Activation Steering
par: Bigelow, Eric, et autres
Publié: (2025) -
Emergence of Hidden Capabilities: Exploring Learning Dynamics in Concept Space
par: Park, Core Francisco, et autres
Publié: (2024) -
ICLR: In-Context Learning of Representations
par: Park, Core Francisco, et autres
Publié: (2024) -
Competition Dynamics Shape Algorithmic Phases of In-Context Learning
par: Park, Core Francisco, et autres
Publié: (2024) -
In-Context Learning Dynamics with Random Binary Sequences
par: Bigelow, Eric J., et autres
Publié: (2023)