In-Context Language Learning: Architectures and Algorithms
Fuente:
arXiv
Salvato in:
| Autori principali: | Akyürek, Ekin, Wang, Bailin, Kim, Yoon, Andreas, Jacob |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Surprising Effectiveness of Test-Time Training for Few-Shot Learning
di: Akyürek, Ekin, et al.
Pubblicazione: (2024)
di: Akyürek, Ekin, et al.
Pubblicazione: (2024)
Is Active Persona Inference Necessary for Aligning Small Models to Personal Preferences?
di: Tang, Zilu, et al.
Pubblicazione: (2025)
di: Tang, Zilu, et al.
Pubblicazione: (2025)
Learning Linear Attention in Polynomial Time
di: Yau, Morris, et al.
Pubblicazione: (2024)
di: Yau, Morris, et al.
Pubblicazione: (2024)
Learning to Decode Collaboratively with Multiple Language Models
di: Shen, Shannon Zejiang, et al.
Pubblicazione: (2024)
di: Shen, Shannon Zejiang, et al.
Pubblicazione: (2024)
Deductive Closure Training of Language Models for Coherence, Accuracy, and Updatability
di: Akyürek, Afra Feyza, et al.
Pubblicazione: (2024)
di: Akyürek, Afra Feyza, et al.
Pubblicazione: (2024)
Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks
di: Wu, Zhaofeng, et al.
Pubblicazione: (2023)
di: Wu, Zhaofeng, et al.
Pubblicazione: (2023)
Parallelizing Linear Transformers with the Delta Rule over Sequence Length
di: Yang, Songlin, et al.
Pubblicazione: (2024)
di: Yang, Songlin, et al.
Pubblicazione: (2024)
Gated Linear Attention Transformers with Hardware-Efficient Training
di: Yang, Songlin, et al.
Pubblicazione: (2023)
di: Yang, Songlin, et al.
Pubblicazione: (2023)
Self-Adapting Language Models
di: Zweiger, Adam, et al.
Pubblicazione: (2025)
di: Zweiger, Adam, et al.
Pubblicazione: (2025)
Bias Amplification in Language Model Evolution: An Iterated Learning Perspective
di: Ren, Yi, et al.
Pubblicazione: (2024)
di: Ren, Yi, et al.
Pubblicazione: (2024)
Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models
di: Puri, Isha, et al.
Pubblicazione: (2026)
di: Puri, Isha, et al.
Pubblicazione: (2026)
Algorithmic Capabilities of Random Transformers
di: Zhong, Ziqian, et al.
Pubblicazione: (2024)
di: Zhong, Ziqian, et al.
Pubblicazione: (2024)
Toward In-Context Teaching: Adapting Examples to Students' Misconceptions
di: Ross, Alexis, et al.
Pubblicazione: (2024)
di: Ross, Alexis, et al.
Pubblicazione: (2024)
Learning to Interpret Weight Differences in Language Models
di: Goel, Avichal, et al.
Pubblicazione: (2025)
di: Goel, Avichal, et al.
Pubblicazione: (2025)
Efficient Context Propagating Perceiver Architectures for Auto-Regressive Language Modeling
di: Mahmood, Kaleel, et al.
Pubblicazione: (2024)
di: Mahmood, Kaleel, et al.
Pubblicazione: (2024)
MOOSComp: Improving Lightweight Long-Context Compressor via Mitigating Over-Smoothing and Incorporating Outlier Scores
di: Zhou, Fengwei, et al.
Pubblicazione: (2025)
di: Zhou, Fengwei, et al.
Pubblicazione: (2025)
Competition Dynamics Shape Algorithmic Phases of In-Context Learning
di: Park, Core Francisco, et al.
Pubblicazione: (2024)
di: Park, Core Francisco, et al.
Pubblicazione: (2024)
Long Context RAG Performance of Large Language Models
di: Leng, Quinn, et al.
Pubblicazione: (2024)
di: Leng, Quinn, et al.
Pubblicazione: (2024)
ELF: Embedded Language Flows
di: Hu, Keya, et al.
Pubblicazione: (2026)
di: Hu, Keya, et al.
Pubblicazione: (2026)
Unforgettable Generalization in Language Models
di: Zhang, Eric, et al.
Pubblicazione: (2024)
di: Zhang, Eric, et al.
Pubblicazione: (2024)
Elements of World Knowledge (EWoK): A Cognition-Inspired Framework for Evaluating Basic World Knowledge in Language Models
di: Ivanova, Anna A., et al.
Pubblicazione: (2024)
di: Ivanova, Anna A., et al.
Pubblicazione: (2024)
How do Language Models Bind Entities in Context?
di: Feng, Jiahai, et al.
Pubblicazione: (2023)
di: Feng, Jiahai, et al.
Pubblicazione: (2023)
Policy Learning with a Language Bottleneck
di: Srivastava, Megha, et al.
Pubblicazione: (2024)
di: Srivastava, Megha, et al.
Pubblicazione: (2024)
Which Attention Heads Matter for In-Context Learning?
di: Yin, Kayo, et al.
Pubblicazione: (2025)
di: Yin, Kayo, et al.
Pubblicazione: (2025)
CART: Context-Anchored Recurrent Transformer -- A Parameter-Efficient Architecture with Learned Stability
di: Capps, Chad A.
Pubblicazione: (2026)
di: Capps, Chad A.
Pubblicazione: (2026)
Forecasting Future Language: Context Design for Mention Markets
di: Kim, Sumin, et al.
Pubblicazione: (2026)
di: Kim, Sumin, et al.
Pubblicazione: (2026)
Task Schema and Binding: A Double Dissociation Study of In-Context Learning
di: Kim, Chaeha
Pubblicazione: (2025)
di: Kim, Chaeha
Pubblicazione: (2025)
Compressed Context Memory For Online Language Model Interaction
di: Kim, Jang-Hyun, et al.
Pubblicazione: (2023)
di: Kim, Jang-Hyun, et al.
Pubblicazione: (2023)
Uncertainty Quantification for In-Context Learning of Large Language Models
di: Ling, Chen, et al.
Pubblicazione: (2024)
di: Ling, Chen, et al.
Pubblicazione: (2024)
Core Context Aware Transformers for Long Context Language Modeling
di: Chen, Yaofo, et al.
Pubblicazione: (2024)
di: Chen, Yaofo, et al.
Pubblicazione: (2024)
Mitigating the Impact of Outlier Channels for Language Model Quantization with Activation Regularization
di: Nrusimha, Aniruddha, et al.
Pubblicazione: (2024)
di: Nrusimha, Aniruddha, et al.
Pubblicazione: (2024)
EdiText: Controllable Coarse-to-Fine Text Editing with Diffusion Language Models
di: Lee, Che Hyun, et al.
Pubblicazione: (2025)
di: Lee, Che Hyun, et al.
Pubblicazione: (2025)
Feedback Loops With Language Models Drive In-Context Reward Hacking
di: Pan, Alexander, et al.
Pubblicazione: (2024)
di: Pan, Alexander, et al.
Pubblicazione: (2024)
Uncovering Emergent Physics Representations Learned In-Context by Large Language Models
di: Song, Yeongwoo, et al.
Pubblicazione: (2025)
di: Song, Yeongwoo, et al.
Pubblicazione: (2025)
How do Large Language Models Learn In-Context? Query and Key Matrices of In-Context Heads are Two Towers for Metric Learning
di: Yu, Zeping, et al.
Pubblicazione: (2024)
di: Yu, Zeping, et al.
Pubblicazione: (2024)
LQ-LoRA: Low-rank Plus Quantized Matrix Decomposition for Efficient Language Model Finetuning
di: Guo, Han, et al.
Pubblicazione: (2023)
di: Guo, Han, et al.
Pubblicazione: (2023)
Online Adaptation of Language Models with a Memory of Amortized Contexts
di: Tack, Jihoon, et al.
Pubblicazione: (2024)
di: Tack, Jihoon, et al.
Pubblicazione: (2024)
Revisiting In-Context Learning with Long Context Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
Online Rubrics Elicitation from Pairwise Comparisons
di: Rezaei, MohammadHossein, et al.
Pubblicazione: (2025)
di: Rezaei, MohammadHossein, et al.
Pubblicazione: (2025)
On Next-Token Prediction in LLMs: How End Goals Determine the Consistency of Decoding Algorithms
di: Trauger, Jacob, et al.
Pubblicazione: (2025)
di: Trauger, Jacob, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Surprising Effectiveness of Test-Time Training for Few-Shot Learning
di: Akyürek, Ekin, et al.
Pubblicazione: (2024) -
Is Active Persona Inference Necessary for Aligning Small Models to Personal Preferences?
di: Tang, Zilu, et al.
Pubblicazione: (2025) -
Learning Linear Attention in Polynomial Time
di: Yau, Morris, et al.
Pubblicazione: (2024) -
Learning to Decode Collaboratively with Multiple Language Models
di: Shen, Shannon Zejiang, et al.
Pubblicazione: (2024) -
Deductive Closure Training of Language Models for Coherence, Accuracy, and Updatability
di: Akyürek, Afra Feyza, et al.
Pubblicazione: (2024)