Are Emergent Abilities in Large Language Models just In-Context Learning?
Fuente:
arXiv
Salvato in:
| Autori principali: | Lu, Sheng, Bigoulaeva, Irina, Sachdeva, Rachneet, Madabushi, Harish Tayyar, Gurevych, Iryna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Inherent Limits of Pretrained LLMs: The Unexpected Convergence of Instruction Tuning and In-Context Learning Capabilities
di: Bigoulaeva, Irina, et al.
Pubblicazione: (2025)
di: Bigoulaeva, Irina, et al.
Pubblicazione: (2025)
FS-RAG: A Frame Semantics Based Approach for Improved Factual Accuracy in Large Language Models
di: Madabushi, Harish Tayyar
Pubblicazione: (2024)
di: Madabushi, Harish Tayyar
Pubblicazione: (2024)
Illusion or Algorithm? Investigating Memorization, Emergence, and Symbolic Processing in In-Context Learning
di: Niu, Jingcheng, et al.
Pubblicazione: (2025)
di: Niu, Jingcheng, et al.
Pubblicazione: (2025)
Turning Logic Against Itself : Probing Model Defenses Through Contrastive Questions
di: Sachdeva, Rachneet, et al.
Pubblicazione: (2025)
di: Sachdeva, Rachneet, et al.
Pubblicazione: (2025)
Patches of Nonlinearity: Instruction Vectors in Large Language Models
di: Bigoulaeva, Irina, et al.
Pubblicazione: (2026)
di: Bigoulaeva, Irina, et al.
Pubblicazione: (2026)
CATfOOD: Counterfactual Augmented Training for Improving Out-of-Domain Performance and Calibration
di: Sachdeva, Rachneet, et al.
Pubblicazione: (2023)
di: Sachdeva, Rachneet, et al.
Pubblicazione: (2023)
SpeciaLex: A Benchmark for In-Context Specialized Lexicon Learning
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2024)
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2024)
Fine-Tuning on Diverse Reasoning Chains Drives Within-Inference CoT Refinement in LLMs
di: Puerto, Haritz, et al.
Pubblicazione: (2024)
di: Puerto, Haritz, et al.
Pubblicazione: (2024)
Localizing and Mitigating Errors in Long-form Question Answering
di: Sachdeva, Rachneet, et al.
Pubblicazione: (2024)
di: Sachdeva, Rachneet, et al.
Pubblicazione: (2024)
Evaluating Large Language Models on Multiword Expressions in Multilingual and Code-Switched Contexts
di: De Leon, Frances Laureano, et al.
Pubblicazione: (2025)
di: De Leon, Frances Laureano, et al.
Pubblicazione: (2025)
Scaling Policy Compliance Assessment in Language Models with Policy Reasoning Traces
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2025)
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2025)
Pre-Trained Language Models Represent Some Geographic Populations Better Than Others
di: Dunn, Jonathan, et al.
Pubblicazione: (2024)
di: Dunn, Jonathan, et al.
Pubblicazione: (2024)
Neither Stochastic Parroting nor AGI: LLMs Solve Tasks through Context-Directed Extrapolation from Training Data Priors
di: Madabushi, Harish Tayyar, et al.
Pubblicazione: (2025)
di: Madabushi, Harish Tayyar, et al.
Pubblicazione: (2025)
Standardize: Aligning Language Models with Expert-Defined Standards for Content Generation
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2024)
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2024)
Safer Policy Compliance with Dynamic Epistemic Fallback
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2026)
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2026)
Evaluating CxG Generalisation in LLMs via Construction-Based NLI Fine Tuning
di: Mackintosh, Tom, et al.
Pubblicazione: (2025)
di: Mackintosh, Tom, et al.
Pubblicazione: (2025)
Dancing with Deer: A Constructional Perspective on MWEs in the Era of LLMs
di: Bonial, Claire, et al.
Pubblicazione: (2025)
di: Bonial, Claire, et al.
Pubblicazione: (2025)
Hypothesis-Driven Feature Manifold Analysis in LLMs via Supervised Multi-Dimensional Scaling
di: Tiblias, Federico, et al.
Pubblicazione: (2025)
di: Tiblias, Federico, et al.
Pubblicazione: (2025)
Word Boundary Information Isn't Useful for Encoder Language Models
di: Gow-Smith, Edward, et al.
Pubblicazione: (2024)
di: Gow-Smith, Edward, et al.
Pubblicazione: (2024)
Code-Mixed Probes Show How Pre-Trained Models Generalise On Code-Switched Text
di: De Leon, Frances A. Laureano, et al.
Pubblicazione: (2024)
di: De Leon, Frances A. Laureano, et al.
Pubblicazione: (2024)
Standardizing Intelligence: Aligning Generative AI for Regulatory and Operational Compliance
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2025)
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2025)
Beyond Memorization: Assessing Semantic Generalization in Large Language Models Using Phrasal Constructions
di: Scivetti, Wesley, et al.
Pubblicazione: (2025)
di: Scivetti, Wesley, et al.
Pubblicazione: (2025)
Adapting Whisper for Regional Dialects: Enhancing Public Services for Vulnerable Populations in the United Kingdom
di: Torgbi, Melissa, et al.
Pubblicazione: (2025)
di: Torgbi, Melissa, et al.
Pubblicazione: (2025)
Attribute or Abstain: Large Language Models as Long Document Assistants
di: Buchmann, Jan, et al.
Pubblicazione: (2024)
di: Buchmann, Jan, et al.
Pubblicazione: (2024)
Robust Utility-Preserving Text Anonymization Based on Large Language Models
di: Yang, Tianyu, et al.
Pubblicazione: (2024)
di: Yang, Tianyu, et al.
Pubblicazione: (2024)
How are Prompts Different in Terms of Sensitivity?
di: Lu, Sheng, et al.
Pubblicazione: (2023)
di: Lu, Sheng, et al.
Pubblicazione: (2023)
Identifying Aspects in Peer Reviews
di: Lu, Sheng, et al.
Pubblicazione: (2025)
di: Lu, Sheng, et al.
Pubblicazione: (2025)
Are Large Language Models Good Classifiers? A Study on Edit Intent Classification in Scientific Document Revisions
di: Ruan, Qian, et al.
Pubblicazione: (2024)
di: Ruan, Qian, et al.
Pubblicazione: (2024)
Cultural Learning-Based Culture Adaptation of Language Models
di: Liu, Chen Cecilia, et al.
Pubblicazione: (2025)
di: Liu, Chen Cecilia, et al.
Pubblicazione: (2025)
Token Weighting for Long-Range Language Modeling
di: Helm, Falko, et al.
Pubblicazione: (2025)
di: Helm, Falko, et al.
Pubblicazione: (2025)
Differentially Private Steering for Large Language Model Alignment
di: Goel, Anmol, et al.
Pubblicazione: (2025)
di: Goel, Anmol, et al.
Pubblicazione: (2025)
How Quantization Shapes Bias in Large Language Models
di: Marcuzzi, Federico, et al.
Pubblicazione: (2025)
di: Marcuzzi, Federico, et al.
Pubblicazione: (2025)
ConspirED: A Dataset for Cognitive Traits of Conspiracy Theories and Large Language Model Safety
di: Bates, Luke, et al.
Pubblicazione: (2025)
di: Bates, Luke, et al.
Pubblicazione: (2025)
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
di: Paul, Indraneil, et al.
Pubblicazione: (2024)
di: Paul, Indraneil, et al.
Pubblicazione: (2024)
Multimodal Large Language Models to Support Real-World Fact-Checking
di: Geng, Jiahui, et al.
Pubblicazione: (2024)
di: Geng, Jiahui, et al.
Pubblicazione: (2024)
Code Prompting Elicits Conditional Reasoning Abilities in Text+Code LLMs
di: Puerto, Haritz, et al.
Pubblicazione: (2024)
di: Puerto, Haritz, et al.
Pubblicazione: (2024)
Transforming Scholarly Landscapes: Influence of Large Language Models on Academic Fields beyond Computer Science
di: Pramanick, Aniket, et al.
Pubblicazione: (2024)
di: Pramanick, Aniket, et al.
Pubblicazione: (2024)
Like a Good Nearest Neighbor: Practical Content Moderation and Text Classification
di: Bates, Luke, et al.
Pubblicazione: (2023)
di: Bates, Luke, et al.
Pubblicazione: (2023)
Automatic Reviewers Fail to Detect Faulty Reasoning in Research Papers: A New Counterfactual Evaluation Framework
di: Dycke, Nils, et al.
Pubblicazione: (2025)
di: Dycke, Nils, et al.
Pubblicazione: (2025)
Citation Failure: Definition, Analysis and Efficient Mitigation
di: Buchmann, Jan, et al.
Pubblicazione: (2025)
di: Buchmann, Jan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Inherent Limits of Pretrained LLMs: The Unexpected Convergence of Instruction Tuning and In-Context Learning Capabilities
di: Bigoulaeva, Irina, et al.
Pubblicazione: (2025) -
FS-RAG: A Frame Semantics Based Approach for Improved Factual Accuracy in Large Language Models
di: Madabushi, Harish Tayyar
Pubblicazione: (2024) -
Illusion or Algorithm? Investigating Memorization, Emergence, and Symbolic Processing in In-Context Learning
di: Niu, Jingcheng, et al.
Pubblicazione: (2025) -
Turning Logic Against Itself : Probing Model Defenses Through Contrastive Questions
di: Sachdeva, Rachneet, et al.
Pubblicazione: (2025) -
Patches of Nonlinearity: Instruction Vectors in Large Language Models
di: Bigoulaeva, Irina, et al.
Pubblicazione: (2026)