Why does in-context learning fail sometimes? Evaluating in-context learning on open and closed questions
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Xiang, Tang, Haoran, Chen, Siyu, Wang, Ziwei, Chen, Ryan, Abram, Marcin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models
por: Qiu, Yifu, et al.
Publicado: (2025)
por: Qiu, Yifu, et al.
Publicado: (2025)
LLM2IR: simple unsupervised contrastive learning makes long-context LLM great retriever
por: Yang, Xiaocong
Publicado: (2025)
por: Yang, Xiaocong
Publicado: (2025)
In-context Learning with Retrieved Demonstrations for Language Models: A Survey
por: Luo, Man, et al.
Publicado: (2024)
por: Luo, Man, et al.
Publicado: (2024)
OpenMedLM: Prompt engineering can out-perform fine-tuning in medical question-answering with open-source large language models
por: Maharjan, Jenish, et al.
Publicado: (2024)
por: Maharjan, Jenish, et al.
Publicado: (2024)
A Survey of Multimodal Retrieval-Augmented Generation
por: Mei, Lang, et al.
Publicado: (2025)
por: Mei, Lang, et al.
Publicado: (2025)
Overview of the TREC 2022 deep learning track
por: Craswell, Nick, et al.
Publicado: (2025)
por: Craswell, Nick, et al.
Publicado: (2025)
Overview of the TREC 2023 deep learning track
por: Craswell, Nick, et al.
Publicado: (2025)
por: Craswell, Nick, et al.
Publicado: (2025)
Overview of the TREC 2021 deep learning track
por: Craswell, Nick, et al.
Publicado: (2025)
por: Craswell, Nick, et al.
Publicado: (2025)
On conceptualisation and an overview of learning path recommender systems in e-learning
por: Fuster-López, A., et al.
Publicado: (2024)
por: Fuster-López, A., et al.
Publicado: (2024)
LORE: A Large Generative Model for Search Relevance
por: Lu, Chenji, et al.
Publicado: (2025)
por: Lu, Chenji, et al.
Publicado: (2025)
Explicit v.s. Implicit Memory: Exploring Multi-hop Complex Reasoning Over Personalized Information
por: Zhang, Zeyu, et al.
Publicado: (2025)
por: Zhang, Zeyu, et al.
Publicado: (2025)
InnoEval: On Research Idea Evaluation as a Knowledge-Grounded, Multi-Perspective Reasoning Problem
por: Qiao, Shuofei, et al.
Publicado: (2026)
por: Qiao, Shuofei, et al.
Publicado: (2026)
Answering real-world clinical questions using large language model based systems
por: Low, Yen Sia, et al.
Publicado: (2024)
por: Low, Yen Sia, et al.
Publicado: (2024)
Reflect then Learn: Active Prompting for Information Extraction Guided by Introspective Confusion
por: Zhao, Dong, et al.
Publicado: (2025)
por: Zhao, Dong, et al.
Publicado: (2025)
Multiview graph dual-attention deep learning and contrastive learning for multi-criteria recommender systems
por: Forouzandeh, Saman, et al.
Publicado: (2025)
por: Forouzandeh, Saman, et al.
Publicado: (2025)
Why Do Open-Source LLMs Struggle with Data Analysis? A Systematic Empirical Study
por: Zhu, Yuqi, et al.
Publicado: (2025)
por: Zhu, Yuqi, et al.
Publicado: (2025)
Improving Crash Data Quality with Large Language Models: Evidence from Secondary Crash Narratives in Kentucky
por: Zhang, Xu, et al.
Publicado: (2025)
por: Zhang, Xu, et al.
Publicado: (2025)
RAVine: Reality-Aligned Evaluation for Agentic Search
por: Xu, Yilong, et al.
Publicado: (2025)
por: Xu, Yilong, et al.
Publicado: (2025)
OneGen: Efficient One-Pass Unified Generation and Retrieval for LLMs
por: Zhang, Jintian, et al.
Publicado: (2024)
por: Zhang, Jintian, et al.
Publicado: (2024)
Reasoning and Tools for Human-Level Forecasting
por: Hsieh, Elvis, et al.
Publicado: (2024)
por: Hsieh, Elvis, et al.
Publicado: (2024)
Planning and Editing What You Retrieve for Enhanced Tool Learning
por: Huang, Tenghao, et al.
Publicado: (2024)
por: Huang, Tenghao, et al.
Publicado: (2024)
TableRAG: Million-Token Table Understanding with Language Models
por: Chen, Si-An, et al.
Publicado: (2024)
por: Chen, Si-An, et al.
Publicado: (2024)
SimRAG: Self-Improving Retrieval-Augmented Generation for Adapting Large Language Models to Specialized Domains
por: Xu, Ran, et al.
Publicado: (2024)
por: Xu, Ran, et al.
Publicado: (2024)
Efficient Evaluation of Large Language Models via Collaborative Filtering
por: Zhong, Xu-Xiang, et al.
Publicado: (2025)
por: Zhong, Xu-Xiang, et al.
Publicado: (2025)
Unified Hallucination Detection for Multimodal Large Language Models
por: Chen, Xiang, et al.
Publicado: (2024)
por: Chen, Xiang, et al.
Publicado: (2024)
Ev2R: Evaluating Evidence Retrieval in Automated Fact-Checking
por: Akhtar, Mubashara, et al.
Publicado: (2024)
por: Akhtar, Mubashara, et al.
Publicado: (2024)
Evaluating and Enhancing Large Language Models for Novelty Assessment in Scholarly Publications
por: Lin, Ethan, et al.
Publicado: (2024)
por: Lin, Ethan, et al.
Publicado: (2024)
Online and Offline Evaluations of Collaborative Filtering and Content Based Recommender Systems
por: Elahi, Ali, et al.
Publicado: (2024)
por: Elahi, Ali, et al.
Publicado: (2024)
Ground-Truth Subgraphs for Better Training and Evaluation of Knowledge Graph Augmented LLMs
por: Cattaneo, Alberto, et al.
Publicado: (2025)
por: Cattaneo, Alberto, et al.
Publicado: (2025)
Inside CORE-KG: Evaluating Structured Prompting and Coreference Resolution for Knowledge Graphs
por: Meher, Dipak, et al.
Publicado: (2025)
por: Meher, Dipak, et al.
Publicado: (2025)
Beyond Relevance: Utility-Centric Retrieval in the LLM Era
por: Zhang, Hengran, et al.
Publicado: (2026)
por: Zhang, Hengran, et al.
Publicado: (2026)
Science Consultant Agent
por: K, Karthikeyan, et al.
Publicado: (2025)
por: K, Karthikeyan, et al.
Publicado: (2025)
Sequential LLM Framework for Fashion Recommendation
por: Liu, Han, et al.
Publicado: (2024)
por: Liu, Han, et al.
Publicado: (2024)
Apollonion: Profile-centric Dialog Agent
por: Chen, Shangyu, et al.
Publicado: (2024)
por: Chen, Shangyu, et al.
Publicado: (2024)
LongRecall: A Structured Approach for Robust Recall Evaluation in Long-Form Text
por: Ardestani, MohamamdJavad, et al.
Publicado: (2025)
por: Ardestani, MohamamdJavad, et al.
Publicado: (2025)
Approaching Human-Level Forecasting with Language Models
por: Halawi, Danny, et al.
Publicado: (2024)
por: Halawi, Danny, et al.
Publicado: (2024)
RAG Playground: A Framework for Systematic Evaluation of Retrieval Strategies and Prompt Engineering in RAG Systems
por: Papadimitriou, Ioannis, et al.
Publicado: (2024)
por: Papadimitriou, Ioannis, et al.
Publicado: (2024)
PaCE: Parsimonious Concept Engineering for Large Language Models
por: Luo, Jinqi, et al.
Publicado: (2024)
por: Luo, Jinqi, et al.
Publicado: (2024)
Familiarity-Aware Evidence Compression for Retrieval-Augmented Generation
por: Jung, Dongwon, et al.
Publicado: (2024)
por: Jung, Dongwon, et al.
Publicado: (2024)
SmartChunk Retrieval: Query-Aware Chunk Compression with Planning for Efficient Document RAG
por: Zhang, Xuechen, et al.
Publicado: (2025)
por: Zhang, Xuechen, et al.
Publicado: (2025)
Ejemplares similares
-
Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models
por: Qiu, Yifu, et al.
Publicado: (2025) -
LLM2IR: simple unsupervised contrastive learning makes long-context LLM great retriever
por: Yang, Xiaocong
Publicado: (2025) -
In-context Learning with Retrieved Demonstrations for Language Models: A Survey
por: Luo, Man, et al.
Publicado: (2024) -
OpenMedLM: Prompt engineering can out-perform fine-tuning in medical question-answering with open-source large language models
por: Maharjan, Jenish, et al.
Publicado: (2024) -
A Survey of Multimodal Retrieval-Augmented Generation
por: Mei, Lang, et al.
Publicado: (2025)