$Se^2$: Sequential Example Selection for In-Context Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Haoyu, Liu, Jianfeng, Huang, Shaohan, Zhan, Yuefeng, Sun, Hao, Deng, Weiwei, Wei, Furu, Zhang, Qi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
GeAR: Generation Augmented Retrieval
von: Liu, Haoyu, et al.
Veröffentlicht: (2025)
von: Liu, Haoyu, et al.
Veröffentlicht: (2025)
MAIN: Mutual Alignment Is Necessary for instruction tuning
von: Yang, Fanyi, et al.
Veröffentlicht: (2025)
von: Yang, Fanyi, et al.
Veröffentlicht: (2025)
HD-Eval: Aligning Large Language Model Evaluators Through Hierarchical Criteria Decomposition
von: Liu, Yuxuan, et al.
Veröffentlicht: (2024)
von: Liu, Yuxuan, et al.
Veröffentlicht: (2024)
On-Policy Context Distillation for Language Models
von: Ye, Tianzhu, et al.
Veröffentlicht: (2026)
von: Ye, Tianzhu, et al.
Veröffentlicht: (2026)
Text Diffusion with Reinforced Conditioning
von: Liu, Yuxuan, et al.
Veröffentlicht: (2024)
von: Liu, Yuxuan, et al.
Veröffentlicht: (2024)
Adapting Large Language Models to Domains via Reading Comprehension
von: Cheng, Daixuan, et al.
Veröffentlicht: (2023)
von: Cheng, Daixuan, et al.
Veröffentlicht: (2023)
Learning to Retrieve In-Context Examples for Large Language Models
von: Wang, Liang, et al.
Veröffentlicht: (2023)
von: Wang, Liang, et al.
Veröffentlicht: (2023)
Effective In-Context Example Selection through Data Compression
von: Sun, Zhongxiang, et al.
Veröffentlicht: (2024)
von: Sun, Zhongxiang, et al.
Veröffentlicht: (2024)
Context-DPO: Aligning Language Models for Context-Faithfulness
von: Bi, Baolong, et al.
Veröffentlicht: (2024)
von: Bi, Baolong, et al.
Veröffentlicht: (2024)
Mixture of LoRA Experts
von: Wu, Xun, et al.
Veröffentlicht: (2024)
von: Wu, Xun, et al.
Veröffentlicht: (2024)
ResLoRA: Identity Residual Mapping in Low-Rank Adaption
von: Shi, Shuhua, et al.
Veröffentlicht: (2024)
von: Shi, Shuhua, et al.
Veröffentlicht: (2024)
Improving Domain Adaptation through Extended-Text Reading Comprehension
von: Jiang, Ting, et al.
Veröffentlicht: (2024)
von: Jiang, Ting, et al.
Veröffentlicht: (2024)
MH-MoE: Multi-Head Mixture-of-Experts
von: Huang, Shaohan, et al.
Veröffentlicht: (2024)
von: Huang, Shaohan, et al.
Veröffentlicht: (2024)
Kosmos-G: Generating Images in Context with Multimodal Large Language Models
von: Pan, Xichen, et al.
Veröffentlicht: (2023)
von: Pan, Xichen, et al.
Veröffentlicht: (2023)
StreamAdapter: Efficient Test Time Adaptation from Contextual Streams
von: Muhtar, Dilxat, et al.
Veröffentlicht: (2024)
von: Muhtar, Dilxat, et al.
Veröffentlicht: (2024)
MoRA: High-Rank Updating for Parameter-Efficient Fine-Tuning
von: Jiang, Ting, et al.
Veröffentlicht: (2024)
von: Jiang, Ting, et al.
Veröffentlicht: (2024)
Online Experiential Learning for Language Models
von: Ye, Tianzhu, et al.
Veröffentlicht: (2026)
von: Ye, Tianzhu, et al.
Veröffentlicht: (2026)
Universal YOCO for Efficient Depth Scaling
von: Sun, Yutao, et al.
Veröffentlicht: (2026)
von: Sun, Yutao, et al.
Veröffentlicht: (2026)
Textual Aesthetics in Large Language Models
von: Jiang, Lingjie, et al.
Veröffentlicht: (2024)
von: Jiang, Lingjie, et al.
Veröffentlicht: (2024)
Multi-Head Mixture-of-Experts
von: Wu, Xun, et al.
Veröffentlicht: (2024)
von: Wu, Xun, et al.
Veröffentlicht: (2024)
The Era of Agentic Organization: Learning to Organize with Language Models
von: Chi, Zewen, et al.
Veröffentlicht: (2025)
von: Chi, Zewen, et al.
Veröffentlicht: (2025)
On-Policy RL with Optimal Reward Baseline
von: Hao, Yaru, et al.
Veröffentlicht: (2025)
von: Hao, Yaru, et al.
Veröffentlicht: (2025)
Instruction Pre-Training: Language Models are Supervised Multitask Learners
von: Cheng, Daixuan, et al.
Veröffentlicht: (2024)
von: Cheng, Daixuan, et al.
Veröffentlicht: (2024)
Thinking Augmented Pre-training
von: Wang, Liang, et al.
Veröffentlicht: (2025)
von: Wang, Liang, et al.
Veröffentlicht: (2025)
MTL-LoRA: Low-Rank Adaptation for Multi-Task Learning
von: Yang, Yaming, et al.
Veröffentlicht: (2024)
von: Yang, Yaming, et al.
Veröffentlicht: (2024)
Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts
von: Zhang, Di, et al.
Veröffentlicht: (2025)
von: Zhang, Di, et al.
Veröffentlicht: (2025)
RetICL: Sequential Retrieval of In-Context Examples with Reinforcement Learning
von: Scarlatos, Alexander, et al.
Veröffentlicht: (2023)
von: Scarlatos, Alexander, et al.
Veröffentlicht: (2023)
VisCodex: Unified Multimodal Code Generation via Merging Vision and Coding Models
von: Jiang, Lingjie, et al.
Veröffentlicht: (2025)
von: Jiang, Lingjie, et al.
Veröffentlicht: (2025)
Black-Box On-Policy Distillation of Large Language Models
von: Ye, Tianzhu, et al.
Veröffentlicht: (2025)
von: Ye, Tianzhu, et al.
Veröffentlicht: (2025)
Reasoning with Exploration: An Entropy Perspective
von: Cheng, Daixuan, et al.
Veröffentlicht: (2025)
von: Cheng, Daixuan, et al.
Veröffentlicht: (2025)
Unlocking the Power of LLM Uncertainty for Active In-Context Example Selection
von: Huang, Hsiu-Yuan, et al.
Veröffentlicht: (2024)
von: Huang, Hsiu-Yuan, et al.
Veröffentlicht: (2024)
Reward Reasoning Model
von: Guo, Jiaxin, et al.
Veröffentlicht: (2025)
von: Guo, Jiaxin, et al.
Veröffentlicht: (2025)
Learning Metadata-Agnostic Representations for Text-to-SQL In-Context Example Selection
von: Mai, Chuhong, et al.
Veröffentlicht: (2024)
von: Mai, Chuhong, et al.
Veröffentlicht: (2024)
You Only Cache Once: Decoder-Decoder Architectures for Language Models
von: Sun, Yutao, et al.
Veröffentlicht: (2024)
von: Sun, Yutao, et al.
Veröffentlicht: (2024)
BitNet b1.58 2B4T Technical Report
von: Ma, Shuming, et al.
Veröffentlicht: (2025)
von: Ma, Shuming, et al.
Veröffentlicht: (2025)
Code Aesthetics with Agentic Reward Feedback
von: Xiao, Bang, et al.
Veröffentlicht: (2025)
von: Xiao, Bang, et al.
Veröffentlicht: (2025)
Auto-ICL: In-Context Learning without Human Supervision
von: Yang, Jinghan, et al.
Veröffentlicht: (2023)
von: Yang, Jinghan, et al.
Veröffentlicht: (2023)
Bootstrap Your Own Context Length
von: Wang, Liang, et al.
Veröffentlicht: (2024)
von: Wang, Liang, et al.
Veröffentlicht: (2024)
GistScore: Learning Better Representations for In-Context Example Selection with Gist Bottlenecks
von: Gupta, Shivanshu, et al.
Veröffentlicht: (2023)
von: Gupta, Shivanshu, et al.
Veröffentlicht: (2023)
Geometric-Mean Policy Optimization
von: Zhao, Yuzhong, et al.
Veröffentlicht: (2025)
von: Zhao, Yuzhong, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
GeAR: Generation Augmented Retrieval
von: Liu, Haoyu, et al.
Veröffentlicht: (2025) -
MAIN: Mutual Alignment Is Necessary for instruction tuning
von: Yang, Fanyi, et al.
Veröffentlicht: (2025) -
HD-Eval: Aligning Large Language Model Evaluators Through Hierarchical Criteria Decomposition
von: Liu, Yuxuan, et al.
Veröffentlicht: (2024) -
On-Policy Context Distillation for Language Models
von: Ye, Tianzhu, et al.
Veröffentlicht: (2026) -
Text Diffusion with Reinforced Conditioning
von: Liu, Yuxuan, et al.
Veröffentlicht: (2024)