Auto-ICL: In-Context Learning without Human Supervision
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Jinghan, Ma, Shuming, Wei, Furu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RetICL: Sequential Retrieval of In-Context Examples with Reinforcement Learning
di: Scarlatos, Alexander, et al.
Pubblicazione: (2023)
di: Scarlatos, Alexander, et al.
Pubblicazione: (2023)
IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning
di: Mishra, Aayush, et al.
Pubblicazione: (2025)
di: Mishra, Aayush, et al.
Pubblicazione: (2025)
CoT-ICL Lab: A Synthetic Framework for Studying Chain-of-Thought Learning from In-Context Demonstrations
di: Kothapalli, Vignesh, et al.
Pubblicazione: (2025)
di: Kothapalli, Vignesh, et al.
Pubblicazione: (2025)
Stress-Testing Long-Context Language Models with Lifelong ICL and Task Haystack
di: Xu, Xiaoyue, et al.
Pubblicazione: (2024)
di: Xu, Xiaoyue, et al.
Pubblicazione: (2024)
In-context Autoencoder for Context Compression in a Large Language Model
di: Ge, Tao, et al.
Pubblicazione: (2023)
di: Ge, Tao, et al.
Pubblicazione: (2023)
Boosting In-Context Learning in LLMs Through the Lens of Classical Supervised Learning
di: Gundem, Korel, et al.
Pubblicazione: (2025)
di: Gundem, Korel, et al.
Pubblicazione: (2025)
Towards Thinking-Optimal Scaling of Test-Time Compute for LLM Reasoning
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
di: Yang, Wenkai, et al.
Pubblicazione: (2025)
BitNet a4.8: 4-bit Activations for 1-bit LLMs
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
BitNet v2: Native 4-bit Activations with Hadamard Transformation for 1-bit LLMs
di: Wang, Hongyu, et al.
Pubblicazione: (2025)
di: Wang, Hongyu, et al.
Pubblicazione: (2025)
Selection-p: Self-Supervised Task-Agnostic Prompt Compression for Faithfulness and Transferability
di: Chung, Tsz Ting, et al.
Pubblicazione: (2024)
di: Chung, Tsz Ting, et al.
Pubblicazione: (2024)
Legal2LogicICL: Improving Generalization in Transforming Legal Cases to Logical Formulas via Diverse Few-Shot Learning
di: Xue, Jieying, et al.
Pubblicazione: (2026)
di: Xue, Jieying, et al.
Pubblicazione: (2026)
Aligning Human and Machine Attention for Enhanced Supervised Learning
di: Chriqui, Avihay, et al.
Pubblicazione: (2025)
di: Chriqui, Avihay, et al.
Pubblicazione: (2025)
Meta-Sel: Efficient Demonstration Selection for In-Context Learning via Supervised Meta-Learning
di: Wang, Xubin, et al.
Pubblicazione: (2026)
di: Wang, Xubin, et al.
Pubblicazione: (2026)
Learning from Reference Answers: Versatile Language Model Alignment without Binary Human Preference Data
di: Zhao, Shuai, et al.
Pubblicazione: (2025)
di: Zhao, Shuai, et al.
Pubblicazione: (2025)
Textual Aesthetics in Large Language Models
di: Jiang, Lingjie, et al.
Pubblicazione: (2024)
di: Jiang, Lingjie, et al.
Pubblicazione: (2024)
Multi-Head Mixture-of-Experts
di: Wu, Xun, et al.
Pubblicazione: (2024)
di: Wu, Xun, et al.
Pubblicazione: (2024)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
di: Tang, Zhengyang, et al.
Pubblicazione: (2024)
di: Tang, Zhengyang, et al.
Pubblicazione: (2024)
AutoLibra: Agent Metric Induction from Open-Ended Human Feedback
di: Zhu, Hao, et al.
Pubblicazione: (2025)
di: Zhu, Hao, et al.
Pubblicazione: (2025)
Bitnet.cpp: Efficient Edge Inference for Ternary LLMs
di: Wang, Jinheng, et al.
Pubblicazione: (2025)
di: Wang, Jinheng, et al.
Pubblicazione: (2025)
Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
di: Wang, Qibin, et al.
Pubblicazione: (2025)
di: Wang, Qibin, et al.
Pubblicazione: (2025)
AutoFAIR : Automatic Data FAIRification via Machine Reading
di: Ma, Tingyan, et al.
Pubblicazione: (2024)
di: Ma, Tingyan, et al.
Pubblicazione: (2024)
Easy-to-Hard Generalization: Scalable Alignment Beyond Human Supervision
di: Sun, Zhiqing, et al.
Pubblicazione: (2024)
di: Sun, Zhiqing, et al.
Pubblicazione: (2024)
Scaling Optimal LR Across Token Horizons
di: Bjorck, Johan, et al.
Pubblicazione: (2024)
di: Bjorck, Johan, et al.
Pubblicazione: (2024)
Wings: Learning Multimodal LLMs without Text-only Forgetting
di: Zhang, Yi-Kai, et al.
Pubblicazione: (2024)
di: Zhang, Yi-Kai, et al.
Pubblicazione: (2024)
Internalizing Outcome Supervision into Process Supervision: A New Paradigm for Reinforcement Learning for Reasoning
di: Ding, Fei, et al.
Pubblicazione: (2026)
di: Ding, Fei, et al.
Pubblicazione: (2026)
Q-Sparse: All Large Language Models can be Fully Sparsely-Activated
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
Guided Self-Evolving LLMs with Minimal Human Supervision
di: Yu, Wenhao, et al.
Pubblicazione: (2025)
di: Yu, Wenhao, et al.
Pubblicazione: (2025)
Towards Scalable Oversight via Partitioned Human Supervision
di: Yin, Ren, et al.
Pubblicazione: (2025)
di: Yin, Ren, et al.
Pubblicazione: (2025)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
ICLR: In-Context Learning of Representations
di: Park, Core Francisco, et al.
Pubblicazione: (2024)
di: Park, Core Francisco, et al.
Pubblicazione: (2024)
SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
Is In-Context Learning Learning?
di: de Wynter, Adrian
Pubblicazione: (2025)
di: de Wynter, Adrian
Pubblicazione: (2025)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
di: Tang, Yao, et al.
Pubblicazione: (2026)
di: Tang, Yao, et al.
Pubblicazione: (2026)
Scaling Reasoning without Attention
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
Generative Representational Instruction Tuning
di: Muennighoff, Niklas, et al.
Pubblicazione: (2024)
di: Muennighoff, Niklas, et al.
Pubblicazione: (2024)
Self-Harmony: Learning to Harmonize Self-Supervision and Self-Play in Test-Time Reinforcement Learning
di: Wang, Ru, et al.
Pubblicazione: (2025)
di: Wang, Ru, et al.
Pubblicazione: (2025)
Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations
di: Wang, Peiyi, et al.
Pubblicazione: (2023)
di: Wang, Peiyi, et al.
Pubblicazione: (2023)
Memorization in In-Context Learning
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
Revisiting In-Context Learning with Long Context Language Models
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
di: Baek, Jinheon, et al.
Pubblicazione: (2024)
Context Tuning for In-Context Optimization
di: Lu, Jack, et al.
Pubblicazione: (2025)
di: Lu, Jack, et al.
Pubblicazione: (2025)
Documenti analoghi
-
RetICL: Sequential Retrieval of In-Context Examples with Reinforcement Learning
di: Scarlatos, Alexander, et al.
Pubblicazione: (2023) -
IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning
di: Mishra, Aayush, et al.
Pubblicazione: (2025) -
CoT-ICL Lab: A Synthetic Framework for Studying Chain-of-Thought Learning from In-Context Demonstrations
di: Kothapalli, Vignesh, et al.
Pubblicazione: (2025) -
Stress-Testing Long-Context Language Models with Lifelong ICL and Task Haystack
di: Xu, Xiaoyue, et al.
Pubblicazione: (2024) -
In-context Autoencoder for Context Compression in a Large Language Model
di: Ge, Tao, et al.
Pubblicazione: (2023)