Large (Vision) Language Models are Unsupervised In-Context Learners
Fuente:
arXiv
Saved in:
| Main Authors: | Gadetsky, Artyom, Atanov, Andrei, Jiang, Yulun, Gao, Zhitong, Mighan, Ghazal Hosseini, Zamir, Amir, Brbic, Maria |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Let Go of Your Labels with Unsupervised Transfer
by: Gadetsky, Artyom, et al.
Published: (2024)
by: Gadetsky, Artyom, et al.
Published: (2024)
Unsupervised Process Reward Models
by: Gadetsky, Artyom, et al.
Published: (2026)
by: Gadetsky, Artyom, et al.
Published: (2026)
Fine-grained Classes and How to Find Them
by: Grcić, Matej, et al.
Published: (2024)
by: Grcić, Matej, et al.
Published: (2024)
ULTra: Unveiling Latent Token Interpretability in Transformer-Based Understanding and Segmentation
by: Hosseini, Hesam, et al.
Published: (2024)
by: Hosseini, Hesam, et al.
Published: (2024)
How Well Does GPT-4o Understand Vision? Evaluating Multimodal Foundation Models on Standard Computer Vision Tasks
by: Ramachandran, Rahul, et al.
Published: (2025)
by: Ramachandran, Rahul, et al.
Published: (2025)
Unraveling the Key Components of OOD Generalization via Diversification
by: Benoit, Harold, et al.
Published: (2023)
by: Benoit, Harold, et al.
Published: (2023)
PACER: Acyclic Causal Discovery from Large-Scale Interventional Data
by: Torné, Ramon Viñas, et al.
Published: (2026)
by: Torné, Ramon Viñas, et al.
Published: (2026)
Meta-RL Induces Exploration in Language Agents
by: Jiang, Yulun, et al.
Published: (2025)
by: Jiang, Yulun, et al.
Published: (2025)
Controlled Training Data Generation with Diffusion Models
by: Yeo, Teresa, et al.
Published: (2024)
by: Yeo, Teresa, et al.
Published: (2024)
Vision Language Models are In-Context Value Learners
by: Ma, Yecheng Jason, et al.
Published: (2024)
by: Ma, Yecheng Jason, et al.
Published: (2024)
Cross-domain Open-world Discovery
by: Wen, Shuo, et al.
Published: (2024)
by: Wen, Shuo, et al.
Published: (2024)
Are Large Language Models In-Context Graph Learners?
by: Li, Jintang, et al.
Published: (2025)
by: Li, Jintang, et al.
Published: (2025)
Large Language Models are Miscalibrated In-Context Learners
by: Li, Chengzu, et al.
Published: (2023)
by: Li, Chengzu, et al.
Published: (2023)
VideoFlexTok: Flexible-Length Coarse-to-Fine Video Tokenization
by: Atanov, Andrei, et al.
Published: (2026)
by: Atanov, Andrei, et al.
Published: (2026)
HeurekaBench: A Benchmarking Framework for AI Co-scientist
by: Panigrahi, Siba Smarak, et al.
Published: (2026)
by: Panigrahi, Siba Smarak, et al.
Published: (2026)
Solving Vision Tasks with Simple Photoreceptors Instead of Cameras
by: Atanov, Andrei, et al.
Published: (2024)
by: Atanov, Andrei, et al.
Published: (2024)
Vintix II: Decision Pre-Trained Transformer is a Scalable In-Context Reinforcement Learner
by: Polubarov, Andrei, et al.
Published: (2026)
by: Polubarov, Andrei, et al.
Published: (2026)
InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models
by: Hosseini, Sayed Mohammadreza Tayaranian, et al.
Published: (2026)
by: Hosseini, Sayed Mohammadreza Tayaranian, et al.
Published: (2026)
Excuse me, sir? Your language model is leaking (information)
by: Zamir, Or
Published: (2024)
by: Zamir, Or
Published: (2024)
A Note on Non-Composability of Layerwise Approximate Verification for Neural Inference
by: Zamir, Or
Published: (2026)
by: Zamir, Or
Published: (2026)
Weak-to-Strong Generalization under Distribution Shifts
by: Jeon, Myeongho, et al.
Published: (2025)
by: Jeon, Myeongho, et al.
Published: (2025)
Reward Is Enough: LLMs Are In-Context Reinforcement Learners
by: Song, Kefan, et al.
Published: (2025)
by: Song, Kefan, et al.
Published: (2025)
LLMs as In-Context Meta-Learners for Model and Hyperparameter Selection
by: Hili, Youssef Attia El, et al.
Published: (2025)
by: Hili, Youssef Attia El, et al.
Published: (2025)
Masked Autoencoders are PDE Learners
by: Zhou, Anthony, et al.
Published: (2024)
by: Zhou, Anthony, et al.
Published: (2024)
Are Large Language Models Good Temporal Graph Learners?
by: Huang, Shenyang, et al.
Published: (2025)
by: Huang, Shenyang, et al.
Published: (2025)
Physics-Informed Neural Networks: Minimizing Residual Loss with Wide Networks and Effective Activations
by: Dashtbayaz, Nima Hosseini, et al.
Published: (2024)
by: Dashtbayaz, Nima Hosseini, et al.
Published: (2024)
Context-Adaptive Multi-Prompt Embedding with Large Language Models for Vision-Language Alignment
by: Kim, Dahun, et al.
Published: (2025)
by: Kim, Dahun, et al.
Published: (2025)
Hybrid Efficient Unsupervised Anomaly Detection for Early Pandemic Case Identification
by: Ghajari, Ghazal, et al.
Published: (2024)
by: Ghajari, Ghazal, et al.
Published: (2024)
Large Language Models are Good Relational Learners
by: Wu, Fang, et al.
Published: (2025)
by: Wu, Fang, et al.
Published: (2025)
Large Language Models are Null-Shot Learners
by: Taveekitworachai, Pittawat, et al.
Published: (2024)
by: Taveekitworachai, Pittawat, et al.
Published: (2024)
Large Language Models are Biased Reinforcement Learners
by: Hayes, William M., et al.
Published: (2024)
by: Hayes, William M., et al.
Published: (2024)
Towards Modeling Learner Performance with Large Language Models
by: Neshaei, Seyed Parsa, et al.
Published: (2024)
by: Neshaei, Seyed Parsa, et al.
Published: (2024)
In-Context Clustering with Large Language Models
by: Wang, Ying, et al.
Published: (2025)
by: Wang, Ying, et al.
Published: (2025)
Benchmarking Optimizers for Large Language Model Pretraining
by: Semenov, Andrei, et al.
Published: (2025)
by: Semenov, Andrei, et al.
Published: (2025)
Linear Transformers are Versatile In-Context Learners
by: Vladymyrov, Max, et al.
Published: (2024)
by: Vladymyrov, Max, et al.
Published: (2024)
Revisiting the Platonic Representation Hypothesis: An Aristotelian View
by: Gröger, Fabian, et al.
Published: (2026)
by: Gröger, Fabian, et al.
Published: (2026)
4M-21: An Any-to-Any Vision Model for Tens of Tasks and Modalities
by: Bachmann, Roman, et al.
Published: (2024)
by: Bachmann, Roman, et al.
Published: (2024)
In-Context Function Learning in Large Language Models
by: Akata, Elif, et al.
Published: (2026)
by: Akata, Elif, et al.
Published: (2026)
Robust CLIP: Unsupervised Adversarial Fine-Tuning of Vision Embeddings for Robust Large Vision-Language Models
by: Schlarmann, Christian, et al.
Published: (2024)
by: Schlarmann, Christian, et al.
Published: (2024)
Transformers are Minimax Optimal Nonparametric In-Context Learners
by: Kim, Juno, et al.
Published: (2024)
by: Kim, Juno, et al.
Published: (2024)
Similar Items
-
Let Go of Your Labels with Unsupervised Transfer
by: Gadetsky, Artyom, et al.
Published: (2024) -
Unsupervised Process Reward Models
by: Gadetsky, Artyom, et al.
Published: (2026) -
Fine-grained Classes and How to Find Them
by: Grcić, Matej, et al.
Published: (2024) -
ULTra: Unveiling Latent Token Interpretability in Transformer-Based Understanding and Segmentation
by: Hosseini, Hesam, et al.
Published: (2024) -
How Well Does GPT-4o Understand Vision? Evaluating Multimodal Foundation Models on Standard Computer Vision Tasks
by: Ramachandran, Rahul, et al.
Published: (2025)