Language Models can Exploit Cross-Task In-context Learning for Data-Scarce Novel Tasks
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chatterjee, Anwoy, Tanwar, Eshaan, Dutta, Subhabrata, Chakraborty, Tanmoy |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Do You Know About My Nation? Investigating Multilingual Language Models' Cultural Literacy Through Factual Knowledge
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)
Multilingual LLMs Struggle to Link Orthography and Semantics in Bilingual Word Processing
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)
HIDE and Seek: Detecting Hallucinations in Language Models via Decoupled Representations
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025)
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025)
Mechanistic Behavior Editing of Language Models
von: Singh, Joykirat, et al.
Veröffentlicht: (2024)
von: Singh, Joykirat, et al.
Veröffentlicht: (2024)
Understanding the Effects of Domain Finetuning on LLMs
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)
$\texttt{LM}^\texttt{2}$: A Simple Society of Language Models Solves Complex Reasoning
von: Juneja, Gurusha, et al.
Veröffentlicht: (2024)
von: Juneja, Gurusha, et al.
Veröffentlicht: (2024)
Multilingual Language Models Encode Script Over Linguistic Structure
von: Verma, Aastha A K, et al.
Veröffentlicht: (2026)
von: Verma, Aastha A K, et al.
Veröffentlicht: (2026)
Can LLMs replace Neil deGrasse Tyson? Evaluating the Reliability of LLMs as Science Communicators
von: Bajpai, Prasoon, et al.
Veröffentlicht: (2024)
von: Bajpai, Prasoon, et al.
Veröffentlicht: (2024)
POSIX: A Prompt Sensitivity Index For Large Language Models
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2024)
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2024)
Small Language Models Fine-tuned to Coordinate Larger Language Models improve Complex Reasoning
von: Juneja, Gurusha, et al.
Veröffentlicht: (2023)
von: Juneja, Gurusha, et al.
Veröffentlicht: (2023)
How to think step-by-step: A mechanistic understanding of chain-of-thought reasoning
von: Dutta, Subhabrata, et al.
Veröffentlicht: (2024)
von: Dutta, Subhabrata, et al.
Veröffentlicht: (2024)
Co-FactChecker: A Framework for Human-AI Collaborative Claim Verification Using Large Reasoning Models
von: Sahnan, Dhruv, et al.
Veröffentlicht: (2026)
von: Sahnan, Dhruv, et al.
Veröffentlicht: (2026)
On the Effect of Instruction Tuning Loss on Generalization
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025)
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025)
Patches of Nonlinearity: Instruction Vectors in Large Language Models
von: Bigoulaeva, Irina, et al.
Veröffentlicht: (2026)
von: Bigoulaeva, Irina, et al.
Veröffentlicht: (2026)
Can LLMs reason over extended multilingual contexts? Towards long-context evaluation beyond retrieval and haystacks
von: Hengle, Amey, et al.
Veröffentlicht: (2025)
von: Hengle, Amey, et al.
Veröffentlicht: (2025)
Markovian ODE-guided scoring can assess the quality of offline reasoning traces in language models
von: Nandi, Arghodeep, et al.
Veröffentlicht: (2026)
von: Nandi, Arghodeep, et al.
Veröffentlicht: (2026)
Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling
von: Tamoyan, Hovhannes, et al.
Veröffentlicht: (2025)
von: Tamoyan, Hovhannes, et al.
Veröffentlicht: (2025)
Reward Modeling for Scientific Writing Evaluation
von: Şahinuç, Furkan, et al.
Veröffentlicht: (2026)
von: Şahinuç, Furkan, et al.
Veröffentlicht: (2026)
Information Anxiety in Large Language Models
von: Bajpai, Prasoon, et al.
Veröffentlicht: (2024)
von: Bajpai, Prasoon, et al.
Veröffentlicht: (2024)
Compression Laws for Large Language Models
von: Sengupta, Ayan, et al.
Veröffentlicht: (2025)
von: Sengupta, Ayan, et al.
Veröffentlicht: (2025)
From Images to Words: Efficient Cross-Modal Knowledge Distillation to Language Models from Black-box Teachers
von: Sengupta, Ayan, et al.
Veröffentlicht: (2026)
von: Sengupta, Ayan, et al.
Veröffentlicht: (2026)
The Art of Scaling Test-Time Compute for Large Language Models
von: Agarwal, Aradhye, et al.
Veröffentlicht: (2025)
von: Agarwal, Aradhye, et al.
Veröffentlicht: (2025)
Hierarchical Latent Structures in Data Generation Process Unify Mechanistic Phenomena across Scale
von: Rohweder, Jonas, et al.
Veröffentlicht: (2026)
von: Rohweder, Jonas, et al.
Veröffentlicht: (2026)
Innocence in the Crossfire: Roles of Skip Connections in Jailbreaking Visual Language Models
von: Nandi, Palash, et al.
Veröffentlicht: (2025)
von: Nandi, Palash, et al.
Veröffentlicht: (2025)
First Finish Search: Efficient Test-Time Scaling in Large Language Models
von: Agarwal, Aradhye, et al.
Veröffentlicht: (2025)
von: Agarwal, Aradhye, et al.
Veröffentlicht: (2025)
SemEval 2024 -- Task 10: Emotion Discovery and Reasoning its Flip in Conversation (EDiReF)
von: Kumar, Shivani, et al.
Veröffentlicht: (2024)
von: Kumar, Shivani, et al.
Veröffentlicht: (2024)
Exposing Long-Tail Safety Failures in Large Language Models through Efficient Diverse Response Sampling
von: Hajra, Suvadeep, et al.
Veröffentlicht: (2026)
von: Hajra, Suvadeep, et al.
Veröffentlicht: (2026)
Decoding Memes: Benchmarking Narrative Role Classification across Multilingual and Multimodal Models
von: Sharma, Shivam, et al.
Veröffentlicht: (2025)
von: Sharma, Shivam, et al.
Veröffentlicht: (2025)
PromptWizard: Task-Aware Prompt Optimization Framework
von: Agarwal, Eshaan, et al.
Veröffentlicht: (2024)
von: Agarwal, Eshaan, et al.
Veröffentlicht: (2024)
PIAST: Rapid Prompting with In-context Augmentation for Scarce Training data
von: Batorski, Pawel, et al.
Veröffentlicht: (2025)
von: Batorski, Pawel, et al.
Veröffentlicht: (2025)
You Only Prune Once: Designing Calibration-Free Model Compression With Policy Learning
von: Sengupta, Ayan, et al.
Veröffentlicht: (2025)
von: Sengupta, Ayan, et al.
Veröffentlicht: (2025)
Adapting Mental Health Prediction Tasks for Cross-lingual Learning via Meta-Training and In-context Learning with Large Language Model
von: Lifelo, Zita, et al.
Veröffentlicht: (2024)
von: Lifelo, Zita, et al.
Veröffentlicht: (2024)
Expert Preference-based Evaluation of Automated Related Work Generation
von: Şahinuç, Furkan, et al.
Veröffentlicht: (2025)
von: Şahinuç, Furkan, et al.
Veröffentlicht: (2025)
coTherapist: A Behavior-Aligned Small Language Model to Support Mental Healthcare Experts
von: Adhikary, Prottay Kumar, et al.
Veröffentlicht: (2026)
von: Adhikary, Prottay Kumar, et al.
Veröffentlicht: (2026)
Persona-aware Generative Model for Code-mixed Language
von: Sengupta, Ayan, et al.
Veröffentlicht: (2023)
von: Sengupta, Ayan, et al.
Veröffentlicht: (2023)
SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection
von: Joshi, Maithili, et al.
Veröffentlicht: (2025)
von: Joshi, Maithili, et al.
Veröffentlicht: (2025)
QuanTaxo: A Quantum Approach to Self-Supervised Taxonomy Expansion
von: Mishra, Sahil, et al.
Veröffentlicht: (2025)
von: Mishra, Sahil, et al.
Veröffentlicht: (2025)
FLAME: Self-Supervised Low-Resource Taxonomy Expansion using Large Language Models
von: Mishra, Sahil, et al.
Veröffentlicht: (2024)
von: Mishra, Sahil, et al.
Veröffentlicht: (2024)
Diversity Augmentation of Dynamic User Preference Data for Boosting Personalized Text Summarizers
von: Chatterjee, Parthiv, et al.
Veröffentlicht: (2025)
von: Chatterjee, Parthiv, et al.
Veröffentlicht: (2025)
An Effective Framework to Help Large Language Models Handle Numeric-involved Long-context Tasks
von: Yu, Yijiong
Veröffentlicht: (2024)
von: Yu, Yijiong
Veröffentlicht: (2024)
Ähnliche Einträge
-
Do You Know About My Nation? Investigating Multilingual Language Models' Cultural Literacy Through Factual Knowledge
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025) -
Multilingual LLMs Struggle to Link Orthography and Semantics in Bilingual Word Processing
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025) -
HIDE and Seek: Detecting Hallucinations in Language Models via Decoupled Representations
von: Chatterjee, Anwoy, et al.
Veröffentlicht: (2025) -
Mechanistic Behavior Editing of Language Models
von: Singh, Joykirat, et al.
Veröffentlicht: (2024) -
Understanding the Effects of Domain Finetuning on LLMs
von: Tanwar, Eshaan, et al.
Veröffentlicht: (2025)