First Train to Generate, then Generate to Train: UnitedSynT5 for Few-Shot NLI
Fuente:
arXiv
Guardado en:
| Autores principales: | Banerjee, Sourav, Mahajan, Anush, Agarwal, Ayushi, Singh, Eishkaran |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The Vulnerability of Language Model Benchmarks: Do They Accurately Reflect True LLM Performance?
por: Banerjee, Sourav, et al.
Publicado: (2024)
por: Banerjee, Sourav, et al.
Publicado: (2024)
REAMS: Reasoning Enhanced Algorithm for Maths Solving
por: Singh, Eishkaran, et al.
Publicado: (2025)
por: Singh, Eishkaran, et al.
Publicado: (2025)
The Surprising Effectiveness of Test-Time Training for Few-Shot Learning
por: Akyürek, Ekin, et al.
Publicado: (2024)
por: Akyürek, Ekin, et al.
Publicado: (2024)
Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples
por: Ghosal, Soumya Suvra, et al.
Publicado: (2025)
por: Ghosal, Soumya Suvra, et al.
Publicado: (2025)
Training for Compositional Sensitivity Reduces Dense Retrieval Generalization
por: Ralev, Radoslav, et al.
Publicado: (2026)
por: Ralev, Radoslav, et al.
Publicado: (2026)
On Few-Shot Prompting for Controllable Question-Answer Generation in Narrative Comprehension
por: Leite, Bernardo, et al.
Publicado: (2024)
por: Leite, Bernardo, et al.
Publicado: (2024)
AttentionDefense: Leveraging System Prompt Attention for Explainable Defense Against Novel Jailbreaks
por: Siska, Charlotte, et al.
Publicado: (2025)
por: Siska, Charlotte, et al.
Publicado: (2025)
Forget NLI, Use a Dictionary: Zero-Shot Topic Classification for Low-Resource Languages with Application to Luxembourgish
por: Philippy, Fred, et al.
Publicado: (2024)
por: Philippy, Fred, et al.
Publicado: (2024)
Document-Level In-Context Few-Shot Relation Extraction via Pre-Trained Language Models
por: Ozyurt, Yilmazcan, et al.
Publicado: (2023)
por: Ozyurt, Yilmazcan, et al.
Publicado: (2023)
XNLIeu: a dataset for cross-lingual NLI in Basque
por: Heredia, Maite, et al.
Publicado: (2024)
por: Heredia, Maite, et al.
Publicado: (2024)
PrefixNLI: Detecting Factual Inconsistencies as Soon as They Arise
por: Harary, Sapir, et al.
Publicado: (2025)
por: Harary, Sapir, et al.
Publicado: (2025)
High-precision medical speech recognition through synthetic data and semantic correction: UNITED-MEDASR
por: Banerjee, Sourav, et al.
Publicado: (2024)
por: Banerjee, Sourav, et al.
Publicado: (2024)
Language Models are Few-Shot Graders
por: Zhao, Chenyan, et al.
Publicado: (2025)
por: Zhao, Chenyan, et al.
Publicado: (2025)
CP-SynC: Multi-Agent Zero-Shot Constraint Modeling in MiniZinc with Synthesized Checkers
por: Song, Yuliang, et al.
Publicado: (2026)
por: Song, Yuliang, et al.
Publicado: (2026)
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation
por: Zhu, Alan, et al.
Publicado: (2025)
por: Zhu, Alan, et al.
Publicado: (2025)
GRAD: Generative Retrieval-Aligned Demonstration Sampler for Efficient Few-Shot Reasoning
por: Gabouj, Oussama, et al.
Publicado: (2025)
por: Gabouj, Oussama, et al.
Publicado: (2025)
Affective-NLI: Towards Accurate and Interpretable Personality Recognition in Conversation
por: Wen, Zhiyuan, et al.
Publicado: (2024)
por: Wen, Zhiyuan, et al.
Publicado: (2024)
Faithful and Robust LLM-Driven Theorem Proving for NLI Explanations
por: Quan, Xin, et al.
Publicado: (2025)
por: Quan, Xin, et al.
Publicado: (2025)
Evaluating the Performance of AI Text Detectors, Few-Shot and Chain-of-Thought Prompting Using DeepSeek Generated Text
por: Alshammari, Hulayyil, et al.
Publicado: (2025)
por: Alshammari, Hulayyil, et al.
Publicado: (2025)
Generalization or Memorization? Brittleness Testing for Chess-Trained Language Models
por: Tang, Ethan
Publicado: (2026)
por: Tang, Ethan
Publicado: (2026)
StoryAlign: Evaluating and Training Reward Models for Story Generation
por: Xia, Haotian, et al.
Publicado: (2026)
por: Xia, Haotian, et al.
Publicado: (2026)
An Agentic AI Framework for Training General Practitioner Student Skills
por: De Marez, Victor, et al.
Publicado: (2025)
por: De Marez, Victor, et al.
Publicado: (2025)
Leveraging Codebook Knowledge with NLI and ChatGPT for Zero-Shot Political Relation Classification
por: Hu, Yibo, et al.
Publicado: (2023)
por: Hu, Yibo, et al.
Publicado: (2023)
GeMQuAD : Generating Multilingual Question Answering Datasets from Large Language Models using Few Shot Learning
por: Namboori, Amani, et al.
Publicado: (2024)
por: Namboori, Amani, et al.
Publicado: (2024)
Generative Explore-Exploit: Training-free Optimization of Generative Recommender Systems using LLM Optimizers
por: Senel, Lütfi Kerem, et al.
Publicado: (2024)
por: Senel, Lütfi Kerem, et al.
Publicado: (2024)
TOFA: Training-Free One-Shot Federated Adaptation for Vision-Language Models
por: Zhang, Li, et al.
Publicado: (2025)
por: Zhang, Li, et al.
Publicado: (2025)
Training a Generally Curious Agent
por: Tajwar, Fahim, et al.
Publicado: (2025)
por: Tajwar, Fahim, et al.
Publicado: (2025)
AutoReason: Automatic Few-Shot Reasoning Decomposition
por: Sevinc, Arda, et al.
Publicado: (2024)
por: Sevinc, Arda, et al.
Publicado: (2024)
PLHF: Prompt Optimization with Few-Shot Human Feedback
por: Yang, Chun-Pai, et al.
Publicado: (2025)
por: Yang, Chun-Pai, et al.
Publicado: (2025)
Mask-guided BERT for Few Shot Text Classification
por: Liao, Wenxiong, et al.
Publicado: (2023)
por: Liao, Wenxiong, et al.
Publicado: (2023)
NL-Eye: Abductive NLI for Images
por: Ventura, Mor, et al.
Publicado: (2024)
por: Ventura, Mor, et al.
Publicado: (2024)
Fighting Against the Repetitive Training and Sample Dependency Problem in Few-shot Named Entity Recognition
por: Tian, Chang, et al.
Publicado: (2024)
por: Tian, Chang, et al.
Publicado: (2024)
TrICy: Trigger-guided Data-to-text Generation with Intent aware Attention-Copy
por: Agarwal, Vibhav, et al.
Publicado: (2024)
por: Agarwal, Vibhav, et al.
Publicado: (2024)
Does Safety Training of LLMs Generalize to Semantically Related Natural Prompts?
por: Addepalli, Sravanti, et al.
Publicado: (2024)
por: Addepalli, Sravanti, et al.
Publicado: (2024)
Generative Large Language Models Trained for Detecting Errors in Radiology Reports
por: Sun, Cong, et al.
Publicado: (2025)
por: Sun, Cong, et al.
Publicado: (2025)
Training Language Models to Generate Quality Code with Program Analysis Feedback
por: Yao, Feng, et al.
Publicado: (2025)
por: Yao, Feng, et al.
Publicado: (2025)
QGen Studio: An Adaptive Question-Answer Generation, Training and Evaluation Platform
por: Moses, Movina, et al.
Publicado: (2025)
por: Moses, Movina, et al.
Publicado: (2025)
Benchmarking Open-Source Large Language Models for Persian in Zero-Shot and Few-Shot Learning
por: Cherakhloo, Mahdi, et al.
Publicado: (2025)
por: Cherakhloo, Mahdi, et al.
Publicado: (2025)
SynDy: Synthetic Dynamic Dataset Generation Framework for Misinformation Tasks
por: Shliselberg, Michael, et al.
Publicado: (2024)
por: Shliselberg, Michael, et al.
Publicado: (2024)
Smaller, Weaker, Yet Better: Training LLM Reasoners via Compute-Optimal Sampling
por: Bansal, Hritik, et al.
Publicado: (2024)
por: Bansal, Hritik, et al.
Publicado: (2024)
Ejemplares similares
-
The Vulnerability of Language Model Benchmarks: Do They Accurately Reflect True LLM Performance?
por: Banerjee, Sourav, et al.
Publicado: (2024) -
REAMS: Reasoning Enhanced Algorithm for Maths Solving
por: Singh, Eishkaran, et al.
Publicado: (2025) -
The Surprising Effectiveness of Test-Time Training for Few-Shot Learning
por: Akyürek, Ekin, et al.
Publicado: (2024) -
Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples
por: Ghosal, Soumya Suvra, et al.
Publicado: (2025) -
Training for Compositional Sensitivity Reduces Dense Retrieval Generalization
por: Ralev, Radoslav, et al.
Publicado: (2026)