SQATIN: Supervised Instruction Tuning Meets Question Answering for Improved Dialogue NLU
Fuente:
arXiv
Guardado en:
| Autores principales: | Razumovskaia, Evgeniia, Glavaš, Goran, Korhonen, Anna, Vulić, Ivan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Analyzing and Adapting Large Language Models for Few-Shot Multilingual NLU: Are We There Yet?
por: Razumovskaia, Evgeniia, et al.
Publicado: (2024)
por: Razumovskaia, Evgeniia, et al.
Publicado: (2024)
Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languages
por: Schmidt, Fabian David, et al.
Publicado: (2024)
por: Schmidt, Fabian David, et al.
Publicado: (2024)
Dial HEALTHDIAL for Advice: A Multilingual and Multi-Parallel Spoken Dialogue Dataset for Knowledge-Grounded Information Seeking
por: Hu, Songbo, et al.
Publicado: (2026)
por: Hu, Songbo, et al.
Publicado: (2026)
$\textit{Dial BeInfo for Faithfulness}$: Improving Factuality of Information-Seeking Dialogue via Behavioural Fine-Tuning
por: Razumovskaia, Evgeniia, et al.
Publicado: (2023)
por: Razumovskaia, Evgeniia, et al.
Publicado: (2023)
Large Language Models are Miscalibrated In-Context Learners
por: Li, Chengzu, et al.
Publicado: (2023)
por: Li, Chengzu, et al.
Publicado: (2023)
ReCoVeR the Target Language: Language Steering without Sacrificing Task Performance
por: Sterz, Hannah, et al.
Publicado: (2025)
por: Sterz, Hannah, et al.
Publicado: (2025)
Supervised In-Context Fine-Tuning for Generative Sequence Labeling
por: Dukić, David, et al.
Publicado: (2025)
por: Dukić, David, et al.
Publicado: (2025)
DIALIGHT: Lightweight Multilingual Development and Evaluation of Task-Oriented Dialogue Systems with Large Language Models
por: Hu, Songbo, et al.
Publicado: (2024)
por: Hu, Songbo, et al.
Publicado: (2024)
Quantifying Language Disparities in Multilingual Large Language Models
por: Hu, Songbo, et al.
Publicado: (2025)
por: Hu, Songbo, et al.
Publicado: (2025)
Agentic Policy Optimization via Instruction-Policy Co-Evolution
por: Zhou, Han, et al.
Publicado: (2025)
por: Zhou, Han, et al.
Publicado: (2025)
AutoPEFT: Automatic Configuration Search for Parameter-Efficient Fine-Tuning
por: Zhou, Han, et al.
Publicado: (2023)
por: Zhou, Han, et al.
Publicado: (2023)
Fleurs-SLU: A Massively Multilingual Benchmark for Spoken Language Understanding
por: Schmidt, Fabian David, et al.
Publicado: (2025)
por: Schmidt, Fabian David, et al.
Publicado: (2025)
DARE: Diverse Visual Question Answering with Robustness Evaluation
por: Sterz, Hannah, et al.
Publicado: (2024)
por: Sterz, Hannah, et al.
Publicado: (2024)
Improving Bilingual Lexicon Induction with Cross-Encoder Reranking
por: Li, Yaoyiran, et al.
Publicado: (2022)
por: Li, Yaoyiran, et al.
Publicado: (2022)
On Bilingual Lexicon Induction with Large Language Models
por: Li, Yaoyiran, et al.
Publicado: (2023)
por: Li, Yaoyiran, et al.
Publicado: (2023)
Self-Augmented In-Context Learning for Unsupervised Word Translation
por: Li, Yaoyiran, et al.
Publicado: (2024)
por: Li, Yaoyiran, et al.
Publicado: (2024)
Polyglot Teachers: Evaluating Language Models for Multilingual Synthetic Data Generation
por: Miranda, Lester James V., et al.
Publicado: (2026)
por: Miranda, Lester James V., et al.
Publicado: (2026)
Scaling Sparse Fine-Tuning to Large Language Models
por: Ansell, Alan, et al.
Publicado: (2024)
por: Ansell, Alan, et al.
Publicado: (2024)
Donors and Recipients: On Asymmetric Transfer Across Tasks and Languages with Parameter-Efficient Fine-Tuning
por: Dymkiewicz, Kajetan, et al.
Publicado: (2025)
por: Dymkiewicz, Kajetan, et al.
Publicado: (2025)
Little Red Riding Hood Goes Around the Globe:Crosslingual Story Planning and Generation with Large Language Models
por: Razumovskaia, Evgeniia, et al.
Publicado: (2022)
por: Razumovskaia, Evgeniia, et al.
Publicado: (2022)
Specialising and Analysing Instruction-Tuned and Byte-Level Language Models for Organic Reaction Prediction
por: Pang, Jiayun, et al.
Publicado: (2024)
por: Pang, Jiayun, et al.
Publicado: (2024)
Improving Word Translation via Two-Stage Contrastive Learning
por: Li, Yaoyiran, et al.
Publicado: (2022)
por: Li, Yaoyiran, et al.
Publicado: (2022)
To Translate or Not to Translate: A Systematic Investigation of Translation-Based Cross-Lingual Transfer to Low-Resource Languages
por: Ebing, Benedikt, et al.
Publicado: (2023)
por: Ebing, Benedikt, et al.
Publicado: (2023)
The Devil Is in the Word Alignment Details: On Translation-Based Cross-Lingual Transfer for Token Classification Tasks
por: Ebing, Benedikt, et al.
Publicado: (2025)
por: Ebing, Benedikt, et al.
Publicado: (2025)
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
por: Zhou, Han, et al.
Publicado: (2024)
por: Zhou, Han, et al.
Publicado: (2024)
Emergent Communication Pretraining for Few-Shot Machine Translation
por: Li, Yaoyiran, et al.
Publicado: (2020)
por: Li, Yaoyiran, et al.
Publicado: (2020)
LongForm: Effective Instruction Tuning with Reverse Instructions
por: Köksal, Abdullatif, et al.
Publicado: (2023)
por: Köksal, Abdullatif, et al.
Publicado: (2023)
SpeechTaxi: On Multilingual Semantic Speech Classification
por: Keller, Lennart, et al.
Publicado: (2024)
por: Keller, Lennart, et al.
Publicado: (2024)
One Script Instead of Hundreds? On Pretraining Romanized Encoder Language Models
por: Ebing, Benedikt, et al.
Publicado: (2026)
por: Ebing, Benedikt, et al.
Publicado: (2026)
TransAlign: Machine Translation Encoders are Strong Word Aligners, Too
por: Ebing, Benedikt, et al.
Publicado: (2025)
por: Ebing, Benedikt, et al.
Publicado: (2025)
BioMistral-NLU: Towards More Generalizable Medical Language Understanding through Instruction Tuning
por: Fu, Yujuan Velvin, et al.
Publicado: (2024)
por: Fu, Yujuan Velvin, et al.
Publicado: (2024)
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
por: Paul, Indraneil, et al.
Publicado: (2024)
por: Paul, Indraneil, et al.
Publicado: (2024)
Translation-Enhanced Multilingual Text-to-Image Generation
por: Li, Yaoyiran, et al.
Publicado: (2023)
por: Li, Yaoyiran, et al.
Publicado: (2023)
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
por: Geigle, Gregor, et al.
Publicado: (2023)
por: Geigle, Gregor, et al.
Publicado: (2023)
Does Object Grounding Really Reduce Hallucination of Large Vision-Language Models?
por: Geigle, Gregor, et al.
Publicado: (2024)
por: Geigle, Gregor, et al.
Publicado: (2024)
African or European Swallow? Benchmarking Large Vision-Language Models for Fine-Grained Object Classification
por: Geigle, Gregor, et al.
Publicado: (2024)
por: Geigle, Gregor, et al.
Publicado: (2024)
Beyond the Final Layer: Intermediate Representations for Better Multilingual Calibration in Large Language Models
por: Zhou, Ej, et al.
Publicado: (2025)
por: Zhou, Ej, et al.
Publicado: (2025)
TopViewRS: Vision-Language Models as Top-View Spatial Reasoners
por: Li, Chengzu, et al.
Publicado: (2024)
por: Li, Chengzu, et al.
Publicado: (2024)
ANHALTEN: Cross-Lingual Transfer for German Token-Level Reference-Free Hallucination Detection
por: Herrlein, Janek, et al.
Publicado: (2024)
por: Herrlein, Janek, et al.
Publicado: (2024)
Modular Sentence Encoders: Separating Language Specialization from Cross-Lingual Alignment
por: Huang, Yongxin, et al.
Publicado: (2024)
por: Huang, Yongxin, et al.
Publicado: (2024)
Ejemplares similares
-
Analyzing and Adapting Large Language Models for Few-Shot Multilingual NLU: Are We There Yet?
por: Razumovskaia, Evgeniia, et al.
Publicado: (2024) -
Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languages
por: Schmidt, Fabian David, et al.
Publicado: (2024) -
Dial HEALTHDIAL for Advice: A Multilingual and Multi-Parallel Spoken Dialogue Dataset for Knowledge-Grounded Information Seeking
por: Hu, Songbo, et al.
Publicado: (2026) -
$\textit{Dial BeInfo for Faithfulness}$: Improving Factuality of Information-Seeking Dialogue via Behavioural Fine-Tuning
por: Razumovskaia, Evgeniia, et al.
Publicado: (2023) -
Large Language Models are Miscalibrated In-Context Learners
por: Li, Chengzu, et al.
Publicado: (2023)