Multimodal In-context Learning for ASR of Low-resource Languages
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Zhaolin, Niehues, Jan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
In-context Language Learning for Endangered Languages in Speech Recognition
par: Li, Zhaolin, et autres
Publié: (2025)
par: Li, Zhaolin, et autres
Publié: (2025)
Augmenting Automatic Speech Recognition Models with Disfluency Detection
par: Amann, Robin, et autres
Publié: (2024)
par: Amann, Robin, et autres
Publié: (2024)
KIT's Low-resource Speech Translation Systems for IWSLT2025: System Enhancement with Synthetic Data and Model Regularization
par: Li, Zhaolin, et autres
Publié: (2025)
par: Li, Zhaolin, et autres
Publié: (2025)
OmniFusion: Simultaneous Multilingual Multimodal Translations via Modular Fusion
par: Koneru, Sai, et autres
Publié: (2025)
par: Koneru, Sai, et autres
Publié: (2025)
MuSaG: A Multimodal German Sarcasm Dataset with Full-Modal Annotations
par: Scott, Aaron, et autres
Publié: (2025)
par: Scott, Aaron, et autres
Publié: (2025)
Language-Independent Representations Improve Zero-Shot Summarization
par: Solovyev, Vladimir, et autres
Publié: (2024)
par: Solovyev, Vladimir, et autres
Publié: (2024)
Do Slides Help? Multi-modal Context for Automatic Transcription of Conference Talks
par: Sinhamahapatra, Supriti, et autres
Publié: (2025)
par: Sinhamahapatra, Supriti, et autres
Publié: (2025)
Middle-Layer Representation Alignment for Cross-Lingual Transfer in Fine-Tuned LLMs
par: Liu, Danni, et autres
Publié: (2025)
par: Liu, Danni, et autres
Publié: (2025)
How Transferable are Attribute Controllers on Pretrained Multilingual Translation Models?
par: Liu, Danni, et autres
Publié: (2023)
par: Liu, Danni, et autres
Publié: (2023)
Parameter-efficient Adaptation of Multilingual Multimodal Models for Low-resource ASR
par: Gupta, Abhishek, et autres
Publié: (2024)
par: Gupta, Abhishek, et autres
Publié: (2024)
Blending LLMs into Cascaded Speech Translation: KIT's Offline Speech Translation System for IWSLT 2024
par: Koneru, Sai, et autres
Publié: (2024)
par: Koneru, Sai, et autres
Publié: (2024)
Contextual Refinement of Translations: Large Language Models for Sentence and Document-Level Post-Editing
par: Koneru, Sai, et autres
Publié: (2023)
par: Koneru, Sai, et autres
Publié: (2023)
End-to-End Evaluation for Low-Latency Simultaneous Speech Translation
par: Huber, Christian, et autres
Publié: (2023)
par: Huber, Christian, et autres
Publié: (2023)
PeFoMed: Parameter Efficient Fine-tuning of Multimodal Large Language Models for Medical Imaging
par: He, Jinlong, et autres
Publié: (2024)
par: He, Jinlong, et autres
Publié: (2024)
Plug, Play, and Fuse: Zero-Shot Joint Decoding via Word-Level Re-ranking Across Diverse Vocabularies
par: Koneru, Sai, et autres
Publié: (2024)
par: Koneru, Sai, et autres
Publié: (2024)
Knockout LLM Assessment: Using Large Language Models for Evaluations through Iterative Pairwise Comparisons
par: Sandan, Isik Baran, et autres
Publié: (2025)
par: Sandan, Isik Baran, et autres
Publié: (2025)
Sentiment Analysis and Emotion Classification using Machine Learning Techniques for Nagamese Language -- A Low-resource Language
par: Morang, Ekha, et autres
Publié: (2025)
par: Morang, Ekha, et autres
Publié: (2025)
Exploring the Role of Transliteration in In-Context Learning for Low-resource Languages Written in Non-Latin Scripts
par: Ma, Chunlan, et autres
Publié: (2024)
par: Ma, Chunlan, et autres
Publié: (2024)
Multilingual Coreference Resolution in Low-resource South Asian Languages
par: Mishra, Ritwik, et autres
Publié: (2024)
par: Mishra, Ritwik, et autres
Publié: (2024)
LoASR-Bench: Evaluating Large Speech Language Models on Low-Resource Automatic Speech Recognition Across Language Families
par: Chen, Jianan, et autres
Publié: (2026)
par: Chen, Jianan, et autres
Publié: (2026)
X-Instruction: Aligning Language Model in Low-resource Languages with Self-curated Cross-lingual Instructions
par: Li, Chong, et autres
Publié: (2024)
par: Li, Chong, et autres
Publié: (2024)
GLoRIA: Gated Low-Rank Interpretable Adaptation for Dialectal ASR
par: Mehralian, Pouya, et autres
Publié: (2026)
par: Mehralian, Pouya, et autres
Publié: (2026)
Improving Contextual ASR via Multi-grained Fusion with Large Language Models
par: Zhou, Shilin, et autres
Publié: (2025)
par: Zhou, Shilin, et autres
Publié: (2025)
Building Robust and Scalable Multilingual ASR for Indian Languages
par: Gangwar, Arjun, et autres
Publié: (2025)
par: Gangwar, Arjun, et autres
Publié: (2025)
Long-context LLMs Struggle with Long In-context Learning
par: Li, Tianle, et autres
Publié: (2024)
par: Li, Tianle, et autres
Publié: (2024)
Using Large Language Model for End-to-End Chinese ASR and NER
par: Li, Yuang, et autres
Publié: (2024)
par: Li, Yuang, et autres
Publié: (2024)
A Survey on In-context Learning
par: Dong, Qingxiu, et autres
Publié: (2022)
par: Dong, Qingxiu, et autres
Publié: (2022)
Tuning LLMs with Contrastive Alignment Instructions for Machine Translation in Unseen, Low-resource Languages
par: Mao, Zhuoyuan, et autres
Publié: (2024)
par: Mao, Zhuoyuan, et autres
Publié: (2024)
Linguistic Neuron Overlap Patterns to Facilitate Cross-lingual Transfer on Low-resource Languages
par: Xu, Yuemei, et autres
Publié: (2025)
par: Xu, Yuemei, et autres
Publié: (2025)
When Helpful Context Leaks: Privacy Risks in Domain-Adapted ASR
par: Züfle, Maike, et autres
Publié: (2026)
par: Züfle, Maike, et autres
Publié: (2026)
KIT's Offline Speech Translation and Instruction Following Submission for IWSLT 2025
par: Koneru, Sai, et autres
Publié: (2025)
par: Koneru, Sai, et autres
Publié: (2025)
Concept-aware Data Construction Improves In-context Learning of Language Models
par: Štefánik, Michal, et autres
Publié: (2024)
par: Štefánik, Michal, et autres
Publié: (2024)
Generative Annotation for ASR Named Entity Correction
par: Luo, Yuanchang, et autres
Publié: (2025)
par: Luo, Yuanchang, et autres
Publié: (2025)
Multimodal Large Language Models for Low-Resource Languages: A Case Study for Basque
par: Arana, Lukas, et autres
Publié: (2025)
par: Arana, Lukas, et autres
Publié: (2025)
Myanmar XNLI: Building a Dataset and Exploring Low-resource Approaches to Natural Language Inference with Myanmar
par: Htet, Aung Kyaw, et autres
Publié: (2025)
par: Htet, Aung Kyaw, et autres
Publié: (2025)
MCIF: Multimodal Crosslingual Instruction-Following Benchmark from Scientific Talks
par: Papi, Sara, et autres
Publié: (2025)
par: Papi, Sara, et autres
Publié: (2025)
Rethinking Invariance in In-context Learning
par: Fang, Lizhe, et autres
Publié: (2025)
par: Fang, Lizhe, et autres
Publié: (2025)
Prompt-tuning with Attribute Guidance for Low-resource Entity Matching
par: Liu, Lihui, et autres
Publié: (2026)
par: Liu, Lihui, et autres
Publié: (2026)
AMPS: ASR with Multimodal Paraphrase Supervision
par: Gupta, Abhishek, et autres
Publié: (2024)
par: Gupta, Abhishek, et autres
Publié: (2024)
Provable Benefits of Task-Specific Prompts for In-context Learning
par: Chang, Xiangyu, et autres
Publié: (2025)
par: Chang, Xiangyu, et autres
Publié: (2025)
Documents similaires
-
In-context Language Learning for Endangered Languages in Speech Recognition
par: Li, Zhaolin, et autres
Publié: (2025) -
Augmenting Automatic Speech Recognition Models with Disfluency Detection
par: Amann, Robin, et autres
Publié: (2024) -
KIT's Low-resource Speech Translation Systems for IWSLT2025: System Enhancement with Synthetic Data and Model Regularization
par: Li, Zhaolin, et autres
Publié: (2025) -
OmniFusion: Simultaneous Multilingual Multimodal Translations via Modular Fusion
par: Koneru, Sai, et autres
Publié: (2025) -
MuSaG: A Multimodal German Sarcasm Dataset with Full-Modal Annotations
par: Scott, Aaron, et autres
Publié: (2025)