Whisper: Courtside Edition Enhancing ASR Performance Through LLM-Driven Context Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ron, Yonathan, Gilboa, Shiri, Dubnov, Tammuz |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Gradient Correlation Subspace Learning against Catastrophic Forgetting
par: Dubnov, Tammuz, et autres
Publié: (2024)
par: Dubnov, Tammuz, et autres
Publié: (2024)
Fine-tuning Whisper for Pashto ASR: strategies and scale
par: Rahman, Hanif
Publié: (2026)
par: Rahman, Hanif
Publié: (2026)
Extending Whisper with prompt tuning to target-speaker ASR
par: Ma, Hao, et autres
Publié: (2023)
par: Ma, Hao, et autres
Publié: (2023)
A Comparative Study of LLM-based ASR and Whisper in Low Resource and Code Switching Scenario
par: Song, Zheshu, et autres
Publié: (2024)
par: Song, Zheshu, et autres
Publié: (2024)
On the Role of Encoder Depth: Pruning Whisper and LoRA Fine-Tuning in SLAM-ASR
par: Kolluri, Ganesh Pavan Kartikeya Bharadwaj, et autres
Publié: (2026)
par: Kolluri, Ganesh Pavan Kartikeya Bharadwaj, et autres
Publié: (2026)
LoRA-Whisper: Parameter-Efficient and Extensible Multilingual ASR
par: Song, Zheshu, et autres
Publié: (2024)
par: Song, Zheshu, et autres
Publié: (2024)
Fast Streaming Transducer ASR Prototyping via Knowledge Distillation with Whisper
par: Thorbecke, Iuliia, et autres
Publié: (2024)
par: Thorbecke, Iuliia, et autres
Publié: (2024)
Quantizing Whisper-small: How design choices affect ASR performance
par: Söhler, Arthur, et autres
Publié: (2025)
par: Söhler, Arthur, et autres
Publié: (2025)
WhisperKit: On-device Real-time ASR with Billion-Scale Transformers
par: Orhon, Atila, et autres
Publié: (2025)
par: Orhon, Atila, et autres
Publié: (2025)
Evaluating ASR robustness to spontaneous speech errors: A study of WhisperX using a Speech Error Database
par: Alderete, John, et autres
Publié: (2025)
par: Alderete, John, et autres
Publié: (2025)
Overcoming Data Scarcity in Multi-Dialectal Arabic ASR via Whisper Fine-Tuning
par: Özyilmaz, Ömer Tarik, et autres
Publié: (2025)
par: Özyilmaz, Ömer Tarik, et autres
Publié: (2025)
Binaural sound source localization using a hybrid time and frequency domain model
par: Geva, Gil, et autres
Publié: (2024)
par: Geva, Gil, et autres
Publié: (2024)
Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning
par: Wang, Shaobo, et autres
Publié: (2025)
par: Wang, Shaobo, et autres
Publié: (2025)
Noise-Robust AV-ASR Using Visual Features Both in the Whisper Encoder and Decoder
par: Li, Zhengyang, et autres
Publié: (2026)
par: Li, Zhengyang, et autres
Publié: (2026)
LA-RAG:Enhancing LLM-based ASR Accuracy with Retrieval-Augmented Generation
par: Li, Shaojun, et autres
Publié: (2024)
par: Li, Shaojun, et autres
Publié: (2024)
OUTFOX: LLM-Generated Essay Detection Through In-Context Learning with Adversarially Generated Examples
par: Koike, Ryuto, et autres
Publié: (2023)
par: Koike, Ryuto, et autres
Publié: (2023)
Towards Rehearsal-Free Multilingual ASR: A LoRA-based Case Study on Whisper
par: Xu, Tianyi, et autres
Publié: (2024)
par: Xu, Tianyi, et autres
Publié: (2024)
Whispering Context: Distilling Syntax and Semantics for Long Speech Transcripts
par: Altinok, Duygu
Publié: (2025)
par: Altinok, Duygu
Publié: (2025)
Speak in Context: Multilingual ASR with Speech Context Alignment via Contrastive Learning
par: Zhang, Yuchen, et autres
Publié: (2026)
par: Zhang, Yuchen, et autres
Publié: (2026)
Improving Domain-Specific ASR with LLM-Generated Contextual Descriptions
par: Suh, Jiwon, et autres
Publié: (2024)
par: Suh, Jiwon, et autres
Publié: (2024)
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
par: Everson, Kevin, et autres
Publié: (2024)
par: Everson, Kevin, et autres
Publié: (2024)
Zero-Shot Context-Aware ASR for Diverse Arabic Varieties
par: Talafha, Bashar, et autres
Publié: (2025)
par: Talafha, Bashar, et autres
Publié: (2025)
Enhancing ASR Performance in the Medical Domain for Dravidian Languages
par: Devarakonda, Sri Charan, et autres
Publié: (2026)
par: Devarakonda, Sri Charan, et autres
Publié: (2026)
Whisper Turns Stronger: Augmenting Wav2Vec 2.0 for Superior ASR in Low-Resource Languages
par: Anidjar, Or Haim, et autres
Publié: (2024)
par: Anidjar, Or Haim, et autres
Publié: (2024)
Context-Enhanced Granular Edit Representation for Efficient and Accurate ASR Post-editing
par: Vejsiu, Luan, et autres
Publié: (2025)
par: Vejsiu, Luan, et autres
Publié: (2025)
DrugRAG: Enhancing Pharmacy LLM Performance Through A Novel Retrieval-Augmented Generation Pipeline
par: Kazemzadeh, Houman, et autres
Publié: (2025)
par: Kazemzadeh, Houman, et autres
Publié: (2025)
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
par: Peng, Yizhou, et autres
Publié: (2025)
par: Peng, Yizhou, et autres
Publié: (2025)
When Helpful Context Leaks: Privacy Risks in Domain-Adapted ASR
par: Züfle, Maike, et autres
Publié: (2026)
par: Züfle, Maike, et autres
Publié: (2026)
Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down
par: Wang, Yingzhi, et autres
Publié: (2025)
par: Wang, Yingzhi, et autres
Publié: (2025)
Whispering in Amharic: Fine-tuning Whisper for Low-resource Language
par: Gete, Dawit Ketema, et autres
Publié: (2025)
par: Gete, Dawit Ketema, et autres
Publié: (2025)
Exploring the Potential of Multimodal LLM with Knowledge-Intensive Multimodal ASR
par: Wang, Minghan, et autres
Publié: (2024)
par: Wang, Minghan, et autres
Publié: (2024)
How Robust Are Large Language Models for Clinical Numeracy? An Empirical Study on Numerical Reasoning Abilities in Clinical Contexts
par: Nguyen, Minh-Vuong, et autres
Publié: (2026)
par: Nguyen, Minh-Vuong, et autres
Publié: (2026)
Semi-Autoregressive Streaming ASR With Label Context
par: Arora, Siddhant, et autres
Publié: (2023)
par: Arora, Siddhant, et autres
Publié: (2023)
Distilling Conversations: Abstract Compression of Conversational Audio Context for LLM-based ASR
par: Kumar, Shashi, et autres
Publié: (2026)
par: Kumar, Shashi, et autres
Publié: (2026)
MEDSAGE: Enhancing Robustness of Medical Dialogue Summarization to ASR Errors with LLM-generated Synthetic Dialogues
par: Binici, Kuluhan, et autres
Publié: (2024)
par: Binici, Kuluhan, et autres
Publié: (2024)
Enhancing Context Through Contrast
par: Ambilduke, Kshitij, et autres
Publié: (2024)
par: Ambilduke, Kshitij, et autres
Publié: (2024)
Enhancing Short-Text Topic Modeling with LLM-Driven Context Expansion and Prefix-Tuned VAEs
par: Akash, Pritom Saha, et autres
Publié: (2024)
par: Akash, Pritom Saha, et autres
Publié: (2024)
Enhancing Long Context Performance in LLMs Through Inner Loop Query Mechanism
par: Tang, Yimin, et autres
Publié: (2024)
par: Tang, Yimin, et autres
Publié: (2024)
Adaptability of ASR Models on Low-Resource Language: A Comparative Study of Whisper and Wav2Vec-BERT on Bangla
par: Ridoy, Md Sazzadul Islam, et autres
Publié: (2025)
par: Ridoy, Md Sazzadul Islam, et autres
Publié: (2025)
Context-Enhanced Contrastive Search for Improved LLM Text Generation
par: Sen, Jaydip, et autres
Publié: (2025)
par: Sen, Jaydip, et autres
Publié: (2025)
Documents similaires
-
Gradient Correlation Subspace Learning against Catastrophic Forgetting
par: Dubnov, Tammuz, et autres
Publié: (2024) -
Fine-tuning Whisper for Pashto ASR: strategies and scale
par: Rahman, Hanif
Publié: (2026) -
Extending Whisper with prompt tuning to target-speaker ASR
par: Ma, Hao, et autres
Publié: (2023) -
A Comparative Study of LLM-based ASR and Whisper in Low Resource and Code Switching Scenario
par: Song, Zheshu, et autres
Publié: (2024) -
On the Role of Encoder Depth: Pruning Whisper and LoRA Fine-Tuning in SLAM-ASR
par: Kolluri, Ganesh Pavan Kartikeya Bharadwaj, et autres
Publié: (2026)