RECOVER: Robust Entity Correction via agentic Orchestration of hypothesis Variants for Evidence-based Recovery
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kumar, Abhishek, Sachdeva, Aashraya |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robust ASR Error Correction with Conservative Data Filtering
par: Udagawa, Takuma, et autres
Publié: (2024)
par: Udagawa, Takuma, et autres
Publié: (2024)
Large Language Models based ASR Error Correction for Child Conversations
par: Xu, Anfeng, et autres
Publié: (2025)
par: Xu, Anfeng, et autres
Publié: (2025)
Incorporating Class-based Language Model for Named Entity Recognition in Factorized Neural Transducer
par: Wang, Peng, et autres
Publié: (2023)
par: Wang, Peng, et autres
Publié: (2023)
HypR: A comprehensive study for ASR hypothesis revising with a reference corpus
par: Wang, Yi-Wei, et autres
Publié: (2023)
par: Wang, Yi-Wei, et autres
Publié: (2023)
Retrieval-Augmented Self-Taught Reasoning Model with Adaptive Chain-of-Thought for ASR Named Entity Correction
par: An, Junjie, et autres
Publié: (2026)
par: An, Junjie, et autres
Publié: (2026)
Performant ASR Models for Medical Entities in Accented Speech
par: Afonja, Tejumade, et autres
Publié: (2024)
par: Afonja, Tejumade, et autres
Publié: (2024)
LipGER: Visually-Conditioned Generative Error Correction for Robust Automatic Speech Recognition
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
Mind the Gap: Entity-Preserved Context-Aware ASR Structured Transcriptions
par: Altinok, Duygu
Publié: (2025)
par: Altinok, Duygu
Publié: (2025)
Exploring Generative Error Correction for Dysarthric Speech Recognition
par: La Quatra, Moreno, et autres
Publié: (2025)
par: La Quatra, Moreno, et autres
Publié: (2025)
Segmentation-Variant Codebooks for Preservation of Paralinguistic and Prosodic Information
par: Sanders, Nicholas, et autres
Publié: (2025)
par: Sanders, Nicholas, et autres
Publié: (2025)
Stateful Conformer with Cache-based Inference for Streaming Automatic Speech Recognition
par: Noroozi, Vahid, et autres
Publié: (2023)
par: Noroozi, Vahid, et autres
Publié: (2023)
Multi-stage Large Language Model Correction for Speech Recognition
par: Pu, Jie, et autres
Publié: (2023)
par: Pu, Jie, et autres
Publié: (2023)
Multi-Source Evidence Fusion for Audio Question Answering
par: Olev, Aivo, et autres
Publié: (2026)
par: Olev, Aivo, et autres
Publié: (2026)
Chain of Correction for Full-text Speech Recognition with Large Language Models
par: Tang, Zhiyuan, et autres
Publié: (2025)
par: Tang, Zhiyuan, et autres
Publié: (2025)
Spelling Correction through Rewriting of Non-Autoregressive ASR Lattices
par: Velikovich, Leonid, et autres
Publié: (2024)
par: Velikovich, Leonid, et autres
Publié: (2024)
Full-text Error Correction for Chinese Speech Recognition with Large Language Model
par: Tang, Zhiyuan, et autres
Publié: (2024)
par: Tang, Zhiyuan, et autres
Publié: (2024)
Pseudo2Real: Task Arithmetic for Pseudo-Label Correction in Automatic Speech Recognition
par: Lin, Yi-Cheng, et autres
Publié: (2025)
par: Lin, Yi-Cheng, et autres
Publié: (2025)
LLM-based Generative Error Correction for Rare Words with Synthetic Data and Phonetic Context
par: Yamashita, Natsuo, et autres
Publié: (2025)
par: Yamashita, Natsuo, et autres
Publié: (2025)
High-precision Voice Search Query Correction via Retrievable Speech-text Embedings
par: Li, Christopher, et autres
Publié: (2024)
par: Li, Christopher, et autres
Publié: (2024)
Fewer Hallucinations, More Verification: A Three-Stage LLM-Based Framework for ASR Error Correction
par: Fang, Yangui, et autres
Publié: (2025)
par: Fang, Yangui, et autres
Publié: (2025)
Robust Speech and Natural Language Processing Models for Depression Screening
par: Lu, Y., et autres
Publié: (2024)
par: Lu, Y., et autres
Publié: (2024)
Scaling Self-Supervised Speech Models Uncovers Deep Linguistic Relationships: Evidence from the Pacific Cluster
par: Kim, Minu, et autres
Publié: (2026)
par: Kim, Minu, et autres
Publié: (2026)
TokenVerse: Towards Unifying Speech and NLP Tasks via Transducer-based ASR
par: Kumar, Shashi, et autres
Publié: (2024)
par: Kumar, Shashi, et autres
Publié: (2024)
MARS6: A Small and Robust Hierarchical-Codec Text-to-Speech Model
par: Baas, Matthew, et autres
Publié: (2025)
par: Baas, Matthew, et autres
Publié: (2025)
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
par: Everson, Kevin, et autres
Publié: (2024)
par: Everson, Kevin, et autres
Publié: (2024)
Enhancing Dialogue Speech Recognition with Robust Contextual Awareness via Noise Representation Learning
par: Lee, Wonjun, et autres
Publié: (2024)
par: Lee, Wonjun, et autres
Publié: (2024)
To Distill or Not to Distill? On the Robustness of Robust Knowledge Distillation
par: Waheed, Abdul, et autres
Publié: (2024)
par: Waheed, Abdul, et autres
Publié: (2024)
ASR Under the Stethoscope: Evaluating Biases in Clinical Speech Recognition across Indian Languages
par: Kumar, Subham, et autres
Publié: (2025)
par: Kumar, Subham, et autres
Publié: (2025)
VALL-E R: Robust and Efficient Zero-Shot Text-to-Speech Synthesis via Monotonic Alignment
par: Han, Bing, et autres
Publié: (2024)
par: Han, Bing, et autres
Publié: (2024)
Empowering Low-Resource Language ASR via Large-Scale Pseudo Labeling
par: Bhogale, Kaushal Santosh, et autres
Publié: (2024)
par: Bhogale, Kaushal Santosh, et autres
Publié: (2024)
IIITH-BUT system for IWSLT 2025 low-resource Bhojpuri to Hindi speech translation
par: Akkiraju, Bhavana, et autres
Publié: (2025)
par: Akkiraju, Bhavana, et autres
Publié: (2025)
ASR Error Correction using Large Language Models
par: Ma, Rao, et autres
Publié: (2024)
par: Ma, Rao, et autres
Publié: (2024)
Crossmodal ASR Error Correction with Discrete Speech Units
par: Li, Yuanchao, et autres
Publié: (2024)
par: Li, Yuanchao, et autres
Publié: (2024)
Retrieval Augmented Generation based context discovery for ASR
par: Siskos, Dimitrios, et autres
Publié: (2025)
par: Siskos, Dimitrios, et autres
Publié: (2025)
Entropy-based Coarse and Compressed Semantic Speech Representation Learning
par: Zuo, Jialong, et autres
Publié: (2025)
par: Zuo, Jialong, et autres
Publié: (2025)
LLM-based speaker diarization correction: A generalizable approach
par: Efstathiadis, Georgios, et autres
Publié: (2024)
par: Efstathiadis, Georgios, et autres
Publié: (2024)
An Exhaustive Evaluation of TTS- and VC-based Data Augmentation for ASR
par: Ogun, Sewade, et autres
Publié: (2025)
par: Ogun, Sewade, et autres
Publié: (2025)
UCorrect: An Unsupervised Framework for Automatic Speech Recognition Error Correction
par: Guo, Jiaxin, et autres
Publié: (2024)
par: Guo, Jiaxin, et autres
Publié: (2024)
Building English ASR model with regional language support
par: Agrawal, Purvi, et autres
Publié: (2025)
par: Agrawal, Purvi, et autres
Publié: (2025)
Efficient ASR for Low-Resource Languages: Leveraging Cross-Lingual Unlabeled Data
par: Bandarupalli, Srihari, et autres
Publié: (2025)
par: Bandarupalli, Srihari, et autres
Publié: (2025)
Documents similaires
-
Robust ASR Error Correction with Conservative Data Filtering
par: Udagawa, Takuma, et autres
Publié: (2024) -
Large Language Models based ASR Error Correction for Child Conversations
par: Xu, Anfeng, et autres
Publié: (2025) -
Incorporating Class-based Language Model for Named Entity Recognition in Factorized Neural Transducer
par: Wang, Peng, et autres
Publié: (2023) -
HypR: A comprehensive study for ASR hypothesis revising with a reference corpus
par: Wang, Yi-Wei, et autres
Publié: (2023) -
Retrieval-Augmented Self-Taught Reasoning Model with Adaptive Chain-of-Thought for ASR Named Entity Correction
par: An, Junjie, et autres
Publié: (2026)