Effectiveness of Text, Acoustic, and Lattice-based representations in Spoken Language Understanding tasks
Fuente:
arXiv
Salvato in:
| Autori principali: | Villatoro-Tello, Esaú, Madikeri, Srikanth, Zuluaga-Gomez, Juan, Sharma, Bidisha, Sarfjoo, Seyyed Saeed, Nigmatulina, Iuliia, Motlicek, Petr, Ivanov, Alexei V., Ganapathiraju, Aravind |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
XLSR-Transducer: Streaming ASR for Self-Supervised Pretrained Models
di: Kumar, Shashi, et al.
Pubblicazione: (2024)
di: Kumar, Shashi, et al.
Pubblicazione: (2024)
TokenVerse: Towards Unifying Speech and NLP Tasks via Transducer-based ASR
di: Kumar, Shashi, et al.
Pubblicazione: (2024)
di: Kumar, Shashi, et al.
Pubblicazione: (2024)
Node-weighted Graph Convolutional Network for Depression Detection in Transcribed Clinical Interviews
di: Burdisso, Sergio, et al.
Pubblicazione: (2023)
di: Burdisso, Sergio, et al.
Pubblicazione: (2023)
Fast Streaming Transducer ASR Prototyping via Knowledge Distillation with Whisper
di: Thorbecke, Iuliia, et al.
Pubblicazione: (2024)
di: Thorbecke, Iuliia, et al.
Pubblicazione: (2024)
Performance evaluation of SLAM-ASR: The Good, the Bad, the Ugly, and the Way Forward
di: Kumar, Shashi, et al.
Pubblicazione: (2024)
di: Kumar, Shashi, et al.
Pubblicazione: (2024)
Dialog2Flow: Pre-training Soft-Contrastive Action-Driven Sentence Embeddings for Automatic Dialog Flow Extraction
di: Burdisso, Sergio, et al.
Pubblicazione: (2024)
di: Burdisso, Sergio, et al.
Pubblicazione: (2024)
Unifying Global and Near-Context Biasing in a Single Trie Pass
di: Thorbecke, Iuliia, et al.
Pubblicazione: (2024)
di: Thorbecke, Iuliia, et al.
Pubblicazione: (2024)
Reliability Estimation of News Media Sources: Birds of a Feather Flock Together
di: Burdisso, Sergio, et al.
Pubblicazione: (2024)
di: Burdisso, Sergio, et al.
Pubblicazione: (2024)
Mapping the Media Landscape: Predicting Factual Reporting and Political Bias Through Web Interactions
di: Sánchez-Cortés, Dairazalia, et al.
Pubblicazione: (2024)
di: Sánchez-Cortés, Dairazalia, et al.
Pubblicazione: (2024)
Better Semi-supervised Learning for Multi-domain ASR Through Incremental Retraining and Data Filtering
di: Carofilis, Andres, et al.
Pubblicazione: (2025)
di: Carofilis, Andres, et al.
Pubblicazione: (2025)
Efficient Data Selection for Domain Adaptation of ASR Using Pseudo-Labels and Multi-Stage Filtering
di: Rangappa, Pradeep, et al.
Pubblicazione: (2025)
di: Rangappa, Pradeep, et al.
Pubblicazione: (2025)
Reducing Prompt Sensitivity in LLM-based Speech Recognition Through Learnable Projection
di: Burdisso, Sergio, et al.
Pubblicazione: (2026)
di: Burdisso, Sergio, et al.
Pubblicazione: (2026)
A Probabilistic Method for Ranking Refinementin Geographic Information Retrieval
di: Esaú Villatoro-Tello
Pubblicazione: (2010)
di: Esaú Villatoro-Tello
Pubblicazione: (2010)
TokenVerse++: Towards Flexible Multitask Learning with Dynamic Task Activation
di: Kumar, Shashi, et al.
Pubblicazione: (2025)
di: Kumar, Shashi, et al.
Pubblicazione: (2025)
Distilling Conversations: Abstract Compression of Conversational Audio Context for LLM-based ASR
di: Kumar, Shashi, et al.
Pubblicazione: (2026)
di: Kumar, Shashi, et al.
Pubblicazione: (2026)
SDialog: A Python Toolkit for End-to-End Agent Building, User Simulation, Dialog Generation, and Evaluation
di: Burdisso, Sergio, et al.
Pubblicazione: (2025)
di: Burdisso, Sergio, et al.
Pubblicazione: (2025)
IDIAPers @ Causal News Corpus 2022: Efficient Causal Relation Identification Through a Prompt-based Few-shot Approach
di: Burdisso, Sergio, et al.
Pubblicazione: (2022)
di: Burdisso, Sergio, et al.
Pubblicazione: (2022)
Text-only adaptation in LLM-based ASR through text denoising
di: Carofilis, Andrés, et al.
Pubblicazione: (2026)
di: Carofilis, Andrés, et al.
Pubblicazione: (2026)
Adaptive Multimodal Person Recognition: A Robust Framework for Handling Missing Modalities
di: Farhadipour, Aref, et al.
Pubblicazione: (2025)
di: Farhadipour, Aref, et al.
Pubblicazione: (2025)
SDialog: A Python Toolkit for End-to-End Agent Building, User Simulation, Dialog Generation, and Evaluation
di: Burdisso, Sergio, et al.
Pubblicazione: (2025)
di: Burdisso, Sergio, et al.
Pubblicazione: (2025)
DAIC-WOZ: On the Validity of Using the Therapist's prompts in Automatic Depression Detection from Clinical Interviews
di: Burdisso, Sergio, et al.
Pubblicazione: (2024)
di: Burdisso, Sergio, et al.
Pubblicazione: (2024)
When Consistency Becomes Bias: Interviewer Effects in Semi-Structured Clinical Interviews
di: Watawana, Hasindri, et al.
Pubblicazione: (2026)
di: Watawana, Hasindri, et al.
Pubblicazione: (2026)
Closing the Speech-Text Gap with Limited Audio for Effective Domain Adaptation in LLM-Based ASR
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
di: Bañeras-Roux, Thibault, et al.
Pubblicazione: (2026)
Temporal fine-tuning for early risk detection
di: Thompson, Horacio, et al.
Pubblicazione: (2025)
di: Thompson, Horacio, et al.
Pubblicazione: (2025)
TidyVoice: A Curated Multilingual Dataset for Speaker Verification Derived from Common Voice
di: Farhadipour, Aref, et al.
Pubblicazione: (2026)
di: Farhadipour, Aref, et al.
Pubblicazione: (2026)
From Text to Voice: A Reproducible and Verifiable Framework for Evaluating Tool Calling LLM Agents
di: Laskar, Md Tahmid Rahman, et al.
Pubblicazione: (2026)
di: Laskar, Md Tahmid Rahman, et al.
Pubblicazione: (2026)
On Optimizing Multimodal Jailbreaks for Spoken Language Models
di: Krishnan, Aravind, et al.
Pubblicazione: (2026)
di: Krishnan, Aravind, et al.
Pubblicazione: (2026)
A Differentiable Alignment Framework for Sequence-to-Sequence Modeling via Optimal Transport
di: Kaloga, Yacouba, et al.
Pubblicazione: (2025)
di: Kaloga, Yacouba, et al.
Pubblicazione: (2025)
Análisis de las actitudes de maestros en ejercicio hacia la educación inclusivai
di: Jefferson Tello-Zuluaga
Pubblicazione: (2023)
di: Jefferson Tello-Zuluaga
Pubblicazione: (2023)
Olomouc Corpus of Spoken Czech: Characterization and Main Features of the Project
di: Petr Pořízka
Pubblicazione: (2009)
di: Petr Pořízka
Pubblicazione: (2009)
Spoofing-Aware Speaker Verification via Wavelet Prompt Tuning and Multi-Model Ensembles
di: Farhadipour, Aref, et al.
Pubblicazione: (2026)
di: Farhadipour, Aref, et al.
Pubblicazione: (2026)
Acoustic and Semantic Modeling of Emotion in Spoken Language
di: Dutta, Soumya
Pubblicazione: (2026)
di: Dutta, Soumya
Pubblicazione: (2026)
Procesos de educación inclusiva en una institución educativa oficial1
di: Jefferson Mauricio Tello-Zuluaga
Pubblicazione: (2023)
di: Jefferson Mauricio Tello-Zuluaga
Pubblicazione: (2023)
Latent Space Factorization in LoRA
di: Kumar, Shashi, et al.
Pubblicazione: (2025)
di: Kumar, Shashi, et al.
Pubblicazione: (2025)
Geometric Latent Reasoning Induces Shorter Generations in LLMs
di: Kumar, Shashi, et al.
Pubblicazione: (2026)
di: Kumar, Shashi, et al.
Pubblicazione: (2026)
Medicaid expansion and participation in the Supplemental Nutrition Assistance Program: The role of Integrated Eligibility Systems
di: Bidisha Mandal
Pubblicazione: (2024)
di: Bidisha Mandal
Pubblicazione: (2024)
CL-UZH submission to the NIST SRE 2024 Speaker Recognition Evaluation
di: Farhadipour, Aref, et al.
Pubblicazione: (2025)
di: Farhadipour, Aref, et al.
Pubblicazione: (2025)
Unidirectional Transverse Scattering in Acoustic Dimers
di: Smagin, Mikhail, et al.
Pubblicazione: (2026)
di: Smagin, Mikhail, et al.
Pubblicazione: (2026)
Assessing Genetic Diversity and Habitat Suitability in Endemic Iranian Darevskia (Reptilia: Lacertidae) Under Climate Change
di: Seyyed Saeed Hosseinian Yousefkhani, et al.
Pubblicazione: (2025)
di: Seyyed Saeed Hosseinian Yousefkhani, et al.
Pubblicazione: (2025)
Estrategias, programas y experiencias de superación de la brecha digital y universalización del acceso a las nuevas tecnologías de información y comunicación, TIC : un panorama regional / Pablo Villatoro , Allison Silva
di: Villatoro, Pablo
di: Villatoro, Pablo
Documenti analoghi
-
XLSR-Transducer: Streaming ASR for Self-Supervised Pretrained Models
di: Kumar, Shashi, et al.
Pubblicazione: (2024) -
TokenVerse: Towards Unifying Speech and NLP Tasks via Transducer-based ASR
di: Kumar, Shashi, et al.
Pubblicazione: (2024) -
Node-weighted Graph Convolutional Network for Depression Detection in Transcribed Clinical Interviews
di: Burdisso, Sergio, et al.
Pubblicazione: (2023) -
Fast Streaming Transducer ASR Prototyping via Knowledge Distillation with Whisper
di: Thorbecke, Iuliia, et al.
Pubblicazione: (2024) -
Performance evaluation of SLAM-ASR: The Good, the Bad, the Ugly, and the Way Forward
di: Kumar, Shashi, et al.
Pubblicazione: (2024)