ASoBO: Attentive Beamformer Selection for Distant Speaker Diarization in Meetings
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mariotte, Theo, Larcher, Anthony, Montresor, Silvio, Thomas, Jean-Hugh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Channel-Combination Algorithms for Robust Distant Voice Activity and Overlapped Speech Detection
par: Mariotte, Théo, et autres
Publié: (2024)
par: Mariotte, Théo, et autres
Publié: (2024)
From Modular to End-to-End Speaker Diarization
par: Landini, Federico
Publié: (2024)
par: Landini, Federico
Publié: (2024)
Leveraging Speaker Embeddings in End-to-End Neural Diarization for Two-Speaker Scenarios
par: Alvarez-Trejos, Juan Ignacio, et autres
Publié: (2024)
par: Alvarez-Trejos, Juan Ignacio, et autres
Publié: (2024)
SDBench: A Comprehensive Benchmark Suite for Speaker Diarization
par: Pacheco, Eduardo, et autres
Publié: (2025)
par: Pacheco, Eduardo, et autres
Publié: (2025)
End-to-End Supervised Hierarchical Graph Clustering for Speaker Diarization
par: Singh, Prachi, et autres
Publié: (2024)
par: Singh, Prachi, et autres
Publié: (2024)
Explainable by-design Audio Segmentation through Non-Negative Matrix Factorization and Probing
par: Lebourdais, Martin, et autres
Publié: (2024)
par: Lebourdais, Martin, et autres
Publié: (2024)
Improving Neural Diarization through Speaker Attribute Attractors and Local Dependency Modeling
par: Palzer, David, et autres
Publié: (2025)
par: Palzer, David, et autres
Publié: (2025)
Speaker Diarization with Overlapping Community Detection Using Graph Attention Networks and Label Propagation Algorithm
par: Li, Zhaoyang, et autres
Publié: (2025)
par: Li, Zhaoyang, et autres
Publié: (2025)
Do we really need Self-Attention for Streaming Automatic Speech Recognition?
par: Dkhissi, Youness, et autres
Publié: (2026)
par: Dkhissi, Youness, et autres
Publié: (2026)
Bangla-WhisperDiar: Fine-Tuning Whisper and PyAnnote for Bangla Long-Form Speech Recognition and Speaker Diarization
par: Bhuiyan, Mohammed Aman, et autres
Publié: (2026)
par: Bhuiyan, Mohammed Aman, et autres
Publié: (2026)
Iterative LLM-based improvement for French Clinical Interview Transcription and Speaker Diarization
par: Marie, Ambre, et autres
Publié: (2026)
par: Marie, Ambre, et autres
Publié: (2026)
MOSS Transcribe Diarize Technical Report
par: AI, MOSI., et autres
Publié: (2026)
par: AI, MOSI., et autres
Publié: (2026)
Incorporating Spatial Cues in Modular Speaker Diarization for Multi-channel Multi-party Meetings
par: Wang, Ruoyu, et autres
Publié: (2024)
par: Wang, Ruoyu, et autres
Publié: (2024)
Pretraining Multi-Speaker Identification for Neural Speaker Diarization
par: Horiguchi, Shota, et autres
Publié: (2025)
par: Horiguchi, Shota, et autres
Publié: (2025)
An Explainable Proxy Model for Multiabel Audio Segmentation
par: Mariotte, Théo, et autres
Publié: (2024)
par: Mariotte, Théo, et autres
Publié: (2024)
USED: Universal Speaker Extraction and Diarization
par: Ao, Junyi, et autres
Publié: (2023)
par: Ao, Junyi, et autres
Publié: (2023)
Leveraging Self-Supervised Learning for Speaker Diarization
par: Han, Jiangyu, et autres
Publié: (2024)
par: Han, Jiangyu, et autres
Publié: (2024)
Mamba-based Segmentation Model for Speaker Diarization
par: Plaquet, Alexis, et autres
Publié: (2024)
par: Plaquet, Alexis, et autres
Publié: (2024)
Sparse Autoencoders Make Audio Foundation Models more Explainable
par: Mariotte, Théo, et autres
Publié: (2025)
par: Mariotte, Théo, et autres
Publié: (2025)
Multiple Choice Learning for Efficient Speech Separation with Many Speakers
par: Perera, David, et autres
Publié: (2024)
par: Perera, David, et autres
Publié: (2024)
Can We Really Repurpose Multi-Speaker ASR Corpus for Speaker Diarization?
par: Horiguchi, Shota, et autres
Publié: (2025)
par: Horiguchi, Shota, et autres
Publié: (2025)
Speaker Embeddings With Weakly Supervised Voice Activity Detection For Efficient Speaker Diarization
par: Thienpondt, Jenthe, et autres
Publié: (2024)
par: Thienpondt, Jenthe, et autres
Publié: (2024)
Speaker Embeddings to Improve Tracking of Intermittent and Moving Speakers
par: Iatariene, Taous, et autres
Publié: (2025)
par: Iatariene, Taous, et autres
Publié: (2025)
NOTSOFAR-1 Challenge: New Datasets, Baseline, and Tasks for Distant Meeting Transcription
par: Vinnikov, Alon, et autres
Publié: (2024)
par: Vinnikov, Alon, et autres
Publié: (2024)
SSPS: Self-Supervised Positive Sampling for Robust Self-Supervised Speaker Verification
par: Lepage, Theo, et autres
Publié: (2025)
par: Lepage, Theo, et autres
Publié: (2025)
Recursive Attentive Pooling for Extracting Speaker Embeddings from Multi-Speaker Recordings
par: Horiguchi, Shota, et autres
Publié: (2024)
par: Horiguchi, Shota, et autres
Publié: (2024)
Disentangling Speakers in Multi-Talker Speech Recognition with Speaker-Aware CTC
par: Kang, Jiawen, et autres
Publié: (2024)
par: Kang, Jiawen, et autres
Publié: (2024)
Memory-Efficient Training for Deep Speaker Embedding Learning in Speaker Verification
par: Liu, Bei, et autres
Publié: (2024)
par: Liu, Bei, et autres
Publié: (2024)
The Multimodal Information Based Speech Processing (MISP) 2025 Challenge: Audio-Visual Diarization and Recognition
par: Gao, Ming, et autres
Publié: (2025)
par: Gao, Ming, et autres
Publié: (2025)
Streaming Sortformer: Speaker Cache-Based Online Speaker Diarization with Arrival-Time Ordering
par: Medennikov, Ivan, et autres
Publié: (2025)
par: Medennikov, Ivan, et autres
Publié: (2025)
Uncertainty Quantification in Machine Learning for Joint Speaker Diarization and Identification
par: McKnight, Simon W., et autres
Publié: (2023)
par: McKnight, Simon W., et autres
Publié: (2023)
Make It Hard to Hear, Easy to Learn: Long-Form Bengali ASR and Speaker Diarization via Extreme Augmentation and Perfect Alignment
par: Hasan, Sanjid, et autres
Publié: (2026)
par: Hasan, Sanjid, et autres
Publié: (2026)
Explainable Attribute-Based Speaker Verification
par: Wu, Xiaoliang, et autres
Publié: (2024)
par: Wu, Xiaoliang, et autres
Publié: (2024)
TS-SEP: Joint Diarization and Separation Conditioned on Estimated Speaker Embeddings
par: Boeddeker, Christoph, et autres
Publié: (2023)
par: Boeddeker, Christoph, et autres
Publié: (2023)
Joint Training of Speaker Embedding Extractor, Speech and Overlap Detection for Diarization
par: Pálka, Petr, et autres
Publié: (2024)
par: Pálka, Petr, et autres
Publié: (2024)
The CHiME-8 DASR Challenge for Generalizable and Array Agnostic Distant Automatic Speech Recognition and Diarization
par: Cornell, Samuele, et autres
Publié: (2024)
par: Cornell, Samuele, et autres
Publié: (2024)
Certification of Speaker Recognition Models to Additive Perturbations
par: Korzh, Dmitrii, et autres
Publié: (2024)
par: Korzh, Dmitrii, et autres
Publié: (2024)
The VoxCeleb Speaker Recognition Challenge: A Retrospective
par: Huh, Jaesung, et autres
Publié: (2024)
par: Huh, Jaesung, et autres
Publié: (2024)
End-to-End Joint ASR and Speaker Role Diarization with Child-Adult Interactions
par: Xu, Anfeng, et autres
Publié: (2026)
par: Xu, Anfeng, et autres
Publié: (2026)
Bengali-Loop: Community Benchmarks for Long-Form Bangla ASR and Speaker Diarization
par: Tabib, H. M. Shadman, et autres
Publié: (2026)
par: Tabib, H. M. Shadman, et autres
Publié: (2026)
Documents similaires
-
Channel-Combination Algorithms for Robust Distant Voice Activity and Overlapped Speech Detection
par: Mariotte, Théo, et autres
Publié: (2024) -
From Modular to End-to-End Speaker Diarization
par: Landini, Federico
Publié: (2024) -
Leveraging Speaker Embeddings in End-to-End Neural Diarization for Two-Speaker Scenarios
par: Alvarez-Trejos, Juan Ignacio, et autres
Publié: (2024) -
SDBench: A Comprehensive Benchmark Suite for Speaker Diarization
par: Pacheco, Eduardo, et autres
Publié: (2025) -
End-to-End Supervised Hierarchical Graph Clustering for Speaker Diarization
par: Singh, Prachi, et autres
Publié: (2024)