Simulating Articulatory Trajectories with Phonological Feature Interpolation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tandazo, Angelo Ortiz, Schatz, Thomas, Hueber, Thomas, Dupoux, Emmanuel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MauBERT: Universal Phonetic Inductive Biases for Few-Shot Acoustic Units Discovery
par: Tandazo, Angelo Ortiz, et autres
Publié: (2025)
par: Tandazo, Angelo Ortiz, et autres
Publié: (2025)
DiscoPhon: Benchmarking the Unsupervised Discovery of Phoneme Inventories With Discrete Speech Units
par: Poli, Maxime, et autres
Publié: (2026)
par: Poli, Maxime, et autres
Publié: (2026)
Improving Spoken Language Modeling with Phoneme Classification: A Simple Fine-tuning Approach
par: Poli, Maxime, et autres
Publié: (2024)
par: Poli, Maxime, et autres
Publié: (2024)
fastabx: A library for efficient computation of ABX discriminability
par: Poli, Maxime, et autres
Publié: (2025)
par: Poli, Maxime, et autres
Publié: (2025)
Is Self-Supervised Learning Enough to Fill in the Gap? A Study on Speech Inpainting
par: Asaad, Ihab, et autres
Publié: (2024)
par: Asaad, Ihab, et autres
Publié: (2024)
Self-Supervised Models of Speech Infer Universal Articulatory Kinematics
par: Cho, Cheol Jun, et autres
Publié: (2023)
par: Cho, Cheol Jun, et autres
Publié: (2023)
On the Relationship between Accent Strength and Articulatory Features
par: Huang, Kevin, et autres
Publié: (2025)
par: Huang, Kevin, et autres
Publié: (2025)
EmphAssess : a Prosodic Benchmark on Assessing Emphasis Transfer in Speech-to-Speech Models
par: de Seyssel, Maureen, et autres
Publié: (2023)
par: de Seyssel, Maureen, et autres
Publié: (2023)
From perception to production: how acoustic invariance facilitates articulatory learning in a self-supervised vocal imitation model
par: Lavechin, Marvin, et autres
Publié: (2025)
par: Lavechin, Marvin, et autres
Publié: (2025)
Tracking Articulatory Dynamics in Speech with a Fixed-Weight BiLSTM-CNN Architecture
par: Pillai, Leena G, et autres
Publié: (2025)
par: Pillai, Leena G, et autres
Publié: (2025)
Acoustic to Articulatory Inversion of Speech; Data Driven Approaches, Challenges, Applications, and Future Scope
par: Pillai, Leena G, et autres
Publié: (2025)
par: Pillai, Leena G, et autres
Publié: (2025)
ARTI-6: Towards Six-dimensional Articulatory Speech Encoding
par: Lee, Jihwan, et autres
Publié: (2025)
par: Lee, Jihwan, et autres
Publié: (2025)
Probing for Phonology in Self-Supervised Speech Representations: A Case Study on Accent Perception
par: Venkateswaran, Nitin, et autres
Publié: (2025)
par: Venkateswaran, Nitin, et autres
Publié: (2025)
Revisiting Interpolation Augmentation for Speech-to-Text Generation
par: Xu, Chen, et autres
Publié: (2024)
par: Xu, Chen, et autres
Publié: (2024)
Articulatory Configurations across Genders and Periods in French Radio and TV archives
par: Elie, Benjamin, et autres
Publié: (2024)
par: Elie, Benjamin, et autres
Publié: (2024)
Articulation-Informed ASR: Integrating Articulatory Features into ASR via Auxiliary Speech Inversion and Cross-Attention Fusion
par: Attia, Ahmed Adel, et autres
Publié: (2025)
par: Attia, Ahmed Adel, et autres
Publié: (2025)
Phonology-Guided Speech-to-Speech Translation for African Languages
par: Ochieng, Peter, et autres
Publié: (2024)
par: Ochieng, Peter, et autres
Publié: (2024)
SpidR: Learning Fast and Stable Linguistic Units for Spoken Language Models Without Supervision
par: Poli, Maxime, et autres
Publié: (2025)
par: Poli, Maxime, et autres
Publié: (2025)
On The Landscape of Spoken Language Models: A Comprehensive Survey
par: Arora, Siddhant, et autres
Publié: (2025)
par: Arora, Siddhant, et autres
Publié: (2025)
BabySLM: language-acquisition-friendly benchmark of self-supervised spoken language models
par: Lavechin, Marvin, et autres
Publié: (2023)
par: Lavechin, Marvin, et autres
Publié: (2023)
CASPER: A Large Scale Spontaneous Speech Dataset
par: Xiao, Cihan, et autres
Publié: (2025)
par: Xiao, Cihan, et autres
Publié: (2025)
Weakly Supervised Phonological Features for Pathological Speech Analysis
par: Thienpondt, Jenthe, et autres
Publié: (2025)
par: Thienpondt, Jenthe, et autres
Publié: (2025)
PhonologyBench: Evaluating Phonological Skills of Large Language Models
par: Suvarna, Ashima, et autres
Publié: (2024)
par: Suvarna, Ashima, et autres
Publié: (2024)
An Approach to Simultaneous Acquisition of Real-Time MRI Video, EEG, and Surface EMG for Articulatory, Brain, and Muscle Activity During Speech Production
par: Lee, Jihwan, et autres
Publié: (2026)
par: Lee, Jihwan, et autres
Publié: (2026)
Voice Conversion for Lombard Speaking Style with Implicit and Explicit Acoustic Feature Conditioning
par: Woszczyk, Dominika, et autres
Publié: (2025)
par: Woszczyk, Dominika, et autres
Publié: (2025)
Accent Conversion with Articulatory Representations
par: Siriwardena, Yashish M., et autres
Publié: (2024)
par: Siriwardena, Yashish M., et autres
Publié: (2024)
An Exhaustive Evaluation of TTS- and VC-based Data Augmentation for ASR
par: Ogun, Sewade, et autres
Publié: (2025)
par: Ogun, Sewade, et autres
Publié: (2025)
Emphasis Sensitivity in Speech Representations
par: Cassini, Shaun, et autres
Publié: (2025)
par: Cassini, Shaun, et autres
Publié: (2025)
Spirit LM: Interleaved Spoken and Written Language Model
par: Nguyen, Tu Anh, et autres
Publié: (2024)
par: Nguyen, Tu Anh, et autres
Publié: (2024)
[b]=[d]-[t]+[p]: Self-supervised Speech Models Discover Phonological Vector Arithmetic
par: Choi, Kwanghee, et autres
Publié: (2026)
par: Choi, Kwanghee, et autres
Publié: (2026)
Interpreting Speaker Characteristics in the Dimensions of Self-Supervised Speech Features
par: van Rensburg, Kyle Janse, et autres
Publié: (2026)
par: van Rensburg, Kyle Janse, et autres
Publié: (2026)
Teaching Machines to Speak Using Articulatory Control
par: Anand, Akshay, et autres
Publié: (2025)
par: Anand, Akshay, et autres
Publié: (2025)
Exploring the potential and limitations of Model Merging for Multi-Domain Adaptation in ASR
par: Carvalho, Carlos, et autres
Publié: (2026)
par: Carvalho, Carlos, et autres
Publié: (2026)
Feature-based analysis of oral narratives from Afrikaans and isiXhosa children
par: Sharratt, Emma, et autres
Publié: (2025)
par: Sharratt, Emma, et autres
Publié: (2025)
Acoustic to Articulatory Speech Inversion for Children with Velopharyngeal Insufficiency
par: Tabatabaee, Saba, et autres
Publié: (2025)
par: Tabatabaee, Saba, et autres
Publié: (2025)
Enhancing Acoustic-to-Articulatory Speech Inversion by Incorporating Nasality
par: Tabatabaee, Saba, et autres
Publié: (2025)
par: Tabatabaee, Saba, et autres
Publié: (2025)
GTR-Voice: Articulatory Phonetics Informed Controllable Expressive Speech Synthesis
par: Li, Zehua Kcriss, et autres
Publié: (2024)
par: Li, Zehua Kcriss, et autres
Publié: (2024)
LASER: Learning by Aligning Self-supervised Representations of Speech for Improving Content-related Tasks
par: Meghanani, Amit, et autres
Publié: (2024)
par: Meghanani, Amit, et autres
Publié: (2024)
SCORE: Self-supervised Correspondence Fine-tuning for Improved Content Representations
par: Meghanani, Amit, et autres
Publié: (2024)
par: Meghanani, Amit, et autres
Publié: (2024)
Improving Acoustic Word Embeddings through Correspondence Training of Self-supervised Speech Representations
par: Meghanani, Amit, et autres
Publié: (2024)
par: Meghanani, Amit, et autres
Publié: (2024)
Documents similaires
-
MauBERT: Universal Phonetic Inductive Biases for Few-Shot Acoustic Units Discovery
par: Tandazo, Angelo Ortiz, et autres
Publié: (2025) -
DiscoPhon: Benchmarking the Unsupervised Discovery of Phoneme Inventories With Discrete Speech Units
par: Poli, Maxime, et autres
Publié: (2026) -
Improving Spoken Language Modeling with Phoneme Classification: A Simple Fine-tuning Approach
par: Poli, Maxime, et autres
Publié: (2024) -
fastabx: A library for efficient computation of ABX discriminability
par: Poli, Maxime, et autres
Publié: (2025) -
Is Self-Supervised Learning Enough to Fill in the Gap? A Study on Speech Inpainting
par: Asaad, Ihab, et autres
Publié: (2024)