Normalization through Fine-tuning: Understanding Wav2vec 2.0 Embeddings for Phonetic Analysis
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yiming, Yang, Yi, Yuan, Jiahong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Continued Pretraining for Domain Adaptation of Wav2vec2.0 in Automatic Speech Recognition for Elementary Math Classroom Settings
par: Attia, Ahmed Adel, et autres
Publié: (2024)
par: Attia, Ahmed Adel, et autres
Publié: (2024)
Human-like Linguistic Biases in Neural Speech Models: Phonetic Categorization and Phonotactic Constraints in Wav2Vec2.0
par: Kloots, Marianne de Heer, et autres
Publié: (2024)
par: Kloots, Marianne de Heer, et autres
Publié: (2024)
Demographic Attributes Prediction from Speech Using WavLM Embeddings
par: Yang, Yuchen, et autres
Publié: (2025)
par: Yang, Yuchen, et autres
Publié: (2025)
WavFusion: Towards wav2vec 2.0 Multimodal Speech Emotion Recognition
par: Li, Feng, et autres
Publié: (2024)
par: Li, Feng, et autres
Publié: (2024)
mini-vec2vec: Scaling Universal Geometry Alignment with Linear Transformations
par: Dar, Guy
Publié: (2025)
par: Dar, Guy
Publié: (2025)
player2vec: A Language Modeling Approach to Understand Player Behavior in Games
par: Wang, Tianze, et autres
Publié: (2024)
par: Wang, Tianze, et autres
Publié: (2024)
Chumor 2.0: Towards Benchmarking Chinese Humor Understanding
par: He, Ruiqi, et autres
Publié: (2024)
par: He, Ruiqi, et autres
Publié: (2024)
Explainable Token-level Noise Filtering for LLM Fine-tuning Datasets
par: Yang, Yuchen, et autres
Publié: (2026)
par: Yang, Yuchen, et autres
Publié: (2026)
Fine-tuning Transformer-based Encoder for Turkish Language Understanding Tasks
par: Yildirim, Savas
Publié: (2024)
par: Yildirim, Savas
Publié: (2024)
Fine-tuning vs Prompting, Can Language Models Understand Human Values?
par: Sun, Pingwei
Publié: (2024)
par: Sun, Pingwei
Publié: (2024)
Advancing Single and Multi-task Text Classification through Large Language Model Fine-tuning
par: Zhao, Hang, et autres
Publié: (2024)
par: Zhao, Hang, et autres
Publié: (2024)
COIG-CQIA: Quality is All You Need for Chinese Instruction Fine-tuning
par: Bai, Yuelin, et autres
Publié: (2024)
par: Bai, Yuelin, et autres
Publié: (2024)
Fine-tuning BERT with Bidirectional LSTM for Fine-grained Movie Reviews Sentiment Analysis
par: Nkhata, Gibson, et autres
Publié: (2025)
par: Nkhata, Gibson, et autres
Publié: (2025)
A Comparative Analysis of Bilingual and Trilingual Wav2Vec Models for Automatic Speech Recognition in Multilingual Oral History Archives
par: Lehečka, Jan, et autres
Publié: (2024)
par: Lehečka, Jan, et autres
Publié: (2024)
Knowledge AI: Fine-tuning NLP Models for Facilitating Scientific Knowledge Extraction and Understanding
par: Muralidharan, Balaji, et autres
Publié: (2024)
par: Muralidharan, Balaji, et autres
Publié: (2024)
Evaluating the Effectiveness of Transformer Layers in Wav2Vec 2.0, XLS-R, and Whisper for Speaker Identification Tasks
par: Stuhlmann, Linus, et autres
Publié: (2025)
par: Stuhlmann, Linus, et autres
Publié: (2025)
Systematic Analysis for Pretrained Language Model Priming for Parameter-Efficient Fine-tuning
par: Huang, Shih-Cheng, et autres
Publié: (2022)
par: Huang, Shih-Cheng, et autres
Publié: (2022)
WavCube: Unifying Speech Representation for Understanding and Generation via Semantic-Acoustic Joint Modeling
par: Yang, Guanrou, et autres
Publié: (2026)
par: Yang, Guanrou, et autres
Publié: (2026)
Speaker Diarization for Low-Resource Languages Through Wav2vec Fine-Tuning
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
par: Abdullah, Abdulhady Abas, et autres
Publié: (2025)
Efficient Model Development through Fine-tuning Transfer
par: Lin, Pin-Jie, et autres
Publié: (2025)
par: Lin, Pin-Jie, et autres
Publié: (2025)
From melodic note sequences to pitches using word2vec
par: Defays, Daniel
Publié: (2024)
par: Defays, Daniel
Publié: (2024)
Using Optimal Transport as Alignment Objective for fine-tuning Multilingual Contextualized Embeddings
par: Alqahtani, Sawsan, et autres
Publié: (2021)
par: Alqahtani, Sawsan, et autres
Publié: (2021)
Stage-wise Fine-tuning for Graph-to-Text Generation
par: Wang, Qingyun, et autres
Publié: (2021)
par: Wang, Qingyun, et autres
Publié: (2021)
PERCORE: A Deep Learning-Based Framework for Persian Spelling Correction with Phonetic Analysis
par: Dashti, Seyed Mohammad Sadegh, et autres
Publié: (2024)
par: Dashti, Seyed Mohammad Sadegh, et autres
Publié: (2024)
The Importance of Online Data: Understanding Preference Fine-tuning via Coverage
par: Song, Yuda, et autres
Publié: (2024)
par: Song, Yuda, et autres
Publié: (2024)
Context Engineering 2.0: The Context of Context Engineering
par: Hua, Qishuo, et autres
Publié: (2025)
par: Hua, Qishuo, et autres
Publié: (2025)
CPT-Boosted Wav2vec2.0: Towards Noise Robust Speech Recognition for Classroom Environments
par: Attia, Ahmed Adel, et autres
Publié: (2024)
par: Attia, Ahmed Adel, et autres
Publié: (2024)
WavSLM: Single-Stream Speech Language Modeling via WavLM Distillation
par: Della Libera, Luca, et autres
Publié: (2026)
par: Della Libera, Luca, et autres
Publié: (2026)
EoRA: Fine-tuning-free Compensation for Compressed LLM with Eigenspace Low-Rank Approximation
par: Liu, Shih-Yang, et autres
Publié: (2024)
par: Liu, Shih-Yang, et autres
Publié: (2024)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
par: Zhu, Lianghui, et autres
Publié: (2023)
par: Zhu, Lianghui, et autres
Publié: (2023)
Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning
par: Wu, Bohao, et autres
Publié: (2025)
par: Wu, Bohao, et autres
Publié: (2025)
Fine-tuning Language Models for Recipe Generation: A Comparative Analysis and Benchmark Study
par: Vij, Anneketh, et autres
Publié: (2025)
par: Vij, Anneketh, et autres
Publié: (2025)
You shall know a piece by the company it keeps. Chess plays as a data for word2vec models
par: Orekhov, Boris
Publié: (2024)
par: Orekhov, Boris
Publié: (2024)
Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
par: Wang, Yibo, et autres
Publié: (2025)
par: Wang, Yibo, et autres
Publié: (2025)
Exploring ASR-Based Wav2Vec2 for Automated Speech Disorder Assessment: Insights and Analysis
par: Nguyen, Tuan, et autres
Publié: (2024)
par: Nguyen, Tuan, et autres
Publié: (2024)
nvBench 2.0: Resolving Ambiguity in Text-to-Visualization through Stepwise Reasoning
par: Luo, Tianqi, et autres
Publié: (2025)
par: Luo, Tianqi, et autres
Publié: (2025)
Automatic Essay Multi-dimensional Scoring with Fine-tuning and Multiple Regression
par: Sun, Kun, et autres
Publié: (2024)
par: Sun, Kun, et autres
Publié: (2024)
LLMs Know More Than Words: A Genre Study with Syntax, Metaphor & Phonetics
par: Shi, Weiye, et autres
Publié: (2025)
par: Shi, Weiye, et autres
Publié: (2025)
Understanding Privacy Risks of Embeddings Induced by Large Language Models
par: Zhu, Zhihao, et autres
Publié: (2024)
par: Zhu, Zhihao, et autres
Publié: (2024)
NeurIPS 2023 LLM Efficiency Fine-tuning Competition
par: Saroufim, Mark, et autres
Publié: (2025)
par: Saroufim, Mark, et autres
Publié: (2025)
Documents similaires
-
Continued Pretraining for Domain Adaptation of Wav2vec2.0 in Automatic Speech Recognition for Elementary Math Classroom Settings
par: Attia, Ahmed Adel, et autres
Publié: (2024) -
Human-like Linguistic Biases in Neural Speech Models: Phonetic Categorization and Phonotactic Constraints in Wav2Vec2.0
par: Kloots, Marianne de Heer, et autres
Publié: (2024) -
Demographic Attributes Prediction from Speech Using WavLM Embeddings
par: Yang, Yuchen, et autres
Publié: (2025) -
WavFusion: Towards wav2vec 2.0 Multimodal Speech Emotion Recognition
par: Li, Feng, et autres
Publié: (2024) -
mini-vec2vec: Scaling Universal Geometry Alignment with Linear Transformations
par: Dar, Guy
Publié: (2025)