Normalization through Fine-tuning: Understanding Wav2vec 2.0 Embeddings for Phonetic Analysis
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yiming, Yang, Yi, Yuan, Jiahong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Continued Pretraining for Domain Adaptation of Wav2vec2.0 in Automatic Speech Recognition for Elementary Math Classroom Settings
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2024)
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2024)
Human-like Linguistic Biases in Neural Speech Models: Phonetic Categorization and Phonotactic Constraints in Wav2Vec2.0
di: Kloots, Marianne de Heer, et al.
Pubblicazione: (2024)
di: Kloots, Marianne de Heer, et al.
Pubblicazione: (2024)
Demographic Attributes Prediction from Speech Using WavLM Embeddings
di: Yang, Yuchen, et al.
Pubblicazione: (2025)
di: Yang, Yuchen, et al.
Pubblicazione: (2025)
WavFusion: Towards wav2vec 2.0 Multimodal Speech Emotion Recognition
di: Li, Feng, et al.
Pubblicazione: (2024)
di: Li, Feng, et al.
Pubblicazione: (2024)
mini-vec2vec: Scaling Universal Geometry Alignment with Linear Transformations
di: Dar, Guy
Pubblicazione: (2025)
di: Dar, Guy
Pubblicazione: (2025)
player2vec: A Language Modeling Approach to Understand Player Behavior in Games
di: Wang, Tianze, et al.
Pubblicazione: (2024)
di: Wang, Tianze, et al.
Pubblicazione: (2024)
Chumor 2.0: Towards Benchmarking Chinese Humor Understanding
di: He, Ruiqi, et al.
Pubblicazione: (2024)
di: He, Ruiqi, et al.
Pubblicazione: (2024)
Explainable Token-level Noise Filtering for LLM Fine-tuning Datasets
di: Yang, Yuchen, et al.
Pubblicazione: (2026)
di: Yang, Yuchen, et al.
Pubblicazione: (2026)
Fine-tuning Transformer-based Encoder for Turkish Language Understanding Tasks
di: Yildirim, Savas
Pubblicazione: (2024)
di: Yildirim, Savas
Pubblicazione: (2024)
Fine-tuning vs Prompting, Can Language Models Understand Human Values?
di: Sun, Pingwei
Pubblicazione: (2024)
di: Sun, Pingwei
Pubblicazione: (2024)
Advancing Single and Multi-task Text Classification through Large Language Model Fine-tuning
di: Zhao, Hang, et al.
Pubblicazione: (2024)
di: Zhao, Hang, et al.
Pubblicazione: (2024)
COIG-CQIA: Quality is All You Need for Chinese Instruction Fine-tuning
di: Bai, Yuelin, et al.
Pubblicazione: (2024)
di: Bai, Yuelin, et al.
Pubblicazione: (2024)
Fine-tuning BERT with Bidirectional LSTM for Fine-grained Movie Reviews Sentiment Analysis
di: Nkhata, Gibson, et al.
Pubblicazione: (2025)
di: Nkhata, Gibson, et al.
Pubblicazione: (2025)
A Comparative Analysis of Bilingual and Trilingual Wav2Vec Models for Automatic Speech Recognition in Multilingual Oral History Archives
di: Lehečka, Jan, et al.
Pubblicazione: (2024)
di: Lehečka, Jan, et al.
Pubblicazione: (2024)
Knowledge AI: Fine-tuning NLP Models for Facilitating Scientific Knowledge Extraction and Understanding
di: Muralidharan, Balaji, et al.
Pubblicazione: (2024)
di: Muralidharan, Balaji, et al.
Pubblicazione: (2024)
Systematic Analysis for Pretrained Language Model Priming for Parameter-Efficient Fine-tuning
di: Huang, Shih-Cheng, et al.
Pubblicazione: (2022)
di: Huang, Shih-Cheng, et al.
Pubblicazione: (2022)
Evaluating the Effectiveness of Transformer Layers in Wav2Vec 2.0, XLS-R, and Whisper for Speaker Identification Tasks
di: Stuhlmann, Linus, et al.
Pubblicazione: (2025)
di: Stuhlmann, Linus, et al.
Pubblicazione: (2025)
WavCube: Unifying Speech Representation for Understanding and Generation via Semantic-Acoustic Joint Modeling
di: Yang, Guanrou, et al.
Pubblicazione: (2026)
di: Yang, Guanrou, et al.
Pubblicazione: (2026)
Speaker Diarization for Low-Resource Languages Through Wav2vec Fine-Tuning
di: Abdullah, Abdulhady Abas, et al.
Pubblicazione: (2025)
di: Abdullah, Abdulhady Abas, et al.
Pubblicazione: (2025)
Efficient Model Development through Fine-tuning Transfer
di: Lin, Pin-Jie, et al.
Pubblicazione: (2025)
di: Lin, Pin-Jie, et al.
Pubblicazione: (2025)
From melodic note sequences to pitches using word2vec
di: Defays, Daniel
Pubblicazione: (2024)
di: Defays, Daniel
Pubblicazione: (2024)
Using Optimal Transport as Alignment Objective for fine-tuning Multilingual Contextualized Embeddings
di: Alqahtani, Sawsan, et al.
Pubblicazione: (2021)
di: Alqahtani, Sawsan, et al.
Pubblicazione: (2021)
Stage-wise Fine-tuning for Graph-to-Text Generation
di: Wang, Qingyun, et al.
Pubblicazione: (2021)
di: Wang, Qingyun, et al.
Pubblicazione: (2021)
The Importance of Online Data: Understanding Preference Fine-tuning via Coverage
di: Song, Yuda, et al.
Pubblicazione: (2024)
di: Song, Yuda, et al.
Pubblicazione: (2024)
PERCORE: A Deep Learning-Based Framework for Persian Spelling Correction with Phonetic Analysis
di: Dashti, Seyed Mohammad Sadegh, et al.
Pubblicazione: (2024)
di: Dashti, Seyed Mohammad Sadegh, et al.
Pubblicazione: (2024)
Context Engineering 2.0: The Context of Context Engineering
di: Hua, Qishuo, et al.
Pubblicazione: (2025)
di: Hua, Qishuo, et al.
Pubblicazione: (2025)
EoRA: Fine-tuning-free Compensation for Compressed LLM with Eigenspace Low-Rank Approximation
di: Liu, Shih-Yang, et al.
Pubblicazione: (2024)
di: Liu, Shih-Yang, et al.
Pubblicazione: (2024)
WavSLM: Single-Stream Speech Language Modeling via WavLM Distillation
di: Della Libera, Luca, et al.
Pubblicazione: (2026)
di: Della Libera, Luca, et al.
Pubblicazione: (2026)
CPT-Boosted Wav2vec2.0: Towards Noise Robust Speech Recognition for Classroom Environments
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2024)
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2024)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning
di: Wu, Bohao, et al.
Pubblicazione: (2025)
di: Wu, Bohao, et al.
Pubblicazione: (2025)
Fine-tuning Language Models for Recipe Generation: A Comparative Analysis and Benchmark Study
di: Vij, Anneketh, et al.
Pubblicazione: (2025)
di: Vij, Anneketh, et al.
Pubblicazione: (2025)
You shall know a piece by the company it keeps. Chess plays as a data for word2vec models
di: Orekhov, Boris
Pubblicazione: (2024)
di: Orekhov, Boris
Pubblicazione: (2024)
Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
di: Wang, Yibo, et al.
Pubblicazione: (2025)
di: Wang, Yibo, et al.
Pubblicazione: (2025)
nvBench 2.0: Resolving Ambiguity in Text-to-Visualization through Stepwise Reasoning
di: Luo, Tianqi, et al.
Pubblicazione: (2025)
di: Luo, Tianqi, et al.
Pubblicazione: (2025)
Automatic Essay Multi-dimensional Scoring with Fine-tuning and Multiple Regression
di: Sun, Kun, et al.
Pubblicazione: (2024)
di: Sun, Kun, et al.
Pubblicazione: (2024)
Exploring ASR-Based Wav2Vec2 for Automated Speech Disorder Assessment: Insights and Analysis
di: Nguyen, Tuan, et al.
Pubblicazione: (2024)
di: Nguyen, Tuan, et al.
Pubblicazione: (2024)
Understanding Privacy Risks of Embeddings Induced by Large Language Models
di: Zhu, Zhihao, et al.
Pubblicazione: (2024)
di: Zhu, Zhihao, et al.
Pubblicazione: (2024)
LLMs Know More Than Words: A Genre Study with Syntax, Metaphor & Phonetics
di: Shi, Weiye, et al.
Pubblicazione: (2025)
di: Shi, Weiye, et al.
Pubblicazione: (2025)
NeurIPS 2023 LLM Efficiency Fine-tuning Competition
di: Saroufim, Mark, et al.
Pubblicazione: (2025)
di: Saroufim, Mark, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Continued Pretraining for Domain Adaptation of Wav2vec2.0 in Automatic Speech Recognition for Elementary Math Classroom Settings
di: Attia, Ahmed Adel, et al.
Pubblicazione: (2024) -
Human-like Linguistic Biases in Neural Speech Models: Phonetic Categorization and Phonotactic Constraints in Wav2Vec2.0
di: Kloots, Marianne de Heer, et al.
Pubblicazione: (2024) -
Demographic Attributes Prediction from Speech Using WavLM Embeddings
di: Yang, Yuchen, et al.
Pubblicazione: (2025) -
WavFusion: Towards wav2vec 2.0 Multimodal Speech Emotion Recognition
di: Li, Feng, et al.
Pubblicazione: (2024) -
mini-vec2vec: Scaling Universal Geometry Alignment with Linear Transformations
di: Dar, Guy
Pubblicazione: (2025)