PWESuite: Phonetic Word Embeddings and Tasks They Facilitate
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zouhar, Vilém, Chang, Kalvin, Cui, Chenxuan, Carlson, Nathaniel, Robinson, Nathaniel, Sachan, Mrinmaya, Mortensen, David |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
How to Select Datapoints for Efficient Human Evaluation of NLG Models?
par: Zouhar, Vilém, et autres
Publié: (2025)
par: Zouhar, Vilém, et autres
Publié: (2025)
AI-Assisted Human Evaluation of Machine Translation
par: Zouhar, Vilém, et autres
Publié: (2024)
par: Zouhar, Vilém, et autres
Publié: (2024)
How to Engage Your Readers? Generating Guiding Questions to Promote Active Reading
par: Cui, Peng, et autres
Publié: (2024)
par: Cui, Peng, et autres
Publié: (2024)
AutoTutor meets Large Language Models: A Language Model Tutor with Rich Pedagogy and Guardrails
par: Chowdhury, Sankalan Pal, et autres
Publié: (2024)
par: Chowdhury, Sankalan Pal, et autres
Publié: (2024)
Multilingual Performance Biases of Large Language Models in Education
par: Gupta, Vansh, et autres
Publié: (2025)
par: Gupta, Vansh, et autres
Publié: (2025)
Early-Exit and Instant Confidence Translation Quality Estimation
par: Zouhar, Vilém, et autres
Publié: (2025)
par: Zouhar, Vilém, et autres
Publié: (2025)
Stolen Subwords: Importance of Vocabularies for Machine Translation Model Stealing
par: Zouhar, Vilém
Publié: (2024)
par: Zouhar, Vilém
Publié: (2024)
RELIC: Investigating Large Language Model Responses using Self-Consistency
par: Cheng, Furui, et autres
Publié: (2023)
par: Cheng, Furui, et autres
Publié: (2023)
Automating Sound Change Prediction for Phylogenetic Inference: A Tukanoan Case Study
par: Chang, Kalvin, et autres
Publié: (2024)
par: Chang, Kalvin, et autres
Publié: (2024)
COMET-poly: Machine Translation Metric Grounded in Other Candidates
par: Züfle, Maike, et autres
Publié: (2025)
par: Züfle, Maike, et autres
Publié: (2025)
A Formal Perspective on Byte-Pair Encoding
par: Zouhar, Vilém, et autres
Publié: (2023)
par: Zouhar, Vilém, et autres
Publié: (2023)
Error Span Annotation: A Balanced Approach for Human Evaluation of Machine Translation
par: Kocmi, Tom, et autres
Publié: (2024)
par: Kocmi, Tom, et autres
Publié: (2024)
Investigating the Zone of Proximal Development of Language Models for In-Context Learning
par: Cui, Peng, et autres
Publié: (2025)
par: Cui, Peng, et autres
Publié: (2025)
Quality and Quantity of Machine Translation References for Automatic Metrics
par: Zouhar, Vilém, et autres
Publié: (2024)
par: Zouhar, Vilém, et autres
Publié: (2024)
Pearmut: Human Evaluation of Translation Made Trivial
par: Zouhar, Vilém, et autres
Publié: (2026)
par: Zouhar, Vilém, et autres
Publié: (2026)
POWSM: A Phonetic Open Whisper-Style Speech Foundation Model
par: Li, Chin-Jou, et autres
Publié: (2025)
par: Li, Chin-Jou, et autres
Publié: (2025)
Unsupervised Word-level Quality Estimation for Machine Translation Through the Lens of Annotators (Dis)agreement
par: Sarti, Gabriele, et autres
Publié: (2025)
par: Sarti, Gabriele, et autres
Publié: (2025)
Can Reasoning Help Large Language Models Capture Human Annotator Disagreement?
par: Ni, Jingwei, et autres
Publié: (2025)
par: Ni, Jingwei, et autres
Publié: (2025)
Multimodal Shannon Game with Images
par: Zouhar, Vilém, et autres
Publié: (2023)
par: Zouhar, Vilém, et autres
Publié: (2023)
Distributional Properties of Subword Regularization
par: Cognetta, Marco, et autres
Publié: (2024)
par: Cognetta, Marco, et autres
Publié: (2024)
Can Large Language Models Code Like a Linguist?: A Case Study in Low Resource Sound Law Induction
par: Naik, Atharva, et autres
Publié: (2024)
par: Naik, Atharva, et autres
Publié: (2024)
Phonotactic Complexity across Dialects
par: Shim, Ryan Soh-Eun, et autres
Publié: (2024)
par: Shim, Ryan Soh-Eun, et autres
Publié: (2024)
QE4PE: Word-level Quality Estimation for Human Post-Editing
par: Sarti, Gabriele, et autres
Publié: (2025)
par: Sarti, Gabriele, et autres
Publié: (2025)
Grammar Control in Dialogue Response Generation for Language Learning Chatbots
par: Glandorf, Dominik, et autres
Publié: (2025)
par: Glandorf, Dominik, et autres
Publié: (2025)
Programming by Examples Meets Historical Linguistics: A Large Language Model Based Approach to Sound Law Induction
par: Naik, Atharva, et autres
Publié: (2025)
par: Naik, Atharva, et autres
Publié: (2025)
What Do Language Models Learn in Context? The Structured Task Hypothesis
par: Li, Jiaoda, et autres
Publié: (2024)
par: Li, Jiaoda, et autres
Publié: (2024)
Evaluating Optimal Reference Translations
par: Zouhar, Vilém, et autres
Publié: (2023)
par: Zouhar, Vilém, et autres
Publié: (2023)
Navigating the Metrics Maze: Reconciling Score Magnitudes and Accuracies
par: Kocmi, Tom, et autres
Publié: (2024)
par: Kocmi, Tom, et autres
Publié: (2024)
Biased Tales: Cultural and Topic Bias in Generating Children's Stories
par: Rooein, Donya, et autres
Publié: (2025)
par: Rooein, Donya, et autres
Publié: (2025)
A Bayesian Optimization Approach to Machine Translation Reranking
par: Cheng, Julius, et autres
Publié: (2024)
par: Cheng, Julius, et autres
Publié: (2024)
Two Counterexamples to Tokenization and the Noiseless Channel
par: Cognetta, Marco, et autres
Publié: (2024)
par: Cognetta, Marco, et autres
Publié: (2024)
Generating Pedagogically Meaningful Visuals for Math Word Problems: A New Benchmark and Analysis of Text-to-Image Models
par: Wang, Junling, et autres
Publié: (2025)
par: Wang, Junling, et autres
Publié: (2025)
Neural Proto-Language Reconstruction
par: Cui, Chenxuan, et autres
Publié: (2024)
par: Cui, Chenxuan, et autres
Publié: (2024)
DialUp! Modeling the Language Continuum by Adapting Models to Dialects and Dialects to Models
par: Bafna, Niyati, et autres
Publié: (2025)
par: Bafna, Niyati, et autres
Publié: (2025)
Probing for Arithmetic Errors in Language Models
par: Sun, Yucheng, et autres
Publié: (2025)
par: Sun, Yucheng, et autres
Publié: (2025)
Automated Knowledge Concept Annotation and Question Representation Learning for Knowledge Tracing
par: Ozyurt, Yilmazcan, et autres
Publié: (2024)
par: Ozyurt, Yilmazcan, et autres
Publié: (2024)
The Medium Is Not the Message: Deconfounding Document Embeddings via Linear Concept Erasure
par: Fan, Yu, et autres
Publié: (2025)
par: Fan, Yu, et autres
Publié: (2025)
Towards Comprehensive Semantic Speech Embeddings for Chinese Dialects
par: Chang, Kalvin, et autres
Publié: (2026)
par: Chang, Kalvin, et autres
Publié: (2026)
Estimating Machine Translation Difficulty
par: Proietti, Lorenzo, et autres
Publié: (2025)
par: Proietti, Lorenzo, et autres
Publié: (2025)
Co-DETECT: Collaborative Discovery of Edge Cases in Text Classification
par: Xiong, Chenfei, et autres
Publié: (2025)
par: Xiong, Chenfei, et autres
Publié: (2025)
Documents similaires
-
How to Select Datapoints for Efficient Human Evaluation of NLG Models?
par: Zouhar, Vilém, et autres
Publié: (2025) -
AI-Assisted Human Evaluation of Machine Translation
par: Zouhar, Vilém, et autres
Publié: (2024) -
How to Engage Your Readers? Generating Guiding Questions to Promote Active Reading
par: Cui, Peng, et autres
Publié: (2024) -
AutoTutor meets Large Language Models: A Language Model Tutor with Rich Pedagogy and Guardrails
par: Chowdhury, Sankalan Pal, et autres
Publié: (2024) -
Multilingual Performance Biases of Large Language Models in Education
par: Gupta, Vansh, et autres
Publié: (2025)