SpeechAlign: a Framework for Speech Translation Alignment Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Alastruey, Belen, Sant, Aleix, Gállego, Gerard I., Dale, David, Costa-jussà, Marta R. |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unveiling the Role of Pretraining in Direct Speech Translation
par: Alastruey, Belen, et autres
Publié: (2024)
par: Alastruey, Belen, et autres
Publié: (2024)
Pushing the Limits of Zero-shot End-to-End Speech Translation
par: Tsiamas, Ioannis, et autres
Publié: (2024)
par: Tsiamas, Ioannis, et autres
Publié: (2024)
SpeechAlign: Aligning Speech Generation to Human Preferences
par: Zhang, Dong, et autres
Publié: (2024)
par: Zhang, Dong, et autres
Publié: (2024)
Improving Language and Modality Transfer in Translation by Character-level Modeling
par: Tsiamas, Ioannis, et autres
Publié: (2025)
par: Tsiamas, Ioannis, et autres
Publié: (2025)
Listening or Reading? Evaluating Speech Awareness in Chain-of-Thought Speech-to-Text Translation
par: Romero-Díaz, Jacobo, et autres
Publié: (2025)
par: Romero-Díaz, Jacobo, et autres
Publié: (2025)
Linguini: A benchmark for language-agnostic linguistic reasoning
par: Sánchez, Eduardo, et autres
Publié: (2024)
par: Sánchez, Eduardo, et autres
Publié: (2024)
Revisiting Direct Speech-to-Text Translation with Speech LLMs: Better Scaling than CoT Prompting?
par: Pareras, Oriol, et autres
Publié: (2025)
par: Pareras, Oriol, et autres
Publié: (2025)
2M-BELEBELE: Highly Multilingual Speech and American Sign Language Comprehension Dataset
par: Costa-jussà, Marta R., et autres
Publié: (2024)
par: Costa-jussà, Marta R., et autres
Publié: (2024)
Interference Matrix: Quantifying Cross-Lingual Interference in Transformer Encoders
par: Alastruey, Belen, et autres
Publié: (2025)
par: Alastruey, Belen, et autres
Publié: (2025)
Translate, then Detect: Leveraging Machine Translation for Cross-Lingual Toxicity Classification
par: Bell, Samuel J., et autres
Publié: (2025)
par: Bell, Samuel J., et autres
Publié: (2025)
POTSA: A Cross-Lingual Speech Alignment Framework for Speech-to-Text Translation
par: Li, Xuanchen, et autres
Publié: (2025)
par: Li, Xuanchen, et autres
Publié: (2025)
On the Similarity of Circuits across Languages: a Case Study on the Subject-verb Agreement Task
par: Ferrando, Javier, et autres
Publié: (2024)
par: Ferrando, Javier, et autres
Publié: (2024)
Simultaneous Speech-to-Speech Translation Without Aligned Data
par: Labiausse, Tom, et autres
Publié: (2026)
par: Labiausse, Tom, et autres
Publié: (2026)
Gender-specific Machine Translation with Large Language Models
par: Sánchez, Eduardo, et autres
Publié: (2023)
par: Sánchez, Eduardo, et autres
Publié: (2023)
DTW-Align: Bridging the Modality Gap in End-to-End Speech Translation with Dynamic Time Warping Alignment
par: Issam, Abderrahmane, et autres
Publié: (2025)
par: Issam, Abderrahmane, et autres
Publié: (2025)
RosettaSpeech: Zero-Shot Speech-to-Speech Translation without Parallel Speech
par: Zheng, Zhisheng, et autres
Publié: (2025)
par: Zheng, Zhisheng, et autres
Publié: (2025)
Speech-to-Text Translation with Phoneme-Augmented CoT: Enhancing Cross-Lingual Transfer in Low-Resource Scenarios
par: Gállego, Gerard I., et autres
Publié: (2025)
par: Gállego, Gerard I., et autres
Publié: (2025)
AlignAtt: Using Attention-based Audio-Translation Alignments as a Guide for Simultaneous Speech Translation
par: Papi, Sara, et autres
Publié: (2023)
par: Papi, Sara, et autres
Publié: (2023)
Hearing to Translate: The Effectiveness of Speech Modality Integration into LLMs
par: Papi, Sara, et autres
Publié: (2025)
par: Papi, Sara, et autres
Publié: (2025)
Adaptive Inner Speech-Text Alignment for LLM-based Speech Translation
par: Liu, Henglyu, et autres
Publié: (2025)
par: Liu, Henglyu, et autres
Publié: (2025)
Streaming Translation and Transcription Through Speech-to-Text Causal Alignment
par: Koshkin, Roman, et autres
Publié: (2026)
par: Koshkin, Roman, et autres
Publié: (2026)
Evaluation of Pose Estimation Systems for Sign Language Translation
par: O'Brien, Catherine, et autres
Publié: (2026)
par: O'Brien, Catherine, et autres
Publié: (2026)
Omnilingual SONAR: Cross-Lingual and Cross-Modal Sentence Embeddings Bridging Massively Multilingual Text and Speech
par: Omnilingual SONAR Team, et autres
Publié: (2026)
par: Omnilingual SONAR Team, et autres
Publié: (2026)
Continuous Rating as Reliable Human Evaluation of Simultaneous Speech Translation
par: Javorský, Dávid, et autres
Publié: (2022)
par: Javorský, Dávid, et autres
Publié: (2022)
Optimizing Multilingual LLMs via Federated Learning: A Study of Client Language Composition
par: Sant, Aleix, et autres
Publié: (2026)
par: Sant, Aleix, et autres
Publié: (2026)
CoSTA: Code-Switched Speech Translation using Aligned Speech-Text Interleaving
par: Shankar, Bhavani, et autres
Publié: (2024)
par: Shankar, Bhavani, et autres
Publié: (2024)
Textless Speech-to-Speech Translation With Limited Parallel Data
par: Diwan, Anuj, et autres
Publié: (2023)
par: Diwan, Anuj, et autres
Publié: (2023)
SpeechT: Findings of the First Mentorship in Speech Translation
par: Moslem, Yasmin, et autres
Publié: (2025)
par: Moslem, Yasmin, et autres
Publié: (2025)
SpeechQE: Estimating the Quality of Direct Speech Translation
par: Han, HyoJung, et autres
Publié: (2024)
par: Han, HyoJung, et autres
Publié: (2024)
Speech Vecalign: an Embedding-based Method for Aligning Parallel Speech Documents
par: Meng, Chutong, et autres
Publié: (2025)
par: Meng, Chutong, et autres
Publié: (2025)
Speech-to-Speech Translation Pipelines for Conversations in Low-Resource Languages
par: Popescu-Belis, Andrei, et autres
Publié: (2025)
par: Popescu-Belis, Andrei, et autres
Publié: (2025)
A Primer on the Inner Workings of Transformer-based Language Models
par: Ferrando, Javier, et autres
Publié: (2024)
par: Ferrando, Javier, et autres
Publié: (2024)
Speech to Speech Translation with Translatotron: A State of the Art Review
par: Kala, Jules R., et autres
Publié: (2025)
par: Kala, Jules R., et autres
Publié: (2025)
Whisper-UT: A Unified Translation Framework for Speech and Text
par: Xiao, Cihan, et autres
Publié: (2025)
par: Xiao, Cihan, et autres
Publié: (2025)
On the Role of Speech Data in Reducing Toxicity Detection Bias
par: Bell, Samuel J., et autres
Publié: (2024)
par: Bell, Samuel J., et autres
Publié: (2024)
End-to-end Automatic Speech Recognition and Speech Translation: Integration of Speech Foundational Models and LLMs
par: Luu, Nam, et autres
Publié: (2025)
par: Luu, Nam, et autres
Publié: (2025)
PROST-LLM: Progressively Enhancing the Speech-to-Speech Translation Capability in LLMs
par: Xu, Jing, et autres
Publié: (2026)
par: Xu, Jing, et autres
Publié: (2026)
Cued Speech Generation Leveraging a Pre-trained Audiovisual Text-to-Speech Model
par: Sankar, Sanjana, et autres
Publié: (2025)
par: Sankar, Sanjana, et autres
Publié: (2025)
Exploring the Correlation between Human and Machine Evaluation of Simultaneous Speech Translation
par: Wang, Xiaoman, et autres
Publié: (2024)
par: Wang, Xiaoman, et autres
Publié: (2024)
"Is Hate Lost in Translation?": Evaluation of Multilingual LGBTQIA+ Hate Speech Detection
par: Chan, Fai Leui, et autres
Publié: (2024)
par: Chan, Fai Leui, et autres
Publié: (2024)
Documents similaires
-
Unveiling the Role of Pretraining in Direct Speech Translation
par: Alastruey, Belen, et autres
Publié: (2024) -
Pushing the Limits of Zero-shot End-to-End Speech Translation
par: Tsiamas, Ioannis, et autres
Publié: (2024) -
SpeechAlign: Aligning Speech Generation to Human Preferences
par: Zhang, Dong, et autres
Publié: (2024) -
Improving Language and Modality Transfer in Translation by Character-level Modeling
par: Tsiamas, Ioannis, et autres
Publié: (2025) -
Listening or Reading? Evaluating Speech Awareness in Chain-of-Thought Speech-to-Text Translation
par: Romero-Díaz, Jacobo, et autres
Publié: (2025)