Pushing the Limits of Zero-shot End-to-End Speech Translation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tsiamas, Ioannis, Gállego, Gerard I., Fonollosa, José A. R., Costa-jussà, Marta R. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Language and Modality Transfer in Translation by Character-level Modeling
par: Tsiamas, Ioannis, et autres
Publié: (2025)
par: Tsiamas, Ioannis, et autres
Publié: (2025)
Unveiling the Role of Pretraining in Direct Speech Translation
par: Alastruey, Belen, et autres
Publié: (2024)
par: Alastruey, Belen, et autres
Publié: (2024)
SpeechAlign: a Framework for Speech Translation Alignment Evaluation
par: Alastruey, Belen, et autres
Publié: (2023)
par: Alastruey, Belen, et autres
Publié: (2023)
Speech is More Than Words: Do Speech-to-Text Translation Systems Leverage Prosody?
par: Tsiamas, Ioannis, et autres
Publié: (2024)
par: Tsiamas, Ioannis, et autres
Publié: (2024)
A Case Study on Filtering for End-to-End Speech Translation
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024)
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024)
Representation Purification for End-to-End Speech Translation
par: Zhang, Chengwei, et autres
Publié: (2024)
par: Zhang, Chengwei, et autres
Publié: (2024)
On the Similarity of Circuits across Languages: a Case Study on the Subject-verb Agreement Task
par: Ferrando, Javier, et autres
Publié: (2024)
par: Ferrando, Javier, et autres
Publié: (2024)
End-to-End Evaluation for Low-Latency Simultaneous Speech Translation
par: Huber, Christian, et autres
Publié: (2023)
par: Huber, Christian, et autres
Publié: (2023)
End-to-End Speech-to-Text Translation: A Survey
par: Sethiya, Nivedita, et autres
Publié: (2023)
par: Sethiya, Nivedita, et autres
Publié: (2023)
Gender-specific Machine Translation with Large Language Models
par: Sánchez, Eduardo, et autres
Publié: (2023)
par: Sánchez, Eduardo, et autres
Publié: (2023)
Revisiting Direct Speech-to-Text Translation with Speech LLMs: Better Scaling than CoT Prompting?
par: Pareras, Oriol, et autres
Publié: (2025)
par: Pareras, Oriol, et autres
Publié: (2025)
Recent Advances in End-to-End Simultaneous Speech Translation
par: Liu, Xiaoqian, et autres
Publié: (2024)
par: Liu, Xiaoqian, et autres
Publié: (2024)
Translate, then Detect: Leveraging Machine Translation for Cross-Lingual Toxicity Classification
par: Bell, Samuel J., et autres
Publié: (2025)
par: Bell, Samuel J., et autres
Publié: (2025)
Joint Training And Decoding for Multilingual End-to-End Simultaneous Speech Translation
par: Huang, Wuwei, et autres
Publié: (2025)
par: Huang, Wuwei, et autres
Publié: (2025)
Listening or Reading? Evaluating Speech Awareness in Chain-of-Thought Speech-to-Text Translation
par: Romero-Díaz, Jacobo, et autres
Publié: (2025)
par: Romero-Díaz, Jacobo, et autres
Publié: (2025)
DTW-Align: Bridging the Modality Gap in End-to-End Speech Translation with Dynamic Time Warping Alignment
par: Issam, Abderrahmane, et autres
Publié: (2025)
par: Issam, Abderrahmane, et autres
Publié: (2025)
A Non-autoregressive Generation Framework for End-to-End Simultaneous Speech-to-Speech Translation
par: Ma, Zhengrui, et autres
Publié: (2024)
par: Ma, Zhengrui, et autres
Publié: (2024)
Leveraging Synthetic Audio Data for End-to-End Low-Resource Speech Translation
par: Moslem, Yasmin
Publié: (2024)
par: Moslem, Yasmin
Publié: (2024)
End-to-End Intracortical Speech Decoding from Neural Activity
par: Khanday, Owais Mujtaba, et autres
Publié: (2026)
par: Khanday, Owais Mujtaba, et autres
Publié: (2026)
End-to-End Speech Translation for Low-Resource Languages Using Weakly Labeled Data
par: Pothula, Aishwarya, et autres
Publié: (2025)
par: Pothula, Aishwarya, et autres
Publié: (2025)
End-to-end Automatic Speech Recognition and Speech Translation: Integration of Speech Foundational Models and LLMs
par: Luu, Nam, et autres
Publié: (2025)
par: Luu, Nam, et autres
Publié: (2025)
WildSpeech-Bench: Benchmarking End-to-End SpeechLLMs in the Wild
par: Zhang, Linhao, et autres
Publié: (2025)
par: Zhang, Linhao, et autres
Publié: (2025)
When End-to-End is Overkill: Rethinking Cascaded Speech-to-Text Translation
par: Min, Anna, et autres
Publié: (2025)
par: Min, Anna, et autres
Publié: (2025)
Soft Language Identification for Language-Agnostic Many-to-One End-to-End Speech Translation
par: Wang, Peidong, et autres
Publié: (2024)
par: Wang, Peidong, et autres
Publié: (2024)
Long-Form End-to-End Speech Translation via Latent Alignment Segmentation
par: Polák, Peter, et autres
Publié: (2023)
par: Polák, Peter, et autres
Publié: (2023)
AdaST: Dynamically Adapting Encoder States in the Decoder for End-to-End Speech-to-Text Translation
par: Huang, Wuwei, et autres
Publié: (2025)
par: Huang, Wuwei, et autres
Publié: (2025)
StutterZero and StutterFormer: End-to-End Speech Conversion for Stuttering Transcription and Correction
par: Xu, Qianheng
Publié: (2025)
par: Xu, Qianheng
Publié: (2025)
MuTox: Universal MUltilingual Audio-based TOXicity Dataset and Zero-shot Detector
par: Costa-jussà, Marta R., et autres
Publié: (2024)
par: Costa-jussà, Marta R., et autres
Publié: (2024)
Cross-modality Data Augmentation for End-to-End Sign Language Translation
par: Ye, Jinhui, et autres
Publié: (2023)
par: Ye, Jinhui, et autres
Publié: (2023)
A Primer on the Inner Workings of Transformer-based Language Models
par: Ferrando, Javier, et autres
Publié: (2024)
par: Ferrando, Javier, et autres
Publié: (2024)
HITSZ's End-To-End Speech Translation Systems Combining Sequence-to-Sequence Auto Speech Recognition Model and Indic Large Language Model for IWSLT 2025 in Indic Track
par: Wei, Xuchen, et autres
Publié: (2025)
par: Wei, Xuchen, et autres
Publié: (2025)
Harnessing the Zero-Shot Power of Instruction-Tuned Large Language Model in End-to-End Speech Recognition
par: Higuchi, Yosuke, et autres
Publié: (2023)
par: Higuchi, Yosuke, et autres
Publié: (2023)
End-to-End Training for Back-Translation with Categorical Reparameterization Trick
par: Heo, DongNyeong, et autres
Publié: (2022)
par: Heo, DongNyeong, et autres
Publié: (2022)
BOUQuET: dataset, Benchmark and Open initiative for Universal Quality Evaluation in Translation
par: The Omnilingual MT Team, et autres
Publié: (2025)
par: The Omnilingual MT Team, et autres
Publié: (2025)
Growing Trees on Sounds: Assessing Strategies for End-to-End Dependency Parsing of Speech
par: Pupier, Adrien, et autres
Publié: (2024)
par: Pupier, Adrien, et autres
Publié: (2024)
LELA: An End-to-end LLM-based Entity Linking Framework with Zero-shot Domain Adaptation
par: Haffoudhi, Samy, et autres
Publié: (2026)
par: Haffoudhi, Samy, et autres
Publié: (2026)
LLaST: Improved End-to-end Speech Translation System Leveraged by Large Language Models
par: Chen, Xi, et autres
Publié: (2024)
par: Chen, Xi, et autres
Publié: (2024)
Translatotron-V(ison): An End-to-End Model for In-Image Machine Translation
par: Lan, Zhibin, et autres
Publié: (2024)
par: Lan, Zhibin, et autres
Publié: (2024)
Enhancing Speech-to-Speech Dialogue Modeling with End-to-End Retrieval-Augmented Generation
par: Feng, Pengchao, et autres
Publié: (2025)
par: Feng, Pengchao, et autres
Publié: (2025)
With Good MT There is No Need For End-to-End: A Case for Translate-then-Summarize Cross-lingual Summarization
par: Varab, Daniel, et autres
Publié: (2024)
par: Varab, Daniel, et autres
Publié: (2024)
Documents similaires
-
Improving Language and Modality Transfer in Translation by Character-level Modeling
par: Tsiamas, Ioannis, et autres
Publié: (2025) -
Unveiling the Role of Pretraining in Direct Speech Translation
par: Alastruey, Belen, et autres
Publié: (2024) -
SpeechAlign: a Framework for Speech Translation Alignment Evaluation
par: Alastruey, Belen, et autres
Publié: (2023) -
Speech is More Than Words: Do Speech-to-Text Translation Systems Leverage Prosody?
par: Tsiamas, Ioannis, et autres
Publié: (2024) -
A Case Study on Filtering for End-to-End Speech Translation
par: Alam, Md Mahfuz Ibn, et autres
Publié: (2024)