LangMark: A Multilingual Dataset for Automatic Post-Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Velazquez, Diego, Grace, Mikaela, Karageorgos, Konstantinos, Carin, Lawrence, Schliem, Aaron, Zaikis, Dimitrios, Wechsler, Roger |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Together We Can: Multilingual Automatic Post-Editing for Low-Resource Languages
por: Deoghare, Sourabh, et al.
Publicado: (2024)
por: Deoghare, Sourabh, et al.
Publicado: (2024)
LangBridge: Multilingual Reasoning Without Multilingual Supervision
por: Yoon, Dongkeun, et al.
Publicado: (2024)
por: Yoon, Dongkeun, et al.
Publicado: (2024)
LangSAMP: Language-Script Aware Multilingual Pretraining
por: Liu, Yihong, et al.
Publicado: (2024)
por: Liu, Yihong, et al.
Publicado: (2024)
ViClaim: A Multilingual Multilabel Dataset for Automatic Claim Detection in Videos
por: Giedemann, Patrick, et al.
Publicado: (2025)
por: Giedemann, Patrick, et al.
Publicado: (2025)
Editing Across Languages: A Survey of Multilingual Knowledge Editing
por: Durrani, Nadir, et al.
Publicado: (2025)
por: Durrani, Nadir, et al.
Publicado: (2025)
NLAS-multi: A Multilingual Corpus of Automatically Generated Natural Language Argumentation Schemes
por: Ruiz-Dolz, Ramon, et al.
Publicado: (2024)
por: Ruiz-Dolz, Ramon, et al.
Publicado: (2024)
Do LLMs Truly Benefit from Longer Context in Automatic Post-Editing?
por: Kim, Ahrii, et al.
Publicado: (2026)
por: Kim, Ahrii, et al.
Publicado: (2026)
MALAMUTE: A Multilingual, Highly-granular, Template-free, Education-based Probing Dataset
por: Shaier, Sagi, et al.
Publicado: (2024)
por: Shaier, Sagi, et al.
Publicado: (2024)
Building Multilingual Datasets for Predicting Mental Health Severity through LLMs: Prospects and Challenges
por: Skianis, Konstantinos, et al.
Publicado: (2024)
por: Skianis, Konstantinos, et al.
Publicado: (2024)
OffensiveLang: A Community Based Implicit Offensive Language Dataset
por: Das, Amit, et al.
Publicado: (2024)
por: Das, Amit, et al.
Publicado: (2024)
Advancing Semi-Supervised Learning for Automatic Post-Editing: Data-Synthesis by Mask-Infilling with Erroneous Terms
por: Lee, Wonkee, et al.
Publicado: (2022)
por: Lee, Wonkee, et al.
Publicado: (2022)
Giving the Old a Fresh Spin: Quality Estimation-Assisted Constrained Decoding for Automatic Post-Editing
por: Deoghare, Sourabh, et al.
Publicado: (2025)
por: Deoghare, Sourabh, et al.
Publicado: (2025)
Text Adaptation to Plain Language and Easy Read via Automatic Post-Editing Cycles
por: Calleja, Jesús, et al.
Publicado: (2025)
por: Calleja, Jesús, et al.
Publicado: (2025)
LangGPS: Language Separability Guided Data Pre-Selection for Joint Multilingual Instruction Tuning
por: Ye, Yangfan, et al.
Publicado: (2025)
por: Ye, Yangfan, et al.
Publicado: (2025)
MQM-APE: Toward High-Quality Error Annotation Predictors with Automatic Post-Editing in LLM Translation Evaluators
por: Lu, Qingyu, et al.
Publicado: (2024)
por: Lu, Qingyu, et al.
Publicado: (2024)
Mark My Words: A Robust Multilingual Model for Punctuation in Text and Speech Transcripts
por: Pulipaka, Sidharth, et al.
Publicado: (2025)
por: Pulipaka, Sidharth, et al.
Publicado: (2025)
Multilingual Knowledge Editing with Language-Agnostic Factual Neurons
por: Zhang, Xue, et al.
Publicado: (2024)
por: Zhang, Xue, et al.
Publicado: (2024)
Cross-lingual Editing in Multilingual Language Models
por: Beniwal, Himanshu, et al.
Publicado: (2024)
por: Beniwal, Himanshu, et al.
Publicado: (2024)
Datasets for Multilingual Answer Sentence Selection
por: Gabburo, Matteo, et al.
Publicado: (2024)
por: Gabburo, Matteo, et al.
Publicado: (2024)
GeniL: A Multilingual Dataset on Generalizing Language
por: Davani, Aida Mostafazadeh, et al.
Publicado: (2024)
por: Davani, Aida Mostafazadeh, et al.
Publicado: (2024)
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
por: Wei, Zihao, et al.
Publicado: (2024)
por: Wei, Zihao, et al.
Publicado: (2024)
Efficiently Identifying Low-Quality Language Subsets in Multilingual Datasets: A Case Study on a Large-Scale Multilingual Audio Dataset
por: Samir, Farhan, et al.
Publicado: (2024)
por: Samir, Farhan, et al.
Publicado: (2024)
A Multilingual Similarity Dataset for News Article Frame
por: Chen, Xi, et al.
Publicado: (2024)
por: Chen, Xi, et al.
Publicado: (2024)
Controlled Evaluation of Syntactic Knowledge in Multilingual Language Models
por: Kryvosheieva, Daria, et al.
Publicado: (2024)
por: Kryvosheieva, Daria, et al.
Publicado: (2024)
Multilingual Topic Classification in X: Dataset and Analysis
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
D-GEN: Automatic Distractor Generation and Evaluation for Reliable Assessment of Generative Model
por: Byun, Grace, et al.
Publicado: (2025)
por: Byun, Grace, et al.
Publicado: (2025)
MEMLA: Enhancing Multilingual Knowledge Editing with Neuron-Masked Low-Rank Adaptation
por: Xie, Jiakuan, et al.
Publicado: (2024)
por: Xie, Jiakuan, et al.
Publicado: (2024)
Enhancing Grammatical Error Detection using BERT with Cleaned Lang-8 Dataset
por: Nihalani, Rahul, et al.
Publicado: (2024)
por: Nihalani, Rahul, et al.
Publicado: (2024)
Poisoned LangChain: Jailbreak LLMs by LangChain
por: Wang, Ziqiu, et al.
Publicado: (2024)
por: Wang, Ziqiu, et al.
Publicado: (2024)
StAyaL | Multilingual Style Transfer
por: Thakrar, Karishma, et al.
Publicado: (2025)
por: Thakrar, Karishma, et al.
Publicado: (2025)
Multilingual Models for Check-Worthy Social Media Posts Detection
por: Kula, Sebastian, et al.
Publicado: (2024)
por: Kula, Sebastian, et al.
Publicado: (2024)
Mitigating Negative Interference in Multilingual Sequential Knowledge Editing through Null-Space Constraints
por: Sun, Wei, et al.
Publicado: (2025)
por: Sun, Wei, et al.
Publicado: (2025)
Taxi1500: A Multilingual Dataset for Text Classification in 1500 Languages
por: Ma, Chunlan, et al.
Publicado: (2023)
por: Ma, Chunlan, et al.
Publicado: (2023)
AfriVoices-KE: A Multilingual Speech Dataset for Kenyan Languages
por: Wanzare, Lilian, et al.
Publicado: (2026)
por: Wanzare, Lilian, et al.
Publicado: (2026)
A New Massive Multilingual Dataset for High-Performance Language Technologies
por: de Gibert, Ona, et al.
Publicado: (2024)
por: de Gibert, Ona, et al.
Publicado: (2024)
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
por: O'Brien, Dayyán, et al.
Publicado: (2025)
por: O'Brien, Dayyán, et al.
Publicado: (2025)
M-ABSA: A Multilingual Dataset for Aspect-Based Sentiment Analysis
por: Wu, Chengyan, et al.
Publicado: (2025)
por: Wu, Chengyan, et al.
Publicado: (2025)
A diverse Multilingual News Headlines Dataset from around the World
por: Leeb, Felix, et al.
Publicado: (2024)
por: Leeb, Felix, et al.
Publicado: (2024)
Multilingual KokoroChat: A Multi-LLM Ensemble Translation Method for Creating a Multilingual Counseling Dialogue Dataset
por: Suzuki, Ryoma, et al.
Publicado: (2026)
por: Suzuki, Ryoma, et al.
Publicado: (2026)
MAKIEval: A Multilingual Automatic WiKidata-based Framework for Cultural Awareness Evaluation for LLMs
por: Zhao, Raoyuan, et al.
Publicado: (2025)
por: Zhao, Raoyuan, et al.
Publicado: (2025)
Ejemplares similares
-
Together We Can: Multilingual Automatic Post-Editing for Low-Resource Languages
por: Deoghare, Sourabh, et al.
Publicado: (2024) -
LangBridge: Multilingual Reasoning Without Multilingual Supervision
por: Yoon, Dongkeun, et al.
Publicado: (2024) -
LangSAMP: Language-Script Aware Multilingual Pretraining
por: Liu, Yihong, et al.
Publicado: (2024) -
ViClaim: A Multilingual Multilabel Dataset for Automatic Claim Detection in Videos
por: Giedemann, Patrick, et al.
Publicado: (2025) -
Editing Across Languages: A Survey of Multilingual Knowledge Editing
por: Durrani, Nadir, et al.
Publicado: (2025)