Triples-to-isiXhosa (T2X): Addressing the Challenges of Low-Resource Agglutinative Data-to-Text Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Meyer, Francois, Buys, Jan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
BabyLMs for isiXhosa: Data-Efficient Language Modelling in a Low-Resource Context
di: Matzopoulos, Alexis, et al.
Pubblicazione: (2025)
di: Matzopoulos, Alexis, et al.
Pubblicazione: (2025)
Automatically assessing oral narratives of Afrikaans and isiXhosa children
di: Louw, Retief, et al.
Pubblicazione: (2025)
di: Louw, Retief, et al.
Pubblicazione: (2025)
Text Detoxification in isiXhosa and Yorùbá: A Cross-Lingual Machine Learning Approach for Low-Resource African Languages
di: Agbeyangi, Abayomi O.
Pubblicazione: (2026)
di: Agbeyangi, Abayomi O.
Pubblicazione: (2026)
Feature-based analysis of oral narratives from Afrikaans and isiXhosa children
di: Sharratt, Emma, et al.
Pubblicazione: (2025)
di: Sharratt, Emma, et al.
Pubblicazione: (2025)
Speech Recognition for Automatically Assessing Afrikaans and isiXhosa Preschool Oral Narratives
di: Jacobs, Christiaan, et al.
Pubblicazione: (2025)
di: Jacobs, Christiaan, et al.
Pubblicazione: (2025)
A Systematic Analysis of Subwords and Cross-Lingual Transfer in Multilingual Translation
di: Meyer, Francois, et al.
Pubblicazione: (2024)
di: Meyer, Francois, et al.
Pubblicazione: (2024)
The Learning Dynamics of Subword Segmentation for Morphologically Diverse Languages
di: Meyer, Francois, et al.
Pubblicazione: (2025)
di: Meyer, Francois, et al.
Pubblicazione: (2025)
Tokenization Strategies for Low-Resource Agglutinative Languages in Word2Vec: Case Study on Turkish and Finnish
di: Hu, Jinfan Frank
Pubblicazione: (2025)
di: Hu, Jinfan Frank
Pubblicazione: (2025)
MzansiText and MzansiLM: An Open Corpus and Decoder-Only Language Model for South African Languages
di: Lombard, Anri, et al.
Pubblicazione: (2026)
di: Lombard, Anri, et al.
Pubblicazione: (2026)
An End-to-End Approach for Child Reading Assessment in the Xhosa Language
di: Chevtchenko, Sergio, et al.
Pubblicazione: (2025)
di: Chevtchenko, Sergio, et al.
Pubblicazione: (2025)
Adapting Large Language Models to a Low-Resource Agglutinative Language: A Comparative Study of LoRA and QLoRA for Bashkir
di: Arabov, Mullosharaf K., et al.
Pubblicazione: (2026)
di: Arabov, Mullosharaf K., et al.
Pubblicazione: (2026)
Text2Data: Low-Resource Data Generation with Textual Control
di: Wang, Shiyu, et al.
Pubblicazione: (2024)
di: Wang, Shiyu, et al.
Pubblicazione: (2024)
VerChol -- Grammar-First Tokenization for Agglutinative Languages
di: Raja, Prabhu
Pubblicazione: (2026)
di: Raja, Prabhu
Pubblicazione: (2026)
Bangla Key2Text: Text Generation from Keywords for a Low Resource Language
di: Talukder, Tonmoy, et al.
Pubblicazione: (2026)
di: Talukder, Tonmoy, et al.
Pubblicazione: (2026)
Marvelous Agglutinative Language Effect on Cross Lingual Transfer Learning
di: Kim, Wooyoung, et al.
Pubblicazione: (2022)
di: Kim, Wooyoung, et al.
Pubblicazione: (2022)
A Rigorous Evaluation of LLM Data Generation Strategies for Low-Resource Languages
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
Multipath parsing in the brain
di: Franzluebbers, Berta, et al.
Pubblicazione: (2024)
di: Franzluebbers, Berta, et al.
Pubblicazione: (2024)
GlotScript: A Resource and Tool for Low Resource Writing System Identification
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2023)
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2023)
STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language Models
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
Unlocking LLMs: Addressing Scarce Data and Bias Challenges in Mental Health
di: Kumar, Vivek, et al.
Pubblicazione: (2024)
di: Kumar, Vivek, et al.
Pubblicazione: (2024)
Massively Multilingual Text Translation For Low-Resource Languages
di: Zhou, Zhong
Pubblicazione: (2024)
di: Zhou, Zhong
Pubblicazione: (2024)
Modeling Low-Resource Health Coaching Dialogues via Neuro-Symbolic Goal Summarization and Text-Units-Text Generation
di: Zhou, Yue, et al.
Pubblicazione: (2024)
di: Zhou, Yue, et al.
Pubblicazione: (2024)
Automated Clinical Report Generation for Remote Cognitive Remediation: Comparing Knowledge-Engineered Templates and LLMs in Low-Resource Settings
di: Zhou, Yongxin, et al.
Pubblicazione: (2026)
di: Zhou, Yongxin, et al.
Pubblicazione: (2026)
Paired by the Teacher: Turning Unpaired Data into High-Fidelity Pairs for Low-Resource Text Generation
di: Lu, Yen-Ju, et al.
Pubblicazione: (2025)
di: Lu, Yen-Ju, et al.
Pubblicazione: (2025)
$\mathcal{V}isi\mathcal{P}runer$: Decoding Discontinuous Cross-Modal Dynamics for Efficient Multimodal LLMs
di: Fan, Yingqi, et al.
Pubblicazione: (2025)
di: Fan, Yingqi, et al.
Pubblicazione: (2025)
Scaling Low-Resource MT via Synthetic Data Generation with LLMs
di: de Gibert, Ona, et al.
Pubblicazione: (2025)
di: de Gibert, Ona, et al.
Pubblicazione: (2025)
Bias Attribution in Filipino Language Models: Extending a Bias Interpretability Metric for Application on Agglutinative Languages
di: Gamboa, Lance Calvin Lim, et al.
Pubblicazione: (2025)
di: Gamboa, Lance Calvin Lim, et al.
Pubblicazione: (2025)
Conflicts in Texts: Data, Implications and Challenges
di: Liu, Siyi, et al.
Pubblicazione: (2025)
di: Liu, Siyi, et al.
Pubblicazione: (2025)
GlotLID: Language Identification for Low-Resource Languages
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2023)
di: Kargaran, Amir Hossein, et al.
Pubblicazione: (2023)
CoDa: Constrained Generation based Data Augmentation for Low-Resource NLP
di: Evuru, Chandra Kiran Reddy, et al.
Pubblicazione: (2024)
di: Evuru, Chandra Kiran Reddy, et al.
Pubblicazione: (2024)
Generative-Adversarial Networks for Low-Resource Language Data Augmentation in Machine Translation
di: Zeng, Linda
Pubblicazione: (2024)
di: Zeng, Linda
Pubblicazione: (2024)
A fully automated and scalable Parallel Data Augmentation for Low Resource Languages using Image and Text Analytics
di: Sharma, Prawaal, et al.
Pubblicazione: (2025)
di: Sharma, Prawaal, et al.
Pubblicazione: (2025)
Rethinking MUSHRA: Addressing Modern Challenges in Text-to-Speech Evaluation
di: Varadhan, Praveen Srinivasa, et al.
Pubblicazione: (2024)
di: Varadhan, Praveen Srinivasa, et al.
Pubblicazione: (2024)
Algorithm for Semantic Network Generation from Texts of Low Resource Languages Such as Kiswahili
di: Wanjawa, Barack Wamkaya, et al.
Pubblicazione: (2025)
di: Wanjawa, Barack Wamkaya, et al.
Pubblicazione: (2025)
A Unified Data Augmentation Framework for Low-Resource Multi-Domain Dialogue Generation
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
di: Liu, Yongkang, et al.
Pubblicazione: (2024)
LLM-Based Data Generation and Clinical Skills Evaluation for Low-Resource French OSCEs
di: Huang, Tian, et al.
Pubblicazione: (2026)
di: Huang, Tian, et al.
Pubblicazione: (2026)
TopXGen: Topic-Diverse Parallel Data Generation for Low-Resource Machine Translation
di: Zebaze, Armel, et al.
Pubblicazione: (2025)
di: Zebaze, Armel, et al.
Pubblicazione: (2025)
Transformer-Driven Triple Fusion Framework for Enhanced Multimodal Author Intent Classification in Low-Resource Bangla
di: Islam, Ariful, et al.
Pubblicazione: (2025)
di: Islam, Ariful, et al.
Pubblicazione: (2025)
Better as Generators Than Classifiers: Leveraging LLMs and Synthetic Data for Low-Resource Multilingual Classification
di: Pecher, Branislav, et al.
Pubblicazione: (2026)
di: Pecher, Branislav, et al.
Pubblicazione: (2026)
Efficient Biomedical Entity Linking: Clinical Text Standardization with Low-Resource Techniques
di: Achara, Akshit, et al.
Pubblicazione: (2024)
di: Achara, Akshit, et al.
Pubblicazione: (2024)
Documenti analoghi
-
BabyLMs for isiXhosa: Data-Efficient Language Modelling in a Low-Resource Context
di: Matzopoulos, Alexis, et al.
Pubblicazione: (2025) -
Automatically assessing oral narratives of Afrikaans and isiXhosa children
di: Louw, Retief, et al.
Pubblicazione: (2025) -
Text Detoxification in isiXhosa and Yorùbá: A Cross-Lingual Machine Learning Approach for Low-Resource African Languages
di: Agbeyangi, Abayomi O.
Pubblicazione: (2026) -
Feature-based analysis of oral narratives from Afrikaans and isiXhosa children
di: Sharratt, Emma, et al.
Pubblicazione: (2025) -
Speech Recognition for Automatically Assessing Afrikaans and isiXhosa Preschool Oral Narratives
di: Jacobs, Christiaan, et al.
Pubblicazione: (2025)