A Survey of Text and Speech Resources for Hausa and Fongbe: Availability, Quality, and Gaps for NLP Development
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Adjovi, Mahounan Pericles, Olufemi, Victor, Eiselen, Roald, Mitra, Prasenjit |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
When Does Data Augmentation Help? Evaluating LLM and Back-Translation Methods for Hausa and Fongbe NLP
par: Adjovi, Mahounan Pericles, et autres
Publié: (2026)
par: Adjovi, Mahounan Pericles, et autres
Publié: (2026)
Mining Large Language Models for Low-Resource Language Data: Comparing Elicitation Strategies for Hausa and Fongbe
par: Adjovi, Mahounan Pericles, et autres
Publié: (2026)
par: Adjovi, Mahounan Pericles, et autres
Publié: (2026)
Budget-Xfer: Budget-Constrained Source Language Selection for Cross-Lingual Transfer to African Languages
par: Idris, Tewodros Kederalah, et autres
Publié: (2026)
par: Idris, Tewodros Kederalah, et autres
Publié: (2026)
ReFoRCE: A Text-to-SQL Agent with Self-Refinement, Consensus Enforcement, and Column Exploration
par: Deng, Minghang, et autres
Publié: (2025)
par: Deng, Minghang, et autres
Publié: (2025)
Developing Acoustic Models for Automatic Speech Recognition in Swedish
par: Salvi, Giampiero
Publié: (2024)
par: Salvi, Giampiero
Publié: (2024)
Beyond Deep Learning: Speech Segmentation and Phone Classification with Neural Assemblies
par: Adelson, Trevor, et autres
Publié: (2026)
par: Adelson, Trevor, et autres
Publié: (2026)
Social Learning through Interactions with Other Agents: A Survey
par: Hillier, Dylan, et autres
Publié: (2024)
par: Hillier, Dylan, et autres
Publié: (2024)
TwinVoice: A Multi-dimensional Benchmark Towards Digital Twins via LLM Persona Simulation
par: Du, Bangde, et autres
Publié: (2025)
par: Du, Bangde, et autres
Publié: (2025)
Deciphering Digital Detectives: Understanding LLM Behaviors and Capabilities in Multi-Agent Mystery Games
par: Wu, Dekun, et autres
Publié: (2023)
par: Wu, Dekun, et autres
Publié: (2023)
Syntactic Blind Spots: How Misalignment Leads to LLMs Mathematical Errors
par: Williamson, Dane, et autres
Publié: (2025)
par: Williamson, Dane, et autres
Publié: (2025)
Pareto-Optimized Open-Source LLMs for Healthcare via Context Retrieval
par: Bayarri-Planas, Jordi, et autres
Publié: (2024)
par: Bayarri-Planas, Jordi, et autres
Publié: (2024)
LLMs and the Human Condition
par: Wallis, Peter
Publié: (2024)
par: Wallis, Peter
Publié: (2024)
A Domain-Agnostic Neurosymbolic Approach for Big Social Data Analysis: Evaluating Mental Health Sentiment on Social Media during COVID-19
par: Khandelwal, Vedant, et autres
Publié: (2024)
par: Khandelwal, Vedant, et autres
Publié: (2024)
Automated Circuit Interpretation via Probe Prompting
par: Birardi, Giuseppe
Publié: (2025)
par: Birardi, Giuseppe
Publié: (2025)
ACCORD: Closing the Commonsense Measurability Gap
par: Roewer-Després, François, et autres
Publié: (2024)
par: Roewer-Després, François, et autres
Publié: (2024)
Balancing Innovation and Integrity: AI Integration in Liberal Arts College Administration
par: Read, Ian Olivo
Publié: (2025)
par: Read, Ian Olivo
Publié: (2025)
SampoNLP: A Self-Referential Toolkit for Morphological Analysis of Subword Tokenizers
par: Chelombitko, Iaroslav, et autres
Publié: (2026)
par: Chelombitko, Iaroslav, et autres
Publié: (2026)
Text2Model: Modeling Copilots for Text-to-Model Translation
par: Kadioglu, Serdar, et autres
Publié: (2026)
par: Kadioglu, Serdar, et autres
Publié: (2026)
Behavioural vs. Representational Systematicity in End-to-End Models: An Opinionated Survey
par: Vegner, Ivan, et autres
Publié: (2025)
par: Vegner, Ivan, et autres
Publié: (2025)
Semantic Decomposition and Selective Context Filtering -- Text Processing Techniques for Context-Aware NLP-Based Systems
par: Villardar, Karl John
Publié: (2025)
par: Villardar, Karl John
Publié: (2025)
The Syntactic Acceptability Dataset (Preview): A Resource for Machine Learning and Linguistic Analysis of English
par: Juzek, Tom S
Publié: (2025)
par: Juzek, Tom S
Publié: (2025)
ChemPro: A Progressive Chemistry Benchmark for Large Language Models
par: Baranwal, Aaditya, et autres
Publié: (2026)
par: Baranwal, Aaditya, et autres
Publié: (2026)
IntelliCode: A Multi-Agent LLM Tutoring System with Centralized Learner Modeling
par: David, Jones, et autres
Publié: (2025)
par: David, Jones, et autres
Publié: (2025)
LLMs as Architects and Critics for Multi-Source Opinion Summarization
par: Attri, Anuj, et autres
Publié: (2025)
par: Attri, Anuj, et autres
Publié: (2025)
Why We Feel What We Feel: Joint Detection of Emotions and Their Opinion Triggers in E-commerce
par: Attri, Arnav, et autres
Publié: (2025)
par: Attri, Arnav, et autres
Publié: (2025)
Aspect-Based Sentiment Analysis for Future Tourism Experiences: A BERT-MoE Framework for Persian User Reviews
par: Taskooh, Hamidreza Kazemi, et autres
Publié: (2026)
par: Taskooh, Hamidreza Kazemi, et autres
Publié: (2026)
SigWavNet: Learning Multiresolution Signal Wavelet Network for Speech Emotion Recognition
par: Nfissi, Alaa, et autres
Publié: (2025)
par: Nfissi, Alaa, et autres
Publié: (2025)
NRR-Phi: Text-to-State Mapping for Ambiguity Preservation in LLM Inference
par: Saito, Kei
Publié: (2026)
par: Saito, Kei
Publié: (2026)
Methodological Foundations for AI-Driven Survey Question Generation
par: Mburu, Ted K., et autres
Publié: (2025)
par: Mburu, Ted K., et autres
Publié: (2025)
CopySpec: Accelerating LLMs with Speculative Copy-and-Paste Without Compromising Quality
par: Dumitru, Razvan-Gabriel, et autres
Publié: (2025)
par: Dumitru, Razvan-Gabriel, et autres
Publié: (2025)
HiPS: Hierarchical PDF Segmentation of Textbooks
par: Wehnert, Sabine, et autres
Publié: (2025)
par: Wehnert, Sabine, et autres
Publié: (2025)
Quaternion Convolutional Neural Networks: Current Advances and Future Directions
par: Altamirano-Gomez, Gerardo, et autres
Publié: (2023)
par: Altamirano-Gomez, Gerardo, et autres
Publié: (2023)
Quo Vadis ChatGPT? From Large Language Models to Large Knowledge Models
par: Venkatasubramanian, Venkat, et autres
Publié: (2024)
par: Venkatasubramanian, Venkat, et autres
Publié: (2024)
QuickSilver -- Speeding up LLM Inference through Dynamic Token Halting, KV Skipping, Contextual Token Fusion, and Adaptive Matryoshka Quantization
par: Khanna, Danush, et autres
Publié: (2025)
par: Khanna, Danush, et autres
Publié: (2025)
The Curious Case of In-Training Compression of State Space Models
par: Chahine, Makram, et autres
Publié: (2025)
par: Chahine, Makram, et autres
Publié: (2025)
OpenAI Cribbed Our Tax Example, But Can GPT-4 Really Do Tax?
par: Blair-Stanek, Andrew, et autres
Publié: (2023)
par: Blair-Stanek, Andrew, et autres
Publié: (2023)
MATH-PT: A Math Reasoning Benchmark for European and Brazilian Portuguese
par: Teixeira, Tiago, et autres
Publié: (2026)
par: Teixeira, Tiago, et autres
Publié: (2026)
Sonar Image Datasets: A Comprehensive Survey of Resources, Challenges, and Applications
par: Gomes, Larissa S., et autres
Publié: (2025)
par: Gomes, Larissa S., et autres
Publié: (2025)
An Automatic Text Classification Method Based on Hierarchical Taxonomies, Neural Networks and Document Embedding: The NETHIC Tool
par: Lomasto, Luigi, et autres
Publié: (2026)
par: Lomasto, Luigi, et autres
Publié: (2026)
A Human-Machine Collaboration Framework for the Development of Schemas
par: Isaak, Nicos
Publié: (2024)
par: Isaak, Nicos
Publié: (2024)
Documents similaires
-
When Does Data Augmentation Help? Evaluating LLM and Back-Translation Methods for Hausa and Fongbe NLP
par: Adjovi, Mahounan Pericles, et autres
Publié: (2026) -
Mining Large Language Models for Low-Resource Language Data: Comparing Elicitation Strategies for Hausa and Fongbe
par: Adjovi, Mahounan Pericles, et autres
Publié: (2026) -
Budget-Xfer: Budget-Constrained Source Language Selection for Cross-Lingual Transfer to African Languages
par: Idris, Tewodros Kederalah, et autres
Publié: (2026) -
ReFoRCE: A Text-to-SQL Agent with Self-Refinement, Consensus Enforcement, and Column Exploration
par: Deng, Minghang, et autres
Publié: (2025) -
Developing Acoustic Models for Automatic Speech Recognition in Swedish
par: Salvi, Giampiero
Publié: (2024)