Transcribing Bengali Text with Regional Dialects to IPA using District Guided Tokens
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Islam, S M Jishanul, Ahmmed, Sadia, Mustakim, Sahid Hossain |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025)
par: Palit, Sayon, et autres
Publié: (2025)
From Pixels to Privacy: Temporally Consistent Video Anonymization via Token Pruning for Privacy Preserving Action Recognition
par: Aslam, Nazia, et autres
Publié: (2026)
par: Aslam, Nazia, et autres
Publié: (2026)
UIPress: Bringing Optical Token Compression to UI-to-Code Generation
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
AraDiCE: Benchmarks for Dialectal and Cultural Capabilities in LLMs
par: Mousi, Basel, et autres
Publié: (2024)
par: Mousi, Basel, et autres
Publié: (2024)
Beyond MCQ: An Open-Ended Arabic Cultural QA Benchmark with Dialect Variants
par: Bhatti, Hunzalah Hassan, et autres
Publié: (2025)
par: Bhatti, Hunzalah Hassan, et autres
Publié: (2025)
Train to Defend: First Defense Against Cryptanalytic Neural Network Parameter Extraction Attacks
par: Kurian, Ashley, et autres
Publié: (2025)
par: Kurian, Ashley, et autres
Publié: (2025)
Circularity and Symmetries of $p$ and $p^{2}$-polygons
par: Haag, Rolf
Publié: (2025)
par: Haag, Rolf
Publié: (2025)
Grammatically-Guided Sparse Attention for Efficient and Interpretable Transformers
par: Pratyush, Spandan
Publié: (2026)
par: Pratyush, Spandan
Publié: (2026)
R-Genie: Reasoning-Guided Generative Image Editing
par: Zhang, Dong, et autres
Publié: (2025)
par: Zhang, Dong, et autres
Publié: (2025)
Mobile Phone Sensor-based Nigerian Driving Dataset to Detect Alcohol-influenced Behaviours
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
par: S, Remya Ajai A, et autres
Publié: (2024)
par: S, Remya Ajai A, et autres
Publié: (2024)
PromptSAM+: Malware Detection based on Prompt Segment Anything Model
par: Wei, Xingyuan, et autres
Publié: (2024)
par: Wei, Xingyuan, et autres
Publié: (2024)
The Hidden Attention of Mamba Models
par: Ali, Ameen, et autres
Publié: (2024)
par: Ali, Ameen, et autres
Publié: (2024)
An End-to-End System for Culturally-Attuned Driving Feedback using a Dual-Component NLG Engine
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
The impact of postediting on AI generative translation in Yemeni context: Translating literary prose by ChatGPT
par: Al-wagieh, Nasim, et autres
Publié: (2026)
par: Al-wagieh, Nasim, et autres
Publié: (2026)
RepoAgent: An LLM-Powered Open-Source Framework for Repository-level Code Documentation Generation
par: Luo, Qinyu, et autres
Publié: (2024)
par: Luo, Qinyu, et autres
Publié: (2024)
HySem: A context length optimized LLM pipeline for unstructured tabular extraction
par: PP, Narayanan, et autres
Publié: (2024)
par: PP, Narayanan, et autres
Publié: (2024)
Software Implementation of Digital Filtering via Tustin's Bilinear Transform
par: Herron, Connor W.
Publié: (2024)
par: Herron, Connor W.
Publié: (2024)
Vision-Language Reasoning for Geolocalization: A Reinforcement Learning Approach
par: Wu, Biao, et autres
Publié: (2026)
par: Wu, Biao, et autres
Publié: (2026)
Story2Proposal: A Scaffold for Structured Scientific Paper Writing
par: Qian, Zhuoyang, et autres
Publié: (2026)
par: Qian, Zhuoyang, et autres
Publié: (2026)
Factual Dialogue Summarization via Learning from Large Language Models
par: Zhu, Rongxin, et autres
Publié: (2024)
par: Zhu, Rongxin, et autres
Publié: (2024)
Generative linguistics contribution to artificial intelligence: Where this contribution lies?
par: Shormani, Mohammed Q.
Publié: (2024)
par: Shormani, Mohammed Q.
Publié: (2024)
From Classification to Ranking: Enhancing LLM Reasoning Capabilities for MBTI Personality Detection
par: Cao, Yuan, et autres
Publié: (2026)
par: Cao, Yuan, et autres
Publié: (2026)
Corpus Considerations for Annotator Modeling and Scaling
par: Sarumi, Olufunke O., et autres
Publié: (2024)
par: Sarumi, Olufunke O., et autres
Publié: (2024)
PaperVoyager : Building Interactive Web with Visual Language Models
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
A generalised editor calculus (Short Paper)
par: Bennetzen, Benjamin, et autres
Publié: (2025)
par: Bennetzen, Benjamin, et autres
Publié: (2025)
Do Large Language Models Speak All Languages Equally? A Comparative Study in Low-Resource Settings
par: Hasan, Md. Arid, et autres
Publié: (2024)
par: Hasan, Md. Arid, et autres
Publié: (2024)
The Syntax of qulk-clauses in Yemeni Ibbi Arabic: A Minimalist Approach
par: Albadani, Zubaida Mohammed, et autres
Publié: (2025)
par: Albadani, Zubaida Mohammed, et autres
Publié: (2025)
I-WebGenBench : Evaluating Interactivity in LLM-Generated Scientific Web Applications
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
par: Wang, Baode, et autres
Publié: (2025)
par: Wang, Baode, et autres
Publié: (2025)
The acquisition of English irregular inflections by Yemeni L1 Arabic learners: A Universal Grammar approach
par: Alsawsh, Muneef Y., et autres
Publié: (2026)
par: Alsawsh, Muneef Y., et autres
Publié: (2026)
Robust Reward Modeling for Large Language Models via Causal Decomposition
par: Lu, Yunsheng, et autres
Publié: (2026)
par: Lu, Yunsheng, et autres
Publié: (2026)
LLM-Based Multi-Task Bangla Hate Speech Detection: Type, Severity, and Target
par: Hasan, Md Arid, et autres
Publié: (2025)
par: Hasan, Md Arid, et autres
Publié: (2025)
Guardians of the Web: The Evolution and Future of Website Information Security
par: Islam, Md Saiful, et autres
Publié: (2025)
par: Islam, Md Saiful, et autres
Publié: (2025)
Towards Platonic Representation for Table Reasoning: A Foundation for Permutation-Invariant Retrieval
par: Tchuitcheu, Willy Carlos, et autres
Publié: (2026)
par: Tchuitcheu, Willy Carlos, et autres
Publié: (2026)
Large Language Model Interface for Home Energy Management Systems
par: Michelon, François, et autres
Publié: (2025)
par: Michelon, François, et autres
Publié: (2025)
Policy-Grounded Safety Evaluation of 20 Large Language Models
par: Contreras, Juan Manuel
Publié: (2025)
par: Contreras, Juan Manuel
Publié: (2025)
Tokenization Disparities as Infrastructure Bias: How Subword Systems Create Inequities in LLM Access and Efficiency
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025)
par: Teklehaymanot, Hailay Kidu, et autres
Publié: (2025)
Automotive-ENV: Benchmarking Multimodal Agents in Vehicle Interface Systems
par: Yan, Junfeng, et autres
Publié: (2025)
par: Yan, Junfeng, et autres
Publié: (2025)
Current LLMs still cannot 'talk much' about grammar modules: Evidence from syntax
par: Shormani, Mohammed Q., et autres
Publié: (2026)
par: Shormani, Mohammed Q., et autres
Publié: (2026)
Documents similaires
-
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025) -
From Pixels to Privacy: Temporally Consistent Video Anonymization via Token Pruning for Privacy Preserving Action Recognition
par: Aslam, Nazia, et autres
Publié: (2026) -
UIPress: Bringing Optical Token Compression to UI-to-Code Generation
par: Dai, Dasen, et autres
Publié: (2026) -
AraDiCE: Benchmarks for Dialectal and Cultural Capabilities in LLMs
par: Mousi, Basel, et autres
Publié: (2024) -
Beyond MCQ: An Open-Ended Arabic Cultural QA Benchmark with Dialect Variants
par: Bhatti, Hunzalah Hassan, et autres
Publié: (2025)