GHTM: A Graph-based Hybrid Topic Modeling Approach with a Benchmark Dataset for the Low-Resource Bengali Language
Fuente:
arXiv
Saved in:
| Main Authors: | Haque, Farhana, Rahman, Md. Abdur, Ahmed, Sumon |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Novel Word Pair-based Gaussian Sentence Similarity Algorithm For Bengali Extractive Text Summarization
by: Morshed, Fahim, et al.
Published: (2024)
by: Morshed, Fahim, et al.
Published: (2024)
BNLI: A Linguistically-Refined Bengali Dataset for Natural Language Inference
by: Haque, Farah Binta, et al.
Published: (2025)
by: Haque, Farah Binta, et al.
Published: (2025)
LLM-Based Evaluation of Low-Resource Machine Translation: A Reference-less Dialect Guided Approach with a Refined Sylheti-English Benchmark
by: Rahman, Md. Atiqur, et al.
Published: (2025)
by: Rahman, Md. Atiqur, et al.
Published: (2025)
From Facts to Folklore: Evaluating Large Language Models on Bengali Cultural Knowledge
by: Chowdhury, Nafis, et al.
Published: (2025)
by: Chowdhury, Nafis, et al.
Published: (2025)
Bengali Fake Reviews: A Benchmark Dataset and Detection System
by: Shahariar, G. M., et al.
Published: (2023)
by: Shahariar, G. M., et al.
Published: (2023)
BLUCK: A Benchmark Dataset for Bengali Linguistic Understanding and Cultural Knowledge
by: Kabir, Daeen, et al.
Published: (2025)
by: Kabir, Daeen, et al.
Published: (2025)
Dhoroni: Exploring Bengali Climate Change and Environmental Views with a Multi-Perspective News Dataset and Natural Language Processing
by: Wasi, Azmine Toushik, et al.
Published: (2024)
by: Wasi, Azmine Toushik, et al.
Published: (2024)
Uddessho: An Extensive Benchmark Dataset for Multimodal Author Intent Classification in Low-Resource Bangla Language
by: Faria, Fatema Tuj Johora, et al.
Published: (2024)
by: Faria, Fatema Tuj Johora, et al.
Published: (2024)
Cost-Efficient Cross-Lingual Retrieval-Augmented Generation for Low-Resource Languages: A Case Study in Bengali Agricultural Advisory
by: Hossain, Md. Asif, et al.
Published: (2026)
by: Hossain, Md. Asif, et al.
Published: (2026)
Bengali Text Classification: An Evaluation of Large Language Model Approaches
by: Hoque, Md Mahmudul, et al.
Published: (2026)
by: Hoque, Md Mahmudul, et al.
Published: (2026)
Harnessing Large Language Models Over Transformer Models for Detecting Bengali Depressive Social Media Text: A Comprehensive Study
by: Chowdhury, Ahmadul Karim, et al.
Published: (2024)
by: Chowdhury, Ahmadul Karim, et al.
Published: (2024)
Gradient Masters at BLP-2025 Task 1: Advancing Low-Resource NLP for Bengali using Ensemble-Based Adversarial Training for Hate Speech Detection
by: Hoque, Syed Mohaiminul, et al.
Published: (2025)
by: Hoque, Syed Mohaiminul, et al.
Published: (2025)
BanglaQuAD: A Bengali Open-domain Question Answering Dataset
by: Rony, Md Rashad Al Hasan, et al.
Published: (2024)
by: Rony, Md Rashad Al Hasan, et al.
Published: (2024)
Cross-Lingual Probing and Community-Grounded Analysis of Gender Bias in Low-Resource Bengali
by: Reaj, Md Asgor Hossain, et al.
Published: (2026)
by: Reaj, Md Asgor Hossain, et al.
Published: (2026)
From Scarcity to Capability: Empowering Fake News Detection in Low-Resource Languages with LLMs
by: Shibu, Hrithik Majumdar, et al.
Published: (2025)
by: Shibu, Hrithik Majumdar, et al.
Published: (2025)
BengaliFig: A Low-Resource Challenge for Figurative and Culturally Grounded Reasoning in Bengali
by: Sefat, Abdullah Al
Published: (2025)
by: Sefat, Abdullah Al
Published: (2025)
Low-Resource Counterspeech Generation for Indic Languages: The Case of Bengali and Hindi
by: Das, Mithun, et al.
Published: (2024)
by: Das, Mithun, et al.
Published: (2024)
BengaliMoralBench: A Benchmark for Auditing Moral Reasoning in Large Language Models within Bengali Language and Culture
by: Ridoy, Shahriyar Zaman, et al.
Published: (2025)
by: Ridoy, Shahriyar Zaman, et al.
Published: (2025)
IPA Transcription of Bengali Texts
by: Fatema, Kanij, et al.
Published: (2024)
by: Fatema, Kanij, et al.
Published: (2024)
Transformer-Based Low-Resource Language Translation: A Study on Standard Bengali to Sylheti
by: Oni, Mangsura Kabir, et al.
Published: (2025)
by: Oni, Mangsura Kabir, et al.
Published: (2025)
Optical Text Recognition in Nepali and Bengali: A Transformer-based Approach
by: Hasan, S M Rakib, et al.
Published: (2024)
by: Hasan, S M Rakib, et al.
Published: (2024)
BenLLMEval: A Comprehensive Evaluation into the Potentials and Pitfalls of Large Language Models on Bengali NLP
by: Kabir, Mohsinul, et al.
Published: (2023)
by: Kabir, Mohsinul, et al.
Published: (2023)
BengaliSent140: A Large-Scale Bengali Binary Sentiment Dataset for Hate and Non-Hate Speech Classification
by: Islam, Akif, et al.
Published: (2026)
by: Islam, Akif, et al.
Published: (2026)
Motamot: A Dataset for Revealing the Supremacy of Large Language Models over Transformer Models in Bengali Political Sentiment Analysis
by: Faria, Fatema Tuj Johora, et al.
Published: (2024)
by: Faria, Fatema Tuj Johora, et al.
Published: (2024)
BnSentMix: A Diverse Bengali-English Code-Mixed Dataset for Sentiment Analysis
by: Alam, Sadia, et al.
Published: (2024)
by: Alam, Sadia, et al.
Published: (2024)
BEnQA: A Question Answering and Reasoning Benchmark for Bengali and English
by: Shafayat, Sheikh, et al.
Published: (2024)
by: Shafayat, Sheikh, et al.
Published: (2024)
Evaluating Subword Tokenization Techniques for Bengali: A Benchmark Study with BengaliBPE
by: Patwary, Firoj Ahmmed, et al.
Published: (2025)
by: Patwary, Firoj Ahmmed, et al.
Published: (2025)
Detecting Hate and Inflammatory Content in Bengali Memes: A New Multimodal Dataset and Co-Attention Framework
by: Ullah, Rakib, et al.
Published: (2026)
by: Ullah, Rakib, et al.
Published: (2026)
Think Outside the Data: Colonial Biases and Systemic Issues in Automated Moderation Pipelines for Low-Resource Languages
by: Shahid, Farhana, et al.
Published: (2025)
by: Shahid, Farhana, et al.
Published: (2025)
Fine-tuned Large Language Models (LLMs): Improved Prompt Injection Attacks Detection
by: Rahman, Md Abdur, et al.
Published: (2024)
by: Rahman, Md Abdur, et al.
Published: (2024)
Multilingual Question Answering in Low-Resource Settings: A Dzongkha-English Benchmark for Foundation Models
by: Hosain, Md. Tanzib, et al.
Published: (2025)
by: Hosain, Md. Tanzib, et al.
Published: (2025)
Tackling Fake News in Bengali: Unraveling the Impact of Summarization vs. Augmentation on Pre-trained Language Models
by: Chowdhury, Arman Sakif, et al.
Published: (2023)
by: Chowdhury, Arman Sakif, et al.
Published: (2023)
From Language to Action: A Review of Large Language Models as Autonomous Agents and Tool Users
by: Chowa, Sadia Sultana, et al.
Published: (2025)
by: Chowa, Sadia Sultana, et al.
Published: (2025)
BenHalluEval: A Multi-Task Hallucination Evaluation Framework for Large Language Models on Bengali
by: Adib, Shefayat E Shams, et al.
Published: (2026)
by: Adib, Shefayat E Shams, et al.
Published: (2026)
Hybrid Tokenization Strategy for DNA Language Model using Byte Pair Encoding and K-MER Methods
by: Sapkota, Ganesh, et al.
Published: (2025)
by: Sapkota, Ganesh, et al.
Published: (2025)
MultiSoc-4D: A Benchmark for Diagnosing Instruction-Induced Label Collapse in Closed-Set LLM Annotation of Bengali Social Media
by: Pramanik, Souvik, et al.
Published: (2026)
by: Pramanik, Souvik, et al.
Published: (2026)
Hierarchical Graph Topic Modeling with Topic Tree-based Transformer
by: Zhang, Delvin Ce, et al.
Published: (2025)
by: Zhang, Delvin Ce, et al.
Published: (2025)
Evaluating LLMs' Multilingual Capabilities for Bengali: Benchmark Creation and Performance Analysis
by: Bhowmik, Shimanto, et al.
Published: (2025)
by: Bhowmik, Shimanto, et al.
Published: (2025)
Understanding Cross-Domain Adaptation in Low-Resource Topic Modeling
by: Akash, Pritom Saha, et al.
Published: (2025)
by: Akash, Pritom Saha, et al.
Published: (2025)
Sinhala-English Word Embedding Alignment: Introducing Datasets and Benchmark for a Low Resource Language
by: Wickramasinghe, Kasun, et al.
Published: (2023)
by: Wickramasinghe, Kasun, et al.
Published: (2023)
Similar Items
-
A Novel Word Pair-based Gaussian Sentence Similarity Algorithm For Bengali Extractive Text Summarization
by: Morshed, Fahim, et al.
Published: (2024) -
BNLI: A Linguistically-Refined Bengali Dataset for Natural Language Inference
by: Haque, Farah Binta, et al.
Published: (2025) -
LLM-Based Evaluation of Low-Resource Machine Translation: A Reference-less Dialect Guided Approach with a Refined Sylheti-English Benchmark
by: Rahman, Md. Atiqur, et al.
Published: (2025) -
From Facts to Folklore: Evaluating Large Language Models on Bengali Cultural Knowledge
by: Chowdhury, Nafis, et al.
Published: (2025) -
Bengali Fake Reviews: A Benchmark Dataset and Detection System
by: Shahariar, G. M., et al.
Published: (2023)