Small Language Models: Architectures, Techniques, Evaluation, Problems and Future Adaptation
Fuente:
arXiv
Saved in:
| Main Authors: | Sakib, Tanjil Hasan, Hosain, Md. Tanzib, Morol, Md. Kishor |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Can Multi-turn Self-refined Single Agent LMs with Retrieval Solve Hard Coding Problems?
by: Hosain, Md Tanzib, et al.
Published: (2025)
by: Hosain, Md Tanzib, et al.
Published: (2025)
Multilingual Question Answering in Low-Resource Settings: A Dzongkha-English Benchmark for Foundation Models
by: Hosain, Md. Tanzib, et al.
Published: (2025)
by: Hosain, Md. Tanzib, et al.
Published: (2025)
Xolver: Multi-Agent Reasoning with Holistic Experience Learning Just Like an Olympiad Team
by: Hosain, Md Tanzib, et al.
Published: (2025)
by: Hosain, Md Tanzib, et al.
Published: (2025)
Outcome-Based Education: Evaluating Students' Perspectives Using Transformer
by: Das, Shuvra Smaran, et al.
Published: (2025)
by: Das, Shuvra Smaran, et al.
Published: (2025)
Multimodal Programming in Computer Science with Interactive Assistance Powered by Large Language Model
by: Gupta, Rajan Das, et al.
Published: (2025)
by: Gupta, Rajan Das, et al.
Published: (2025)
BRAINS: A Retrieval-Augmented System for Alzheimer's Detection and Monitoring
by: Gupta, Rajan Das, et al.
Published: (2025)
by: Gupta, Rajan Das, et al.
Published: (2025)
PhysicsEval: Inference-Time Techniques to Improve the Reasoning Proficiency of Large Language Models on Physics Problems
by: Siddique, Oshayer, et al.
Published: (2025)
by: Siddique, Oshayer, et al.
Published: (2025)
An Interdisciplinary Review of Commonsense Reasoning and Intent Detection
by: Sakib, Md Nazmus
Published: (2025)
by: Sakib, Md Nazmus
Published: (2025)
Consolidating Trees of Robotic Plans Generated Using Large Language Models to Improve Reliability
by: Sakib, Md Sadman, et al.
Published: (2024)
by: Sakib, Md Sadman, et al.
Published: (2024)
Risks, Causes, and Mitigations of Widespread Deployments of Large Language Models (LLMs): A Survey
by: Sakib, Md Nazmus, et al.
Published: (2024)
by: Sakib, Md Nazmus, et al.
Published: (2024)
Pitfalls of Evaluating Language Models with Open Benchmarks
by: Hasan, Md. Najib, et al.
Published: (2025)
by: Hasan, Md. Najib, et al.
Published: (2025)
VLAgeBench: Benchmarking Large Vision-Language Models for Zero-Shot Human Age Estimation
by: Sajib, Rakib Hossain, et al.
Published: (2026)
by: Sajib, Rakib Hossain, et al.
Published: (2026)
IMVB7t: A Multi-Modal Model for Food Preferences based on Artificially Produced Traits
by: Abir, Mushfiqur Rahman, et al.
Published: (2024)
by: Abir, Mushfiqur Rahman, et al.
Published: (2024)
Privacy Preserving Machine Learning Model Personalization through Federated Personalized Learning
by: Hosain, Md. Tanzib, et al.
Published: (2025)
by: Hosain, Md. Tanzib, et al.
Published: (2025)
Automatic Pull Request Description Generation Using LLMs: A T5 Model Approach
by: Sakib, Md Nazmus, et al.
Published: (2024)
by: Sakib, Md Nazmus, et al.
Published: (2024)
Ensemble Language Models for Multilingual Sentiment Analysis
by: Hasan, Md Arid
Published: (2024)
by: Hasan, Md Arid
Published: (2024)
Real-Time Confidence Detection through Facial Expressions and Hand Gestures
by: Sakib, Tanjil Hasan, et al.
Published: (2025)
by: Sakib, Tanjil Hasan, et al.
Published: (2025)
Beyond Semantic Similarity: A Component-Wise Evaluation Framework for Medical Question Answering Systems with Health Equity Implications
by: Sakib, Abu Noman Md, et al.
Published: (2026)
by: Sakib, Abu Noman Md, et al.
Published: (2026)
Bengali Text Classification: An Evaluation of Large Language Model Approaches
by: Hoque, Md Mahmudul, et al.
Published: (2026)
by: Hoque, Md Mahmudul, et al.
Published: (2026)
MapEval: A Map-Based Evaluation of Geo-Spatial Reasoning in Foundation Models
by: Dihan, Mahir Labib, et al.
Published: (2024)
by: Dihan, Mahir Labib, et al.
Published: (2024)
Better to Ask in English: Evaluation of Large Language Models on English, Low-resource and Cross-Lingual Settings
by: Dey, Krishno, et al.
Published: (2024)
by: Dey, Krishno, et al.
Published: (2024)
LLM-ProS: Analyzing Large Language Models' Performance in Competitive Problem Solving
by: Hossain, Md Sifat, et al.
Published: (2025)
by: Hossain, Md Sifat, et al.
Published: (2025)
UPLME: Uncertainty-Aware Probabilistic Language Modelling for Robust Empathy Regression
by: Hasan, Md Rakibul, et al.
Published: (2025)
by: Hasan, Md Rakibul, et al.
Published: (2025)
Thinking Like a Botanist: Challenging Multimodal Language Models with Intent-Driven Chain-of-Inquiry
by: Sakib, Syed Nazmus, et al.
Published: (2026)
by: Sakib, Syed Nazmus, et al.
Published: (2026)
Unified Deployment-Aware Evaluation of Open Reasoning Language Models
by: Manik, Md Motaleb Hossen, et al.
Published: (2026)
by: Manik, Md Motaleb Hossen, et al.
Published: (2026)
Bangla Sign Language Translation: Dataset Creation Challenges, Benchmarking and Prospects
by: Rubaiyeat, Husne Ara, et al.
Published: (2025)
by: Rubaiyeat, Husne Ara, et al.
Published: (2025)
MIC: Medical Image Classification Using Chest X-ray (COVID-19 and Pneumonia) Dataset with the Help of CNN and Customized CNN
by: Fahad, Nafiz, et al.
Published: (2024)
by: Fahad, Nafiz, et al.
Published: (2024)
A Multi-Model Approach to English-Bangla Sentiment Classification of Government Mobile Banking App Reviews
by: Molla, Md. Naim, et al.
Published: (2026)
by: Molla, Md. Naim, et al.
Published: (2026)
Redefining Experts: Interpretable Decomposition of Language Models for Toxicity Mitigation
by: Shaik, Zuhair Hasan, et al.
Published: (2025)
by: Shaik, Zuhair Hasan, et al.
Published: (2025)
Path To Gain Functional Transparency In Artificial Intelligence With Meaningful Explainability
by: Hosain, Md. Tanzib, et al.
Published: (2023)
by: Hosain, Md. Tanzib, et al.
Published: (2023)
A hybrid transformer and attention based recurrent neural network for robust and interpretable sentiment analysis of tweets
by: Jahin, Md Abrar, et al.
Published: (2024)
by: Jahin, Md Abrar, et al.
Published: (2024)
BanTH: A Multi-label Hate Speech Detection Dataset for Transliterated Bangla
by: Haider, Fabiha, et al.
Published: (2024)
by: Haider, Fabiha, et al.
Published: (2024)
Small Vision-Language Models: A Survey on Compact Architectures and Techniques
by: Patnaik, Nitesh, et al.
Published: (2025)
by: Patnaik, Nitesh, et al.
Published: (2025)
Empirical Evidence of Complexity-Induced Limits in Large Language Models on Finite Discrete State-Space Problems with Explicit Validity Constraints
by: Utsho, Md. Fahad Ullah, et al.
Published: (2026)
by: Utsho, Md. Fahad Ullah, et al.
Published: (2026)
Application of Multimodal Large Language Models in Autonomous Driving
by: Islam, Md Robiul
Published: (2024)
by: Islam, Md Robiul
Published: (2024)
Beyond Symbolic Solving: Multi Chain-of-Thought Voting for Geometric Reasoning in Large Language Models
by: Siddique, Md. Abu Bakor, et al.
Published: (2026)
by: Siddique, Md. Abu Bakor, et al.
Published: (2026)
Comparative Analysis Based on DeepSeek, ChatGPT, and Google Gemini: Features, Techniques, Performance, Future Prospects
by: Rahman, Anichur, et al.
Published: (2025)
by: Rahman, Anichur, et al.
Published: (2025)
Labels Generated by Large Language Models Help Measure People's Empathy in Vitro
by: Hasan, Md Rakibul, et al.
Published: (2025)
by: Hasan, Md Rakibul, et al.
Published: (2025)
Evaluating Nuanced Bias in Large Language Model Free Response Answers
by: Healey, Jennifer, et al.
Published: (2024)
by: Healey, Jennifer, et al.
Published: (2024)
BDA: Bangla Text Data Augmentation Framework
by: Tariquzzaman, Md., et al.
Published: (2024)
by: Tariquzzaman, Md., et al.
Published: (2024)
Similar Items
-
Can Multi-turn Self-refined Single Agent LMs with Retrieval Solve Hard Coding Problems?
by: Hosain, Md Tanzib, et al.
Published: (2025) -
Multilingual Question Answering in Low-Resource Settings: A Dzongkha-English Benchmark for Foundation Models
by: Hosain, Md. Tanzib, et al.
Published: (2025) -
Xolver: Multi-Agent Reasoning with Holistic Experience Learning Just Like an Olympiad Team
by: Hosain, Md Tanzib, et al.
Published: (2025) -
Outcome-Based Education: Evaluating Students' Perspectives Using Transformer
by: Das, Shuvra Smaran, et al.
Published: (2025) -
Multimodal Programming in Computer Science with Interactive Assistance Powered by Large Language Model
by: Gupta, Rajan Das, et al.
Published: (2025)