Generalists vs. Specialists: Evaluating Large Language Models for Urdu
Fuente:
arXiv
Salvato in:
| Autori principali: | Arif, Samee, Azeemi, Abdul Hameed, Raza, Agha Ali, Athar, Awais |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Fellowship of the LLMs: Multi-Model Workflows for Synthetic Preference Optimization Dataset Generation
di: Arif, Samee, et al.
Pubblicazione: (2024)
di: Arif, Samee, et al.
Pubblicazione: (2024)
UQA: Corpus for Urdu Question Answering
di: Arif, Samee, et al.
Pubblicazione: (2024)
di: Arif, Samee, et al.
Pubblicazione: (2024)
WER We Stand: Benchmarking Urdu ASR Models
di: Arif, Samee, et al.
Pubblicazione: (2024)
di: Arif, Samee, et al.
Pubblicazione: (2024)
Language Model-Driven Data Pruning Enables Efficient Active Learning
di: Azeemi, Abdul Hameed, et al.
Pubblicazione: (2024)
di: Azeemi, Abdul Hameed, et al.
Pubblicazione: (2024)
With a Grain of SALT: Are LLMs Fair Across Social Dimensions?
di: Arif, Samee, et al.
Pubblicazione: (2024)
di: Arif, Samee, et al.
Pubblicazione: (2024)
To Label or Not to Label: Hybrid Active Learning for Neural Machine Translation
di: Azeemi, Abdul Hameed, et al.
Pubblicazione: (2024)
di: Azeemi, Abdul Hameed, et al.
Pubblicazione: (2024)
Kahaani: A Multimodal Co-Creative Storytelling System
di: Arif, Samee, et al.
Pubblicazione: (2024)
di: Arif, Samee, et al.
Pubblicazione: (2024)
The Age of Curiosity Meets the Age of AI: Benchmarking Child Safety in Large Language Models
di: Arif, Samee, et al.
Pubblicazione: (2026)
di: Arif, Samee, et al.
Pubblicazione: (2026)
From Press to Pixels: Evolving Urdu Text Recognition
di: Arif, Samee, et al.
Pubblicazione: (2025)
di: Arif, Samee, et al.
Pubblicazione: (2025)
UrduLM: A Resource-Efficient Monolingual Urdu Language Model
di: Ali, Syed Muhammad, et al.
Pubblicazione: (2026)
di: Ali, Syed Muhammad, et al.
Pubblicazione: (2026)
Evaluating Large Language Models on Urdu Idiom Translation
di: Khan, Muhammad Farmal, et al.
Pubblicazione: (2025)
di: Khan, Muhammad Farmal, et al.
Pubblicazione: (2025)
Urdu News Article Recommendation Model using Natural Language Processing Techniques
di: Abbas, Syed Zain, et al.
Pubblicazione: (2022)
di: Abbas, Syed Zain, et al.
Pubblicazione: (2022)
Qalb: Largest State-of-the-Art Urdu Large Language Model for 230M Speakers with Systematic Continued Pre-training
di: Hassan, Muhammad Taimoor, et al.
Pubblicazione: (2026)
di: Hassan, Muhammad Taimoor, et al.
Pubblicazione: (2026)
From Generalist to Specialist: Improving Large Language Models for Medical Physics Using ARCoT
di: Grandinetti, Jace, et al.
Pubblicazione: (2024)
di: Grandinetti, Jace, et al.
Pubblicazione: (2024)
From Generalist to Specialist: A Survey of Large Language Models for Chemistry
di: Han, Yang, et al.
Pubblicazione: (2024)
di: Han, Yang, et al.
Pubblicazione: (2024)
On-Device Collaborative Language Modeling via a Mixture of Generalists and Specialists
di: Fan, Dongyang, et al.
Pubblicazione: (2024)
di: Fan, Dongyang, et al.
Pubblicazione: (2024)
UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu
di: Adeeba, Farah, et al.
Pubblicazione: (2025)
di: Adeeba, Farah, et al.
Pubblicazione: (2025)
Assessing the Feasibility of Lightweight Whisper Models for Low-Resource Urdu Transcription
di: Antall, Abdul Rehman, et al.
Pubblicazione: (2025)
di: Antall, Abdul Rehman, et al.
Pubblicazione: (2025)
Scaling Truth: The Confidence Paradox in AI Fact-Checking
di: Qazi, Ihsan A., et al.
Pubblicazione: (2025)
di: Qazi, Ihsan A., et al.
Pubblicazione: (2025)
Empathy Applicability Modeling for General Health Queries
di: Randhawa, Shan, et al.
Pubblicazione: (2026)
di: Randhawa, Shan, et al.
Pubblicazione: (2026)
One Word at a Time: Incremental Completion Decomposition Breaks LLM Safety
di: Arif, Samee, et al.
Pubblicazione: (2026)
di: Arif, Samee, et al.
Pubblicazione: (2026)
Evaluating Customized vs. Generalist Transformer-based Models for Legal Contract Classification
di: Singh, Amrita, et al.
Pubblicazione: (2025)
di: Singh, Amrita, et al.
Pubblicazione: (2025)
PakBBQ: A Culturally Adapted Bias Benchmark for QA
di: Hashmat, Abdullah, et al.
Pubblicazione: (2025)
di: Hashmat, Abdullah, et al.
Pubblicazione: (2025)
Generalist Reward Models: Found Inside Large Language Models
di: Li, Yi-Chen, et al.
Pubblicazione: (2025)
di: Li, Yi-Chen, et al.
Pubblicazione: (2025)
Irony Detection in Urdu Text: A Comparative Study Using Machine Learning Models and Large Language Models
di: Ahmad, Fiaz, et al.
Pubblicazione: (2025)
di: Ahmad, Fiaz, et al.
Pubblicazione: (2025)
Enhanced Urdu Intent Detection with Large Language Models and Prototype-Informed Predictive Pipelines
di: Hassan, Faiza, et al.
Pubblicazione: (2025)
di: Hassan, Faiza, et al.
Pubblicazione: (2025)
Low-Resource Transliteration for Roman-Urdu and Urdu Using Transformer-Based Models
di: Butt, Umer, et al.
Pubblicazione: (2025)
di: Butt, Umer, et al.
Pubblicazione: (2025)
Fake News Classification in Urdu: A Domain Adaptation Approach for a Low-Resource Language
di: Ali, Muhammad Zain, et al.
Pubblicazione: (2025)
di: Ali, Muhammad Zain, et al.
Pubblicazione: (2025)
Towards Generalist Prompting for Large Language Models by Mental Models
di: Guan, Haoxiang, et al.
Pubblicazione: (2024)
di: Guan, Haoxiang, et al.
Pubblicazione: (2024)
TESS 2: A Large-Scale Generalist Diffusion Language Model
di: Tae, Jaesung, et al.
Pubblicazione: (2025)
di: Tae, Jaesung, et al.
Pubblicazione: (2025)
Generalist Large Language Models Outperform Clinical Tools on Medical Benchmarks
di: Vishwanath, Krithik, et al.
Pubblicazione: (2025)
di: Vishwanath, Krithik, et al.
Pubblicazione: (2025)
Developing Safe and Responsible Large Language Model : Can We Balance Bias Reduction and Language Understanding in Large Language Models?
di: Raza, Shaina, et al.
Pubblicazione: (2024)
di: Raza, Shaina, et al.
Pubblicazione: (2024)
GSCo: Towards Generalizable AI in Medicine via Generalist-Specialist Collaboration
di: He, Sunan, et al.
Pubblicazione: (2024)
di: He, Sunan, et al.
Pubblicazione: (2024)
Fine-Tuning Large Language Models with QLoRA for Offensive Language Detection in Roman Urdu-English Code-Mixed Text
di: Hussain, Nisar, et al.
Pubblicazione: (2025)
di: Hussain, Nisar, et al.
Pubblicazione: (2025)
Specialists or Generalists? Multi-Agent and Single-Agent LLMs for Essay Grading
di: Idowu, Jamiu Adekunle, et al.
Pubblicazione: (2026)
di: Idowu, Jamiu Adekunle, et al.
Pubblicazione: (2026)
Evaluating Vision-Language and Large Language Models for Automated Student Assessment in Indonesian Classrooms
di: Aisyah, Nurul, et al.
Pubblicazione: (2025)
di: Aisyah, Nurul, et al.
Pubblicazione: (2025)
Biomedical Large Languages Models Seem not to be Superior to Generalist Models on Unseen Medical Data
di: Dorfner, Felix J., et al.
Pubblicazione: (2024)
di: Dorfner, Felix J., et al.
Pubblicazione: (2024)
A Paradigm Gap in Urdu
di: Adeeba, Farah, et al.
Pubblicazione: (2025)
di: Adeeba, Farah, et al.
Pubblicazione: (2025)
Ax-to-Grind Urdu: Benchmark Dataset for Urdu Fake News Detection
di: Harris, Sheetal, et al.
Pubblicazione: (2024)
di: Harris, Sheetal, et al.
Pubblicazione: (2024)
LLMs-Healthcare : Current Applications and Challenges of Large Language Models in various Medical Specialties
di: Mumtaz, Ummara, et al.
Pubblicazione: (2023)
di: Mumtaz, Ummara, et al.
Pubblicazione: (2023)
Documenti analoghi
-
The Fellowship of the LLMs: Multi-Model Workflows for Synthetic Preference Optimization Dataset Generation
di: Arif, Samee, et al.
Pubblicazione: (2024) -
UQA: Corpus for Urdu Question Answering
di: Arif, Samee, et al.
Pubblicazione: (2024) -
WER We Stand: Benchmarking Urdu ASR Models
di: Arif, Samee, et al.
Pubblicazione: (2024) -
Language Model-Driven Data Pruning Enables Efficient Active Learning
di: Azeemi, Abdul Hameed, et al.
Pubblicazione: (2024) -
With a Grain of SALT: Are LLMs Fair Across Social Dimensions?
di: Arif, Samee, et al.
Pubblicazione: (2024)