MATA: Mindful Assessment of the Telugu Abilities of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kranti, Chalamalasetti, Vajjala, Sowmya |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MetricalARGS: A Taxonomy for Studying Metrical Poetry with LLMs
par: Kranti, Chalamalasetti, et autres
Publié: (2025)
par: Kranti, Chalamalasetti, et autres
Publié: (2025)
Test Set Quality in Multilingual LLM Evaluation
par: Kranti, Chalamalasetti, et autres
Publié: (2025)
par: Kranti, Chalamalasetti, et autres
Publié: (2025)
The Problem with Safety Classification is not just the Models
par: Vajjala, Sowmya
Publié: (2025)
par: Vajjala, Sowmya
Publié: (2025)
IndicGEC: Powerful Models, or a Measurement Mirage?
par: Vajjala, Sowmya
Publié: (2025)
par: Vajjala, Sowmya
Publié: (2025)
Mind the Gap: Evaluating LLM Understanding of Human-Taught Road Safety Principles
par: Kranti, Chalamalasetti
Publié: (2025)
par: Kranti, Chalamalasetti
Publié: (2025)
Towards No-Code Programming of Cobots: Experiments with Code Synthesis by Large Code Models for Conversational Programming
par: Kranti, Chalamalasetti, et autres
Publié: (2024)
par: Kranti, Chalamalasetti, et autres
Publié: (2024)
From Templates to Natural Language: Generalization Challenges in Instruction-Tuned LLMs for Spatial Reasoning
par: Kranti, Chalamalasetti, et autres
Publié: (2025)
par: Kranti, Chalamalasetti, et autres
Publié: (2025)
Does Synthetic Data Help Named Entity Recognition for Low-Resource Languages?
par: Kamath, Gaurav, et autres
Publié: (2025)
par: Kamath, Gaurav, et autres
Publié: (2025)
clem:todd: A Framework for the Systematic Benchmarking of LLM-Based Task-Oriented Dialogue System Realisations
par: Kranti, Chalamalasetti, et autres
Publié: (2025)
par: Kranti, Chalamalasetti, et autres
Publié: (2025)
Retrieval-Augmented Code Generation for Situated Action Generation: A Case Study on Minecraft
par: Kranti, Chalamalasetti, et autres
Publié: (2024)
par: Kranti, Chalamalasetti, et autres
Publié: (2024)
Scope Ambiguities in Large Language Models
par: Kamath, Gaurav, et autres
Publié: (2024)
par: Kamath, Gaurav, et autres
Publié: (2024)
Multi-Turn Multi-Agent Dialogue for Collaborative Reconstruction Improves VLM Performance on Spatial Reasoning, But Only Barely
par: Kranti, Chalamalasetti, et autres
Publié: (2026)
par: Kranti, Chalamalasetti, et autres
Publié: (2026)
Text Classification in the LLM Era -- Where do we stand?
par: Vajjala, Sowmya, et autres
Publié: (2025)
par: Vajjala, Sowmya, et autres
Publié: (2025)
Dravidian language family through Universal Dependencies lens
par: Rama, Taraka, et autres
Publié: (2024)
par: Rama, Taraka, et autres
Publié: (2024)
Annotation Errors and NER: A Study with OntoNotes 5.0
par: Bernier-Colborne, Gabriel, et autres
Publié: (2024)
par: Bernier-Colborne, Gabriel, et autres
Publié: (2024)
A Third Paradigm for LLM Evaluation: Dialogue Game-Based Evaluation using clembench
par: Schlangen, David, et autres
Publié: (2025)
par: Schlangen, David, et autres
Publié: (2025)
clembench-2024: A Challenging, Dynamic, Complementary, Multilingual Benchmark and Underlying Flexible Framework for LLMs as Multi-Action Agents
par: Beyer, Anne, et autres
Publié: (2024)
par: Beyer, Anne, et autres
Publié: (2024)
Evaluating Telugu Proficiency in Large Language Models_ A Comparative Analysis of ChatGPT and Gemini
par: Kishore, Katikela Sreeharsha, et autres
Publié: (2024)
par: Kishore, Katikela Sreeharsha, et autres
Publié: (2024)
Opportunities and Challenges of LLMs in Education: An NLP Perspective
par: Vajjala, Sowmya, et autres
Publié: (2025)
par: Vajjala, Sowmya, et autres
Publié: (2025)
LLMs in Education: Novel Perspectives, Challenges, and Opportunities
par: Alhafni, Bashar, et autres
Publié: (2024)
par: Alhafni, Bashar, et autres
Publié: (2024)
Automatic Fact-checking in English and Telugu
par: Chikkala, Ravi Kiran, et autres
Publié: (2025)
par: Chikkala, Ravi Kiran, et autres
Publié: (2025)
TeluguST-46: A Benchmark Corpus and Comprehensive Evaluation for Telugu-English Speech Translation
par: Akkiraju, Bhavana, et autres
Publié: (2025)
par: Akkiraju, Bhavana, et autres
Publié: (2025)
Theory of Mind in Large Language Models: Assessment and Enhancement
par: Chen, Ruirui, et autres
Publié: (2025)
par: Chen, Ruirui, et autres
Publié: (2025)
Making Metadata More FAIR Using Large Language Models
par: Sundaram, Sowmya S., et autres
Publié: (2023)
par: Sundaram, Sowmya S., et autres
Publié: (2023)
Code-Mixed Telugu-English Hate Speech Detection
par: Kakarla, Santhosh, et autres
Publié: (2025)
par: Kakarla, Santhosh, et autres
Publié: (2025)
Extracting and Combining Abilities For Building Multi-lingual Ability-enhanced Large Language Models
par: Chen, Zhipeng, et autres
Publié: (2024)
par: Chen, Zhipeng, et autres
Publié: (2024)
The Astonishing Ability of Large Language Models to Parse Jabberwockified Language
par: Lupyan, Gary, et autres
Publié: (2026)
par: Lupyan, Gary, et autres
Publié: (2026)
Disentangling Memory and Reasoning Ability in Large Language Models
par: Jin, Mingyu, et autres
Publié: (2024)
par: Jin, Mingyu, et autres
Publié: (2024)
CoCoTen: Detecting Adversarial Inputs to Large Language Models through Latent Space Features of Contextual Co-occurrence Tensors
par: Kadali, Sri Durga Sai Sowmya, et autres
Publié: (2025)
par: Kadali, Sri Durga Sai Sowmya, et autres
Publié: (2025)
Human-Centered Supervision for Sentiment Analysis in Telugu: A Systematic Inquiry Beyond Accuracy
par: Kumar, Vallabhaneni Raj, et autres
Publié: (2025)
par: Kumar, Vallabhaneni Raj, et autres
Publié: (2025)
ICLEval: Evaluating In-Context Learning Ability of Large Language Models
par: Chen, Wentong, et autres
Publié: (2024)
par: Chen, Wentong, et autres
Publié: (2024)
Are Emergent Abilities in Large Language Models just In-Context Learning?
par: Lu, Sheng, et autres
Publié: (2023)
par: Lu, Sheng, et autres
Publié: (2023)
UniversalCEFR: Enabling Open Multilingual Research on Language Proficiency Assessment
par: Imperial, Joseph Marvin, et autres
Publié: (2025)
par: Imperial, Joseph Marvin, et autres
Publié: (2025)
Exploring Continual Fine-Tuning for Enhancing Language Ability in Large Language Model
par: Aggarwal, Divyanshu, et autres
Publié: (2024)
par: Aggarwal, Divyanshu, et autres
Publié: (2024)
TeClass: A Human-Annotated Relevance-based Headline Classification and Generation Dataset for Telugu
par: Kanumolu, Gopichand, et autres
Publié: (2024)
par: Kanumolu, Gopichand, et autres
Publié: (2024)
Jailbreaking Leaves a Trace: Understanding and Detecting Jailbreak Attacks from Internal Representations of Large Language Models
par: Kadali, Sri Durga Sai Sowmya, et autres
Publié: (2026)
par: Kadali, Sri Durga Sai Sowmya, et autres
Publié: (2026)
Psychological Counseling Ability of Large Language Models
par: Peng, Fangyu, et autres
Publié: (2025)
par: Peng, Fangyu, et autres
Publié: (2025)
Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue
par: Gu, Jia-Chen, et autres
Publié: (2024)
par: Gu, Jia-Chen, et autres
Publié: (2024)
Counting Ability of Large Language Models and Impact of Tokenization
par: Zhang, Xiang, et autres
Publié: (2024)
par: Zhang, Xiang, et autres
Publié: (2024)
Challenging the Abilities of Large Language Models in Italian: a Community Initiative
par: Nissim, Malvina, et autres
Publié: (2025)
par: Nissim, Malvina, et autres
Publié: (2025)
Documents similaires
-
MetricalARGS: A Taxonomy for Studying Metrical Poetry with LLMs
par: Kranti, Chalamalasetti, et autres
Publié: (2025) -
Test Set Quality in Multilingual LLM Evaluation
par: Kranti, Chalamalasetti, et autres
Publié: (2025) -
The Problem with Safety Classification is not just the Models
par: Vajjala, Sowmya
Publié: (2025) -
IndicGEC: Powerful Models, or a Measurement Mirage?
par: Vajjala, Sowmya
Publié: (2025) -
Mind the Gap: Evaluating LLM Understanding of Human-Taught Road Safety Principles
par: Kranti, Chalamalasetti
Publié: (2025)