MATA: Mindful Assessment of the Telugu Abilities of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Kranti, Chalamalasetti, Vajjala, Sowmya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MetricalARGS: A Taxonomy for Studying Metrical Poetry with LLMs
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
Test Set Quality in Multilingual LLM Evaluation
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
The Problem with Safety Classification is not just the Models
di: Vajjala, Sowmya
Pubblicazione: (2025)
di: Vajjala, Sowmya
Pubblicazione: (2025)
IndicGEC: Powerful Models, or a Measurement Mirage?
di: Vajjala, Sowmya
Pubblicazione: (2025)
di: Vajjala, Sowmya
Pubblicazione: (2025)
Mind the Gap: Evaluating LLM Understanding of Human-Taught Road Safety Principles
di: Kranti, Chalamalasetti
Pubblicazione: (2025)
di: Kranti, Chalamalasetti
Pubblicazione: (2025)
Towards No-Code Programming of Cobots: Experiments with Code Synthesis by Large Code Models for Conversational Programming
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2024)
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2024)
From Templates to Natural Language: Generalization Challenges in Instruction-Tuned LLMs for Spatial Reasoning
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
Does Synthetic Data Help Named Entity Recognition for Low-Resource Languages?
di: Kamath, Gaurav, et al.
Pubblicazione: (2025)
di: Kamath, Gaurav, et al.
Pubblicazione: (2025)
clem:todd: A Framework for the Systematic Benchmarking of LLM-Based Task-Oriented Dialogue System Realisations
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025)
Retrieval-Augmented Code Generation for Situated Action Generation: A Case Study on Minecraft
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2024)
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2024)
Scope Ambiguities in Large Language Models
di: Kamath, Gaurav, et al.
Pubblicazione: (2024)
di: Kamath, Gaurav, et al.
Pubblicazione: (2024)
Multi-Turn Multi-Agent Dialogue for Collaborative Reconstruction Improves VLM Performance on Spatial Reasoning, But Only Barely
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2026)
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2026)
Text Classification in the LLM Era -- Where do we stand?
di: Vajjala, Sowmya, et al.
Pubblicazione: (2025)
di: Vajjala, Sowmya, et al.
Pubblicazione: (2025)
Dravidian language family through Universal Dependencies lens
di: Rama, Taraka, et al.
Pubblicazione: (2024)
di: Rama, Taraka, et al.
Pubblicazione: (2024)
Annotation Errors and NER: A Study with OntoNotes 5.0
di: Bernier-Colborne, Gabriel, et al.
Pubblicazione: (2024)
di: Bernier-Colborne, Gabriel, et al.
Pubblicazione: (2024)
A Third Paradigm for LLM Evaluation: Dialogue Game-Based Evaluation using clembench
di: Schlangen, David, et al.
Pubblicazione: (2025)
di: Schlangen, David, et al.
Pubblicazione: (2025)
clembench-2024: A Challenging, Dynamic, Complementary, Multilingual Benchmark and Underlying Flexible Framework for LLMs as Multi-Action Agents
di: Beyer, Anne, et al.
Pubblicazione: (2024)
di: Beyer, Anne, et al.
Pubblicazione: (2024)
Evaluating Telugu Proficiency in Large Language Models_ A Comparative Analysis of ChatGPT and Gemini
di: Kishore, Katikela Sreeharsha, et al.
Pubblicazione: (2024)
di: Kishore, Katikela Sreeharsha, et al.
Pubblicazione: (2024)
Opportunities and Challenges of LLMs in Education: An NLP Perspective
di: Vajjala, Sowmya, et al.
Pubblicazione: (2025)
di: Vajjala, Sowmya, et al.
Pubblicazione: (2025)
LLMs in Education: Novel Perspectives, Challenges, and Opportunities
di: Alhafni, Bashar, et al.
Pubblicazione: (2024)
di: Alhafni, Bashar, et al.
Pubblicazione: (2024)
Automatic Fact-checking in English and Telugu
di: Chikkala, Ravi Kiran, et al.
Pubblicazione: (2025)
di: Chikkala, Ravi Kiran, et al.
Pubblicazione: (2025)
TeluguST-46: A Benchmark Corpus and Comprehensive Evaluation for Telugu-English Speech Translation
di: Akkiraju, Bhavana, et al.
Pubblicazione: (2025)
di: Akkiraju, Bhavana, et al.
Pubblicazione: (2025)
Theory of Mind in Large Language Models: Assessment and Enhancement
di: Chen, Ruirui, et al.
Pubblicazione: (2025)
di: Chen, Ruirui, et al.
Pubblicazione: (2025)
Making Metadata More FAIR Using Large Language Models
di: Sundaram, Sowmya S., et al.
Pubblicazione: (2023)
di: Sundaram, Sowmya S., et al.
Pubblicazione: (2023)
Code-Mixed Telugu-English Hate Speech Detection
di: Kakarla, Santhosh, et al.
Pubblicazione: (2025)
di: Kakarla, Santhosh, et al.
Pubblicazione: (2025)
Extracting and Combining Abilities For Building Multi-lingual Ability-enhanced Large Language Models
di: Chen, Zhipeng, et al.
Pubblicazione: (2024)
di: Chen, Zhipeng, et al.
Pubblicazione: (2024)
The Astonishing Ability of Large Language Models to Parse Jabberwockified Language
di: Lupyan, Gary, et al.
Pubblicazione: (2026)
di: Lupyan, Gary, et al.
Pubblicazione: (2026)
Disentangling Memory and Reasoning Ability in Large Language Models
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
CoCoTen: Detecting Adversarial Inputs to Large Language Models through Latent Space Features of Contextual Co-occurrence Tensors
di: Kadali, Sri Durga Sai Sowmya, et al.
Pubblicazione: (2025)
di: Kadali, Sri Durga Sai Sowmya, et al.
Pubblicazione: (2025)
Human-Centered Supervision for Sentiment Analysis in Telugu: A Systematic Inquiry Beyond Accuracy
di: Kumar, Vallabhaneni Raj, et al.
Pubblicazione: (2025)
di: Kumar, Vallabhaneni Raj, et al.
Pubblicazione: (2025)
ICLEval: Evaluating In-Context Learning Ability of Large Language Models
di: Chen, Wentong, et al.
Pubblicazione: (2024)
di: Chen, Wentong, et al.
Pubblicazione: (2024)
Are Emergent Abilities in Large Language Models just In-Context Learning?
di: Lu, Sheng, et al.
Pubblicazione: (2023)
di: Lu, Sheng, et al.
Pubblicazione: (2023)
UniversalCEFR: Enabling Open Multilingual Research on Language Proficiency Assessment
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2025)
di: Imperial, Joseph Marvin, et al.
Pubblicazione: (2025)
Exploring Continual Fine-Tuning for Enhancing Language Ability in Large Language Model
di: Aggarwal, Divyanshu, et al.
Pubblicazione: (2024)
di: Aggarwal, Divyanshu, et al.
Pubblicazione: (2024)
TeClass: A Human-Annotated Relevance-based Headline Classification and Generation Dataset for Telugu
di: Kanumolu, Gopichand, et al.
Pubblicazione: (2024)
di: Kanumolu, Gopichand, et al.
Pubblicazione: (2024)
Jailbreaking Leaves a Trace: Understanding and Detecting Jailbreak Attacks from Internal Representations of Large Language Models
di: Kadali, Sri Durga Sai Sowmya, et al.
Pubblicazione: (2026)
di: Kadali, Sri Durga Sai Sowmya, et al.
Pubblicazione: (2026)
Psychological Counseling Ability of Large Language Models
di: Peng, Fangyu, et al.
Pubblicazione: (2025)
di: Peng, Fangyu, et al.
Pubblicazione: (2025)
Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue
di: Gu, Jia-Chen, et al.
Pubblicazione: (2024)
di: Gu, Jia-Chen, et al.
Pubblicazione: (2024)
Counting Ability of Large Language Models and Impact of Tokenization
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
Challenging the Abilities of Large Language Models in Italian: a Community Initiative
di: Nissim, Malvina, et al.
Pubblicazione: (2025)
di: Nissim, Malvina, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MetricalARGS: A Taxonomy for Studying Metrical Poetry with LLMs
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025) -
Test Set Quality in Multilingual LLM Evaluation
di: Kranti, Chalamalasetti, et al.
Pubblicazione: (2025) -
The Problem with Safety Classification is not just the Models
di: Vajjala, Sowmya
Pubblicazione: (2025) -
IndicGEC: Powerful Models, or a Measurement Mirage?
di: Vajjala, Sowmya
Pubblicazione: (2025) -
Mind the Gap: Evaluating LLM Understanding of Human-Taught Road Safety Principles
di: Kranti, Chalamalasetti
Pubblicazione: (2025)