Evaluating the Performance of Large Language Models for SDG Mapping (Technical Report)
Fuente:
arXiv
Salvato in:
| Autori principali: | Yin, Hui, Aryani, Amir, Nambiar, Nakul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Technical Report on classification of literature related to children speech disorder
di: Wang, Ziang, et al.
Pubblicazione: (2025)
di: Wang, Ziang, et al.
Pubblicazione: (2025)
Arcee Trinity Large Technical Report
di: Singh, Varun, et al.
Pubblicazione: (2026)
di: Singh, Varun, et al.
Pubblicazione: (2026)
Combining Knowledge Graphs and Large Language Models
di: Kau, Amanda, et al.
Pubblicazione: (2024)
di: Kau, Amanda, et al.
Pubblicazione: (2024)
Evaluating the Performance of Large Language Models via Debates
di: Moniri, Behrad, et al.
Pubblicazione: (2024)
di: Moniri, Behrad, et al.
Pubblicazione: (2024)
Comparative Performance Evaluation of Large Language Models for Extracting Molecular Interactions and Pathway Knowledge
di: Park, Gilchan, et al.
Pubblicazione: (2023)
di: Park, Gilchan, et al.
Pubblicazione: (2023)
Performance Law of Large Language Models
di: Wu, Chuhan, et al.
Pubblicazione: (2024)
di: Wu, Chuhan, et al.
Pubblicazione: (2024)
Technical Report: Small Language Model for Japanese Clinical and Medicine
di: Watanabe, Shogo
Pubblicazione: (2024)
di: Watanabe, Shogo
Pubblicazione: (2024)
Compositional Instruction Following with Language Models and Reinforcement Learning
di: Cohen, Vanya, et al.
Pubblicazione: (2025)
di: Cohen, Vanya, et al.
Pubblicazione: (2025)
Evaluating Large Language Models with fmeval
di: Schwöbel, Pola, et al.
Pubblicazione: (2024)
di: Schwöbel, Pola, et al.
Pubblicazione: (2024)
Data Augmentations for Improved (Large) Language Model Generalization
di: Feder, Amir, et al.
Pubblicazione: (2023)
di: Feder, Amir, et al.
Pubblicazione: (2023)
Evaluating Large Language Models at Evaluating Instruction Following
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2023)
di: Zeng, Zhiyuan, et al.
Pubblicazione: (2023)
Latent Performance Profiling of Large Language Models
di: Chakraborty, Tanmoy, et al.
Pubblicazione: (2026)
di: Chakraborty, Tanmoy, et al.
Pubblicazione: (2026)
Baichuan Alignment Technical Report
di: Lin, Mingan, et al.
Pubblicazione: (2024)
di: Lin, Mingan, et al.
Pubblicazione: (2024)
Megrez-Omni Technical Report
di: Li, Boxun, et al.
Pubblicazione: (2025)
di: Li, Boxun, et al.
Pubblicazione: (2025)
Long Context RAG Performance of Large Language Models
di: Leng, Quinn, et al.
Pubblicazione: (2024)
di: Leng, Quinn, et al.
Pubblicazione: (2024)
MapIQ: Evaluating Multimodal Large Language Models for Map Question Answering
di: Srivastava, Varun, et al.
Pubblicazione: (2025)
di: Srivastava, Varun, et al.
Pubblicazione: (2025)
Large Language Model Agent as a Mechanical Designer
di: Jadhav, Yayati, et al.
Pubblicazione: (2024)
di: Jadhav, Yayati, et al.
Pubblicazione: (2024)
AMGPT: a Large Language Model for Contextual Querying in Additive Manufacturing
di: Chandrasekhar, Achuth, et al.
Pubblicazione: (2024)
di: Chandrasekhar, Achuth, et al.
Pubblicazione: (2024)
Towards Modeling Learner Performance with Large Language Models
di: Neshaei, Seyed Parsa, et al.
Pubblicazione: (2024)
di: Neshaei, Seyed Parsa, et al.
Pubblicazione: (2024)
Equivalent Linear Mappings of Large Language Models
di: Golden, James R.
Pubblicazione: (2025)
di: Golden, James R.
Pubblicazione: (2025)
Bias in Large Language Models: Origin, Evaluation, and Mitigation
di: Guo, Yufei, et al.
Pubblicazione: (2024)
di: Guo, Yufei, et al.
Pubblicazione: (2024)
MANGO: A Benchmark for Evaluating Mapping and Navigation Abilities of Large Language Models
di: Ding, Peng, et al.
Pubblicazione: (2024)
di: Ding, Peng, et al.
Pubblicazione: (2024)
Scaling Laws for Downstream Task Performance of Large Language Models
di: Isik, Berivan, et al.
Pubblicazione: (2024)
di: Isik, Berivan, et al.
Pubblicazione: (2024)
InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models
di: Hosseini, Sayed Mohammadreza Tayaranian, et al.
Pubblicazione: (2026)
di: Hosseini, Sayed Mohammadreza Tayaranian, et al.
Pubblicazione: (2026)
KAT-Coder-V2 Technical Report
di: Li, Fengxiang, et al.
Pubblicazione: (2026)
di: Li, Fengxiang, et al.
Pubblicazione: (2026)
Large Language and Reasoning Models are Shallow Disjunctive Reasoners
di: Khalid, Irtaza, et al.
Pubblicazione: (2025)
di: Khalid, Irtaza, et al.
Pubblicazione: (2025)
Revisiting Dynamic Evaluation: Online Adaptation for Large Language Models
di: Rannen-Triki, Amal, et al.
Pubblicazione: (2024)
di: Rannen-Triki, Amal, et al.
Pubblicazione: (2024)
CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models
di: Wang, Song, et al.
Pubblicazione: (2024)
di: Wang, Song, et al.
Pubblicazione: (2024)
Optimizing Multi-Task Learning for Enhanced Performance in Large Language Models
di: Qi, Zhen, et al.
Pubblicazione: (2024)
di: Qi, Zhen, et al.
Pubblicazione: (2024)
Bayesian Evaluation of Large Language Model Behavior
di: Longjohn, Rachel, et al.
Pubblicazione: (2025)
di: Longjohn, Rachel, et al.
Pubblicazione: (2025)
Merging Language and Domain Specific Models: The Impact on Technical Vocabulary Acquisition
di: Rousset, Thibault, et al.
Pubblicazione: (2025)
di: Rousset, Thibault, et al.
Pubblicazione: (2025)
H2O-Danube3 Technical Report
di: Pfeiffer, Pascal, et al.
Pubblicazione: (2024)
di: Pfeiffer, Pascal, et al.
Pubblicazione: (2024)
Self-Directed Synthetic Dialogues and Revisions Technical Report
di: Lambert, Nathan, et al.
Pubblicazione: (2024)
di: Lambert, Nathan, et al.
Pubblicazione: (2024)
Mapping Faithful Reasoning in Language Models
di: Li, Jiazheng, et al.
Pubblicazione: (2025)
di: Li, Jiazheng, et al.
Pubblicazione: (2025)
Confidence-Aware Sub-Structure Beam Search (CABS): Mitigating Hallucination in Structured Data Generation with Large Language Models
di: Wei, Chengwei, et al.
Pubblicazione: (2024)
di: Wei, Chengwei, et al.
Pubblicazione: (2024)
Flextron: Many-in-One Flexible Large Language Model
di: Cai, Ruisi, et al.
Pubblicazione: (2024)
di: Cai, Ruisi, et al.
Pubblicazione: (2024)
Large Language Models in Fire Engineering: An Examination of Technical Questions Against Domain Knowledge
di: Hostetter, Haley, et al.
Pubblicazione: (2024)
di: Hostetter, Haley, et al.
Pubblicazione: (2024)
AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese
di: Simplício, Afonso, et al.
Pubblicazione: (2026)
di: Simplício, Afonso, et al.
Pubblicazione: (2026)
MEIT: Multimodal Electrocardiogram Instruction Tuning on Large Language Models for Report Generation
di: Wan, Zhongwei, et al.
Pubblicazione: (2024)
di: Wan, Zhongwei, et al.
Pubblicazione: (2024)
OCEAN: Offline Chain-of-thought Evaluation and Alignment in Large Language Models
di: Wu, Junda, et al.
Pubblicazione: (2024)
di: Wu, Junda, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Technical Report on classification of literature related to children speech disorder
di: Wang, Ziang, et al.
Pubblicazione: (2025) -
Arcee Trinity Large Technical Report
di: Singh, Varun, et al.
Pubblicazione: (2026) -
Combining Knowledge Graphs and Large Language Models
di: Kau, Amanda, et al.
Pubblicazione: (2024) -
Evaluating the Performance of Large Language Models via Debates
di: Moniri, Behrad, et al.
Pubblicazione: (2024) -
Comparative Performance Evaluation of Large Language Models for Extracting Molecular Interactions and Pathway Knowledge
di: Park, Gilchan, et al.
Pubblicazione: (2023)