How to Measure the Intelligence of Large Language Models?
Fuente:
arXiv
Guardado en:
| Autores principales: | Körber, Nils, Wehrli, Silvan, Irrgang, Christopher |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
German Text Embedding Clustering Benchmark
por: Wehrli, Silvan, et al.
Publicado: (2024)
por: Wehrli, Silvan, et al.
Publicado: (2024)
Multimodal Survival Analysis with Locally Deployable Large Language Models
por: Gögl, Moritz, et al.
Publicado: (2026)
por: Gögl, Moritz, et al.
Publicado: (2026)
On the Measure of a Model: From Intelligence to Generality
por: Dhar, Ruchira, et al.
Publicado: (2025)
por: Dhar, Ruchira, et al.
Publicado: (2025)
Neuro-Symbolic Artificial Intelligence: Towards Improving the Reasoning Abilities of Large Language Models
por: Yang, Xiao-Wen, et al.
Publicado: (2025)
por: Yang, Xiao-Wen, et al.
Publicado: (2025)
An Automated Survey of Generative Artificial Intelligence: Large Language Models, Architectures, Protocols, and Applications
por: Garrido-Merchán, Eduardo C., et al.
Publicado: (2023)
por: Garrido-Merchán, Eduardo C., et al.
Publicado: (2023)
The Ratchet Effect in Silico through Interaction-Driven Cumulative Intelligence in Large Language Models
por: Zhuang, Ren
Publicado: (2025)
por: Zhuang, Ren
Publicado: (2025)
Measuring Social Norms of Large Language Models
por: Yuan, Ye, et al.
Publicado: (2024)
por: Yuan, Ye, et al.
Publicado: (2024)
Large Language Models Are Unreliable for Cyber Threat Intelligence
por: Mezzi, Emanuele, et al.
Publicado: (2025)
por: Mezzi, Emanuele, et al.
Publicado: (2025)
Simulating Viva Voce Examinations to Evaluate Clinical Reasoning in Large Language Models
por: Chiu, Christopher, et al.
Publicado: (2025)
por: Chiu, Christopher, et al.
Publicado: (2025)
Advancing Generative Artificial Intelligence and Large Language Models for Demand Side Management with Internet of Electric Vehicles
por: Zhang, Hanwen, et al.
Publicado: (2025)
por: Zhang, Hanwen, et al.
Publicado: (2025)
How Can We Diagnose and Treat Bias in Large Language Models for Clinical Decision-Making?
por: Benkirane, Kenza, et al.
Publicado: (2024)
por: Benkirane, Kenza, et al.
Publicado: (2024)
DP-Fusion: Token-Level Differentially Private Inference for Large Language Models
por: Thareja, Rushil, et al.
Publicado: (2025)
por: Thareja, Rushil, et al.
Publicado: (2025)
AfroBench: How Good are Large Language Models on African Languages?
por: Ojo, Jessica, et al.
Publicado: (2023)
por: Ojo, Jessica, et al.
Publicado: (2023)
Few-Shot Cross-Lingual Transfer for Prompting Large Language Models in Low-Resource Languages
por: Toukmaji, Christopher
Publicado: (2024)
por: Toukmaji, Christopher
Publicado: (2024)
How Do Large Language Monkeys Get Their Power (Laws)?
por: Schaeffer, Rylan, et al.
Publicado: (2025)
por: Schaeffer, Rylan, et al.
Publicado: (2025)
Intelligent Materials Modelling: Large Language Models Versus Partial Least Squares Regression for Predicting Polysulfone Membrane Mechanical Performance
por: Cao, Dingding, et al.
Publicado: (2026)
por: Cao, Dingding, et al.
Publicado: (2026)
How Do Large Language Models Understand Graph Patterns? A Benchmark for Graph Pattern Comprehension
por: Dai, Xinnan, et al.
Publicado: (2024)
por: Dai, Xinnan, et al.
Publicado: (2024)
How Overconfidence in Initial Choices and Underconfidence Under Criticism Modulate Change of Mind in Large Language Models
por: Kumaran, Dharshan, et al.
Publicado: (2025)
por: Kumaran, Dharshan, et al.
Publicado: (2025)
Walk the Talk? Measuring the Faithfulness of Large Language Model Explanations
por: Matton, Katie, et al.
Publicado: (2025)
por: Matton, Katie, et al.
Publicado: (2025)
Do Large Language Models Know How Much They Know?
por: Prato, Gabriele, et al.
Publicado: (2025)
por: Prato, Gabriele, et al.
Publicado: (2025)
BRIDGES: Bridging Graph Modality and Large Language Models within EDA Tasks
por: Li, Wei, et al.
Publicado: (2025)
por: Li, Wei, et al.
Publicado: (2025)
Scientific Computing with Large Language Models
por: Culver, Christopher, et al.
Publicado: (2024)
por: Culver, Christopher, et al.
Publicado: (2024)
Apple Intelligence Foundation Language Models: Tech Report 2025
por: Li, Ethan, et al.
Publicado: (2025)
por: Li, Ethan, et al.
Publicado: (2025)
Privacy Auditing of Large Language Models
por: Panda, Ashwinee, et al.
Publicado: (2025)
por: Panda, Ashwinee, et al.
Publicado: (2025)
Interpreting Language Models Through Concept Descriptions: A Survey
por: Feldhus, Nils, et al.
Publicado: (2025)
por: Feldhus, Nils, et al.
Publicado: (2025)
Distributed Threat Intelligence at the Edge Devices: A Large Language Model-Driven Approach
por: Hasan, Syed Mhamudul, et al.
Publicado: (2024)
por: Hasan, Syed Mhamudul, et al.
Publicado: (2024)
On Speculative Decoding for Multimodal Large Language Models
por: Gagrani, Mukul, et al.
Publicado: (2024)
por: Gagrani, Mukul, et al.
Publicado: (2024)
Having Beer after Prayer? Measuring Cultural Bias in Large Language Models
por: Naous, Tarek, et al.
Publicado: (2023)
por: Naous, Tarek, et al.
Publicado: (2023)
The Curse of Depth in Large Language Models
por: Sun, Wenfang, et al.
Publicado: (2025)
por: Sun, Wenfang, et al.
Publicado: (2025)
Sequential Enumeration in Large Language Models
por: Hou, Kuinan, et al.
Publicado: (2025)
por: Hou, Kuinan, et al.
Publicado: (2025)
Mixture of Experts in Large Language Models
por: Zhang, Danyang, et al.
Publicado: (2025)
por: Zhang, Danyang, et al.
Publicado: (2025)
Confidence Calibration in Large Language Models
por: Michael, Noam, et al.
Publicado: (2026)
por: Michael, Noam, et al.
Publicado: (2026)
Symmetric Pruning of Large Language Models
por: Yi, Kai, et al.
Publicado: (2025)
por: Yi, Kai, et al.
Publicado: (2025)
How do Large Language Models Navigate Conflicts between Honesty and Helpfulness?
por: Liu, Ryan, et al.
Publicado: (2024)
por: Liu, Ryan, et al.
Publicado: (2024)
Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models
por: Das, Rocktim Jyoti, et al.
Publicado: (2023)
por: Das, Rocktim Jyoti, et al.
Publicado: (2023)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
por: Aravindan, Ashwath Vaithinathan, et al.
Publicado: (2026)
por: Aravindan, Ashwath Vaithinathan, et al.
Publicado: (2026)
Simplifying Outcomes of Language Model Component Analyses with ELIA
por: Eidt, Aaron Louis, et al.
Publicado: (2026)
por: Eidt, Aaron Louis, et al.
Publicado: (2026)
How Does Controllability Emerge In Language Models During Pretraining?
por: She, Jianshu, et al.
Publicado: (2025)
por: She, Jianshu, et al.
Publicado: (2025)
Calibrated Language Models and How to Find Them with Label Smoothing
por: Huang, Jerry, et al.
Publicado: (2025)
por: Huang, Jerry, et al.
Publicado: (2025)
LLMCheckup: Conversational Examination of Large Language Models via Interpretability Tools and Self-Explanations
por: Wang, Qianli, et al.
Publicado: (2024)
por: Wang, Qianli, et al.
Publicado: (2024)
Ejemplares similares
-
German Text Embedding Clustering Benchmark
por: Wehrli, Silvan, et al.
Publicado: (2024) -
Multimodal Survival Analysis with Locally Deployable Large Language Models
por: Gögl, Moritz, et al.
Publicado: (2026) -
On the Measure of a Model: From Intelligence to Generality
por: Dhar, Ruchira, et al.
Publicado: (2025) -
Neuro-Symbolic Artificial Intelligence: Towards Improving the Reasoning Abilities of Large Language Models
por: Yang, Xiao-Wen, et al.
Publicado: (2025) -
An Automated Survey of Generative Artificial Intelligence: Large Language Models, Architectures, Protocols, and Applications
por: Garrido-Merchán, Eduardo C., et al.
Publicado: (2023)