How to Measure the Intelligence of Large Language Models?
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Körber, Nils, Wehrli, Silvan, Irrgang, Christopher |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
German Text Embedding Clustering Benchmark
von: Wehrli, Silvan, et al.
Veröffentlicht: (2024)
von: Wehrli, Silvan, et al.
Veröffentlicht: (2024)
Multimodal Survival Analysis with Locally Deployable Large Language Models
von: Gögl, Moritz, et al.
Veröffentlicht: (2026)
von: Gögl, Moritz, et al.
Veröffentlicht: (2026)
On the Measure of a Model: From Intelligence to Generality
von: Dhar, Ruchira, et al.
Veröffentlicht: (2025)
von: Dhar, Ruchira, et al.
Veröffentlicht: (2025)
Neuro-Symbolic Artificial Intelligence: Towards Improving the Reasoning Abilities of Large Language Models
von: Yang, Xiao-Wen, et al.
Veröffentlicht: (2025)
von: Yang, Xiao-Wen, et al.
Veröffentlicht: (2025)
An Automated Survey of Generative Artificial Intelligence: Large Language Models, Architectures, Protocols, and Applications
von: Garrido-Merchán, Eduardo C., et al.
Veröffentlicht: (2023)
von: Garrido-Merchán, Eduardo C., et al.
Veröffentlicht: (2023)
The Ratchet Effect in Silico through Interaction-Driven Cumulative Intelligence in Large Language Models
von: Zhuang, Ren
Veröffentlicht: (2025)
von: Zhuang, Ren
Veröffentlicht: (2025)
Measuring Social Norms of Large Language Models
von: Yuan, Ye, et al.
Veröffentlicht: (2024)
von: Yuan, Ye, et al.
Veröffentlicht: (2024)
Large Language Models Are Unreliable for Cyber Threat Intelligence
von: Mezzi, Emanuele, et al.
Veröffentlicht: (2025)
von: Mezzi, Emanuele, et al.
Veröffentlicht: (2025)
Simulating Viva Voce Examinations to Evaluate Clinical Reasoning in Large Language Models
von: Chiu, Christopher, et al.
Veröffentlicht: (2025)
von: Chiu, Christopher, et al.
Veröffentlicht: (2025)
Advancing Generative Artificial Intelligence and Large Language Models for Demand Side Management with Internet of Electric Vehicles
von: Zhang, Hanwen, et al.
Veröffentlicht: (2025)
von: Zhang, Hanwen, et al.
Veröffentlicht: (2025)
How Can We Diagnose and Treat Bias in Large Language Models for Clinical Decision-Making?
von: Benkirane, Kenza, et al.
Veröffentlicht: (2024)
von: Benkirane, Kenza, et al.
Veröffentlicht: (2024)
DP-Fusion: Token-Level Differentially Private Inference for Large Language Models
von: Thareja, Rushil, et al.
Veröffentlicht: (2025)
von: Thareja, Rushil, et al.
Veröffentlicht: (2025)
AfroBench: How Good are Large Language Models on African Languages?
von: Ojo, Jessica, et al.
Veröffentlicht: (2023)
von: Ojo, Jessica, et al.
Veröffentlicht: (2023)
Few-Shot Cross-Lingual Transfer for Prompting Large Language Models in Low-Resource Languages
von: Toukmaji, Christopher
Veröffentlicht: (2024)
von: Toukmaji, Christopher
Veröffentlicht: (2024)
How Do Large Language Monkeys Get Their Power (Laws)?
von: Schaeffer, Rylan, et al.
Veröffentlicht: (2025)
von: Schaeffer, Rylan, et al.
Veröffentlicht: (2025)
Intelligent Materials Modelling: Large Language Models Versus Partial Least Squares Regression for Predicting Polysulfone Membrane Mechanical Performance
von: Cao, Dingding, et al.
Veröffentlicht: (2026)
von: Cao, Dingding, et al.
Veröffentlicht: (2026)
How Do Large Language Models Understand Graph Patterns? A Benchmark for Graph Pattern Comprehension
von: Dai, Xinnan, et al.
Veröffentlicht: (2024)
von: Dai, Xinnan, et al.
Veröffentlicht: (2024)
How Overconfidence in Initial Choices and Underconfidence Under Criticism Modulate Change of Mind in Large Language Models
von: Kumaran, Dharshan, et al.
Veröffentlicht: (2025)
von: Kumaran, Dharshan, et al.
Veröffentlicht: (2025)
Walk the Talk? Measuring the Faithfulness of Large Language Model Explanations
von: Matton, Katie, et al.
Veröffentlicht: (2025)
von: Matton, Katie, et al.
Veröffentlicht: (2025)
Do Large Language Models Know How Much They Know?
von: Prato, Gabriele, et al.
Veröffentlicht: (2025)
von: Prato, Gabriele, et al.
Veröffentlicht: (2025)
BRIDGES: Bridging Graph Modality and Large Language Models within EDA Tasks
von: Li, Wei, et al.
Veröffentlicht: (2025)
von: Li, Wei, et al.
Veröffentlicht: (2025)
Scientific Computing with Large Language Models
von: Culver, Christopher, et al.
Veröffentlicht: (2024)
von: Culver, Christopher, et al.
Veröffentlicht: (2024)
Apple Intelligence Foundation Language Models: Tech Report 2025
von: Li, Ethan, et al.
Veröffentlicht: (2025)
von: Li, Ethan, et al.
Veröffentlicht: (2025)
Privacy Auditing of Large Language Models
von: Panda, Ashwinee, et al.
Veröffentlicht: (2025)
von: Panda, Ashwinee, et al.
Veröffentlicht: (2025)
Interpreting Language Models Through Concept Descriptions: A Survey
von: Feldhus, Nils, et al.
Veröffentlicht: (2025)
von: Feldhus, Nils, et al.
Veröffentlicht: (2025)
Distributed Threat Intelligence at the Edge Devices: A Large Language Model-Driven Approach
von: Hasan, Syed Mhamudul, et al.
Veröffentlicht: (2024)
von: Hasan, Syed Mhamudul, et al.
Veröffentlicht: (2024)
On Speculative Decoding for Multimodal Large Language Models
von: Gagrani, Mukul, et al.
Veröffentlicht: (2024)
von: Gagrani, Mukul, et al.
Veröffentlicht: (2024)
Having Beer after Prayer? Measuring Cultural Bias in Large Language Models
von: Naous, Tarek, et al.
Veröffentlicht: (2023)
von: Naous, Tarek, et al.
Veröffentlicht: (2023)
The Curse of Depth in Large Language Models
von: Sun, Wenfang, et al.
Veröffentlicht: (2025)
von: Sun, Wenfang, et al.
Veröffentlicht: (2025)
Sequential Enumeration in Large Language Models
von: Hou, Kuinan, et al.
Veröffentlicht: (2025)
von: Hou, Kuinan, et al.
Veröffentlicht: (2025)
Mixture of Experts in Large Language Models
von: Zhang, Danyang, et al.
Veröffentlicht: (2025)
von: Zhang, Danyang, et al.
Veröffentlicht: (2025)
Confidence Calibration in Large Language Models
von: Michael, Noam, et al.
Veröffentlicht: (2026)
von: Michael, Noam, et al.
Veröffentlicht: (2026)
Symmetric Pruning of Large Language Models
von: Yi, Kai, et al.
Veröffentlicht: (2025)
von: Yi, Kai, et al.
Veröffentlicht: (2025)
How do Large Language Models Navigate Conflicts between Honesty and Helpfulness?
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
von: Liu, Ryan, et al.
Veröffentlicht: (2024)
Beyond Size: How Gradients Shape Pruning Decisions in Large Language Models
von: Das, Rocktim Jyoti, et al.
Veröffentlicht: (2023)
von: Das, Rocktim Jyoti, et al.
Veröffentlicht: (2023)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
von: Aravindan, Ashwath Vaithinathan, et al.
Veröffentlicht: (2026)
von: Aravindan, Ashwath Vaithinathan, et al.
Veröffentlicht: (2026)
Simplifying Outcomes of Language Model Component Analyses with ELIA
von: Eidt, Aaron Louis, et al.
Veröffentlicht: (2026)
von: Eidt, Aaron Louis, et al.
Veröffentlicht: (2026)
How Does Controllability Emerge In Language Models During Pretraining?
von: She, Jianshu, et al.
Veröffentlicht: (2025)
von: She, Jianshu, et al.
Veröffentlicht: (2025)
Calibrated Language Models and How to Find Them with Label Smoothing
von: Huang, Jerry, et al.
Veröffentlicht: (2025)
von: Huang, Jerry, et al.
Veröffentlicht: (2025)
LLMCheckup: Conversational Examination of Large Language Models via Interpretability Tools and Self-Explanations
von: Wang, Qianli, et al.
Veröffentlicht: (2024)
von: Wang, Qianli, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
German Text Embedding Clustering Benchmark
von: Wehrli, Silvan, et al.
Veröffentlicht: (2024) -
Multimodal Survival Analysis with Locally Deployable Large Language Models
von: Gögl, Moritz, et al.
Veröffentlicht: (2026) -
On the Measure of a Model: From Intelligence to Generality
von: Dhar, Ruchira, et al.
Veröffentlicht: (2025) -
Neuro-Symbolic Artificial Intelligence: Towards Improving the Reasoning Abilities of Large Language Models
von: Yang, Xiao-Wen, et al.
Veröffentlicht: (2025) -
An Automated Survey of Generative Artificial Intelligence: Large Language Models, Architectures, Protocols, and Applications
von: Garrido-Merchán, Eduardo C., et al.
Veröffentlicht: (2023)