Intelligence Analysis of Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Galanti, Liane, Baron, Ethan |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
The Fair Language Model Paradox
by: Pinto, Andrea, et al.
Published: (2024)
by: Pinto, Andrea, et al.
Published: (2024)
From Grounding to Planning: Benchmarking Bottlenecks in Web Agents
by: Shlomov, Segev, et al.
Published: (2024)
by: Shlomov, Segev, et al.
Published: (2024)
AgentFixer: From Failure Detection to Fix Recommendations in LLM Agentic Systems
by: Mulian, Hadar, et al.
Published: (2026)
by: Mulian, Hadar, et al.
Published: (2026)
Building Artificial Intelligence with Creative Agency and Self-hood
by: Gabora, Liane, et al.
Published: (2024)
by: Gabora, Liane, et al.
Published: (2024)
Tool Building as a Path to "Superintelligence"
by: Koplow, David, et al.
Published: (2026)
by: Koplow, David, et al.
Published: (2026)
Agentic Systems as Boosting Weak Reasoning Models
by: Sunkaraneni, Varun, et al.
Published: (2026)
by: Sunkaraneni, Varun, et al.
Published: (2026)
Directional Neural Collapse Explains Few-Shot Transfer in Self-Supervised Learning
by: Luthra, Achleshwar, et al.
Published: (2026)
by: Luthra, Achleshwar, et al.
Published: (2026)
Evaluating the Meta- and Object-Level Reasoning of Large Language Models for Question Answering
by: Ferguson, Nick, et al.
Published: (2025)
by: Ferguson, Nick, et al.
Published: (2025)
Distribution-Aware Algorithm Design with LLM Agents
by: Koganti, Saharsh, et al.
Published: (2026)
by: Koganti, Saharsh, et al.
Published: (2026)
Generalization or Memorization? Brittleness Testing for Chess-Trained Language Models
by: Tang, Ethan
Published: (2026)
by: Tang, Ethan
Published: (2026)
Does Self-Evaluation Enable Wireheading in Language Models?
by: Africa, David Demitri, et al.
Published: (2025)
by: Africa, David Demitri, et al.
Published: (2025)
DisCO: Reinforcing Large Reasoning Models with Discriminative Constrained Optimization
by: Li, Gang, et al.
Published: (2025)
by: Li, Gang, et al.
Published: (2025)
The Hot Mess of AI: How Does Misalignment Scale With Model Intelligence and Task Complexity?
by: Hägele, Alexander, et al.
Published: (2026)
by: Hägele, Alexander, et al.
Published: (2026)
Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering
by: Glazer, Neta, et al.
Published: (2026)
by: Glazer, Neta, et al.
Published: (2026)
Language Models can Self-Improve at State-Value Estimation for Better Search
by: Mendes, Ethan, et al.
Published: (2025)
by: Mendes, Ethan, et al.
Published: (2025)
Jailbreaking Large Vision Language Models in Intelligent Transportation Systems
by: Das, Badhan Chandra, et al.
Published: (2025)
by: Das, Badhan Chandra, et al.
Published: (2025)
Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
by: Rocamonde, Juan, et al.
Published: (2023)
by: Rocamonde, Juan, et al.
Published: (2023)
Knowledge Tagging with Large Language Model based Multi-Agent System
by: Li, Hang, et al.
Published: (2024)
by: Li, Hang, et al.
Published: (2024)
Anticipatory Evaluation of Language Models
by: Park, Jungsoo, et al.
Published: (2025)
by: Park, Jungsoo, et al.
Published: (2025)
Structured Cognitive Loop for Behavioral Intelligence in Large Language Model Agents
by: Kim, Myung Ho
Published: (2025)
by: Kim, Myung Ho
Published: (2025)
TMIQ: Quantifying Test and Measurement Domain Intelligence in Large Language Models
by: Olowe, Emmanuel A., et al.
Published: (2025)
by: Olowe, Emmanuel A., et al.
Published: (2025)
Uncovering Latent Bias in LLM-Based Emergency Department Triage Through Proxy Variables
by: Zhang, Ethan
Published: (2026)
by: Zhang, Ethan
Published: (2026)
A Unified Assessment of the Poverty of the Stimulus Argument for Neural Language Models
by: Yang, Xiulin, et al.
Published: (2026)
by: Yang, Xiulin, et al.
Published: (2026)
How to Measure the Intelligence of Large Language Models?
by: Körber, Nils, et al.
Published: (2024)
by: Körber, Nils, et al.
Published: (2024)
Artificial Intelligence as Strange Intelligence: Against Linear Models of Intelligence
by: Chilson, Kendra, et al.
Published: (2026)
by: Chilson, Kendra, et al.
Published: (2026)
Eureka-Audio: Triggering Audio Intelligence in Compact Language Models
by: Zhang, Dan, et al.
Published: (2026)
by: Zhang, Dan, et al.
Published: (2026)
Organizing a Society of Language Models: Structures and Mechanisms for Enhanced Collective Intelligence
by: Ferreira, Silvan, et al.
Published: (2024)
by: Ferreira, Silvan, et al.
Published: (2024)
Can Large Language Models be Trusted for Evaluation? Scalable Meta-Evaluation of LLMs as Evaluators via Agent Debate
by: Chern, Steffi, et al.
Published: (2024)
by: Chern, Steffi, et al.
Published: (2024)
Large Language Models and Scientific Discourse: Where's the Intelligence?
by: Collins, Harry, et al.
Published: (2026)
by: Collins, Harry, et al.
Published: (2026)
Recursive Symbolic Consciousness: A Formal Model of Emergent Intelligence Across Minds and Machines
by: Goudy, Anastasia
Published: (2025)
by: Goudy, Anastasia
Published: (2025)
Mapping the Landscape of Artificial Intelligence in Life Cycle Assessment Using Large Language Models
by: Mensikova, Anastasija, et al.
Published: (2026)
by: Mensikova, Anastasija, et al.
Published: (2026)
Truly Assessing Fluid Intelligence of Large Language Models through Dynamic Reasoning Evaluation
by: Yang, Yue, et al.
Published: (2025)
by: Yang, Yue, et al.
Published: (2025)
Imagine in Space: Exploring the Frontier of Spatial Intelligence and Reasoning Efficiency in Vision Language Models
by: Lian, Xiaoxing, et al.
Published: (2025)
by: Lian, Xiaoxing, et al.
Published: (2025)
Monotropic Artificial Intelligence: Toward a Cognitive Taxonomy of Domain-Specialized Language Models
by: Filho, Antonio de Sousa Leitão, et al.
Published: (2026)
by: Filho, Antonio de Sousa Leitão, et al.
Published: (2026)
OmniGeo: Towards a Multimodal Large Language Models for Geospatial Artificial Intelligence
by: Yuan, Long, et al.
Published: (2025)
by: Yuan, Long, et al.
Published: (2025)
Sustainable and Intelligent Public Facility Failure Management System Based on Large Language Models
by: Bi, Siguo, et al.
Published: (2025)
by: Bi, Siguo, et al.
Published: (2025)
General-Purpose Aerial Intelligent Agents Empowered by Large Language Models
by: Zhao, Ji, et al.
Published: (2025)
by: Zhao, Ji, et al.
Published: (2025)
INGRID: Intelligent Generative Robotic Design Using Large Language Models
by: Jia, Guanglu, et al.
Published: (2025)
by: Jia, Guanglu, et al.
Published: (2025)
Do Current Language Models Support Code Intelligence for R Programming Language?
by: Zhao, ZiXiao, et al.
Published: (2024)
by: Zhao, ZiXiao, et al.
Published: (2024)
Apple Intelligence Foundation Language Models
by: Gunter, Tom, et al.
Published: (2024)
by: Gunter, Tom, et al.
Published: (2024)
Similar Items
-
The Fair Language Model Paradox
by: Pinto, Andrea, et al.
Published: (2024) -
From Grounding to Planning: Benchmarking Bottlenecks in Web Agents
by: Shlomov, Segev, et al.
Published: (2024) -
AgentFixer: From Failure Detection to Fix Recommendations in LLM Agentic Systems
by: Mulian, Hadar, et al.
Published: (2026) -
Building Artificial Intelligence with Creative Agency and Self-hood
by: Gabora, Liane, et al.
Published: (2024) -
Tool Building as a Path to "Superintelligence"
by: Koplow, David, et al.
Published: (2026)