Intelligence Analysis of Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Galanti, Liane, Baron, Ethan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Fair Language Model Paradox
di: Pinto, Andrea, et al.
Pubblicazione: (2024)
di: Pinto, Andrea, et al.
Pubblicazione: (2024)
From Grounding to Planning: Benchmarking Bottlenecks in Web Agents
di: Shlomov, Segev, et al.
Pubblicazione: (2024)
di: Shlomov, Segev, et al.
Pubblicazione: (2024)
AgentFixer: From Failure Detection to Fix Recommendations in LLM Agentic Systems
di: Mulian, Hadar, et al.
Pubblicazione: (2026)
di: Mulian, Hadar, et al.
Pubblicazione: (2026)
Building Artificial Intelligence with Creative Agency and Self-hood
di: Gabora, Liane, et al.
Pubblicazione: (2024)
di: Gabora, Liane, et al.
Pubblicazione: (2024)
Tool Building as a Path to "Superintelligence"
di: Koplow, David, et al.
Pubblicazione: (2026)
di: Koplow, David, et al.
Pubblicazione: (2026)
Agentic Systems as Boosting Weak Reasoning Models
di: Sunkaraneni, Varun, et al.
Pubblicazione: (2026)
di: Sunkaraneni, Varun, et al.
Pubblicazione: (2026)
Directional Neural Collapse Explains Few-Shot Transfer in Self-Supervised Learning
di: Luthra, Achleshwar, et al.
Pubblicazione: (2026)
di: Luthra, Achleshwar, et al.
Pubblicazione: (2026)
Evaluating the Meta- and Object-Level Reasoning of Large Language Models for Question Answering
di: Ferguson, Nick, et al.
Pubblicazione: (2025)
di: Ferguson, Nick, et al.
Pubblicazione: (2025)
Distribution-Aware Algorithm Design with LLM Agents
di: Koganti, Saharsh, et al.
Pubblicazione: (2026)
di: Koganti, Saharsh, et al.
Pubblicazione: (2026)
Generalization or Memorization? Brittleness Testing for Chess-Trained Language Models
di: Tang, Ethan
Pubblicazione: (2026)
di: Tang, Ethan
Pubblicazione: (2026)
Does Self-Evaluation Enable Wireheading in Language Models?
di: Africa, David Demitri, et al.
Pubblicazione: (2025)
di: Africa, David Demitri, et al.
Pubblicazione: (2025)
DisCO: Reinforcing Large Reasoning Models with Discriminative Constrained Optimization
di: Li, Gang, et al.
Pubblicazione: (2025)
di: Li, Gang, et al.
Pubblicazione: (2025)
The Hot Mess of AI: How Does Misalignment Scale With Model Intelligence and Task Complexity?
di: Hägele, Alexander, et al.
Pubblicazione: (2026)
di: Hägele, Alexander, et al.
Pubblicazione: (2026)
Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering
di: Glazer, Neta, et al.
Pubblicazione: (2026)
di: Glazer, Neta, et al.
Pubblicazione: (2026)
Language Models can Self-Improve at State-Value Estimation for Better Search
di: Mendes, Ethan, et al.
Pubblicazione: (2025)
di: Mendes, Ethan, et al.
Pubblicazione: (2025)
Jailbreaking Large Vision Language Models in Intelligent Transportation Systems
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025)
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025)
Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
di: Rocamonde, Juan, et al.
Pubblicazione: (2023)
di: Rocamonde, Juan, et al.
Pubblicazione: (2023)
Knowledge Tagging with Large Language Model based Multi-Agent System
di: Li, Hang, et al.
Pubblicazione: (2024)
di: Li, Hang, et al.
Pubblicazione: (2024)
Anticipatory Evaluation of Language Models
di: Park, Jungsoo, et al.
Pubblicazione: (2025)
di: Park, Jungsoo, et al.
Pubblicazione: (2025)
Structured Cognitive Loop for Behavioral Intelligence in Large Language Model Agents
di: Kim, Myung Ho
Pubblicazione: (2025)
di: Kim, Myung Ho
Pubblicazione: (2025)
TMIQ: Quantifying Test and Measurement Domain Intelligence in Large Language Models
di: Olowe, Emmanuel A., et al.
Pubblicazione: (2025)
di: Olowe, Emmanuel A., et al.
Pubblicazione: (2025)
Uncovering Latent Bias in LLM-Based Emergency Department Triage Through Proxy Variables
di: Zhang, Ethan
Pubblicazione: (2026)
di: Zhang, Ethan
Pubblicazione: (2026)
A Unified Assessment of the Poverty of the Stimulus Argument for Neural Language Models
di: Yang, Xiulin, et al.
Pubblicazione: (2026)
di: Yang, Xiulin, et al.
Pubblicazione: (2026)
How to Measure the Intelligence of Large Language Models?
di: Körber, Nils, et al.
Pubblicazione: (2024)
di: Körber, Nils, et al.
Pubblicazione: (2024)
Artificial Intelligence as Strange Intelligence: Against Linear Models of Intelligence
di: Chilson, Kendra, et al.
Pubblicazione: (2026)
di: Chilson, Kendra, et al.
Pubblicazione: (2026)
Eureka-Audio: Triggering Audio Intelligence in Compact Language Models
di: Zhang, Dan, et al.
Pubblicazione: (2026)
di: Zhang, Dan, et al.
Pubblicazione: (2026)
Organizing a Society of Language Models: Structures and Mechanisms for Enhanced Collective Intelligence
di: Ferreira, Silvan, et al.
Pubblicazione: (2024)
di: Ferreira, Silvan, et al.
Pubblicazione: (2024)
Can Large Language Models be Trusted for Evaluation? Scalable Meta-Evaluation of LLMs as Evaluators via Agent Debate
di: Chern, Steffi, et al.
Pubblicazione: (2024)
di: Chern, Steffi, et al.
Pubblicazione: (2024)
Large Language Models and Scientific Discourse: Where's the Intelligence?
di: Collins, Harry, et al.
Pubblicazione: (2026)
di: Collins, Harry, et al.
Pubblicazione: (2026)
Recursive Symbolic Consciousness: A Formal Model of Emergent Intelligence Across Minds and Machines
di: Goudy, Anastasia
Pubblicazione: (2025)
di: Goudy, Anastasia
Pubblicazione: (2025)
Mapping the Landscape of Artificial Intelligence in Life Cycle Assessment Using Large Language Models
di: Mensikova, Anastasija, et al.
Pubblicazione: (2026)
di: Mensikova, Anastasija, et al.
Pubblicazione: (2026)
Truly Assessing Fluid Intelligence of Large Language Models through Dynamic Reasoning Evaluation
di: Yang, Yue, et al.
Pubblicazione: (2025)
di: Yang, Yue, et al.
Pubblicazione: (2025)
Imagine in Space: Exploring the Frontier of Spatial Intelligence and Reasoning Efficiency in Vision Language Models
di: Lian, Xiaoxing, et al.
Pubblicazione: (2025)
di: Lian, Xiaoxing, et al.
Pubblicazione: (2025)
Monotropic Artificial Intelligence: Toward a Cognitive Taxonomy of Domain-Specialized Language Models
di: Filho, Antonio de Sousa Leitão, et al.
Pubblicazione: (2026)
di: Filho, Antonio de Sousa Leitão, et al.
Pubblicazione: (2026)
OmniGeo: Towards a Multimodal Large Language Models for Geospatial Artificial Intelligence
di: Yuan, Long, et al.
Pubblicazione: (2025)
di: Yuan, Long, et al.
Pubblicazione: (2025)
Sustainable and Intelligent Public Facility Failure Management System Based on Large Language Models
di: Bi, Siguo, et al.
Pubblicazione: (2025)
di: Bi, Siguo, et al.
Pubblicazione: (2025)
General-Purpose Aerial Intelligent Agents Empowered by Large Language Models
di: Zhao, Ji, et al.
Pubblicazione: (2025)
di: Zhao, Ji, et al.
Pubblicazione: (2025)
INGRID: Intelligent Generative Robotic Design Using Large Language Models
di: Jia, Guanglu, et al.
Pubblicazione: (2025)
di: Jia, Guanglu, et al.
Pubblicazione: (2025)
Do Current Language Models Support Code Intelligence for R Programming Language?
di: Zhao, ZiXiao, et al.
Pubblicazione: (2024)
di: Zhao, ZiXiao, et al.
Pubblicazione: (2024)
Apple Intelligence Foundation Language Models
di: Gunter, Tom, et al.
Pubblicazione: (2024)
di: Gunter, Tom, et al.
Pubblicazione: (2024)
Documenti analoghi
-
The Fair Language Model Paradox
di: Pinto, Andrea, et al.
Pubblicazione: (2024) -
From Grounding to Planning: Benchmarking Bottlenecks in Web Agents
di: Shlomov, Segev, et al.
Pubblicazione: (2024) -
AgentFixer: From Failure Detection to Fix Recommendations in LLM Agentic Systems
di: Mulian, Hadar, et al.
Pubblicazione: (2026) -
Building Artificial Intelligence with Creative Agency and Self-hood
di: Gabora, Liane, et al.
Pubblicazione: (2024) -
Tool Building as a Path to "Superintelligence"
di: Koplow, David, et al.
Pubblicazione: (2026)