Salvato in:
| Autori principali: | Gawin, Cole, Sun, Yidan, Kejriwal, Mayank |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2502.14086 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Relational Schemata in BERT Are Inducible, Not Emergent: A Study of Performance vs. Competence in Language Models
di: Gawin, Cole
Pubblicazione: (2025)
di: Gawin, Cole
Pubblicazione: (2025)
Defining and Evaluating Decision and Composite Risk in Language Models Applied to Natural Language Inference
di: Shen, Ke, et al.
Pubblicazione: (2024)
di: Shen, Ke, et al.
Pubblicazione: (2024)
HALO: An Ontology for Representing and Categorizing Hallucinations in Large Language Models
di: Nananukul, Navapat, et al.
Pubblicazione: (2023)
di: Nananukul, Navapat, et al.
Pubblicazione: (2023)
Humanlike Cognitive Patterns as Emergent Phenomena in Large Language Models
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)
GRASP: A Grid-Based Benchmark for Evaluating Commonsense Spatial Reasoning
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)
Second Guess: Detecting Uncertainty Through Abstention and Answer Stability in Small Language Models
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2026)
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2026)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2026)
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2026)
An Evaluation of Estimative Uncertainty in Large Language Models
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)
SelECT-SQL: Self-correcting ensemble Chain-of-Thought for Text-to-SQL
di: Shen, Ke, et al.
Pubblicazione: (2024)
di: Shen, Ke, et al.
Pubblicazione: (2024)
Is persona enough for personality? Using ChatGPT to reconstruct an agent's latent personality from simple descriptions
di: Ji, Yongyi, et al.
Pubblicazione: (2024)
di: Ji, Yongyi, et al.
Pubblicazione: (2024)
Theory Discovery in Social Networks: Automating ERGM Specification with Large Language Models
di: Sun, Yidan, et al.
Pubblicazione: (2026)
di: Sun, Yidan, et al.
Pubblicazione: (2026)
Exploring a Cognitive Architecture for Learning Arithmetic Equations
di: Gawin, Cole
Pubblicazione: (2024)
di: Gawin, Cole
Pubblicazione: (2024)
Frame of Reference: Addressing the Challenges of Common Ground Representation in Situational Dialogs
di: Mohapatra, Biswesh, et al.
Pubblicazione: (2026)
di: Mohapatra, Biswesh, et al.
Pubblicazione: (2026)
What is an "Abstract Reasoner"? Revisiting Experiments and Arguments about Large Language Models
di: Yun, Tian, et al.
Pubblicazione: (2025)
di: Yun, Tian, et al.
Pubblicazione: (2025)
An Analysis of Artificial Intelligence Adoption in NIH-Funded Research
di: Nananukul, Navapat, et al.
Pubblicazione: (2026)
di: Nananukul, Navapat, et al.
Pubblicazione: (2026)
Emergent Symbolic Mechanisms Support Abstract Reasoning in Large Language Models
di: Yang, Yukang, et al.
Pubblicazione: (2025)
di: Yang, Yukang, et al.
Pubblicazione: (2025)
Abstract Activation Spaces for Content-Invariant Reasoning in Large Language Models
di: Maraia, Gabriele, et al.
Pubblicazione: (2026)
di: Maraia, Gabriele, et al.
Pubblicazione: (2026)
IPPON: Common Sense Guided Informative Path Planning for Object Goal Navigation
di: Qu, Kaixian, et al.
Pubblicazione: (2024)
di: Qu, Kaixian, et al.
Pubblicazione: (2024)
Beyond the Star Rating: A Scalable Framework for Aspect-Based Sentiment Analysis Using LLMs and Text Classification
di: Patil, Vishal, et al.
Pubblicazione: (2026)
di: Patil, Vishal, et al.
Pubblicazione: (2026)
From No to Know: Taxonomy, Challenges, and Opportunities for Negation Understanding in Multimodal Foundation Models
di: Vatsa, Mayank, et al.
Pubblicazione: (2025)
di: Vatsa, Mayank, et al.
Pubblicazione: (2025)
Large Language Models as Common-Sense Heuristics
di: Borro, Andrey, et al.
Pubblicazione: (2025)
di: Borro, Andrey, et al.
Pubblicazione: (2025)
Cross-lingual Editing in Multilingual Language Models
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024)
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024)
Meaningful Learning: Enhancing Abstract Reasoning in Large Language Models via Generic Fact Guidance
di: Xiong, Kai, et al.
Pubblicazione: (2024)
di: Xiong, Kai, et al.
Pubblicazione: (2024)
FRIDA to the Rescue! Analyzing Synthetic Data Effectiveness in Object-Based Common Sense Reasoning for Disaster Response
di: Shichman, Mollie, et al.
Pubblicazione: (2025)
di: Shichman, Mollie, et al.
Pubblicazione: (2025)
AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models
di: Yeh, Cheng-Kai, et al.
Pubblicazione: (2025)
di: Yeh, Cheng-Kai, et al.
Pubblicazione: (2025)
Code-Driven Planning in Grid Worlds with Large Language Models
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2025)
di: Aravindan, Ashwath Vaithinathan, et al.
Pubblicazione: (2025)
Remember This Event That Year? Assessing Temporal Information and Reasoning in Large Language Models
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024)
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024)
Generating Novelty in Open-World Multi-Agent Strategic Board Games
di: Kejriwal, Mayank, et al.
Pubblicazione: (2025)
di: Kejriwal, Mayank, et al.
Pubblicazione: (2025)
A Compound AI Agent for Conversational Grant Discovery
di: Tang, Zhisheng, et al.
Pubblicazione: (2026)
di: Tang, Zhisheng, et al.
Pubblicazione: (2026)
Where Does Toxicity Live? Mechanistic Localization and Targeted Suppression in Language Models
di: Beniwal, Himanshu, et al.
Pubblicazione: (2026)
di: Beniwal, Himanshu, et al.
Pubblicazione: (2026)
CommonIT: Commonality-Aware Instruction Tuning for Large Language Models via Data Partitions
di: Rao, Jun, et al.
Pubblicazione: (2024)
di: Rao, Jun, et al.
Pubblicazione: (2024)
Large Language Models Show Signs of Alignment with Human Neurocognition During Abstract Reasoning
di: Pinier, Christopher, et al.
Pubblicazione: (2025)
di: Pinier, Christopher, et al.
Pubblicazione: (2025)
A Reliable Common-Sense Reasoning Socialbot Built Using LLMs and Goal-Directed ASP
di: Zeng, Yankai, et al.
Pubblicazione: (2024)
di: Zeng, Yankai, et al.
Pubblicazione: (2024)
Do AI Models Perform Human-like Abstract Reasoning Across Modalities?
di: Beger, Claas, et al.
Pubblicazione: (2025)
di: Beger, Claas, et al.
Pubblicazione: (2025)
The Emergence of Abstract Thought in Large Language Models Beyond Any Language
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
No Universal Prompt: Unifying Reasoning through Adaptive Prompting for Temporal Table Reasoning
di: Rajgaria, Abhishek, et al.
Pubblicazione: (2025)
di: Rajgaria, Abhishek, et al.
Pubblicazione: (2025)
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
di: Zhou, Qianrui, et al.
Pubblicazione: (2025)
di: Zhou, Qianrui, et al.
Pubblicazione: (2025)
CausalARC: Abstract Reasoning with Causal World Models
di: Maasch, Jacqueline, et al.
Pubblicazione: (2025)
di: Maasch, Jacqueline, et al.
Pubblicazione: (2025)
Mathematical Reasoning in Large Language Models: Benchmarks, Architectures, Evaluation, and Open Challenges
di: Amjad, Husnain, et al.
Pubblicazione: (2026)
di: Amjad, Husnain, et al.
Pubblicazione: (2026)
Modeling and Simulating Agent-Based City Migration Using Conway's Game of Life
di: Deng, Bruce, et al.
Pubblicazione: (2024)
di: Deng, Bruce, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Relational Schemata in BERT Are Inducible, Not Emergent: A Study of Performance vs. Competence in Language Models
di: Gawin, Cole
Pubblicazione: (2025) -
Defining and Evaluating Decision and Composite Risk in Language Models Applied to Natural Language Inference
di: Shen, Ke, et al.
Pubblicazione: (2024) -
HALO: An Ontology for Representing and Categorizing Hallucinations in Large Language Models
di: Nananukul, Navapat, et al.
Pubblicazione: (2023) -
Humanlike Cognitive Patterns as Emergent Phenomena in Large Language Models
di: Tang, Zhisheng, et al.
Pubblicazione: (2024) -
GRASP: A Grid-Based Benchmark for Evaluating Commonsense Spatial Reasoning
di: Tang, Zhisheng, et al.
Pubblicazione: (2024)