Reasoning aligns language models to human cognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Guiomar, Gonçalo, Torre, Elia, Moure, Pehuen, Shavina, Victoria, Giulianelli, Mario, Liu, Shih-Chii, Mante, Valerio |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Murphys Laws of AI Alignment: Why the Gap Always Wins
por: Gaikwad, Madhava
Publicado: (2025)
por: Gaikwad, Madhava
Publicado: (2025)
An Epidemiological Knowledge Graph extracted from the World Health Organization's Disease Outbreak News
por: Consoli, Sergio, et al.
Publicado: (2025)
por: Consoli, Sergio, et al.
Publicado: (2025)
SLEAN: Simple Lightweight Ensemble Analysis Network for Multi-Provider LLM Coordination: Design, Implementation, and Vibe Coding Bug Investigation Case Study
por: Vargas, Matheus J. T.
Publicado: (2025)
por: Vargas, Matheus J. T.
Publicado: (2025)
Solving Zebra Puzzles Using Constraint-Guided Multi-Agent Systems
por: Berman, Shmuel, et al.
Publicado: (2024)
por: Berman, Shmuel, et al.
Publicado: (2024)
TableMoE: Neuro-Symbolic Routing for Structured Expert Reasoning in Multimodal Table Understanding
por: Zhang, Junwen, et al.
Publicado: (2025)
por: Zhang, Junwen, et al.
Publicado: (2025)
Data and AI governance: Promoting equity, ethics, and fairness in large language models
por: Abhishek, Alok, et al.
Publicado: (2025)
por: Abhishek, Alok, et al.
Publicado: (2025)
Vibe-Creation: The Epistemology of Human-AI Emergent Cognition
por: Levin, Ilya
Publicado: (2026)
por: Levin, Ilya
Publicado: (2026)
Navigational Thinking as an Emerging Paradigm of Computer Science in the Age of Generative AI
por: Levin, Ilya
Publicado: (2026)
por: Levin, Ilya
Publicado: (2026)
Project Synapse: A Hierarchical Multi-Agent Framework with Hybrid Memory for Autonomous Resolution of Last-Mile Delivery Disruptions
por: Yadav, Arin Gopalan, et al.
Publicado: (2026)
por: Yadav, Arin Gopalan, et al.
Publicado: (2026)
Feature-Factory: Automating Software Feature Integration Using Generative AI
por: Vsevolodovna, Ruslan Idelfonso Magana
Publicado: (2024)
por: Vsevolodovna, Ruslan Idelfonso Magana
Publicado: (2024)
Reasoning Promotes Robustness in Theory of Mind Tasks
por: de Haan, Ian B., et al.
Publicado: (2026)
por: de Haan, Ian B., et al.
Publicado: (2026)
Generative AI and the Transformation of Software Development Practices
por: Acharya, Vivek
Publicado: (2025)
por: Acharya, Vivek
Publicado: (2025)
A Comparative Study of Feature Selection in Tsetlin Machines
por: Halenka, Vojtech, et al.
Publicado: (2025)
por: Halenka, Vojtech, et al.
Publicado: (2025)
Low-Resource Neural Machine Translation Using Recurrent Neural Networks and Transfer Learning: A Case Study on English-to-Igbo
por: Ekle, Ocheme Anthony, et al.
Publicado: (2025)
por: Ekle, Ocheme Anthony, et al.
Publicado: (2025)
Epidemic Information Extraction for Event-Based Surveillance using Large Language Models
por: Consoli, Sergio, et al.
Publicado: (2024)
por: Consoli, Sergio, et al.
Publicado: (2024)
Reference-Guided Verdict: LLMs-as-Judges in Automatic Evaluation of Free-Form QA
por: Badshah, Sher, et al.
Publicado: (2024)
por: Badshah, Sher, et al.
Publicado: (2024)
An Automatic Text Classification Method Based on Hierarchical Taxonomies, Neural Networks and Document Embedding: The NETHIC Tool
por: Lomasto, Luigi, et al.
Publicado: (2026)
por: Lomasto, Luigi, et al.
Publicado: (2026)
Intersymbolic AI: Interlinking Symbolic AI and Subsymbolic AI
por: Platzer, André
Publicado: (2024)
por: Platzer, André
Publicado: (2024)
Practical Quantum CIM Empowerment via All-Domestic-Core Agentic Large Model
por: Rui, Wang, et al.
Publicado: (2026)
por: Rui, Wang, et al.
Publicado: (2026)
PennyCoder: Efficient Domain-Specific LLMs for PennyLane-Based Quantum Code Generation
por: Basit, Abdul, et al.
Publicado: (2025)
por: Basit, Abdul, et al.
Publicado: (2025)
Approaching I/O-optimality for Approximate Attention
por: Papp, Pál András, et al.
Publicado: (2026)
por: Papp, Pál András, et al.
Publicado: (2026)
Mind the Metrics: Patterns for Telemetry-Aware In-IDE AI Application Development using the Model Context Protocol (MCP)
por: Koc, Vincent, et al.
Publicado: (2025)
por: Koc, Vincent, et al.
Publicado: (2025)
AI Model for Predicting Binding Affinity of Antidiabetic Compounds Targeting PPAR
por: Aman, La Ode, et al.
Publicado: (2024)
por: Aman, La Ode, et al.
Publicado: (2024)
From MTEB to MTOB: Retrieval-Augmented Classification for Descriptive Grammars
por: Kornilov, Albert, et al.
Publicado: (2024)
por: Kornilov, Albert, et al.
Publicado: (2024)
Beyond Accuracy: Decomposing the Reasoning Efficiency of LLMs
por: Kaiser, Daniel, et al.
Publicado: (2026)
por: Kaiser, Daniel, et al.
Publicado: (2026)
PLUGH: A Benchmark for Spatial Understanding and Reasoning in Large Language Models
por: Tikhonov, Alexey
Publicado: (2024)
por: Tikhonov, Alexey
Publicado: (2024)
Tokenizations for Austronesian Language Models: study on languages in Indonesia Archipelago
por: Lumbantobing, Andhika Bernard, et al.
Publicado: (2026)
por: Lumbantobing, Andhika Bernard, et al.
Publicado: (2026)
A Modular Cognitive Architecture for Assisted Reasoning: The Nemosine Framework
por: Melo, Edervaldo
Publicado: (2025)
por: Melo, Edervaldo
Publicado: (2025)
SHARP: Social Harm Analysis via Risk Profiles for Measuring Inequities in Large Language Models
por: Abhishek, Alok, et al.
Publicado: (2026)
por: Abhishek, Alok, et al.
Publicado: (2026)
TSDS: Data Selection for Task-Specific Model Finetuning
por: Liu, Zifan, et al.
Publicado: (2024)
por: Liu, Zifan, et al.
Publicado: (2024)
BEATS: Bias Evaluation and Assessment Test Suite for Large Language Models
por: Abhishek, Alok, et al.
Publicado: (2025)
por: Abhishek, Alok, et al.
Publicado: (2025)
GLEAN: Grounded Lightweight Evaluation Anchors for Contamination-Aware Tabular Reasoning
por: Wang, Qizhi
Publicado: (2026)
por: Wang, Qizhi
Publicado: (2026)
QHackBench: Benchmarking Large Language Models for Quantum Code Generation Using PennyLane Hackathon Challenges
por: Basit, Abdul, et al.
Publicado: (2025)
por: Basit, Abdul, et al.
Publicado: (2025)
Controlling Long-Horizon Behavior in Language Model Agents with Explicit State Dynamics
por: Subaharan, Sukesh
Publicado: (2026)
por: Subaharan, Sukesh
Publicado: (2026)
Harnessing non-adversarial robustness in large language models
por: Zhou, Qinghua, et al.
Publicado: (2026)
por: Zhou, Qinghua, et al.
Publicado: (2026)
Towards robust long-context understanding of large language model via active recap learning
por: Hui, Chenyu
Publicado: (2026)
por: Hui, Chenyu
Publicado: (2026)
Multilingual and Multimodal LLMs in the Wild: Building for Low-Resource Languages
por: Alam, Firoj, et al.
Publicado: (2026)
por: Alam, Firoj, et al.
Publicado: (2026)
LLM-Based Multi-Task Bangla Hate Speech Detection: Type, Severity, and Target
por: Hasan, Md Arid, et al.
Publicado: (2025)
por: Hasan, Md Arid, et al.
Publicado: (2025)
PropXplain: Can LLMs Enable Explainable Propaganda Detection?
por: Hasanain, Maram, et al.
Publicado: (2025)
por: Hasanain, Maram, et al.
Publicado: (2025)
Sinhala Transliteration: A Comparative Analysis Between Rule-based and Seq2Seq Approaches
por: De Mel, Yomal, et al.
Publicado: (2024)
por: De Mel, Yomal, et al.
Publicado: (2024)
Ejemplares similares
-
Murphys Laws of AI Alignment: Why the Gap Always Wins
por: Gaikwad, Madhava
Publicado: (2025) -
An Epidemiological Knowledge Graph extracted from the World Health Organization's Disease Outbreak News
por: Consoli, Sergio, et al.
Publicado: (2025) -
SLEAN: Simple Lightweight Ensemble Analysis Network for Multi-Provider LLM Coordination: Design, Implementation, and Vibe Coding Bug Investigation Case Study
por: Vargas, Matheus J. T.
Publicado: (2025) -
Solving Zebra Puzzles Using Constraint-Guided Multi-Agent Systems
por: Berman, Shmuel, et al.
Publicado: (2024) -
TableMoE: Neuro-Symbolic Routing for Structured Expert Reasoning in Multimodal Table Understanding
por: Zhang, Junwen, et al.
Publicado: (2025)