Mixture of Cognitive Reasoners: Modular Reasoning with Brain-Like Specialization
Fuente:
arXiv
Salvato in:
| Autori principali: | AlKhamissi, Badr, De Sabbata, C. Nicolò, Tuckute, Greta, Chen, Zeming, Schrimpf, Martin, Bosselut, Antoine |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Brain-Like Language Processing via a Shallow Untrained Multihead Attention Network
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
The LLM Language Network: A Neuroscientific Approach for Identifying Causally Task-Relevant Units
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
MIRAGE: Adaptive Multimodal Gating for Whole-Brain fMRI Encoding
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2026)
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2026)
From Language to Cognition: How LLMs Outgrow the Human Language Network
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025)
Rational Metareasoning for Large Language Models
di: De Sabbata, C. Nicolò, et al.
Pubblicazione: (2024)
di: De Sabbata, C. Nicolò, et al.
Pubblicazione: (2024)
Instruction-tuning Aligns LLMs to the Human Brain
di: Aw, Khai Loong, et al.
Pubblicazione: (2023)
di: Aw, Khai Loong, et al.
Pubblicazione: (2023)
Inducing Dyslexia in Vision Language Models
di: Honarmand, Melika, et al.
Pubblicazione: (2025)
di: Honarmand, Melika, et al.
Pubblicazione: (2025)
Dreaming Out Loud: A Self-Synthesis Approach For Training Vision-Language Models With Developmentally Plausible Data
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
A Context-Contrastive Inference Approach To Partial Diacritization
di: ElNokrashy, Muhammad, et al.
Pubblicazione: (2024)
di: ElNokrashy, Muhammad, et al.
Pubblicazione: (2024)
Depth-Wise Attention (DWAtt): A Layer Fusion Method for Data-Efficient Classification
di: ElNokrashy, Muhammad, et al.
Pubblicazione: (2022)
di: ElNokrashy, Muhammad, et al.
Pubblicazione: (2022)
Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models
di: Jamaa, Yassine, et al.
Pubblicazione: (2025)
di: Jamaa, Yassine, et al.
Pubblicazione: (2025)
PERK: Long-Context Reasoning as Parameter-Efficient Test-Time Learning
di: Chen, Zeming, et al.
Pubblicazione: (2025)
di: Chen, Zeming, et al.
Pubblicazione: (2025)
"Flex Tape Can't Fix That": Bias and Misinformation in Edited Language Models
di: Halevy, Karina, et al.
Pubblicazione: (2024)
di: Halevy, Karina, et al.
Pubblicazione: (2024)
Hire Your Anthropologist! Rethinking Culture Benchmarks Through an Anthropological Lens
di: AlKhamissi, Mai, et al.
Pubblicazione: (2025)
di: AlKhamissi, Mai, et al.
Pubblicazione: (2025)
Investigating Cultural Alignment of Large Language Models
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
Khattat: Enhancing Readability and Concept Representation of Semantic Typography
di: Hussein, Ahmed, et al.
Pubblicazione: (2024)
di: Hussein, Ahmed, et al.
Pubblicazione: (2024)
Model Connectomes: A Generational Approach to Data-Efficient Language Models
di: Kotar, Klemen, et al.
Pubblicazione: (2025)
di: Kotar, Klemen, et al.
Pubblicazione: (2025)
TopoLM: brain-like spatio-functional organization in a topographic language model
di: Rathi, Neil, et al.
Pubblicazione: (2024)
di: Rathi, Neil, et al.
Pubblicazione: (2024)
Discovering Knowledge-Critical Subnetworks in Pretrained Language Models
di: Bayazit, Deniz, et al.
Pubblicazione: (2023)
di: Bayazit, Deniz, et al.
Pubblicazione: (2023)
Large Language Models Align with the Human Brain during Creative Thinking
di: Ismayilzada, Mete, et al.
Pubblicazione: (2026)
di: Ismayilzada, Mete, et al.
Pubblicazione: (2026)
Revisiting Multilingual Data Mixtures in Language Model Pretraining
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
Complex Reasoning over Logical Queries on Commonsense Knowledge Graphs
di: Fang, Tianqing, et al.
Pubblicazione: (2024)
di: Fang, Tianqing, et al.
Pubblicazione: (2024)
Rosetta Stone at KSAA-RD Shared Task: A Hop From Language Modeling To Word--Definition Alignment
di: ElBakry, Ahmed, et al.
Pubblicazione: (2023)
di: ElBakry, Ahmed, et al.
Pubblicazione: (2023)
Geospatial Mechanistic Interpretability of Large Language Models
di: De Sabbata, Stef, et al.
Pubblicazione: (2025)
di: De Sabbata, Stef, et al.
Pubblicazione: (2025)
Exploring Geographic Relative Space in Large Language Models through Activation Patching
di: De Sabbata, Stef, et al.
Pubblicazione: (2026)
di: De Sabbata, Stef, et al.
Pubblicazione: (2026)
Scaling Laws for Task-Optimized Models of the Primate Visual Ventral Stream
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2024)
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2024)
Learning to Trade Like an Expert: Cognitive Fine-Tuning for Stable Financial Reasoning in Language Models
di: Pan, Yuchen, et al.
Pubblicazione: (2026)
di: Pan, Yuchen, et al.
Pubblicazione: (2026)
Crosscoding Through Time: Tracking Emergence & Consolidation Of Linguistic Representations Throughout LLM Pretraining
di: Bayazit, Deniz, et al.
Pubblicazione: (2025)
di: Bayazit, Deniz, et al.
Pubblicazione: (2025)
Sleep Brain and Cardiac Activity Predict Cognitive Flexibility and Conceptual Reasoning Using Deep Learning
di: Khajehpiri, Boshra, et al.
Pubblicazione: (2025)
di: Khajehpiri, Boshra, et al.
Pubblicazione: (2025)
Tracking the Limits of Knowledge Propagation: How LLMs Fail at Multi-Step Reasoning with Conflicting Knowledge
di: Feng, Yiyang, et al.
Pubblicazione: (2026)
di: Feng, Yiyang, et al.
Pubblicazione: (2026)
Mixture of Length and Pruning Experts for Knowledge Graphs Reasoning
di: Du, Enjun, et al.
Pubblicazione: (2025)
di: Du, Enjun, et al.
Pubblicazione: (2025)
Learning to Reason with Mixture of Tokens
di: Jain, Adit, et al.
Pubblicazione: (2025)
di: Jain, Adit, et al.
Pubblicazione: (2025)
Layer Specialization Underlying Compositional Reasoning in Transformers
di: Liu, Jing
Pubblicazione: (2025)
di: Liu, Jing
Pubblicazione: (2025)
Reliable Evaluation and Benchmarks for Statement Autoformalization
di: Poiroux, Auguste, et al.
Pubblicazione: (2024)
di: Poiroux, Auguste, et al.
Pubblicazione: (2024)
LLMs Are In-Context Bandit Reinforcement Learners
di: Monea, Giovanni, et al.
Pubblicazione: (2024)
di: Monea, Giovanni, et al.
Pubblicazione: (2024)
Transformers Pretrained on Procedural Data Contain Modular Structures for Algorithmic Reasoning
di: Shinnick, Zachary, et al.
Pubblicazione: (2025)
di: Shinnick, Zachary, et al.
Pubblicazione: (2025)
Modeling the language cortex with form-independent and enriched representations of sentence meaning reveals remarkable semantic abstractness
di: Saha, Shreya, et al.
Pubblicazione: (2025)
di: Saha, Shreya, et al.
Pubblicazione: (2025)
Unveiling the Basin-Like Loss Landscape in Large Language Models
di: Chen, Huanran, et al.
Pubblicazione: (2025)
di: Chen, Huanran, et al.
Pubblicazione: (2025)
MLP Fusion: Towards Efficient Fine-tuning of Dense and Mixture-of-Experts Language Models
di: Ai, Mengting, et al.
Pubblicazione: (2023)
di: Ai, Mengting, et al.
Pubblicazione: (2023)
PMODE: Theoretically Grounded and Modular Mixture Modeling
di: Vandermeulen, Robert A.
Pubblicazione: (2025)
di: Vandermeulen, Robert A.
Pubblicazione: (2025)
Documenti analoghi
-
Brain-Like Language Processing via a Shallow Untrained Multihead Attention Network
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024) -
The LLM Language Network: A Neuroscientific Approach for Identifying Causally Task-Relevant Units
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024) -
MIRAGE: Adaptive Multimodal Gating for Whole-Brain fMRI Encoding
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2026) -
From Language to Cognition: How LLMs Outgrow the Human Language Network
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025) -
Rational Metareasoning for Large Language Models
di: De Sabbata, C. Nicolò, et al.
Pubblicazione: (2024)