The LLM Language Network: A Neuroscientific Approach for Identifying Causally Task-Relevant Units
Fuente:
arXiv
Salvato in:
| Autori principali: | AlKhamissi, Badr, Tuckute, Greta, Bosselut, Antoine, Schrimpf, Martin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Brain-Like Language Processing via a Shallow Untrained Multihead Attention Network
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
From Language to Cognition: How LLMs Outgrow the Human Language Network
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025)
Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models
di: Jamaa, Yassine, et al.
Pubblicazione: (2025)
di: Jamaa, Yassine, et al.
Pubblicazione: (2025)
Mixture of Cognitive Reasoners: Modular Reasoning with Brain-Like Specialization
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025)
Inducing Dyslexia in Vision Language Models
di: Honarmand, Melika, et al.
Pubblicazione: (2025)
di: Honarmand, Melika, et al.
Pubblicazione: (2025)
A Context-Contrastive Inference Approach To Partial Diacritization
di: ElNokrashy, Muhammad, et al.
Pubblicazione: (2024)
di: ElNokrashy, Muhammad, et al.
Pubblicazione: (2024)
Instruction-tuning Aligns LLMs to the Human Brain
di: Aw, Khai Loong, et al.
Pubblicazione: (2023)
di: Aw, Khai Loong, et al.
Pubblicazione: (2023)
MIRAGE: Adaptive Multimodal Gating for Whole-Brain fMRI Encoding
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2026)
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2026)
Rational Metareasoning for Large Language Models
di: De Sabbata, C. Nicolò, et al.
Pubblicazione: (2024)
di: De Sabbata, C. Nicolò, et al.
Pubblicazione: (2024)
Dreaming Out Loud: A Self-Synthesis Approach For Training Vision-Language Models With Developmentally Plausible Data
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
Depth-Wise Attention (DWAtt): A Layer Fusion Method for Data-Efficient Classification
di: ElNokrashy, Muhammad, et al.
Pubblicazione: (2022)
di: ElNokrashy, Muhammad, et al.
Pubblicazione: (2022)
"Flex Tape Can't Fix That": Bias and Misinformation in Edited Language Models
di: Halevy, Karina, et al.
Pubblicazione: (2024)
di: Halevy, Karina, et al.
Pubblicazione: (2024)
Investigating Cultural Alignment of Large Language Models
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024)
Hire Your Anthropologist! Rethinking Culture Benchmarks Through an Anthropological Lens
di: AlKhamissi, Mai, et al.
Pubblicazione: (2025)
di: AlKhamissi, Mai, et al.
Pubblicazione: (2025)
Khattat: Enhancing Readability and Concept Representation of Semantic Typography
di: Hussein, Ahmed, et al.
Pubblicazione: (2024)
di: Hussein, Ahmed, et al.
Pubblicazione: (2024)
TopoLM: brain-like spatio-functional organization in a topographic language model
di: Rathi, Neil, et al.
Pubblicazione: (2024)
di: Rathi, Neil, et al.
Pubblicazione: (2024)
Rosetta Stone at KSAA-RD Shared Task: A Hop From Language Modeling To Word--Definition Alignment
di: ElBakry, Ahmed, et al.
Pubblicazione: (2023)
di: ElBakry, Ahmed, et al.
Pubblicazione: (2023)
Crosscoding Through Time: Tracking Emergence & Consolidation Of Linguistic Representations Throughout LLM Pretraining
di: Bayazit, Deniz, et al.
Pubblicazione: (2025)
di: Bayazit, Deniz, et al.
Pubblicazione: (2025)
Model Connectomes: A Generational Approach to Data-Efficient Language Models
di: Kotar, Klemen, et al.
Pubblicazione: (2025)
di: Kotar, Klemen, et al.
Pubblicazione: (2025)
Large Language Models Align with the Human Brain during Creative Thinking
di: Ismayilzada, Mete, et al.
Pubblicazione: (2026)
di: Ismayilzada, Mete, et al.
Pubblicazione: (2026)
Helpful to a Fault: Measuring Illicit Assistance in Multi-Turn, Multilingual LLM Agents
di: Talokar, Nivya, et al.
Pubblicazione: (2026)
di: Talokar, Nivya, et al.
Pubblicazione: (2026)
PERK: Long-Context Reasoning as Parameter-Efficient Test-Time Learning
di: Chen, Zeming, et al.
Pubblicazione: (2025)
di: Chen, Zeming, et al.
Pubblicazione: (2025)
Revisiting Multilingual Data Mixtures in Language Model Pretraining
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
ConLID: Supervised Contrastive Learning for Low-Resource Language Identification
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
Discovering Knowledge-Critical Subnetworks in Pretrained Language Models
di: Bayazit, Deniz, et al.
Pubblicazione: (2023)
di: Bayazit, Deniz, et al.
Pubblicazione: (2023)
Modeling the language cortex with form-independent and enriched representations of sentence meaning reveals remarkable semantic abstractness
di: Saha, Shreya, et al.
Pubblicazione: (2025)
di: Saha, Shreya, et al.
Pubblicazione: (2025)
Reliable Evaluation and Benchmarks for Statement Autoformalization
di: Poiroux, Auguste, et al.
Pubblicazione: (2024)
di: Poiroux, Auguste, et al.
Pubblicazione: (2024)
LLMs Are In-Context Bandit Reinforcement Learners
di: Monea, Giovanni, et al.
Pubblicazione: (2024)
di: Monea, Giovanni, et al.
Pubblicazione: (2024)
Evaluating Language Model Agency through Negotiations
di: Davidson, Tim R., et al.
Pubblicazione: (2024)
di: Davidson, Tim R., et al.
Pubblicazione: (2024)
Can Performant LLMs Be Ethical? Quantifying the Impact of Web Crawling Opt-Outs
di: Fan, Dongyang, et al.
Pubblicazione: (2025)
di: Fan, Dongyang, et al.
Pubblicazione: (2025)
Introducing HALC: A general pipeline for finding optimal prompting strategies for automated coding with LLMs in the computational social sciences
di: Reich, Andreas, et al.
Pubblicazione: (2025)
di: Reich, Andreas, et al.
Pubblicazione: (2025)
GaLLoP: Gradient-based Sparse Learning on Low-Magnitude Parameters
di: Choudhary, Anand, et al.
Pubblicazione: (2025)
di: Choudhary, Anand, et al.
Pubblicazione: (2025)
Identifying Factual Inconsistencies in Summaries: Grounding LLM Inference via Task Taxonomy
di: Xu, Liyan, et al.
Pubblicazione: (2024)
di: Xu, Liyan, et al.
Pubblicazione: (2024)
A Logical Fallacy-Informed Framework for Argument Generation
di: Mouchel, Luca, et al.
Pubblicazione: (2024)
di: Mouchel, Luca, et al.
Pubblicazione: (2024)
Topoformer: brain-like topographic organization in Transformer language models through spatial querying and reweighting
di: Binhuraib, Taha, et al.
Pubblicazione: (2025)
di: Binhuraib, Taha, et al.
Pubblicazione: (2025)
Disentangling Language Roles in Multilingual LLM Task Execution
di: Zhan, Qishi, et al.
Pubblicazione: (2026)
di: Zhan, Qishi, et al.
Pubblicazione: (2026)
Scaling Laws for Task-Optimized Models of the Primate Visual Ventral Stream
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2024)
di: Gokce, Abdulkadir, et al.
Pubblicazione: (2024)
Parity-Aware Byte-Pair Encoding: Improving Cross-lingual Fairness in Tokenization
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
Reward Models Identify Consistency, Not Causality
di: Xu, Yuhui, et al.
Pubblicazione: (2025)
di: Xu, Yuhui, et al.
Pubblicazione: (2025)
LLM4Causal: Democratized Causal Tools for Everyone via Large Language Model
di: Jiang, Haitao, et al.
Pubblicazione: (2023)
di: Jiang, Haitao, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Brain-Like Language Processing via a Shallow Untrained Multihead Attention Network
di: AlKhamissi, Badr, et al.
Pubblicazione: (2024) -
From Language to Cognition: How LLMs Outgrow the Human Language Network
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025) -
Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models
di: Jamaa, Yassine, et al.
Pubblicazione: (2025) -
Mixture of Cognitive Reasoners: Modular Reasoning with Brain-Like Specialization
di: AlKhamissi, Badr, et al.
Pubblicazione: (2025) -
Inducing Dyslexia in Vision Language Models
di: Honarmand, Melika, et al.
Pubblicazione: (2025)