Unsupervised decoding of encoded reasoning using language model interpretability
Fuente:
arXiv
Saved in:
| Main Authors: | Fang, Ching, Marks, Samuel |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Where meaning lives: Layer-wise accessibility of psycholinguistic features in encoder and decoder language models
by: Tikhomirova, Taisiia, et al.
Published: (2026)
by: Tikhomirova, Taisiia, et al.
Published: (2026)
Nonlocal operator learning for fMRI encoding and decoding tasks
by: Kramer, Andreas, et al.
Published: (2026)
by: Kramer, Andreas, et al.
Published: (2026)
Slm-mux: Orchestrating small language models for reasoning
by: Wang, Chenyu, et al.
Published: (2025)
by: Wang, Chenyu, et al.
Published: (2025)
Response: Emergent analogical reasoning in large language models
by: Hodel, Damian, et al.
Published: (2023)
by: Hodel, Damian, et al.
Published: (2023)
Retrieval-augmented reasoning with lean language models
by: Chan, Ryan Sze-Yin, et al.
Published: (2025)
by: Chan, Ryan Sze-Yin, et al.
Published: (2025)
Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles
by: Bhattacharya, Antara Raaghavi, et al.
Published: (2025)
by: Bhattacharya, Antara Raaghavi, et al.
Published: (2025)
Scaling laws for language encoding models in fMRI
by: Antonello, Richard, et al.
Published: (2023)
by: Antonello, Richard, et al.
Published: (2023)
Temporal convolutional and fusional transformer model with Bi-LSTM encoder-decoder for multi-time-window remaining useful life prediction
by: Pour, Mohamadreza Akbari, et al.
Published: (2025)
by: Pour, Mohamadreza Akbari, et al.
Published: (2025)
Supervised sparse auto-encoders for interpretable and compositional representations
by: Harzli, Ouns El, et al.
Published: (2026)
by: Harzli, Ouns El, et al.
Published: (2026)
MathDivide: Improved mathematical reasoning by large language models
by: Srivastava, Saksham Sahai, et al.
Published: (2024)
by: Srivastava, Saksham Sahai, et al.
Published: (2024)
Diffusion on language model encodings for protein sequence generation
by: Meshchaninov, Viacheslav, et al.
Published: (2024)
by: Meshchaninov, Viacheslav, et al.
Published: (2024)
Mellow: a small audio language model for reasoning
by: Deshmukh, Soham, et al.
Published: (2025)
by: Deshmukh, Soham, et al.
Published: (2025)
Code-enabled language models can outperform reasoning models on diverse tasks
by: Zhang, Cedegao E., et al.
Published: (2025)
by: Zhang, Cedegao E., et al.
Published: (2025)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
by: Syromiatnikov, Mykyta, et al.
Published: (2025)
by: Syromiatnikov, Mykyta, et al.
Published: (2025)
Replacing thinking with tool usage enables reasoning in small language models
by: Rainone, Corrado, et al.
Published: (2025)
by: Rainone, Corrado, et al.
Published: (2025)
Enhancing reasoning accuracy in large language models during inference time
by: Sharma, Vinay, et al.
Published: (2026)
by: Sharma, Vinay, et al.
Published: (2026)
Teaching large language models to reason like expert diagnosticians
by: Buckley, Thomas A., et al.
Published: (2025)
by: Buckley, Thomas A., et al.
Published: (2025)
Do language models practice what they preach? Examining language ideologies about gendered language reform encoded in LLMs
by: Watson, Julia, et al.
Published: (2024)
by: Watson, Julia, et al.
Published: (2024)
Transformer Dynamics: A neuroscientific approach to interpretability of large language models
by: Fernando, Jesseba, et al.
Published: (2025)
by: Fernando, Jesseba, et al.
Published: (2025)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
by: Han, Yifu, et al.
Published: (2025)
by: Han, Yifu, et al.
Published: (2025)
Large language models show fragile cognitive reasoning about human emotions
by: Bhattacharyya, Sree, et al.
Published: (2025)
by: Bhattacharyya, Sree, et al.
Published: (2025)
ThoughtSource: A central hub for large language model reasoning data
by: Ott, Simon, et al.
Published: (2023)
by: Ott, Simon, et al.
Published: (2023)
Superhuman performance of a large language model on the reasoning tasks of a physician
by: Brodeur, Peter G., et al.
Published: (2024)
by: Brodeur, Peter G., et al.
Published: (2024)
Information encoding and decoding in in-vitro neural networks on micro electrode arrays through stimulation timing
by: Lindell, Trym A. E., et al.
Published: (2024)
by: Lindell, Trym A. E., et al.
Published: (2024)
The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets
by: Marks, Samuel, et al.
Published: (2023)
by: Marks, Samuel, et al.
Published: (2023)
RareAlert: Aligning heterogeneous large language model reasoning for early rare disease risk screening
by: Chen, Xi, et al.
Published: (2026)
by: Chen, Xi, et al.
Published: (2026)
BRAVE: Broadening the visual encoding of vision-language models
by: Kar, Oğuzhan Fatih, et al.
Published: (2024)
by: Kar, Oğuzhan Fatih, et al.
Published: (2024)
Social preferences with unstable interactive reasoning: Large language models in economic trust games
by: Jiamin, Ou, et al.
Published: (2025)
by: Jiamin, Ou, et al.
Published: (2025)
Evidence from counterfactual tasks supports emergent analogical reasoning in large language models
by: Webb, Taylor, et al.
Published: (2024)
by: Webb, Taylor, et al.
Published: (2024)
Cognitive models can reveal interpretable value trade-offs in language models
by: Murthy, Sonia K., et al.
Published: (2025)
by: Murthy, Sonia K., et al.
Published: (2025)
Automated stereotactic radiosurgery planning using a human-in-the-loop reasoning large language model agent
by: Nusrat, Humza, et al.
Published: (2025)
by: Nusrat, Humza, et al.
Published: (2025)
A note on the impossibility of conditional PAC-efficient reasoning in large language models
by: Zeng, Hao
Published: (2025)
by: Zeng, Hao
Published: (2025)
CaseGPT: a case reasoning framework based on language models and retrieval-augmented generation
by: Yang, Rui
Published: (2024)
by: Yang, Rui
Published: (2024)
Fresh in memory: Training-order recency is linearly encoded in language model activations
by: Krasheninnikov, Dmitrii, et al.
Published: (2025)
by: Krasheninnikov, Dmitrii, et al.
Published: (2025)
Agentic-HLS: An agentic reasoning based high-level synthesis system using large language models (AI for EDA workshop 2024)
by: Oztas, Ali Emre, et al.
Published: (2024)
by: Oztas, Ali Emre, et al.
Published: (2024)
An interpretable generative multimodal neuroimaging-genomics framework for decoding Alzheimer's disease
by: Dolci, Giorgio, et al.
Published: (2024)
by: Dolci, Giorgio, et al.
Published: (2024)
A systematic evaluation of vision-language models for observational astronomical reasoning tasks
by: Ren, Wenke, et al.
Published: (2026)
by: Ren, Wenke, et al.
Published: (2026)
ClinicalGPT-R1: Pushing reasoning capability of generalist disease diagnosis with large language model
by: Lan, Wuyang, et al.
Published: (2025)
by: Lan, Wuyang, et al.
Published: (2025)
Demonstrating specification gaming in reasoning models
by: Bondarenko, Alexander, et al.
Published: (2025)
by: Bondarenko, Alexander, et al.
Published: (2025)
Multi-step retrieval and reasoning improves radiology question answering with large language models
by: Wind, Sebastian, et al.
Published: (2025)
by: Wind, Sebastian, et al.
Published: (2025)
Similar Items
-
Where meaning lives: Layer-wise accessibility of psycholinguistic features in encoder and decoder language models
by: Tikhomirova, Taisiia, et al.
Published: (2026) -
Nonlocal operator learning for fMRI encoding and decoding tasks
by: Kramer, Andreas, et al.
Published: (2026) -
Slm-mux: Orchestrating small language models for reasoning
by: Wang, Chenyu, et al.
Published: (2025) -
Response: Emergent analogical reasoning in large language models
by: Hodel, Damian, et al.
Published: (2023) -
Retrieval-augmented reasoning with lean language models
by: Chan, Ryan Sze-Yin, et al.
Published: (2025)