An introduction to graphical tensor notation for mechanistic interpretability
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Taylor, Jordan K. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Joint data imputation and mechanistic modelling for simulating heart-brain interactions in incomplete datasets
par: Banus, Jaume, et autres
Publié: (2020)
par: Banus, Jaume, et autres
Publié: (2020)
Identifying Functionally Important Features with End-to-End Sparse Dictionary Learning
par: Braun, Dan, et autres
Publié: (2024)
par: Braun, Dan, et autres
Publié: (2024)
DoWhy-GCM: An extension of DoWhy for causal inference in graphical causal models
par: Blöbaum, Patrick, et autres
Publié: (2022)
par: Blöbaum, Patrick, et autres
Publié: (2022)
Semantic Geometry for policy-constrained interpretation
par: Phadke, Nikit
Publié: (2025)
par: Phadke, Nikit
Publié: (2025)
Revisiting the robustness of post-hoc interpretability methods
par: Wei, Jiawen, et autres
Publié: (2024)
par: Wei, Jiawen, et autres
Publié: (2024)
On the transferability of Sparse Autoencoders for interpreting compressed models
par: Gupte, Suchit, et autres
Publié: (2025)
par: Gupte, Suchit, et autres
Publié: (2025)
Weight-sparse transformers have interpretable circuits
par: Gao, Leo, et autres
Publié: (2025)
par: Gao, Leo, et autres
Publié: (2025)
Enhancing interpretability of rule-based classifiers through feature graphs
par: Sirocchi, Christel, et autres
Publié: (2025)
par: Sirocchi, Christel, et autres
Publié: (2025)
Robustness questions the interpretability of graph neural networks: what to do?
par: Lukyanov, Kirill, et autres
Publié: (2025)
par: Lukyanov, Kirill, et autres
Publié: (2025)
Universal scaling laws in quantum-probabilistic machine learning by tensor network towards interpreting representation and generalization powers
par: Bai, Sheng-Chen, et autres
Publié: (2024)
par: Bai, Sheng-Chen, et autres
Publié: (2024)
Empirical influence functions to understand the logic of fine-tuning
par: Matelsky, Jordan K., et autres
Publié: (2024)
par: Matelsky, Jordan K., et autres
Publié: (2024)
VAE-Inf: A statistically interpretable generative paradigm for imbalanced classification
par: Wu, Hongfei, et autres
Publié: (2026)
par: Wu, Hongfei, et autres
Publié: (2026)
Defense effectiveness across architectural layers: a mechanistic evaluation of persistent memory attacks on stateful LLM agents
par: Leong, Jun Wen
Publié: (2026)
par: Leong, Jun Wen
Publié: (2026)
WEITS: A Wavelet-enhanced residual framework for interpretable time series forecasting
par: Guo, Ziyou, et autres
Publié: (2024)
par: Guo, Ziyou, et autres
Publié: (2024)
Accurate and interpretable drug-drug interaction prediction enabled by knowledge subgraph learning
par: Wang, Yaqing, et autres
Publié: (2023)
par: Wang, Yaqing, et autres
Publié: (2023)
A Study of Plasticity Loss in On-Policy Deep Reinforcement Learning
par: Juliani, Arthur, et autres
Publié: (2024)
par: Juliani, Arthur, et autres
Publié: (2024)
Quantifying Symptom Causality in Clinical Decision Making: An Exploration Using CausaLM
par: Shetty, Mehul, et autres
Publié: (2025)
par: Shetty, Mehul, et autres
Publié: (2025)
Self-interpreting Adversarial Images
par: Zhang, Tingwei, et autres
Publié: (2024)
par: Zhang, Tingwei, et autres
Publié: (2024)
SGC-RML: A reliable and interpretable longitudinal assessment for PD in real-world DNS
par: Wei, Wenbin, et autres
Publié: (2026)
par: Wei, Wenbin, et autres
Publié: (2026)
What on Earth is AlphaEarth? Hierarchical structure and functional interpretability for global land cover
par: Benavides-Martinez, Ivan Felipe, et autres
Publié: (2026)
par: Benavides-Martinez, Ivan Felipe, et autres
Publié: (2026)
A constraints-based approach to fully interpretable neural networks for detecting learner behaviors
par: Pinto, Juan D., et autres
Publié: (2025)
par: Pinto, Juan D., et autres
Publié: (2025)
Pilot selection in the era of Virtual reality: algorithms for accurate and interpretable machine learning models
par: Ke, Luoma, et autres
Publié: (2025)
par: Ke, Luoma, et autres
Publié: (2025)
RACE-SM: Reinforcement Learning Based Autonomous Control for Social On-Ramp Merging
par: Poots, Jordan
Publié: (2024)
par: Poots, Jordan
Publié: (2024)
Directional Routing in Transformers
par: Taylor, Kevin
Publié: (2026)
par: Taylor, Kevin
Publié: (2026)
BP-Seg: A graphical model approach to unsupervised and non-contiguous text segmentation using belief propagation
par: Li, Fengyi, et autres
Publié: (2025)
par: Li, Fengyi, et autres
Publié: (2025)
Granular-ball computing: an efficient, robust, and interpretable adaptive multi-granularity representation and computation method
par: Xia, Shuyin, et autres
Publié: (2023)
par: Xia, Shuyin, et autres
Publié: (2023)
Product-Aware Deep Autoencoders for Robust Process Monitoring in Multi-Product Cyber-Physical Systems
par: Islam, MD Shafikul, et autres
Publié: (2026)
par: Islam, MD Shafikul, et autres
Publié: (2026)
Neuron-based explanations of neural networks sacrifice completeness and interpretability
par: Dey, Nolan, et autres
Publié: (2020)
par: Dey, Nolan, et autres
Publié: (2020)
The Effects of Data Imbalance Under a Federated Learning Approach for Credit Risk Forecasting
par: Zhang, Shuyao, et autres
Publié: (2024)
par: Zhang, Shuyao, et autres
Publié: (2024)
DIM: Enforcing Domain-Informed Monotonicity in Deep Neural Networks
par: Salim, Joshua, et autres
Publié: (2025)
par: Salim, Joshua, et autres
Publié: (2025)
TQCompressor: improving tensor decomposition methods in neural networks via permutations
par: Abronin, V., et autres
Publié: (2024)
par: Abronin, V., et autres
Publié: (2024)
Learning to Abstract Visuomotor Mappings using Meta-Reinforcement Learning
par: Velazquez-Vargas, Carlos A., et autres
Publié: (2024)
par: Velazquez-Vargas, Carlos A., et autres
Publié: (2024)
Simulating realistic short tandem repeat capillary electrophoretic signal using a generative adversarial network
par: Taylor, Duncan, et autres
Publié: (2024)
par: Taylor, Duncan, et autres
Publié: (2024)
pUniFind: a unified large pre-trained deep learning model pushing the limit of mass spectra interpretation
par: Zhao, Jiale, et autres
Publié: (2025)
par: Zhao, Jiale, et autres
Publié: (2025)
Scalable Utility-Aware Multiclass Calibration
par: Hegazy, Mahmoud, et autres
Publié: (2025)
par: Hegazy, Mahmoud, et autres
Publié: (2025)
Driving pattern interpretation based on action phases clustering
par: Yao, Xue, et autres
Publié: (2024)
par: Yao, Xue, et autres
Publié: (2024)
Formal Logic Enabled Personalized Federated Learning Through Property Inference
par: An, Ziyan, et autres
Publié: (2024)
par: An, Ziyan, et autres
Publié: (2024)
Are Large-Language Models Graph Algorithmic Reasoners?
par: Taylor, Alexander K, et autres
Publié: (2024)
par: Taylor, Alexander K, et autres
Publié: (2024)
Zero-shot protein stability prediction by inverse folding models: a free energy interpretation
par: Frellsen, Jes, et autres
Publié: (2025)
par: Frellsen, Jes, et autres
Publié: (2025)
Using Slisemap to interpret physical data
par: Seppäläinen, Lauri, et autres
Publié: (2023)
par: Seppäläinen, Lauri, et autres
Publié: (2023)
Documents similaires
-
Joint data imputation and mechanistic modelling for simulating heart-brain interactions in incomplete datasets
par: Banus, Jaume, et autres
Publié: (2020) -
Identifying Functionally Important Features with End-to-End Sparse Dictionary Learning
par: Braun, Dan, et autres
Publié: (2024) -
DoWhy-GCM: An extension of DoWhy for causal inference in graphical causal models
par: Blöbaum, Patrick, et autres
Publié: (2022) -
Semantic Geometry for policy-constrained interpretation
par: Phadke, Nikit
Publié: (2025) -
Revisiting the robustness of post-hoc interpretability methods
par: Wei, Jiawen, et autres
Publié: (2024)