Penzai + Treescope: A Toolkit for Interpreting, Visualizing, and Editing Models As Data
Fuente:
arXiv
Guardado en:
| Autor principal: | Johnson, Daniel D. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Interpretable Embeddings with Sparse Autoencoders: A Data Analysis Toolkit
por: Jiang, Nick, et al.
Publicado: (2025)
por: Jiang, Nick, et al.
Publicado: (2025)
Quanda: An Interpretability Toolkit for Training Data Attribution Evaluation and Beyond
por: Bareeva, Dilyara, et al.
Publicado: (2024)
por: Bareeva, Dilyara, et al.
Publicado: (2024)
DreamReader: An Interpretability Toolkit for Text-to-Image Models
por: Prakash, Nirmalendu, et al.
Publicado: (2026)
por: Prakash, Nirmalendu, et al.
Publicado: (2026)
Towards Interpretability in Audio and Visual Affective Machine Learning: A Review
por: Johnson, David S., et al.
Publicado: (2023)
por: Johnson, David S., et al.
Publicado: (2023)
SynVA: A Modular Toolkit for Vessel Generation and Aneurysm Editing
por: Finck, Marten J., et al.
Publicado: (2026)
por: Finck, Marten J., et al.
Publicado: (2026)
Venom: A PyTorch Generative Modeling Toolkit
por: Yan, Liang
Publicado: (2026)
por: Yan, Liang
Publicado: (2026)
Interpretable Visualizations of Data Spaces for Classification Problems
por: Jorgensen, Christian, et al.
Publicado: (2025)
por: Jorgensen, Christian, et al.
Publicado: (2025)
A Toolkit for Virtual Reality Data Collection
por: Rolff, Tim, et al.
Publicado: (2024)
por: Rolff, Tim, et al.
Publicado: (2024)
Dialz: A Python Toolkit for Steering Vectors
por: Siddique, Zara, et al.
Publicado: (2025)
por: Siddique, Zara, et al.
Publicado: (2025)
Prisma: An Open Source Toolkit for Mechanistic Interpretability in Vision and Video
por: Joseph, Sonia, et al.
Publicado: (2025)
por: Joseph, Sonia, et al.
Publicado: (2025)
DataArc-SynData-Toolkit: A Unified Closed-Loop Framework for Multi-Path, Multimodal, and Multilingual Data Synthesis
por: Shi, Zhichao, et al.
Publicado: (2026)
por: Shi, Zhichao, et al.
Publicado: (2026)
PAODING: A High-fidelity Data-free Pruning Toolkit for Debloating Pre-trained Neural Networks
por: Meng, Mark Huasong, et al.
Publicado: (2024)
por: Meng, Mark Huasong, et al.
Publicado: (2024)
ThinkEdit: Interpretable Weight Editing to Mitigate Overly Short Thinking in Reasoning Models
por: Sun, Chung-En, et al.
Publicado: (2025)
por: Sun, Chung-En, et al.
Publicado: (2025)
UNCA: A Neutrosophic-Based Framework for Robust Clustering and Enhanced Data Interpretation
por: Dhinakaran, D., et al.
Publicado: (2025)
por: Dhinakaran, D., et al.
Publicado: (2025)
Editing as Unlearning: Are Knowledge Editing Methods Strong Baselines for Large Language Model Unlearning?
por: Li, Zexi, et al.
Publicado: (2025)
por: Li, Zexi, et al.
Publicado: (2025)
Bridging Graph Structure and Knowledge-Guided Editing for Interpretable Temporal Knowledge Graph Reasoning
por: Fan, Shiqi, et al.
Publicado: (2026)
por: Fan, Shiqi, et al.
Publicado: (2026)
Data Selection: A General Principle for Building Small Interpretable Models
por: Ghose, Abhishek
Publicado: (2022)
por: Ghose, Abhishek
Publicado: (2022)
NepTrain and NepTrainKit: Automated Active Learning and Visualization Toolkit for Neuroevolution Potentials
por: Chen, Chengbing, et al.
Publicado: (2025)
por: Chen, Chengbing, et al.
Publicado: (2025)
PaintBench: Deterministic Evaluation of Precise Visual Editing
por: Xu, Kai, et al.
Publicado: (2026)
por: Xu, Kai, et al.
Publicado: (2026)
Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models
por: Marks, Samuel, et al.
Publicado: (2024)
por: Marks, Samuel, et al.
Publicado: (2024)
HGCN(O): A Self-Tuning GCN HyperModel Toolkit for Outcome Prediction in Event-Sequence Data
por: Wang, Fang, et al.
Publicado: (2025)
por: Wang, Fang, et al.
Publicado: (2025)
Rashomon Sets for Prototypical-Part Networks: Editing Interpretable Models in Real-Time
por: Donnelly, Jon, et al.
Publicado: (2025)
por: Donnelly, Jon, et al.
Publicado: (2025)
MXtalTools: A Toolkit for Machine Learning on Molecular Crystals
por: Kilgour, Michael, et al.
Publicado: (2025)
por: Kilgour, Michael, et al.
Publicado: (2025)
Data Science with LLMs and Interpretable Models
por: Bordt, Sebastian, et al.
Publicado: (2024)
por: Bordt, Sebastian, et al.
Publicado: (2024)
NeMo-Aligner: Scalable Toolkit for Efficient Model Alignment
por: Shen, Gerald, et al.
Publicado: (2024)
por: Shen, Gerald, et al.
Publicado: (2024)
TerraTorch: The Geospatial Foundation Models Toolkit
por: Gomes, Carlos, et al.
Publicado: (2025)
por: Gomes, Carlos, et al.
Publicado: (2025)
Interpreting and Editing Vision-Language Representations to Mitigate Hallucinations
por: Jiang, Nick, et al.
Publicado: (2024)
por: Jiang, Nick, et al.
Publicado: (2024)
FMTK: A Modular Toolkit for Composable Time Series Foundation Model Pipelines
por: Shastri, Hetvi, et al.
Publicado: (2025)
por: Shastri, Hetvi, et al.
Publicado: (2025)
OpenBox: A Python Toolkit for Generalized Black-box Optimization
por: Jiang, Huaijun, et al.
Publicado: (2023)
por: Jiang, Huaijun, et al.
Publicado: (2023)
Model Interpretation and Explainability: Towards Creating Transparency in Prediction Models
por: Kridel, Donald, et al.
Publicado: (2024)
por: Kridel, Donald, et al.
Publicado: (2024)
GenCtrl -- A Formal Controllability Toolkit for Generative Models
por: Cheng, Emily, et al.
Publicado: (2026)
por: Cheng, Emily, et al.
Publicado: (2026)
CEBench: A Benchmarking Toolkit for the Cost-Effectiveness of LLM Pipelines
por: Sun, Wenbo, et al.
Publicado: (2024)
por: Sun, Wenbo, et al.
Publicado: (2024)
SHAPCA: Consistent and Interpretable Explanations for Machine Learning Models on Spectroscopy Data
por: Zhang, Mingxing, et al.
Publicado: (2026)
por: Zhang, Mingxing, et al.
Publicado: (2026)
FairLogue: A Toolkit for Intersectional Fairness Analysis in Clinical Machine Learning Models
por: Souligne, Nick, et al.
Publicado: (2026)
por: Souligne, Nick, et al.
Publicado: (2026)
Structural Inference: Interpreting Small Language Models with Susceptibilities
por: Baker, Garrett, et al.
Publicado: (2025)
por: Baker, Garrett, et al.
Publicado: (2025)
Predictive Concept Decoders: Training Scalable End-to-End Interpretability Assistants
por: Huang, Vincent, et al.
Publicado: (2025)
por: Huang, Vincent, et al.
Publicado: (2025)
DeconDTN-Toolkit: A Library for Evaluation and Enhancement of Robustness to Provenance Shift
por: Tan, Yongsen, et al.
Publicado: (2026)
por: Tan, Yongsen, et al.
Publicado: (2026)
Benchmarking Multimodal Variational Autoencoders: CdSprites+ Dataset and Toolkit
por: Sejnova, Gabriela, et al.
Publicado: (2022)
por: Sejnova, Gabriela, et al.
Publicado: (2022)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
por: Goddard, Charles, et al.
Publicado: (2024)
por: Goddard, Charles, et al.
Publicado: (2024)
Patterning: The Dual of Interpretability
por: Wang, George, et al.
Publicado: (2026)
por: Wang, George, et al.
Publicado: (2026)
Ejemplares similares
-
Interpretable Embeddings with Sparse Autoencoders: A Data Analysis Toolkit
por: Jiang, Nick, et al.
Publicado: (2025) -
Quanda: An Interpretability Toolkit for Training Data Attribution Evaluation and Beyond
por: Bareeva, Dilyara, et al.
Publicado: (2024) -
DreamReader: An Interpretability Toolkit for Text-to-Image Models
por: Prakash, Nirmalendu, et al.
Publicado: (2026) -
Towards Interpretability in Audio and Visual Affective Machine Learning: A Review
por: Johnson, David S., et al.
Publicado: (2023) -
SynVA: A Modular Toolkit for Vessel Generation and Aneurysm Editing
por: Finck, Marten J., et al.
Publicado: (2026)