Automatic Discovery of Visual Circuits
Fuente:
arXiv
Salvato in:
| Autori principali: | Rajaram, Achyuta, Chowdhury, Neil, Torralba, Antonio, Andreas, Jacob, Schwettmann, Sarah |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Line of Sight: On Linear Representations in VLLMs
di: Rajaram, Achyuta, et al.
Pubblicazione: (2025)
di: Rajaram, Achyuta, et al.
Pubblicazione: (2025)
A Multimodal Automated Interpretability Agent
di: Shaham, Tamar Rott, et al.
Pubblicazione: (2024)
di: Shaham, Tamar Rott, et al.
Pubblicazione: (2024)
Nearest Neighbor Normalization Improves Multimodal Retrieval
di: Chowdhury, Neil, et al.
Pubblicazione: (2024)
di: Chowdhury, Neil, et al.
Pubblicazione: (2024)
CoE: Chain-of-Explanation via Automatic Visual Concept Circuit Description and Polysemanticity Quantification
di: Yu, Wenlong, et al.
Pubblicazione: (2025)
di: Yu, Wenlong, et al.
Pubblicazione: (2025)
Granular Concept Circuits: Toward a Fine-Grained Circuit Discovery for Concept Representations
di: Kwon, Dahee, et al.
Pubblicazione: (2025)
di: Kwon, Dahee, et al.
Pubblicazione: (2025)
Counting Circuits: Mechanistic Interpretability of Visual Reasoning in Large Vision-Language Models
di: Che, Liwei, et al.
Pubblicazione: (2026)
di: Che, Liwei, et al.
Pubblicazione: (2026)
Dataset Distillation for Pre-Trained Self-Supervised Vision Models
di: Cazenavette, George, et al.
Pubblicazione: (2025)
di: Cazenavette, George, et al.
Pubblicazione: (2025)
Automatically Generating Visual Hallucination Test Cases for Multimodal Large Language Models
di: Liu, Zhongye, et al.
Pubblicazione: (2024)
di: Liu, Zhongye, et al.
Pubblicazione: (2024)
Visual Prompt Discovery via Semantic Exploration
di: Kim, Jaechang, et al.
Pubblicazione: (2026)
di: Kim, Jaechang, et al.
Pubblicazione: (2026)
Tensor Memory: Fixed-Size Recurrent State for Long-Horizon Transformers
di: Swain, Kabir, et al.
Pubblicazione: (2026)
di: Swain, Kabir, et al.
Pubblicazione: (2026)
VCD: A Dataset for Visual Commonsense Discovery in Images
di: Shen, Xiangqing, et al.
Pubblicazione: (2024)
di: Shen, Xiangqing, et al.
Pubblicazione: (2024)
Image-Intrinsic Priors for Integrated Circuit Defect Detection and Novel Class Discovery via Self-Supervised Learning
di: Zhao, Botong., et al.
Pubblicazione: (2025)
di: Zhao, Botong., et al.
Pubblicazione: (2025)
Enhancing Skin Disease Diagnosis: Interpretable Visual Concept Discovery with SAM
di: Hu, Xin, et al.
Pubblicazione: (2024)
di: Hu, Xin, et al.
Pubblicazione: (2024)
TSOM: Small Object Motion Detection Neural Network Inspired by Avian Visual Circuit
di: Hu, Pignge, et al.
Pubblicazione: (2024)
di: Hu, Pignge, et al.
Pubblicazione: (2024)
TM-PATHVQA:90000+ Textless Multilingual Questions for Medical Visual Question Answering
di: Rajkhowa, Tonmoy, et al.
Pubblicazione: (2024)
di: Rajkhowa, Tonmoy, et al.
Pubblicazione: (2024)
TruthLens: Visual Grounding for Universal DeepFake Reasoning
di: Kundu, Rohit, et al.
Pubblicazione: (2025)
di: Kundu, Rohit, et al.
Pubblicazione: (2025)
Single-pass Adaptive Image Tokenization for Minimum Program Search
di: Duggal, Shivam, et al.
Pubblicazione: (2025)
di: Duggal, Shivam, et al.
Pubblicazione: (2025)
DiffEM: Learning from Corrupted Data with Diffusion Models via Expectation Maximization
di: Hosseintabar, Danial, et al.
Pubblicazione: (2025)
di: Hosseintabar, Danial, et al.
Pubblicazione: (2025)
Synthetic Data Augmentation for Table Detection: Re-evaluating TableNet's Performance with Automatically Generated Document Images
di: Sahukara, Krishna, et al.
Pubblicazione: (2025)
di: Sahukara, Krishna, et al.
Pubblicazione: (2025)
Adaptive Length Image Tokenization via Recurrent Allocation
di: Duggal, Shivam, et al.
Pubblicazione: (2024)
di: Duggal, Shivam, et al.
Pubblicazione: (2024)
AutoViVQA: A Large-Scale Automatically Constructed Dataset for Vietnamese Visual Question Answering
di: Tuong, Nguyen Anh, et al.
Pubblicazione: (2026)
di: Tuong, Nguyen Anh, et al.
Pubblicazione: (2026)
ResAgent: Entropy-based Prior Point Discovery and Visual Reasoning for Referring Expression Segmentation
di: Wang, Yihao, et al.
Pubblicazione: (2026)
di: Wang, Yihao, et al.
Pubblicazione: (2026)
AVTrustBench: Assessing and Enhancing Reliability and Robustness in Audio-Visual LLMs
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025)
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025)
Automatic Layout Planning for Visually-Rich Documents with Instruction-Following Models
di: Zhu, Wanrong, et al.
Pubblicazione: (2024)
di: Zhu, Wanrong, et al.
Pubblicazione: (2024)
Visual Homing in Outdoor Robots Using Mushroom Body Circuits and Learning Walks
di: Gattaux, Gabriel G., et al.
Pubblicazione: (2025)
di: Gattaux, Gabriel G., et al.
Pubblicazione: (2025)
Intelligent Director: An Automatic Framework for Dynamic Visual Composition using ChatGPT
di: Zheng, Sixiao, et al.
Pubblicazione: (2024)
di: Zheng, Sixiao, et al.
Pubblicazione: (2024)
Separating Knowledge and Perception with Procedural Data
di: Rodríguez-Muñoz, Adrián, et al.
Pubblicazione: (2025)
di: Rodríguez-Muñoz, Adrián, et al.
Pubblicazione: (2025)
Finer-CAM: Spotting the Difference Reveals Finer Details for Visual Explanation
di: Zhang, Ziheng, et al.
Pubblicazione: (2025)
di: Zhang, Ziheng, et al.
Pubblicazione: (2025)
VB: Visibility Benchmark for Visibility and Perspective Reasoning in Images
di: Tripathi, Neil
Pubblicazione: (2026)
di: Tripathi, Neil
Pubblicazione: (2026)
MAGNET: A Multi-agent Framework for Finding Audio-Visual Needles by Reasoning over Multi-Video Haystacks
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025)
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025)
Certified Circuits: Stability Guarantees for Mechanistic Circuits
di: Anani, Alaa, et al.
Pubblicazione: (2026)
di: Anani, Alaa, et al.
Pubblicazione: (2026)
VSA4VQA: Scaling a Vector Symbolic Architecture to Visual Question Answering on Natural Images
di: Penzkofer, Anna, et al.
Pubblicazione: (2024)
di: Penzkofer, Anna, et al.
Pubblicazione: (2024)
FACE: Faithful Automatic Concept Extraction
di: Bhusal, Dipkamal, et al.
Pubblicazione: (2025)
di: Bhusal, Dipkamal, et al.
Pubblicazione: (2025)
Automatic dental superimposition of 3D intraorals and 2D photographs for human identification
di: Villegas-Yeguas, Antonio D., et al.
Pubblicazione: (2026)
di: Villegas-Yeguas, Antonio D., et al.
Pubblicazione: (2026)
Classifier-to-Bias: Toward Unsupervised Automatic Bias Detection for Visual Classifiers
di: Guimard, Quentin, et al.
Pubblicazione: (2025)
di: Guimard, Quentin, et al.
Pubblicazione: (2025)
Automatic Medical Report Generation: Methods and Applications
di: Guo, Li, et al.
Pubblicazione: (2024)
di: Guo, Li, et al.
Pubblicazione: (2024)
Alignment-Aware and Reliability-Gated Multimodal Fusion for Unmanned Aerial Vehicle Detection Across Heterogeneous Thermal-Visual Sensors
di: Jahan, Ishrat, et al.
Pubblicazione: (2026)
di: Jahan, Ishrat, et al.
Pubblicazione: (2026)
Ontology-Guided Diffusion for Zero-Shot Visual Sim2Real Transfer
di: Youssef, Mohamed, et al.
Pubblicazione: (2026)
di: Youssef, Mohamed, et al.
Pubblicazione: (2026)
Generalized Class Discovery in Instance Segmentation
di: Hoang, Cuong Manh, et al.
Pubblicazione: (2025)
di: Hoang, Cuong Manh, et al.
Pubblicazione: (2025)
Automatized Self-Supervised Learning for Skin Lesion Screening
di: Useini, Vullnet, et al.
Pubblicazione: (2023)
di: Useini, Vullnet, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Line of Sight: On Linear Representations in VLLMs
di: Rajaram, Achyuta, et al.
Pubblicazione: (2025) -
A Multimodal Automated Interpretability Agent
di: Shaham, Tamar Rott, et al.
Pubblicazione: (2024) -
Nearest Neighbor Normalization Improves Multimodal Retrieval
di: Chowdhury, Neil, et al.
Pubblicazione: (2024) -
CoE: Chain-of-Explanation via Automatic Visual Concept Circuit Description and Polysemanticity Quantification
di: Yu, Wenlong, et al.
Pubblicazione: (2025) -
Granular Concept Circuits: Toward a Fine-Grained Circuit Discovery for Concept Representations
di: Kwon, Dahee, et al.
Pubblicazione: (2025)