Interpretable Measures of Conceptual Similarity by Complexity-Constrained Descriptive Auto-Encoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Achille, Alessandro, Steeg, Greg Ver, Liu, Tian Yu, Trager, Matthew, Klingenberg, Carson, Soatto, Stefano |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Descriminative-Generative Custom Tokens for Vision-Language Models
par: Perera, Pramuditha, et autres
Publié: (2025)
par: Perera, Pramuditha, et autres
Publié: (2025)
NeRF-Insert: 3D Local Editing with Multimodal Control Signals
par: Sabat, Benet Oriol, et autres
Publié: (2024)
par: Sabat, Benet Oriol, et autres
Publié: (2024)
Linear Spaces of Meanings: Compositional Structures in Vision-Language Models
par: Trager, Matthew, et autres
Publié: (2023)
par: Trager, Matthew, et autres
Publié: (2023)
Making Sense Of Distributed Representations With Activation Spectroscopy
par: Reing, Kyle, et autres
Publié: (2025)
par: Reing, Kyle, et autres
Publié: (2025)
Multi-Modal Hallucination Control by Visual Information Grounding
par: Favero, Alessandro, et autres
Publié: (2024)
par: Favero, Alessandro, et autres
Publié: (2024)
Training Data Protection with Compositional Diffusion Models
par: Golatkar, Aditya, et autres
Publié: (2023)
par: Golatkar, Aditya, et autres
Publié: (2023)
Learning Morphisms with Gauss-Newton Approximation for Growing Networks
par: Lawton, Neal, et autres
Publié: (2024)
par: Lawton, Neal, et autres
Publié: (2024)
CPR: Retrieval Augmented Generation for Copyright Protection
par: Golatkar, Aditya, et autres
Publié: (2024)
par: Golatkar, Aditya, et autres
Publié: (2024)
Diffusion Bridge Models for 3D Medical Image Translation
par: Zhang, Shaorong, et autres
Publié: (2025)
par: Zhang, Shaorong, et autres
Publié: (2025)
AugUndo: Scaling Up Augmentations for Monocular Depth Completion and Estimation
par: Wu, Yangchao, et autres
Publié: (2023)
par: Wu, Yangchao, et autres
Publié: (2023)
Sub-token ViT Embedding via Stochastic Resonance Transformers
par: Lao, Dong, et autres
Publié: (2023)
par: Lao, Dong, et autres
Publié: (2023)
Diffeomorphic Template Registration for Atmospheric Turbulence Mitigation
par: Lao, Dong, et autres
Publié: (2024)
par: Lao, Dong, et autres
Publié: (2024)
RSA: Resolving Scale Ambiguities in Monocular Depth Estimators through Language Descriptions
par: Zeng, Ziyao, et autres
Publié: (2024)
par: Zeng, Ziyao, et autres
Publié: (2024)
Auto-Encoding Morph-Tokens for Multimodal LLM
par: Pan, Kaihang, et autres
Publié: (2024)
par: Pan, Kaihang, et autres
Publié: (2024)
Diffusion Soup: Model Merging for Text-to-Image Diffusion Models
par: Biggs, Benjamin, et autres
Publié: (2024)
par: Biggs, Benjamin, et autres
Publié: (2024)
MIMIC: Multimodal Inversion for Model Interpretation and Conceptualization
par: Jain, Animesh, et autres
Publié: (2025)
par: Jain, Animesh, et autres
Publié: (2025)
Interpretable Similarity of Synthetic Image Utility
par: Gatoula, Panagiota, et autres
Publié: (2025)
par: Gatoula, Panagiota, et autres
Publié: (2025)
Descriptive Image-Text Matching with Graded Contextual Similarity
par: Jang, Jinhyun, et autres
Publié: (2025)
par: Jang, Jinhyun, et autres
Publié: (2025)
Mixed-Query Transformer: A Unified Image Segmentation Architecture
par: Wang, Pei, et autres
Publié: (2024)
par: Wang, Pei, et autres
Publié: (2024)
Interpretable 3D Neural Object Volumes for Robust Conceptual Reasoning
par: Pham, Nhi, et autres
Publié: (2025)
par: Pham, Nhi, et autres
Publié: (2025)
Non-autoregressive Sequence-to-Sequence Vision-Language Models
par: Shi, Kunyu, et autres
Publié: (2024)
par: Shi, Kunyu, et autres
Publié: (2024)
Fast and Interpretable 2D Homography Decomposition: Similarity-Kernel-Similarity and Affine-Core-Affine Transformations
par: Cai, Shen, et autres
Publié: (2024)
par: Cai, Shen, et autres
Publié: (2024)
Compositional Structures in Neural Embedding and Interaction Decompositions
par: Trager, Matthew, et autres
Publié: (2024)
par: Trager, Matthew, et autres
Publié: (2024)
e1: Learning Adaptive Control of Reasoning Effort
par: Kleinman, Michael, et autres
Publié: (2025)
par: Kleinman, Michael, et autres
Publié: (2025)
Fast Sparse View Guided NeRF Update for Object Reconfigurations
par: Lu, Ziqi, et autres
Publié: (2024)
par: Lu, Ziqi, et autres
Publié: (2024)
On the Viability of Monocular Depth Pre-training for Semantic Segmentation
par: Lao, Dong, et autres
Publié: (2022)
par: Lao, Dong, et autres
Publié: (2022)
Auto-Encoded Supervision for Perceptual Image Super-Resolution
par: Lee, MinKyu, et autres
Publié: (2024)
par: Lee, MinKyu, et autres
Publié: (2024)
Knowledge driven Description Synthesis for Floor Plan Interpretation
par: Goyal, Shreya, et autres
Publié: (2021)
par: Goyal, Shreya, et autres
Publié: (2021)
Unified Auto-Encoding with Masked Diffusion
par: Hansen-Estruch, Philippe, et autres
Publié: (2024)
par: Hansen-Estruch, Philippe, et autres
Publié: (2024)
AutoAD-Zero: A Training-Free Framework for Zero-Shot Audio Description
par: Xie, Junyu, et autres
Publié: (2024)
par: Xie, Junyu, et autres
Publié: (2024)
Semantic Similarity Score for Measuring Visual Similarity at Semantic Level
par: Fan, Senran, et autres
Publié: (2024)
par: Fan, Senran, et autres
Publié: (2024)
Hyperspectral Image Recovery Constrained by Multi-Granularity Non-Local Self-Similarity Priors
par: Peng, Zhuoran, et autres
Publié: (2025)
par: Peng, Zhuoran, et autres
Publié: (2025)
AutoPrune: Each Complexity Deserves a Pruning Policy
par: Wang, Hanshi, et autres
Publié: (2025)
par: Wang, Hanshi, et autres
Publié: (2025)
A Quantitative Evaluation of Score Distillation Sampling Based Text-to-3D
par: Fei, Xiaohan, et autres
Publié: (2024)
par: Fei, Xiaohan, et autres
Publié: (2024)
Conceptual Learning via Embedding Approximations for Reinforcing Interpretability and Transparency
par: Dikter, Maor, et autres
Publié: (2024)
par: Dikter, Maor, et autres
Publié: (2024)
PICASO: Permutation-Invariant Context Composition with State Space Models
par: Liu, Tian Yu, et autres
Publié: (2025)
par: Liu, Tian Yu, et autres
Publié: (2025)
AutoDFP: Automatic Data-Free Pruning via Channel Similarity Reconstruction
par: Li, Siqi, et autres
Publié: (2024)
par: Li, Siqi, et autres
Publié: (2024)
Similarity-as-Evidence: Calibrating Overconfident VLMs for Interpretable and Label-Efficient Medical Active Learning
par: Xie, Zhuofan, et autres
Publié: (2026)
par: Xie, Zhuofan, et autres
Publié: (2026)
Divided Attention: Unsupervised Multi-Object Discovery with Contextually Separated Slots
par: Lao, Dong, et autres
Publié: (2023)
par: Lao, Dong, et autres
Publié: (2023)
Conceptualizing Multi-scale Wavelet Attention and Ray-based Encoding for Human-Object Interaction Detection
par: Pay, Quan Bi, et autres
Publié: (2025)
par: Pay, Quan Bi, et autres
Publié: (2025)
Documents similaires
-
Descriminative-Generative Custom Tokens for Vision-Language Models
par: Perera, Pramuditha, et autres
Publié: (2025) -
NeRF-Insert: 3D Local Editing with Multimodal Control Signals
par: Sabat, Benet Oriol, et autres
Publié: (2024) -
Linear Spaces of Meanings: Compositional Structures in Vision-Language Models
par: Trager, Matthew, et autres
Publié: (2023) -
Making Sense Of Distributed Representations With Activation Spectroscopy
par: Reing, Kyle, et autres
Publié: (2025) -
Multi-Modal Hallucination Control by Visual Information Grounding
par: Favero, Alessandro, et autres
Publié: (2024)