Understanding Visual Concepts Across Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Trabucco, Brandon, Gurinas, Max, Doherty, Kyle, Salakhutdinov, Ruslan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Effective Data Augmentation With Diffusion Models
par: Trabucco, Brandon, et autres
Publié: (2023)
par: Trabucco, Brandon, et autres
Publié: (2023)
Leafy Spurge Dataset: Real-world Weed Classification Within Aerial Drone Imagery
par: Doherty, Kyle, et autres
Publié: (2024)
par: Doherty, Kyle, et autres
Publié: (2024)
Stylus: Automatic Adapter Selection for Diffusion Models
par: Luo, Michael, et autres
Publié: (2024)
par: Luo, Michael, et autres
Publié: (2024)
Plan-Seq-Learn: Language Model Guided RL for Solving Long Horizon Robotics Tasks
par: Dalal, Murtaza, et autres
Publié: (2024)
par: Dalal, Murtaza, et autres
Publié: (2024)
Blind Inverse Problem Solving Made Easy by Text-to-Image Latent Diffusion
par: Dontas, Michail, et autres
Publié: (2024)
par: Dontas, Michail, et autres
Publié: (2024)
Neural MP: A Generalist Neural Motion Planner
par: Dalal, Murtaza, et autres
Publié: (2024)
par: Dalal, Murtaza, et autres
Publié: (2024)
InSTA: Towards Internet-Scale Training For Agents
par: Trabucco, Brandon, et autres
Publié: (2025)
par: Trabucco, Brandon, et autres
Publié: (2025)
FACTR: Force-Attending Curriculum Training for Contact-Rich Policy Learning
par: Liu, Jason Jingzhou, et autres
Publié: (2025)
par: Liu, Jason Jingzhou, et autres
Publié: (2025)
HEMM: Holistic Evaluation of Multimodal Foundation Models
par: Liang, Paul Pu, et autres
Publié: (2024)
par: Liang, Paul Pu, et autres
Publié: (2024)
Understanding Trade offs When Conditioning Synthetic Data
par: Trabucco, Brandon, et autres
Publié: (2025)
par: Trabucco, Brandon, et autres
Publié: (2025)
Prompt Optimizer of Text-to-Image Diffusion Models for Abstract Concept Understanding
par: Fan, Zezhong, et autres
Publié: (2024)
par: Fan, Zezhong, et autres
Publié: (2024)
Towards Generalisable Time Series Understanding Across Domains
par: Turgut, Özgün, et autres
Publié: (2024)
par: Turgut, Özgün, et autres
Publié: (2024)
Jodi: Unification of Visual Generation and Understanding via Joint Modeling
par: Xu, Yifeng, et autres
Publié: (2025)
par: Xu, Yifeng, et autres
Publié: (2025)
Understanding Multimodal Deep Neural Networks: A Concept Selection View
par: Shang, Chenming, et autres
Publié: (2024)
par: Shang, Chenming, et autres
Publié: (2024)
Understanding Distributed Representations of Concepts in Deep Neural Networks without Supervision
par: Chang, Wonjoon, et autres
Publié: (2023)
par: Chang, Wonjoon, et autres
Publié: (2023)
OmniPrism: Learning Disentangled Visual Concept for Image Generation
par: Li, Yangyang, et autres
Publié: (2024)
par: Li, Yangyang, et autres
Publié: (2024)
Weakly Supervised Concept Learning for Object-centric Visual Reasoning
par: Tiwari, Sparsh, et autres
Publié: (2026)
par: Tiwari, Sparsh, et autres
Publié: (2026)
Unsupervised Interpretable Basis Extraction for Concept-Based Visual Explanations
par: Doumanoglou, Alexandros, et autres
Publié: (2023)
par: Doumanoglou, Alexandros, et autres
Publié: (2023)
Concept Arithmetics for Circumventing Concept Inhibition in Diffusion Models
par: Petsiuk, Vitali, et autres
Publié: (2024)
par: Petsiuk, Vitali, et autres
Publié: (2024)
PerceptionLM: Open-Access Data and Models for Detailed Visual Understanding
par: Cho, Jang Hyun, et autres
Publié: (2025)
par: Cho, Jang Hyun, et autres
Publié: (2025)
Pix2Code: Learning to Compose Neural Visual Concepts as Programs
par: Wüst, Antonia, et autres
Publié: (2024)
par: Wüst, Antonia, et autres
Publié: (2024)
Learning Concept-Based Causal Transition and Symbolic Reasoning for Visual Planning
par: Qian, Yilue, et autres
Publié: (2023)
par: Qian, Yilue, et autres
Publié: (2023)
Advancing Generalization Across a Variety of Abstract Visual Reasoning Tasks
par: Małkiński, Mikołaj, et autres
Publié: (2025)
par: Małkiński, Mikołaj, et autres
Publié: (2025)
Improving Intervention Efficacy via Concept Realignment in Concept Bottleneck Models
par: Singhi, Nishad, et autres
Publié: (2024)
par: Singhi, Nishad, et autres
Publié: (2024)
Concept Weaver: Enabling Multi-Concept Fusion in Text-to-Image Models
par: Kwon, Gihyun, et autres
Publié: (2024)
par: Kwon, Gihyun, et autres
Publié: (2024)
A Comparative Study of Custom CNNs, Pre-trained Models, and Transfer Learning Across Multiple Visual Datasets
par: Akhand, Annoor Sharara
Publié: (2026)
par: Akhand, Annoor Sharara
Publié: (2026)
Pre-trained Vision-Language Models Learn Discoverable Visual Concepts
par: Zang, Yuan, et autres
Publié: (2024)
par: Zang, Yuan, et autres
Publié: (2024)
Editable Concept Bottleneck Models
par: Hu, Lijie, et autres
Publié: (2024)
par: Hu, Lijie, et autres
Publié: (2024)
GSplatLoc: Grounding Keypoint Descriptors into 3D Gaussian Splatting for Improved Visual Localization
par: Sidorov, Gennady, et autres
Publié: (2024)
par: Sidorov, Gennady, et autres
Publié: (2024)
Automated Black-box Prompt Engineering for Personalized Text-to-Image Generation
par: He, Yutong, et autres
Publié: (2024)
par: He, Yutong, et autres
Publié: (2024)
ConceptPrune: Concept Editing in Diffusion Models via Skilled Neuron Pruning
par: Chavhan, Ruchika, et autres
Publié: (2024)
par: Chavhan, Ruchika, et autres
Publié: (2024)
Understanding Video Transformers via Universal Concept Discovery
par: Kowal, Matthew, et autres
Publié: (2024)
par: Kowal, Matthew, et autres
Publié: (2024)
IoT-LM: Large Multisensory Language Models for the Internet of Things
par: Mo, Shentong, et autres
Publié: (2024)
par: Mo, Shentong, et autres
Publié: (2024)
RGB-Th-Bench: A Dense benchmark for Visual-Thermal Understanding of Vision Language Models
par: Moshtaghi, Mehdi, et autres
Publié: (2025)
par: Moshtaghi, Mehdi, et autres
Publié: (2025)
Energy-Based Concept Bottleneck Models: Unifying Prediction, Concept Intervention, and Probabilistic Interpretations
par: Xu, Xinyue, et autres
Publié: (2024)
par: Xu, Xinyue, et autres
Publié: (2024)
Semi-supervised Concept Bottleneck Models
par: Hu, Lijie, et autres
Publié: (2024)
par: Hu, Lijie, et autres
Publié: (2024)
Zero-shot Concept Bottleneck Models
par: Yamaguchi, Shin'ya, et autres
Publié: (2025)
par: Yamaguchi, Shin'ya, et autres
Publié: (2025)
Process-Guided Concept Bottleneck Model
par: Asiyabi, Reza M., et autres
Publié: (2026)
par: Asiyabi, Reza M., et autres
Publié: (2026)
Learning to Infer Generative Template Programs for Visual Concepts
par: Jones, R. Kenny, et autres
Publié: (2024)
par: Jones, R. Kenny, et autres
Publié: (2024)
Visual-TCAV: Concept-based Attribution and Saliency Maps for Post-hoc Explainability in Image Classification
par: De Santis, Antonio, et autres
Publié: (2024)
par: De Santis, Antonio, et autres
Publié: (2024)
Documents similaires
-
Effective Data Augmentation With Diffusion Models
par: Trabucco, Brandon, et autres
Publié: (2023) -
Leafy Spurge Dataset: Real-world Weed Classification Within Aerial Drone Imagery
par: Doherty, Kyle, et autres
Publié: (2024) -
Stylus: Automatic Adapter Selection for Diffusion Models
par: Luo, Michael, et autres
Publié: (2024) -
Plan-Seq-Learn: Language Model Guided RL for Solving Long Horizon Robotics Tasks
par: Dalal, Murtaza, et autres
Publié: (2024) -
Blind Inverse Problem Solving Made Easy by Text-to-Image Latent Diffusion
par: Dontas, Michail, et autres
Publié: (2024)