Image Categorization and Search via a GAT Autoencoder and Representative Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Sap, Duygu, Lotz, Martin, Mattinson, Connor |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Performance-Efficiency Trade-off for Fashion Image Retrieval
di: Hurtado, Julio, et al.
Pubblicazione: (2025)
di: Hurtado, Julio, et al.
Pubblicazione: (2025)
Enhancing Leaf Disease Classification Using GAT-GCN Hybrid Model
di: Sundhar, Shyam, et al.
Pubblicazione: (2025)
di: Sundhar, Shyam, et al.
Pubblicazione: (2025)
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
Enhancing Hyperspectral Images via Diffusion Model and Group-Autoencoder Super-resolution Network
di: Wang, Zhaoyang, et al.
Pubblicazione: (2024)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2024)
The Role of Data Curation in Image Captioning
di: Li, Wenyan, et al.
Pubblicazione: (2023)
di: Li, Wenyan, et al.
Pubblicazione: (2023)
Detection, Retrieval, and Explanation Unified: A Violence Detection System Based on Knowledge Graphs and GAT
di: Jiang, Wen-Dong, et al.
Pubblicazione: (2025)
di: Jiang, Wen-Dong, et al.
Pubblicazione: (2025)
SuperiorGAT: Graph Attention Networks for Sparse LiDAR Point Cloud Reconstruction in Autonomous Systems
di: Awedat, Khalfalla, et al.
Pubblicazione: (2025)
di: Awedat, Khalfalla, et al.
Pubblicazione: (2025)
Local Representative Token Guided Merging for Text-to-Image Generation
di: Lee, Min-Jeong, et al.
Pubblicazione: (2025)
di: Lee, Min-Jeong, et al.
Pubblicazione: (2025)
REPrune: Channel Pruning via Kernel Representative Selection
di: Park, Mincheol, et al.
Pubblicazione: (2024)
di: Park, Mincheol, et al.
Pubblicazione: (2024)
Revisiting Diffusion Autoencoder Training for Image Reconstruction Quality
di: Khungurn, Pramook, et al.
Pubblicazione: (2025)
di: Khungurn, Pramook, et al.
Pubblicazione: (2025)
Blocks as Probes: Dissecting Categorization Ability of Large Multimodal Models
di: Fu, Bin, et al.
Pubblicazione: (2024)
di: Fu, Bin, et al.
Pubblicazione: (2024)
GAT-NeRF: Geometry-Aware-Transformer Enhanced Neural Radiance Fields for High-Fidelity 4D Facial Avatars
di: Chang, Zhe, et al.
Pubblicazione: (2026)
di: Chang, Zhe, et al.
Pubblicazione: (2026)
Diffusion Autoencoder for Unsupervised Artifact Restoration in Handheld Fundus Images
di: Palani, Mathumetha, et al.
Pubblicazione: (2026)
di: Palani, Mathumetha, et al.
Pubblicazione: (2026)
Generalizable Sensor-Based Activity Recognition via Categorical Concept Invariant Learning
di: Xiong, Di, et al.
Pubblicazione: (2024)
di: Xiong, Di, et al.
Pubblicazione: (2024)
Uncovering Conceptual Blindspots in Generative Image Models Using Sparse Autoencoders
di: Bohacek, Matyas, et al.
Pubblicazione: (2025)
di: Bohacek, Matyas, et al.
Pubblicazione: (2025)
DAE-Fuse: An Adaptive Discriminative Autoencoder for Multi-Modality Image Fusion
di: Guo, Yuchen, et al.
Pubblicazione: (2024)
di: Guo, Yuchen, et al.
Pubblicazione: (2024)
MAESIL: Masked Autoencoder for Enhanced Self-supervised Medical Image Learning
di: Kim, Kyeonghun, et al.
Pubblicazione: (2026)
di: Kim, Kyeonghun, et al.
Pubblicazione: (2026)
Latent Diffusion Model without Variational Autoencoder
di: Shi, Minglei, et al.
Pubblicazione: (2025)
di: Shi, Minglei, et al.
Pubblicazione: (2025)
MaeFuse: Transferring Omni Features with Pretrained Masked Autoencoders for Infrared and Visible Image Fusion via Guided Training
di: Li, Jiayang, et al.
Pubblicazione: (2024)
di: Li, Jiayang, et al.
Pubblicazione: (2024)
Exploring Social Media Image Categorization Using Large Models with Different Adaptation Methods: A Case Study on Cultural Nature's Contributions to People
di: Khaldi, Rohaifa, et al.
Pubblicazione: (2024)
di: Khaldi, Rohaifa, et al.
Pubblicazione: (2024)
Unsupervised Tomato Split Anomaly Detection using Hyperspectral Imaging and Variational Autoencoders
di: Abdulsalam, Mahmoud, et al.
Pubblicazione: (2025)
di: Abdulsalam, Mahmoud, et al.
Pubblicazione: (2025)
CLIMB: Controllable Longitudinal Brain Image Generation using Mamba-based Latent Diffusion Model and Gaussian-aligned Autoencoder
di: Dao, Duy-Phuong, et al.
Pubblicazione: (2026)
di: Dao, Duy-Phuong, et al.
Pubblicazione: (2026)
Latent-Compressed Variational Autoencoder for Video Diffusion Models
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
di: Guan, Jiarui, et al.
Pubblicazione: (2026)
The Algorithmic Gaze of Image Quality Assessment: An Audit and Trace Ethnography of the LAION-Aesthetics Predictor
di: Taylor, Jordan, et al.
Pubblicazione: (2026)
di: Taylor, Jordan, et al.
Pubblicazione: (2026)
Representing Animatable Avatar via Factorized Neural Fields
di: Song, Chunjin, et al.
Pubblicazione: (2024)
di: Song, Chunjin, et al.
Pubblicazione: (2024)
Open Ad-hoc Categorization with Contextualized Feature Learning
di: Wang, Zilin, et al.
Pubblicazione: (2025)
di: Wang, Zilin, et al.
Pubblicazione: (2025)
Gaussian Masked Autoencoders
di: Rajasegaran, Jathushan, et al.
Pubblicazione: (2025)
di: Rajasegaran, Jathushan, et al.
Pubblicazione: (2025)
SAEmnesia: Erasing Concepts in Diffusion Models with Supervised Sparse Autoencoders
di: Cassano, Enrico, et al.
Pubblicazione: (2025)
di: Cassano, Enrico, et al.
Pubblicazione: (2025)
Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models
di: Chen, Junyu, et al.
Pubblicazione: (2024)
di: Chen, Junyu, et al.
Pubblicazione: (2024)
Text-based Person Search in Full Images via Semantic-Driven Proposal Generation
di: Zhang, Shizhou, et al.
Pubblicazione: (2021)
di: Zhang, Shizhou, et al.
Pubblicazione: (2021)
Diffusion Autoencoders are Scalable Image Tokenizers
di: Chen, Yinbo, et al.
Pubblicazione: (2025)
di: Chen, Yinbo, et al.
Pubblicazione: (2025)
Representing 3D Shapes With 64 Latent Vectors for 3D Diffusion Models
di: Cho, In, et al.
Pubblicazione: (2025)
di: Cho, In, et al.
Pubblicazione: (2025)
One-Step is Enough: Sparse Autoencoders for Text-to-Image Diffusion Models
di: Surkov, Viacheslav, et al.
Pubblicazione: (2024)
di: Surkov, Viacheslav, et al.
Pubblicazione: (2024)
SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders
di: Li, Qing, et al.
Pubblicazione: (2025)
di: Li, Qing, et al.
Pubblicazione: (2025)
Ladder Bottom-up Convolutional Bidirectional Variational Autoencoder for Image Translation of Dotted Arabic Expiration Dates
di: Zidane, Ahmed, et al.
Pubblicazione: (2023)
di: Zidane, Ahmed, et al.
Pubblicazione: (2023)
Self Pre-training with Topology- and Spatiality-aware Masked Autoencoders for 3D Medical Image Segmentation
di: Gu, Pengfei, et al.
Pubblicazione: (2024)
di: Gu, Pengfei, et al.
Pubblicazione: (2024)
Spotlighter: Revisiting Prompt Tuning from a Representative Mining View
di: Gao, Yutong, et al.
Pubblicazione: (2025)
di: Gao, Yutong, et al.
Pubblicazione: (2025)
Uncertainty-guided Compositional Alignment with Part-to-Whole Semantic Representativeness in Hyperbolic Vision-Language Models
di: Kim, Hayeon, et al.
Pubblicazione: (2026)
di: Kim, Hayeon, et al.
Pubblicazione: (2026)
SPARC: Concept-Aligned Sparse Autoencoders for Cross-Model and Cross-Modal Interpretability
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2025)
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2025)
The Scene Language: Representing Scenes with Programs, Words, and Embeddings
di: Zhang, Yunzhi, et al.
Pubblicazione: (2024)
di: Zhang, Yunzhi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Performance-Efficiency Trade-off for Fashion Image Retrieval
di: Hurtado, Julio, et al.
Pubblicazione: (2025) -
Enhancing Leaf Disease Classification Using GAT-GCN Hybrid Model
di: Sundhar, Shyam, et al.
Pubblicazione: (2025) -
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
di: Dunlop, Connor, et al.
Pubblicazione: (2025) -
Enhancing Hyperspectral Images via Diffusion Model and Group-Autoencoder Super-resolution Network
di: Wang, Zhaoyang, et al.
Pubblicazione: (2024) -
The Role of Data Curation in Image Captioning
di: Li, Wenyan, et al.
Pubblicazione: (2023)