Representation Learning with Adaptive Superpixel Coding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Khalil, Mahmoud, Khalil, Ahmad, Ngom, Alioune |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ResNetVLLM -- Multi-modal Vision LLM for the Video Understanding Task
par: Khalil, Ahmad, et autres
Publié: (2025)
par: Khalil, Ahmad, et autres
Publié: (2025)
ResNetVLLM-2: Addressing ResNetVLLM's Multi-Modal Hallucinations
par: Khalil, Ahmad, et autres
Publié: (2025)
par: Khalil, Ahmad, et autres
Publié: (2025)
Learning Superpixel Ensemble and Hierarchy Graphs for Melanoma Detection
par: Elwer, Asmaa M., et autres
Publié: (2026)
par: Elwer, Asmaa M., et autres
Publié: (2026)
ViGText: Deepfake Image Detection with Vision-Language Model Explanations and Graph Neural Networks
par: ALBarqawi, Ahmad, et autres
Publié: (2025)
par: ALBarqawi, Ahmad, et autres
Publié: (2025)
Superpixel Semantics Representation and Pre-training for Vision-Language Task
par: Zhang, Siyu, et autres
Publié: (2023)
par: Zhang, Siyu, et autres
Publié: (2023)
Unsupervised Instance Segmentation with Superpixels
par: Hoang, Cuong Manh
Publié: (2025)
par: Hoang, Cuong Manh
Publié: (2025)
Tackling the Abstraction and Reasoning Corpus with Vision Transformers: the Importance of 2D Representation, Positions, and Objects
par: Li, Wenhao, et autres
Publié: (2024)
par: Li, Wenhao, et autres
Publié: (2024)
CapsFake: A Multimodal Capsule Network for Detecting Instruction-Guided Deepfakes
par: Nguyen, Tuan, et autres
Publié: (2025)
par: Nguyen, Tuan, et autres
Publié: (2025)
Knowledge-based learning in Text-RAG and Image-RAG
par: Shim, Alexander, et autres
Publié: (2026)
par: Shim, Alexander, et autres
Publié: (2026)
SuperCL: Superpixel Guided Contrastive Learning for Medical Image Segmentation Pre-training
par: Zeng, Shuang, et autres
Publié: (2025)
par: Zeng, Shuang, et autres
Publié: (2025)
Multimodal Chaptering for Long-Form TV Newscast Video
par: Guetari, Khalil, et autres
Publié: (2024)
par: Guetari, Khalil, et autres
Publié: (2024)
CoUn: Empowering Machine Unlearning via Contrastive Learning
par: Khalil, Yasser H., et autres
Publié: (2025)
par: Khalil, Yasser H., et autres
Publié: (2025)
Federated Learning with Heterogeneous Data Handling for Robust Vehicular Object Detection
par: Khalil, Ahmad, et autres
Publié: (2024)
par: Khalil, Ahmad, et autres
Publié: (2024)
SP${ }^3$ : Superpixel-propagated pseudo-label learning for weakly semi-supervised medical image segmentation
par: Li, Shiman, et autres
Publié: (2024)
par: Li, Shiman, et autres
Publié: (2024)
DSXFormer: Dual-Pooling Spectral Squeeze-Expansion and Dynamic Context Attention Transformer for Hyperspectral Image Classification
par: Ullah, Farhan, et autres
Publié: (2026)
par: Ullah, Farhan, et autres
Publié: (2026)
SyriSign: A Parallel Corpus for Arabic Text to Syrian Arabic Sign Language Translation
par: Khalil, Mohammad Amer, et autres
Publié: (2026)
par: Khalil, Mohammad Amer, et autres
Publié: (2026)
The Role of Machine Learning in Congenital Heart Disease Diagnosis: Datasets, Algorithms, and Insights
par: Khan, Khalil, et autres
Publié: (2025)
par: Khan, Khalil, et autres
Publié: (2025)
Adaptive Disentangled Representation Learning for Incomplete Multi-View Multi-Label Classification
par: Li, Quanjiang, et autres
Publié: (2026)
par: Li, Quanjiang, et autres
Publié: (2026)
STAR: Semantic-Temporal Adaptive Representation Learning for Few-Shot Action Recognition
par: Liu, Hongli, et autres
Publié: (2026)
par: Liu, Hongli, et autres
Publié: (2026)
Superpixel Attack: Enhancing Black-box Adversarial Attack with Image-driven Division Areas
par: Oe, Issa, et autres
Publié: (2025)
par: Oe, Issa, et autres
Publié: (2025)
Adaptive Global-Local Representation Learning and Selection for Cross-Domain Facial Expression Recognition
par: Gao, Yuefang, et autres
Publié: (2024)
par: Gao, Yuefang, et autres
Publié: (2024)
Representation-Level Adversarial Regularization for Clinically Aligned Multitask Thyroid Ultrasound Assessment
par: Salama, Dina, et autres
Publié: (2026)
par: Salama, Dina, et autres
Publié: (2026)
VISUALCENT: Visual Human Analysis using Dynamic Centroid Representation
par: Ahmad, Niaz, et autres
Publié: (2025)
par: Ahmad, Niaz, et autres
Publié: (2025)
Learning and Leveraging World Models in Visual Representation Learning
par: Garrido, Quentin, et autres
Publié: (2024)
par: Garrido, Quentin, et autres
Publié: (2024)
CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook
par: Chen, Zeyu, et autres
Publié: (2026)
par: Chen, Zeyu, et autres
Publié: (2026)
DARTer: Dynamic Adaptive Representation Tracker for Nighttime UAV Tracking
par: Li, Xuzhao, et autres
Publié: (2025)
par: Li, Xuzhao, et autres
Publié: (2025)
Beyond Matryoshka: Revisiting Sparse Coding for Adaptive Representation
par: Wen, Tiansheng, et autres
Publié: (2025)
par: Wen, Tiansheng, et autres
Publié: (2025)
IdentiFace : A VGG Based Multimodal Facial Biometric System
par: Rabea, Mahmoud, et autres
Publié: (2024)
par: Rabea, Mahmoud, et autres
Publié: (2024)
On the Temporality for Sketch Representation Learning
par: Junior, Marcelo Isaias de Moraes, et autres
Publié: (2025)
par: Junior, Marcelo Isaias de Moraes, et autres
Publié: (2025)
Sparse Representation Learning for Vessels
par: Prabhakar, Chinmay, et autres
Publié: (2026)
par: Prabhakar, Chinmay, et autres
Publié: (2026)
Automatic Pith Detection in Tree Cross-Section Images Using Deep Learning
par: Liao, Tzu-I, et autres
Publié: (2025)
par: Liao, Tzu-I, et autres
Publié: (2025)
BiGR: Harnessing Binary Latent Codes for Image Generation and Improved Visual Representation Capabilities
par: Hao, Shaozhe, et autres
Publié: (2024)
par: Hao, Shaozhe, et autres
Publié: (2024)
AdaTok: Adaptive Token Compression with Object-Aware Representations for Efficient Multimodal LLMs
par: Zhang, Xinliang, et autres
Publié: (2025)
par: Zhang, Xinliang, et autres
Publié: (2025)
Revisiting Feature Prediction for Learning Visual Representations from Video
par: Bardes, Adrien, et autres
Publié: (2024)
par: Bardes, Adrien, et autres
Publié: (2024)
Learning Robust Intervention Representations with Delta Embeddings
par: Alimisis, Panagiotis, et autres
Publié: (2025)
par: Alimisis, Panagiotis, et autres
Publié: (2025)
Learning Street View Representations with Spatiotemporal Contrast
par: Li, Yong, et autres
Publié: (2025)
par: Li, Yong, et autres
Publié: (2025)
Cluster Contrast for Unsupervised Visual Representation Learning
par: Giakoumoglou, Nikolaos, et autres
Publié: (2025)
par: Giakoumoglou, Nikolaos, et autres
Publié: (2025)
Diffusion Models and Representation Learning: A Survey
par: Fuest, Michael, et autres
Publié: (2024)
par: Fuest, Michael, et autres
Publié: (2024)
Learning Transferable Features for Implicit Neural Representations
par: Vyas, Kushal, et autres
Publié: (2024)
par: Vyas, Kushal, et autres
Publié: (2024)
Robust Multimodal Learning via Representation Decoupling
par: Wei, Shicai, et autres
Publié: (2024)
par: Wei, Shicai, et autres
Publié: (2024)
Documents similaires
-
ResNetVLLM -- Multi-modal Vision LLM for the Video Understanding Task
par: Khalil, Ahmad, et autres
Publié: (2025) -
ResNetVLLM-2: Addressing ResNetVLLM's Multi-Modal Hallucinations
par: Khalil, Ahmad, et autres
Publié: (2025) -
Learning Superpixel Ensemble and Hierarchy Graphs for Melanoma Detection
par: Elwer, Asmaa M., et autres
Publié: (2026) -
ViGText: Deepfake Image Detection with Vision-Language Model Explanations and Graph Neural Networks
par: ALBarqawi, Ahmad, et autres
Publié: (2025) -
Superpixel Semantics Representation and Pre-training for Vision-Language Task
par: Zhang, Siyu, et autres
Publié: (2023)