Mimicking Human Visual Development for Learning Robust Image Representations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Raj, Ankita, Prajaapat, Kaashika, Gandhi, Tapan Kumar, Arora, Chetan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Backdoor Attacks on Open Vocabulary Object Detectors via Multi-Modal Prompt Tuning
par: Raj, Ankita, et autres
Publié: (2025)
par: Raj, Ankita, et autres
Publié: (2025)
Identifying Physically Realizable Triggers for Backdoored Face Recognition Networks
par: Raj, Ankita, et autres
Publié: (2025)
par: Raj, Ankita, et autres
Publié: (2025)
Examining the Threat Landscape: Foundation Models and Model Stealing
par: Raj, Ankita, et autres
Publié: (2025)
par: Raj, Ankita, et autres
Publié: (2025)
Assessing Risk of Stealing Proprietary Models for Medical Imaging Tasks
par: Raj, Ankita, et autres
Publié: (2025)
par: Raj, Ankita, et autres
Publié: (2025)
CrossMed: A Multimodal Cross-Task Benchmark for Compositional Generalization in Medical Imaging
par: Singh, Pooja, et autres
Publié: (2025)
par: Singh, Pooja, et autres
Publié: (2025)
LQ-Adapter: ViT-Adapter with Learnable Queries for Gallbladder Cancer Detection from Ultrasound Image
par: Madan, Chetan, et autres
Publié: (2024)
par: Madan, Chetan, et autres
Publié: (2024)
VGGT-SLAM++
par: Mandal, Avilasha, et autres
Publié: (2026)
par: Mandal, Avilasha, et autres
Publié: (2026)
Focus on Texture: Rethinking Pre-training in Masked Autoencoders for Medical Image Classification
par: Madan, Chetan, et autres
Publié: (2025)
par: Madan, Chetan, et autres
Publié: (2025)
Mimicking-Bench: A Benchmark for Generalizable Humanoid-Scene Interaction Learning via Human Mimicking
par: Liu, Yun, et autres
Publié: (2024)
par: Liu, Yun, et autres
Publié: (2024)
Learning Disentangled Representation in Object-Centric Models for Visual Dynamics Prediction via Transformers
par: Gandhi, Sanket, et autres
Publié: (2024)
par: Gandhi, Sanket, et autres
Publié: (2024)
Reliable Active Learning from Unreliable Labels via Neural Collapse Geometry
par: Goel, Atharv, et autres
Publié: (2025)
par: Goel, Atharv, et autres
Publié: (2025)
Improving Image Captioning by Mimicking Human Reformulation Feedback at Inference-time
par: Berger, Uri, et autres
Publié: (2025)
par: Berger, Uri, et autres
Publié: (2025)
Feature Space Perturbation: A Panacea to Enhanced Transferability Estimation
par: Khoba, Prafful Kumar, et autres
Publié: (2025)
par: Khoba, Prafful Kumar, et autres
Publié: (2025)
Learning Robust Representations via Bidirectional Transition for Visual Reinforcement Learning
par: Hu, Xiaobo, et autres
Publié: (2023)
par: Hu, Xiaobo, et autres
Publié: (2023)
microCLIP: Unsupervised CLIP Adaptation via Coarse-Fine Token Fusion for Fine-Grained Image Classification
par: Silva, Sathira, et autres
Publié: (2025)
par: Silva, Sathira, et autres
Publié: (2025)
WavShadow: Wavelet Based Shadow Segmentation and Removal
par: Jain, Shreyans, et autres
Publié: (2024)
par: Jain, Shreyans, et autres
Publié: (2024)
Towards Fine-Grained Adaptation of CLIP via a Self-Trained Alignment Score
par: Ali, Eman, et autres
Publié: (2025)
par: Ali, Eman, et autres
Publié: (2025)
Use of Metric Learning for the Recognition of Handwritten Digits, and its Application to Increase the Outreach of Voice-based Communication Platforms
par: Pant, Devesh, et autres
Publié: (2025)
par: Pant, Devesh, et autres
Publié: (2025)
FocusMAE: Gallbladder Cancer Detection from Ultrasound Videos with Focused Masked Autoencoders
par: Basu, Soumen, et autres
Publié: (2024)
par: Basu, Soumen, et autres
Publié: (2024)
D-MASTER: Mask Annealed Transformer for Unsupervised Domain Adaptation in Breast Cancer Detection from Mammograms
par: Ashraf, Tajamul, et autres
Publié: (2024)
par: Ashraf, Tajamul, et autres
Publié: (2024)
Personalized Image Generation from an Author Writing Style
par: Gandhi, Sagar, et autres
Publié: (2025)
par: Gandhi, Sagar, et autres
Publié: (2025)
MicroDetect-Net (MDN): Leveraging Deep Learning to Detect Microplastics in Clam Blood, a Step Towards Human Blood Analysis
par: Marwah, Riju, et autres
Publié: (2025)
par: Marwah, Riju, et autres
Publié: (2025)
Robust Human Trajectory Prediction via Self-Supervised Skeleton Representation Learning
par: Arashima, Taishu, et autres
Publié: (2026)
par: Arashima, Taishu, et autres
Publié: (2026)
An Exploratory Study on Abstract Images and Visual Representations Learned from Them
par: Li, Haotian, et autres
Publié: (2025)
par: Li, Haotian, et autres
Publié: (2025)
Reasoning as Representation: Rethinking Visual Reinforcement Learning in Image Quality Assessment
par: Zhao, Shijie, et autres
Publié: (2025)
par: Zhao, Shijie, et autres
Publié: (2025)
LeOCLR: Leveraging Original Images for Contrastive Learning of Visual Representations
par: Alkhalefi, Mohammad, et autres
Publié: (2024)
par: Alkhalefi, Mohammad, et autres
Publié: (2024)
NeoARCADE: Robust Calibration for Distance Estimation to Support Assistive Drones for the Visually Impaired
par: Raj, Suman, et autres
Publié: (2025)
par: Raj, Suman, et autres
Publié: (2025)
Can Reasons Help Improve Pedestrian Intent Estimation? A Cross-Modal Approach
par: Khindkar, Vaishnavi, et autres
Publié: (2024)
par: Khindkar, Vaishnavi, et autres
Publié: (2024)
Prompting without Panic: Attribute-aware, Zero-shot, Test-Time Calibration
par: Hebbalaguppe, Ramya, et autres
Publié: (2025)
par: Hebbalaguppe, Ramya, et autres
Publié: (2025)
Alignment and Safety of Diffusion Models via Reinforcement Learning and Reward Modeling: A Survey
par: Lamba, Preeti, et autres
Publié: (2025)
par: Lamba, Preeti, et autres
Publié: (2025)
ECoDepth: Effective Conditioning of Diffusion Models for Monocular Depth Estimation
par: Patni, Suraj, et autres
Publié: (2024)
par: Patni, Suraj, et autres
Publié: (2024)
V2M: Visual 2-Dimensional Mamba for Image Representation Learning
par: Wang, Chengkun, et autres
Publié: (2024)
par: Wang, Chengkun, et autres
Publié: (2024)
Vision Mamba for Permeability Prediction of Porous Media
par: Kashefi, Ali, et autres
Publié: (2025)
par: Kashefi, Ali, et autres
Publié: (2025)
A novel Fourier neural operator framework for classification of multi-sized images: Application to three dimensional digital porous media
par: Kashefi, Ali, et autres
Publié: (2024)
par: Kashefi, Ali, et autres
Publié: (2024)
Robust Visual Representation Learning with Multi-modal Prior Knowledge for Image Classification Under Distribution Shift
par: Zhou, Hongkuan, et autres
Publié: (2024)
par: Zhou, Hongkuan, et autres
Publié: (2024)
Improving Adversarial Robustness via Decoupled Visual Representation Masking
par: Liu, Decheng, et autres
Publié: (2024)
par: Liu, Decheng, et autres
Publié: (2024)
Efficient High-Resolution Visual Representation Learning with State Space Model for Human Pose Estimation
par: Zhang, Hao, et autres
Publié: (2024)
par: Zhang, Hao, et autres
Publié: (2024)
PVLR: Prompt-driven Visual-Linguistic Representation Learning for Multi-Label Image Recognition
par: Tan, Hao, et autres
Publié: (2024)
par: Tan, Hao, et autres
Publié: (2024)
Learning to See Through a Baby's Eyes: Early Visual Diets Enable Robust Visual Intelligence in Humans and Machines
par: Cai, Yusen, et autres
Publié: (2025)
par: Cai, Yusen, et autres
Publié: (2025)
RAM++: Robust Representation Learning via Adaptive Mask for All-in-One Image Restoration
par: Zhang, Zilong, et autres
Publié: (2025)
par: Zhang, Zilong, et autres
Publié: (2025)
Documents similaires
-
Backdoor Attacks on Open Vocabulary Object Detectors via Multi-Modal Prompt Tuning
par: Raj, Ankita, et autres
Publié: (2025) -
Identifying Physically Realizable Triggers for Backdoored Face Recognition Networks
par: Raj, Ankita, et autres
Publié: (2025) -
Examining the Threat Landscape: Foundation Models and Model Stealing
par: Raj, Ankita, et autres
Publié: (2025) -
Assessing Risk of Stealing Proprietary Models for Medical Imaging Tasks
par: Raj, Ankita, et autres
Publié: (2025) -
CrossMed: A Multimodal Cross-Task Benchmark for Compositional Generalization in Medical Imaging
par: Singh, Pooja, et autres
Publié: (2025)