L-SWAG: Layer-Sample Wise Activation with Gradients information for Zero-Shot NAS on Vision Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Casarin, Sofia, Escalera, Sergio, Lanz, Oswald |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GRASP-GCN: Graph-Shape Prioritization for Neural Architecture Search under Distribution Shifts
par: Casarin, Sofia, et autres
Publié: (2024)
par: Casarin, Sofia, et autres
Publié: (2024)
Your Image is My Video: Reshaping the Receptive Field via Image-To-Video Differentiable AutoAugmentation and Fusion
par: Casarin, Sofia, et autres
Publié: (2024)
par: Casarin, Sofia, et autres
Publié: (2024)
Action-Guided Attention for Video Action Anticipation
par: Tai, Tsung-Ming, et autres
Publié: (2026)
par: Tai, Tsung-Ming, et autres
Publié: (2026)
Gate-Shift-Pose: Enhancing Action Recognition in Sports with Skeleton Information
par: Bianchi, Edoardo, et autres
Publié: (2025)
par: Bianchi, Edoardo, et autres
Publié: (2025)
Fractals as Pre-training Datasets for Anomaly Detection and Localization
par: Ugwu, C. I., et autres
Publié: (2024)
par: Ugwu, C. I., et autres
Publié: (2024)
SWAP-NAS: Sample-Wise Activation Patterns for Ultra-fast NAS
par: Peng, Yameng, et autres
Publié: (2024)
par: Peng, Yameng, et autres
Publié: (2024)
SWAG: Splatting in the Wild images with Appearance-conditioned Gaussians
par: Dahmani, Hiba, et autres
Publié: (2024)
par: Dahmani, Hiba, et autres
Publié: (2024)
A Transformer Model for Boundary Detection in Continuous Sign Language
par: Rastgoo, Razieh, et autres
Publié: (2024)
par: Rastgoo, Razieh, et autres
Publié: (2024)
Stochastic Layer-Wise Shuffle for Improving Vision Mamba Training
par: Huang, Zizheng, et autres
Publié: (2024)
par: Huang, Zizheng, et autres
Publié: (2024)
On the Element-Wise Representation and Reasoning in Zero-Shot Image Recognition: A Systematic Survey
par: Guo, Jingcai, et autres
Publié: (2024)
par: Guo, Jingcai, et autres
Publié: (2024)
SWAG: Long-term Surgical Workflow Prediction with Generative-based Anticipation
par: Boels, Maxence, et autres
Publié: (2024)
par: Boels, Maxence, et autres
Publié: (2024)
CObL: Toward Zero-Shot Ordinal Layering without User Prompting
par: Damaraju, Aneel, et autres
Publié: (2025)
par: Damaraju, Aneel, et autres
Publié: (2025)
AnomalyVFM -- Transforming Vision Foundation Models into Zero-Shot Anomaly Detectors
par: Fučka, Matic, et autres
Publié: (2026)
par: Fučka, Matic, et autres
Publié: (2026)
AnoRefiner: Anomaly-Aware Group-Wise Refinement for Zero-Shot Industrial Anomaly Detection
par: Huang, Dayou, et autres
Publié: (2025)
par: Huang, Dayou, et autres
Publié: (2025)
VisualAD: Language-Free Zero-Shot Anomaly Detection via Vision Transformer
par: Hou, Yanning, et autres
Publié: (2026)
par: Hou, Yanning, et autres
Publié: (2026)
Progressive Semantic-Guided Vision Transformer for Zero-Shot Learning
par: Chen, Shiming, et autres
Publié: (2024)
par: Chen, Shiming, et autres
Publié: (2024)
Structure-Preserving Zero-Shot Image Editing via Stage-Wise Latent Injection in Diffusion Models
par: Jeong, Dasol, et autres
Publié: (2025)
par: Jeong, Dasol, et autres
Publié: (2025)
Depth-Wise Convolutions in Vision Transformers for Efficient Training on Small Datasets
par: Zhang, Tianxiao, et autres
Publié: (2024)
par: Zhang, Tianxiao, et autres
Publié: (2024)
Zero-Shot Wildlife Sorting Using Vision Transformers: Evaluating Clustering and Continuous Similarity Ordering
par: Markoff, Hugo, et autres
Publié: (2025)
par: Markoff, Hugo, et autres
Publié: (2025)
Explainable AI: Context-Aware Layer-Wise Integrated Gradients for Explaining Transformer Models
par: Mersha, Melkamu Abay, et autres
Publié: (2026)
par: Mersha, Melkamu Abay, et autres
Publié: (2026)
Layer-Wise Feature Metric of Semantic-Pixel Matching for Few-Shot Learning
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
Zero-Shot Class Unlearning in CLIP with Synthetic Samples
par: Kravets, A., et autres
Publié: (2024)
par: Kravets, A., et autres
Publié: (2024)
Hierarchical and Step-Layer-Wise Tuning of Attention Specialty for Multi-Instance Synthesis in Diffusion Transformers
par: Zhang, Chunyang, et autres
Publié: (2025)
par: Zhang, Chunyang, et autres
Publié: (2025)
Can Cross-Layer Transcoders Replace Vision Transformer Activations? An Interpretable Perspective on Vision
par: Chatzoudis, Gerasimos, et autres
Publié: (2026)
par: Chatzoudis, Gerasimos, et autres
Publié: (2026)
Zero-Shot Coreset Selection via Iterative Subspace Sampling
par: Griffin, Brent A., et autres
Publié: (2024)
par: Griffin, Brent A., et autres
Publié: (2024)
ZePo: Zero-Shot Portrait Stylization with Faster Sampling
par: Liu, Jin, et autres
Publié: (2024)
par: Liu, Jin, et autres
Publié: (2024)
Layered Rendering Diffusion Model for Controllable Zero-Shot Image Synthesis
par: Qi, Zipeng, et autres
Publié: (2023)
par: Qi, Zipeng, et autres
Publié: (2023)
Zero-Shot Vision Encoder Grafting via LLM Surrogates
par: Yue, Kaiyu, et autres
Publié: (2025)
par: Yue, Kaiyu, et autres
Publié: (2025)
Noise is an Efficient Learner for Zero-Shot Vision-Language Models
par: Imam, Raza, et autres
Publié: (2025)
par: Imam, Raza, et autres
Publié: (2025)
Seamless Human Motion Composition with Blended Positional Encodings
par: Barquero, German, et autres
Publié: (2024)
par: Barquero, German, et autres
Publié: (2024)
Binary Verification for Zero-Shot Vision
par: Hu, Rongbin, et autres
Publié: (2025)
par: Hu, Rongbin, et autres
Publié: (2025)
DiTVR: Zero-Shot Diffusion Transformer for Video Restoration
par: Gao, Sicheng, et autres
Publié: (2025)
par: Gao, Sicheng, et autres
Publié: (2025)
Super-class guided Transformer for Zero-Shot Attribute Classification
par: Kim, Sehyung, et autres
Publié: (2025)
par: Kim, Sehyung, et autres
Publié: (2025)
Depth-Wise Representation Development Under Blockwise Self-Supervised Learning for Video Vision Transformers
par: Römer, Jonas, et autres
Publié: (2026)
par: Römer, Jonas, et autres
Publié: (2026)
RVLF: A Reinforcing Vision-Language Framework for Gloss-Free Sign Language Translation
par: Rao, Zhi, et autres
Publié: (2025)
par: Rao, Zhi, et autres
Publié: (2025)
DNA Family: Boosting Weight-Sharing NAS with Block-Wise Supervisions
par: Wang, Guangrun, et autres
Publié: (2024)
par: Wang, Guangrun, et autres
Publié: (2024)
Radiology Report Generation with Layer-Wise Anatomical Attention
par: Muñiz-De-León, Emmanuel D., et autres
Publié: (2025)
par: Muñiz-De-León, Emmanuel D., et autres
Publié: (2025)
Vision Transformers for Zero-Shot Clustering of Animal Images: A Comparative Benchmarking Study
par: Markoff, Hugo, et autres
Publié: (2026)
par: Markoff, Hugo, et autres
Publié: (2026)
Leveraging Vision-Language Embeddings for Zero-Shot Learning in Histopathology Images
par: Rahaman, Md Mamunur, et autres
Publié: (2025)
par: Rahaman, Md Mamunur, et autres
Publié: (2025)
Interpretable Zero-Shot Learning with Locally-Aligned Vision-Language Model
par: Chen, Shiming, et autres
Publié: (2025)
par: Chen, Shiming, et autres
Publié: (2025)
Documents similaires
-
GRASP-GCN: Graph-Shape Prioritization for Neural Architecture Search under Distribution Shifts
par: Casarin, Sofia, et autres
Publié: (2024) -
Your Image is My Video: Reshaping the Receptive Field via Image-To-Video Differentiable AutoAugmentation and Fusion
par: Casarin, Sofia, et autres
Publié: (2024) -
Action-Guided Attention for Video Action Anticipation
par: Tai, Tsung-Ming, et autres
Publié: (2026) -
Gate-Shift-Pose: Enhancing Action Recognition in Sports with Skeleton Information
par: Bianchi, Edoardo, et autres
Publié: (2025) -
Fractals as Pre-training Datasets for Anomaly Detection and Localization
par: Ugwu, C. I., et autres
Publié: (2024)