Self-Supervised Weight Templates for Scalable Vision Model Initialization
Fuente:
arXiv
Guardado en:
| Autores principales: | Xie, Yucheng, Feng, Fu, Shi, Ruixiao, Wang, Jing, Rui, Yong, Geng, Xin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DivControl: Knowledge Diversion for Controllable Image Generation
por: Xie, Yucheng, et al.
Publicado: (2025)
por: Xie, Yucheng, et al.
Publicado: (2025)
FINE: Factorizing Knowledge for Initialization of Variable-sized Diffusion Models
por: Xie, Yucheng, et al.
Publicado: (2024)
por: Xie, Yucheng, et al.
Publicado: (2024)
A Creative Agent is Worth a 64-Token Template
por: Shi, Ruixiao, et al.
Publicado: (2026)
por: Shi, Ruixiao, et al.
Publicado: (2026)
KIND: Knowledge Integration and Diversion for Training Decomposable Models
por: Xie, Yucheng, et al.
Publicado: (2024)
por: Xie, Yucheng, et al.
Publicado: (2024)
Constraint-based Pre-training: From Structured Constraints to Scalable Model Initialization
por: Feng, Fu, et al.
Publicado: (2026)
por: Feng, Fu, et al.
Publicado: (2026)
WAVE: Weight Templates for Adaptive Initialization of Variable-sized Models
por: Feng, Fu, et al.
Publicado: (2024)
por: Feng, Fu, et al.
Publicado: (2024)
FAD: Frequency Adaptation and Diversion for Cross-domain Few-shot Learning
por: Shi, Ruixiao, et al.
Publicado: (2025)
por: Shi, Ruixiao, et al.
Publicado: (2025)
Exploring Learngene via Stage-wise Weight Sharing for Initializing Variable-sized Models
por: Xia, Shi-Yu, et al.
Publicado: (2024)
por: Xia, Shi-Yu, et al.
Publicado: (2024)
Stratified Knowledge-Density Super-Network for Scalable Vision Transformers
por: Li, Longhua, et al.
Publicado: (2025)
por: Li, Longhua, et al.
Publicado: (2025)
Self-Supervised Vision Transformers for Writer Retrieval
por: Raven, Tim, et al.
Publicado: (2024)
por: Raven, Tim, et al.
Publicado: (2024)
Enriching Knowledge Distillation with Intra-Class Contrastive Learning
por: Yuan, Hua, et al.
Publicado: (2025)
por: Yuan, Hua, et al.
Publicado: (2025)
Deconstructing Denoising Diffusion Models for Self-Supervised Learning
por: Chen, Xinlei, et al.
Publicado: (2024)
por: Chen, Xinlei, et al.
Publicado: (2024)
On Using Quasirandom Sequences in Machine Learning for Model Weight Initialization
por: Miranskyy, Andriy, et al.
Publicado: (2024)
por: Miranskyy, Andriy, et al.
Publicado: (2024)
Enhancing Cognition and Explainability of Multimodal Foundation Models with Self-Synthesized Data
por: Shi, Yucheng, et al.
Publicado: (2025)
por: Shi, Yucheng, et al.
Publicado: (2025)
N-Tree Diffusion for Long-Horizon Wildfire Risk Forecasting
por: Xing, Yucheng, et al.
Publicado: (2026)
por: Xing, Yucheng, et al.
Publicado: (2026)
Efficient and Long-Tailed Generalization for Pre-trained Vision-Language Model
por: Shi, Jiang-Xin, et al.
Publicado: (2024)
por: Shi, Jiang-Xin, et al.
Publicado: (2024)
Self-Supervised Scalable Deep Compressed Sensing
por: Chen, Bin, et al.
Publicado: (2023)
por: Chen, Bin, et al.
Publicado: (2023)
A Study on Self-Supervised Pretraining for Vision Problems in Gastrointestinal Endoscopy
por: Sanderson, Edward, et al.
Publicado: (2024)
por: Sanderson, Edward, et al.
Publicado: (2024)
Self-Improving Small Object Grounding in LVLMs
por: Yang, Tianze, et al.
Publicado: (2026)
por: Yang, Tianze, et al.
Publicado: (2026)
FlowDepth: Decoupling Optical Flow for Self-Supervised Monocular Depth Estimation
por: Sun, Yiyang, et al.
Publicado: (2024)
por: Sun, Yiyang, et al.
Publicado: (2024)
Distribution-Conditional Generation: From Class Distribution to Creative Generation
por: Feng, Fu, et al.
Publicado: (2025)
por: Feng, Fu, et al.
Publicado: (2025)
Dataset Distillation for Pre-Trained Self-Supervised Vision Models
por: Cazenavette, George, et al.
Publicado: (2025)
por: Cazenavette, George, et al.
Publicado: (2025)
SupMAE: Supervised Masked Autoencoders Are Efficient Vision Learners
por: Liang, Feng, et al.
Publicado: (2022)
por: Liang, Feng, et al.
Publicado: (2022)
Temporal Embeddings: Scalable Self-Supervised Temporal Representation Learning from Spatiotemporal Data for Multimodal Computer Vision
por: Cao, Yi, et al.
Publicado: (2023)
por: Cao, Yi, et al.
Publicado: (2023)
MM-Zero: Self-Evolving Multi-Model Vision Language Models From Zero Data
por: Li, Zongxia, et al.
Publicado: (2026)
por: Li, Zongxia, et al.
Publicado: (2026)
Elastic Attention Cores for Scalable Vision Transformers
por: Song, Alan Z., et al.
Publicado: (2026)
por: Song, Alan Z., et al.
Publicado: (2026)
Couple to Control: Joint Initial Noise Design in Diffusion Models
por: Jia, Jing, et al.
Publicado: (2026)
por: Jia, Jing, et al.
Publicado: (2026)
In-Context Symmetries: Self-Supervised Learning through Contextual World Models
por: Gupta, Sharut, et al.
Publicado: (2024)
por: Gupta, Sharut, et al.
Publicado: (2024)
VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision
por: Xu, Yi, et al.
Publicado: (2024)
por: Xu, Yi, et al.
Publicado: (2024)
Hyperspectral Anomaly Detection with Self-Supervised Anomaly Prior
por: Liu, Yidan, et al.
Publicado: (2024)
por: Liu, Yidan, et al.
Publicado: (2024)
Vision-Language Models are Strong Noisy Label Detectors
por: Wei, Tong, et al.
Publicado: (2024)
por: Wei, Tong, et al.
Publicado: (2024)
Stable Consistency Tuning: Understanding and Improving Consistency Models
por: Wang, Fu-Yun, et al.
Publicado: (2024)
por: Wang, Fu-Yun, et al.
Publicado: (2024)
Self-Calibrated Tuning of Vision-Language Models for Out-of-Distribution Detection
por: Yu, Geng, et al.
Publicado: (2024)
por: Yu, Geng, et al.
Publicado: (2024)
Input-Adaptive Generative Dynamics in Diffusion Models
por: Xing, Yucheng, et al.
Publicado: (2024)
por: Xing, Yucheng, et al.
Publicado: (2024)
SITUATE: Indoor Human Trajectory Prediction through Geometric Features and Self-Supervised Vision Representation
por: Capogrosso, Luigi, et al.
Publicado: (2024)
por: Capogrosso, Luigi, et al.
Publicado: (2024)
LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics
por: Balestriero, Randall, et al.
Publicado: (2025)
por: Balestriero, Randall, et al.
Publicado: (2025)
Unifying Self-Supervised Clustering and Energy-Based Models
por: Sansone, Emanuele, et al.
Publicado: (2023)
por: Sansone, Emanuele, et al.
Publicado: (2023)
Active Zero: Self-Evolving Vision-Language Models through Active Environment Exploration
por: He, Jinghan, et al.
Publicado: (2026)
por: He, Jinghan, et al.
Publicado: (2026)
WSVD: Weighted Low-Rank Approximation for Fast and Efficient Execution of Low-Precision Vision-Language Models
por: Wang, Haiyu, et al.
Publicado: (2026)
por: Wang, Haiyu, et al.
Publicado: (2026)
Variance-Aware Adaptive Weighting for Diffusion Model Training
por: Sun, Nanlong, et al.
Publicado: (2026)
por: Sun, Nanlong, et al.
Publicado: (2026)
Ejemplares similares
-
DivControl: Knowledge Diversion for Controllable Image Generation
por: Xie, Yucheng, et al.
Publicado: (2025) -
FINE: Factorizing Knowledge for Initialization of Variable-sized Diffusion Models
por: Xie, Yucheng, et al.
Publicado: (2024) -
A Creative Agent is Worth a 64-Token Template
por: Shi, Ruixiao, et al.
Publicado: (2026) -
KIND: Knowledge Integration and Diversion for Training Decomposable Models
por: Xie, Yucheng, et al.
Publicado: (2024) -
Constraint-based Pre-training: From Structured Constraints to Scalable Model Initialization
por: Feng, Fu, et al.
Publicado: (2026)