Gespeichert in:
| Hauptverfasser: | Feng, Fu, Xie, Yucheng, Wang, Jing, Geng, Xin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2406.17503 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Self-Supervised Weight Templates for Scalable Vision Model Initialization
von: Xie, Yucheng, et al.
Veröffentlicht: (2026)
von: Xie, Yucheng, et al.
Veröffentlicht: (2026)
Constraint-based Pre-training: From Structured Constraints to Scalable Model Initialization
von: Feng, Fu, et al.
Veröffentlicht: (2026)
von: Feng, Fu, et al.
Veröffentlicht: (2026)
One-for-All Model Initialization with Frequency-Domain Knowledge
von: Shen, Jianlu, et al.
Veröffentlicht: (2026)
von: Shen, Jianlu, et al.
Veröffentlicht: (2026)
Exploring Learngene via Stage-wise Weight Sharing for Initializing Variable-sized Models
von: Xia, Shi-Yu, et al.
Veröffentlicht: (2024)
von: Xia, Shi-Yu, et al.
Veröffentlicht: (2024)
FINE: Factorizing Knowledge for Initialization of Variable-sized Diffusion Models
von: Xie, Yucheng, et al.
Veröffentlicht: (2024)
von: Xie, Yucheng, et al.
Veröffentlicht: (2024)
Knowledge Diversion for Efficient Morphology Control and Policy Transfer
von: Feng, Fu, et al.
Veröffentlicht: (2025)
von: Feng, Fu, et al.
Veröffentlicht: (2025)
DivControl: Knowledge Diversion for Controllable Image Generation
von: Xie, Yucheng, et al.
Veröffentlicht: (2025)
von: Xie, Yucheng, et al.
Veröffentlicht: (2025)
A Unified Framework for Knowledge Transfer in Bidirectional Model Scaling
von: Shen, Jianlu, et al.
Veröffentlicht: (2026)
von: Shen, Jianlu, et al.
Veröffentlicht: (2026)
Transferring Core Knowledge via Learngenes
von: Feng, Fu, et al.
Veröffentlicht: (2024)
von: Feng, Fu, et al.
Veröffentlicht: (2024)
WAVE: Weighted Autoregressive Varying Gate for Time Series Forecasting
von: Lu, Jiecheng, et al.
Veröffentlicht: (2024)
von: Lu, Jiecheng, et al.
Veröffentlicht: (2024)
Puppet-CNN: Continuous Parameter Dynamics for Input-Adaptive Convolutional Networks
von: Xing, Yucheng, et al.
Veröffentlicht: (2024)
von: Xing, Yucheng, et al.
Veröffentlicht: (2024)
A Creative Agent is Worth a 64-Token Template
von: Shi, Ruixiao, et al.
Veröffentlicht: (2026)
von: Shi, Ruixiao, et al.
Veröffentlicht: (2026)
Input-Adaptive Generative Dynamics in Diffusion Models
von: Xing, Yucheng, et al.
Veröffentlicht: (2024)
von: Xing, Yucheng, et al.
Veröffentlicht: (2024)
Automating the Selection of Proxy Variables of Unmeasured Confounders
von: Xie, Feng, et al.
Veröffentlicht: (2024)
von: Xie, Feng, et al.
Veröffentlicht: (2024)
Selecting the Number of Communities for Weighted Degree-Corrected Stochastic Block Models
von: Liu, Yucheng, et al.
Veröffentlicht: (2024)
von: Liu, Yucheng, et al.
Veröffentlicht: (2024)
On approximating the $f$-divergence between two Ising models
von: Feng, Weiming, et al.
Veröffentlicht: (2025)
von: Feng, Weiming, et al.
Veröffentlicht: (2025)
Testability of Instrumental Variables in Additive Nonlinear, Non-Constant Effects Models
von: Guo, Xichen, et al.
Veröffentlicht: (2024)
von: Guo, Xichen, et al.
Veröffentlicht: (2024)
Learngene Search Across Multiple Datasets for Building Variable-Sized Models
von: Shi, Boyu, et al.
Veröffentlicht: (2026)
von: Shi, Boyu, et al.
Veröffentlicht: (2026)
Deep Learning Optimization Using Self-Adaptive Weighted Auxiliary Variables
von: Liu, Yaru, et al.
Veröffentlicht: (2025)
von: Liu, Yaru, et al.
Veröffentlicht: (2025)
Confounded Causal Imitation Learning with Instrumental Variables
von: Zeng, Yan, et al.
Veröffentlicht: (2025)
von: Zeng, Yan, et al.
Veröffentlicht: (2025)
Local Causal Structure Learning in the Presence of Latent Variables
von: Xie, Feng, et al.
Veröffentlicht: (2024)
von: Xie, Feng, et al.
Veröffentlicht: (2024)
Local Learning for Covariate Selection in Nonparametric Causal Effect Estimation with Latent Variables
von: Li, Zheng, et al.
Veröffentlicht: (2024)
von: Li, Zheng, et al.
Veröffentlicht: (2024)
Weighted-Sum of Gaussian Process Latent Variable Models
von: Odgers, James, et al.
Veröffentlicht: (2024)
von: Odgers, James, et al.
Veröffentlicht: (2024)
Weight Initialization and Variance Dynamics in Deep Neural Networks and Large Language Models
von: Han, Yankun
Veröffentlicht: (2025)
von: Han, Yankun
Veröffentlicht: (2025)
HRP: High-Rank Preheating for Superior LoRA Initialization
von: Chen, Yuzhu, et al.
Veröffentlicht: (2025)
von: Chen, Yuzhu, et al.
Veröffentlicht: (2025)
TapWeight: Reweighting Pretraining Objectives for Task-Adaptive Pretraining
von: Zhang, Ruiyi, et al.
Veröffentlicht: (2024)
von: Zhang, Ruiyi, et al.
Veröffentlicht: (2024)
LDLT L-Lipschitz Network Weight Parameterization Initialization
von: Juston, Marius F. R., et al.
Veröffentlicht: (2026)
von: Juston, Marius F. R., et al.
Veröffentlicht: (2026)
Beyond Gaussian Initializations: Signal Preserving Weight Initialization for Odd-Sigmoid Activations
von: Lee, Hyunwoo, et al.
Veröffentlicht: (2025)
von: Lee, Hyunwoo, et al.
Veröffentlicht: (2025)
Inaccurate Label Distribution Learning with Dependency Noise
von: Kou, Zhiqiang, et al.
Veröffentlicht: (2024)
von: Kou, Zhiqiang, et al.
Veröffentlicht: (2024)
N-Tree Diffusion for Long-Horizon Wildfire Risk Forecasting
von: Xing, Yucheng, et al.
Veröffentlicht: (2026)
von: Xing, Yucheng, et al.
Veröffentlicht: (2026)
Simple Full-Spectrum Correlated k-Distribution Model based on Multilayer Perceptron
von: Wang, Xin, et al.
Veröffentlicht: (2024)
von: Wang, Xin, et al.
Veröffentlicht: (2024)
Generalized Independent Noise Condition for Estimating Causal Structure with Latent Variables
von: Xie, Feng, et al.
Veröffentlicht: (2023)
von: Xie, Feng, et al.
Veröffentlicht: (2023)
On Using Quasirandom Sequences in Machine Learning for Model Weight Initialization
von: Miranskyy, Andriy, et al.
Veröffentlicht: (2024)
von: Miranskyy, Andriy, et al.
Veröffentlicht: (2024)
CAWI: Copula-Aligned Weight Initialization for Randomized Neural Networks
von: Akhtar, Mushir, et al.
Veröffentlicht: (2026)
von: Akhtar, Mushir, et al.
Veröffentlicht: (2026)
TA-GGAD: Testing-time Adaptive Graph Model for Generalist Graph Anomaly Detection
von: Zhang, Xiong, et al.
Veröffentlicht: (2026)
von: Zhang, Xiong, et al.
Veröffentlicht: (2026)
Comparing Template-based and Template-free Language Model Probing
von: Shaier, Sagi, et al.
Veröffentlicht: (2024)
von: Shaier, Sagi, et al.
Veröffentlicht: (2024)
TemplateRL: Structured Template-Guided Reinforcement Learning for LLM Reasoning
von: Wu, Jinyang, et al.
Veröffentlicht: (2025)
von: Wu, Jinyang, et al.
Veröffentlicht: (2025)
Multi-Task Model Merging via Adaptive Weight Disentanglement
von: Xiong, Feng, et al.
Veröffentlicht: (2024)
von: Xiong, Feng, et al.
Veröffentlicht: (2024)
Reducing Oversmoothing through Informed Weight Initialization in Graph Neural Networks
von: Kelesis, Dimitrios, et al.
Veröffentlicht: (2024)
von: Kelesis, Dimitrios, et al.
Veröffentlicht: (2024)
A Self-Attentive Meta-Optimizer with Group-Adaptive Learning Rates and Weight Decay
von: Zhao, JiangBo, et al.
Veröffentlicht: (2026)
von: Zhao, JiangBo, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Self-Supervised Weight Templates for Scalable Vision Model Initialization
von: Xie, Yucheng, et al.
Veröffentlicht: (2026) -
Constraint-based Pre-training: From Structured Constraints to Scalable Model Initialization
von: Feng, Fu, et al.
Veröffentlicht: (2026) -
One-for-All Model Initialization with Frequency-Domain Knowledge
von: Shen, Jianlu, et al.
Veröffentlicht: (2026) -
Exploring Learngene via Stage-wise Weight Sharing for Initializing Variable-sized Models
von: Xia, Shi-Yu, et al.
Veröffentlicht: (2024) -
FINE: Factorizing Knowledge for Initialization of Variable-sized Diffusion Models
von: Xie, Yucheng, et al.
Veröffentlicht: (2024)