Effects of Initialization Biases on Deep Neural Network Training Dynamics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pellegrino, Nicholas, Szczecina, David, Fieguth, Paul W. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hard Samples, Bad Labels: Robust Loss Functions That Know When to Back Off
par: Pellegrino, Nicholas, et autres
Publié: (2025)
par: Pellegrino, Nicholas, et autres
Publié: (2025)
Pre-train to Gain: Robust Learning Without Clean Labels
par: Szczecina, David, et autres
Publié: (2025)
par: Szczecina, David, et autres
Publié: (2025)
Reinforcement Learning for Stock Transactions
par: Zhou, Ziyi, et autres
Publié: (2025)
par: Zhou, Ziyi, et autres
Publié: (2025)
Understanding the Limits of Deep Tabular Methods with Temporal Shift
par: Cai, Hao-Run, et autres
Publié: (2025)
par: Cai, Hao-Run, et autres
Publié: (2025)
RVI-SAC: Average Reward Off-Policy Deep Reinforcement Learning
par: Hisaki, Yukinari, et autres
Publié: (2024)
par: Hisaki, Yukinari, et autres
Publié: (2024)
Fine-Tuning Regimes Define Distinct Continual Learning Problems
par: Iordache, Paul-Tiberiu, et autres
Publié: (2026)
par: Iordache, Paul-Tiberiu, et autres
Publié: (2026)
An Improved Adaptive PID Optimizer with Enhanced Convergence and Stability for Deep Learning
par: Saini, Saurabh, et autres
Publié: (2026)
par: Saini, Saurabh, et autres
Publié: (2026)
Dynamical Priors as a Training Objective in Reinforcement Learning
par: Subaharan, Sukesh
Publié: (2026)
par: Subaharan, Sukesh
Publié: (2026)
Contrastive Mutual Information Learning: Toward Robust Representations without Positive-Pair Augmentations
par: Livne, Micha
Publié: (2025)
par: Livne, Micha
Publié: (2025)
Contrastive MIM: A Contrastive Mutual Information Framework for Unified Generative and Discriminative Representation Learning
par: Livne, Micha
Publié: (2025)
par: Livne, Micha
Publié: (2025)
Feature-aware Modulation for Learning from Temporal Tabular Data
par: Cai, Hao-Run, et autres
Publié: (2025)
par: Cai, Hao-Run, et autres
Publié: (2025)
Adaptive Weighting in Knowledge Distillation: An Axiomatic Framework for Multi-Scale Teacher Ensemble Optimization
par: Flouro, Aaron R., et autres
Publié: (2026)
par: Flouro, Aaron R., et autres
Publié: (2026)
When Redundancy Matters: Machine Teaching of Representations
par: Ferri, Cèsar, et autres
Publié: (2024)
par: Ferri, Cèsar, et autres
Publié: (2024)
Data structure > labels? Unsupervised heuristics for SVM hyperparameter estimation
par: Cholewa, Michał, et autres
Publié: (2021)
par: Cholewa, Michał, et autres
Publié: (2021)
Generative Pretrained Embedding and Hierarchical Irregular Time Series Representation for Daily Living Activity Recognition
par: Bouchabou, Damien, et autres
Publié: (2024)
par: Bouchabou, Damien, et autres
Publié: (2024)
Multi-Teacher Ensemble Distillation: A Mathematical Framework for Probability-Domain Knowledge Aggregation
par: Flouro, Aaron R., et autres
Publié: (2026)
par: Flouro, Aaron R., et autres
Publié: (2026)
Grammar-based evolutionary approach for automated workflow composition with domain-specific operators and ensemble diversity
par: Barbudo, Rafael, et autres
Publié: (2024)
par: Barbudo, Rafael, et autres
Publié: (2024)
Temporal Taskification in Streaming Continual Learning: A Source of Evaluation Instability
par: Filat, Nicolae, et autres
Publié: (2026)
par: Filat, Nicolae, et autres
Publié: (2026)
Adaptive Exploration for Latent-State Bandits
par: Jin, Jikai, et autres
Publié: (2026)
par: Jin, Jikai, et autres
Publié: (2026)
Data-Driven Preference Sampling for Pareto Front Learning
par: Ye, Rongguang, et autres
Publié: (2024)
par: Ye, Rongguang, et autres
Publié: (2024)
Nonlinear Data Integration via Kernel Methods for Data Collaboration Analysis
par: Suetake, Yamato, et autres
Publié: (2026)
par: Suetake, Yamato, et autres
Publié: (2026)
Adaptive Bernstein Change Detector for High-Dimensional Data Streams
par: Heyden, Marco, et autres
Publié: (2023)
par: Heyden, Marco, et autres
Publié: (2023)
Repetition Makes Perfect: Recurrent Graph Neural Networks Match Message-Passing Limit
par: Rosenbluth, Eran, et autres
Publié: (2025)
par: Rosenbluth, Eran, et autres
Publié: (2025)
Lost in Aggregation: On a Fundamental Expressivity Limit of Message-Passing Graph Neural Networks
par: Rosenbluth, Eran
Publié: (2026)
par: Rosenbluth, Eran
Publié: (2026)
Client-Conditional Federated Learning via Local Training Data Statistics
par: Brännvall, Rickard
Publié: (2026)
par: Brännvall, Rickard
Publié: (2026)
cPNN: Continuous Progressive Neural Networks for Evolving Streaming Time Series
par: Giannini, Federico, et autres
Publié: (2026)
par: Giannini, Federico, et autres
Publié: (2026)
Human-Aligned Skill Discovery: Balancing Behaviour Exploration and Alignment
par: Hussonnois, Maxence, et autres
Publié: (2025)
par: Hussonnois, Maxence, et autres
Publié: (2025)
Correction and Corruption: A Two-Rate View of Error Flow in LLM Protocols
par: Reitich, Fernando
Publié: (2026)
par: Reitich, Fernando
Publié: (2026)
Distinguished In Uniform: Self Attention Vs. Virtual Nodes
par: Rosenbluth, Eran, et autres
Publié: (2024)
par: Rosenbluth, Eran, et autres
Publié: (2024)
Tracking Changing Probabilities via Dynamic Learners
par: Madani, Omid
Publié: (2024)
par: Madani, Omid
Publié: (2024)
Predicting Microbial Interactions Using Graph Neural Networks
par: Gholamzadeh, Elham, et autres
Publié: (2025)
par: Gholamzadeh, Elham, et autres
Publié: (2025)
Your Data, My Model: Learning Who Really Helps in Federated Learning
par: Abdurakhmanova, Shamsiiat, et autres
Publié: (2024)
par: Abdurakhmanova, Shamsiiat, et autres
Publié: (2024)
Evolving machine learning workflows through interactive AutoML
par: Barbudo, Rafael, et autres
Publié: (2024)
par: Barbudo, Rafael, et autres
Publié: (2024)
MAcPNN: Mutual Assisted Learning on Data Streams with Temporal Dependence
par: Giannini, Federico, et autres
Publié: (2026)
par: Giannini, Federico, et autres
Publié: (2026)
Territory Paint Wars: Diagnosing and Mitigating Failure Modes in Competitive Multi-Agent PPO
par: Singh, Diyansha
Publié: (2026)
par: Singh, Diyansha
Publié: (2026)
Neurosymbolic Association Rule Mining from Tabular Data
par: Karabulut, Erkan, et autres
Publié: (2025)
par: Karabulut, Erkan, et autres
Publié: (2025)
Layer-Parallel Training for Transformers
par: Jiang, Shuai, et autres
Publié: (2026)
par: Jiang, Shuai, et autres
Publié: (2026)
CVCM Track Circuits Pre-emptive Failure Diagnostics for Predictive Maintenance Using Deep Neural Networks
par: Mukherjee, Debdeep, et autres
Publié: (2025)
par: Mukherjee, Debdeep, et autres
Publié: (2025)
QGraphLIME - Explaining Quantum Graph Neural Networks
par: Jena, Haribandhu, et autres
Publié: (2025)
par: Jena, Haribandhu, et autres
Publié: (2025)
A Comparative Survey of PyTorch vs TensorFlow for Deep Learning: Usability, Performance, and Deployment Trade-offs
par: Alawi, Zakariya Ba
Publié: (2025)
par: Alawi, Zakariya Ba
Publié: (2025)
Documents similaires
-
Hard Samples, Bad Labels: Robust Loss Functions That Know When to Back Off
par: Pellegrino, Nicholas, et autres
Publié: (2025) -
Pre-train to Gain: Robust Learning Without Clean Labels
par: Szczecina, David, et autres
Publié: (2025) -
Reinforcement Learning for Stock Transactions
par: Zhou, Ziyi, et autres
Publié: (2025) -
Understanding the Limits of Deep Tabular Methods with Temporal Shift
par: Cai, Hao-Run, et autres
Publié: (2025) -
RVI-SAC: Average Reward Off-Policy Deep Reinforcement Learning
par: Hisaki, Yukinari, et autres
Publié: (2024)