On Multi-Stage Loss Dynamics in Neural Networks: Mechanisms of Plateau and Descent Stages
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Zheng-An, Luo, Tao, Wang, GuiHong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
From Condensation to Rank Collapse: A Two-Stage Analysis of Transformer Training Dynamics
di: Chen, Zheng-An, et al.
Pubblicazione: (2025)
di: Chen, Zheng-An, et al.
Pubblicazione: (2025)
SGUQ: Staged Graph Convolution Neural Network for Alzheimer's Disease Diagnosis using Multi-Omics Data
di: Tao, Liang, et al.
Pubblicazione: (2024)
di: Tao, Liang, et al.
Pubblicazione: (2024)
Accurate Multi-Category Student Performance Forecasting at Early Stages of Online Education Using Neural Networks
di: Junejo, Naveed Ur Rehman, et al.
Pubblicazione: (2024)
di: Junejo, Naveed Ur Rehman, et al.
Pubblicazione: (2024)
Generalization Guarantees of Gradient Descent for Multi-Layer Neural Networks
di: Wang, Puyu, et al.
Pubblicazione: (2023)
di: Wang, Puyu, et al.
Pubblicazione: (2023)
Stochastic Gradient Descent for Two-layer Neural Networks
di: Cao, Dinghao, et al.
Pubblicazione: (2024)
di: Cao, Dinghao, et al.
Pubblicazione: (2024)
msf-CNN: Patch-based Multi-Stage Fusion with Convolutional Neural Networks for TinyML
di: Huang, Zhaolan, et al.
Pubblicazione: (2025)
di: Huang, Zhaolan, et al.
Pubblicazione: (2025)
Stage-Aware Learning for Dynamic Treatments
di: Ye, Hanwen, et al.
Pubblicazione: (2023)
di: Ye, Hanwen, et al.
Pubblicazione: (2023)
Generalizable Sleep Staging via Multi-Level Domain Alignment
di: Wang, Jiquan, et al.
Pubblicazione: (2023)
di: Wang, Jiquan, et al.
Pubblicazione: (2023)
Embedding Principle in Depth for the Loss Landscape Analysis of Deep Neural Networks
di: Bai, Zhiwei, et al.
Pubblicazione: (2022)
di: Bai, Zhiwei, et al.
Pubblicazione: (2022)
WaveSleepNet: An Interpretable Network for Expert-like Sleep Staging
di: Pei, Yan, et al.
Pubblicazione: (2024)
di: Pei, Yan, et al.
Pubblicazione: (2024)
On-Device Continual Learning with Dual-Stage Buffer and Dynamic Loss for Point-of-Care Pneumonia Diagnosis
di: Kim, Danu
Pubblicazione: (2026)
di: Kim, Danu
Pubblicazione: (2026)
Two-Stage Aggregation with Dynamic Local Attention for Irregular Time Series
di: Chen, Xingyu, et al.
Pubblicazione: (2023)
di: Chen, Xingyu, et al.
Pubblicazione: (2023)
Physics-Informed Neural Network Surrogate Models for River Stage Prediction
di: Zoch, Maximilian, et al.
Pubblicazione: (2025)
di: Zoch, Maximilian, et al.
Pubblicazione: (2025)
Differentially Private Two-Stage Gradient Descent for Instrumental Variable Regression
di: Liang, Haodong, et al.
Pubblicazione: (2025)
di: Liang, Haodong, et al.
Pubblicazione: (2025)
Variational Stochastic Gradient Descent for Deep Neural Networks
di: Chen, Haotian, et al.
Pubblicazione: (2024)
di: Chen, Haotian, et al.
Pubblicazione: (2024)
PPNet: A Two-Stage Neural Network for End-to-end Path Planning
di: Meng, Qinglong, et al.
Pubblicazione: (2024)
di: Meng, Qinglong, et al.
Pubblicazione: (2024)
DynamicLight: Two-Stage Dynamic Traffic Signal Timing
di: Zhang, Liang, et al.
Pubblicazione: (2022)
di: Zhang, Liang, et al.
Pubblicazione: (2022)
Adaptive Two-Stage Cloud Resource Scaling via Hierarchical Multi-Indicator Forecasting and Bayesian Decision-Making
di: Luo, Yang, et al.
Pubblicazione: (2024)
di: Luo, Yang, et al.
Pubblicazione: (2024)
Distributed No-Regret Learning for Multi-Stage Systems with End-to-End Bandit Feedback
di: Hou, I-Hong
Pubblicazione: (2024)
di: Hou, I-Hong
Pubblicazione: (2024)
Generative Early Stage Ranking
di: Hong, Juhee, et al.
Pubblicazione: (2025)
di: Hong, Juhee, et al.
Pubblicazione: (2025)
Multi-Stage Prototype Learning for Interpretable Time Series Classification
di: Kalisetti, Bhavesh, et al.
Pubblicazione: (2021)
di: Kalisetti, Bhavesh, et al.
Pubblicazione: (2021)
Understanding the Staged Dynamics of Transformers in Learning Latent Structure
di: Saha, Rohan, et al.
Pubblicazione: (2025)
di: Saha, Rohan, et al.
Pubblicazione: (2025)
Hierarchical Stage-Wise Training of Linked Deep Neural Networks for Multi-Building and Multi-Floor Indoor Localization Based on Wi-Fi RSSI Fingerprinting
di: Li, Sihao, et al.
Pubblicazione: (2024)
di: Li, Sihao, et al.
Pubblicazione: (2024)
Sequential Strategic Classification with Multi-Stage Selective Classifiers
di: Huang, Ziyuan, et al.
Pubblicazione: (2026)
di: Huang, Ziyuan, et al.
Pubblicazione: (2026)
Deep Convolutional Neural Networks on Multiclass Classification of Three-Dimensional Brain Images for Parkinson's Disease Stage Prediction
di: Huang, Guan-Hua, et al.
Pubblicazione: (2024)
di: Huang, Guan-Hua, et al.
Pubblicazione: (2024)
Exploring Diffusion Models' Corruption Stage in Few-Shot Fine-tuning and Mitigating with Bayesian Neural Networks
di: Wu, Xiaoyu, et al.
Pubblicazione: (2024)
di: Wu, Xiaoyu, et al.
Pubblicazione: (2024)
Generalization Bounds of Stochastic Gradient Descent in Homogeneous Neural Networks
di: Ma, Wenquan, et al.
Pubblicazione: (2026)
di: Ma, Wenquan, et al.
Pubblicazione: (2026)
Personalized Sleep Staging Leveraging Source-free Unsupervised Domain Adaptation
di: Zhou, Yangxuan, et al.
Pubblicazione: (2024)
di: Zhou, Yangxuan, et al.
Pubblicazione: (2024)
Bidding-Aware Retrieval for Multi-Stage Consistency in Online Advertising
di: Liu, Bin, et al.
Pubblicazione: (2025)
di: Liu, Bin, et al.
Pubblicazione: (2025)
FCOS: A Two-Stage Recoverable Model Pruning Framework for Automatic Modulation Recognition
di: Lu, Yao, et al.
Pubblicazione: (2025)
di: Lu, Yao, et al.
Pubblicazione: (2025)
Growing Neural Networks: Dynamic Evolution through Gradient Descent
di: Radhakrishnan, Anil, et al.
Pubblicazione: (2025)
di: Radhakrishnan, Anil, et al.
Pubblicazione: (2025)
Disentangling the Causes of Plasticity Loss in Neural Networks
di: Lyle, Clare, et al.
Pubblicazione: (2024)
di: Lyle, Clare, et al.
Pubblicazione: (2024)
Hybrid Coordinate Descent for Efficient Neural Network Learning Using Line Search and Gradient Descent
di: Hsiao, Yen-Che, et al.
Pubblicazione: (2024)
di: Hsiao, Yen-Che, et al.
Pubblicazione: (2024)
Towards Multi-Source Domain Generalization for Sleep Staging with Noisy Labels
di: Wang, Kening, et al.
Pubblicazione: (2026)
di: Wang, Kening, et al.
Pubblicazione: (2026)
DeepStage: Learning Autonomous Defense Policies Against Multi-Stage APT Campaigns
di: Phan, Trung V., et al.
Pubblicazione: (2026)
di: Phan, Trung V., et al.
Pubblicazione: (2026)
A Unified Physics-Informed Neural Network for Modeling Coupled Electro- and Elastodynamic Wave Propagation Using Three-Stage Loss Optimization
di: Bharadwaj, Suhas Suresh, et al.
Pubblicazione: (2026)
di: Bharadwaj, Suhas Suresh, et al.
Pubblicazione: (2026)
Hitting Time Isomorphism for Multi-Stage Planning with Foundation Policies
di: Boock, Magnus Victor, et al.
Pubblicazione: (2026)
di: Boock, Magnus Victor, et al.
Pubblicazione: (2026)
SleepNetZero: Zero-Burden Zero-Shot Reliable Sleep Staging With Neural Networks Based on Ballistocardiograms
di: Li, Shuzhen, et al.
Pubblicazione: (2024)
di: Li, Shuzhen, et al.
Pubblicazione: (2024)
Resource Efficient Sleep Staging via Multi-Level Masking and Prompt Learning
di: Ai, Lejun, et al.
Pubblicazione: (2025)
di: Ai, Lejun, et al.
Pubblicazione: (2025)
Loss Patterns of Neural Networks
di: Skorokhodov, Ivan, et al.
Pubblicazione: (2019)
di: Skorokhodov, Ivan, et al.
Pubblicazione: (2019)
Documenti analoghi
-
From Condensation to Rank Collapse: A Two-Stage Analysis of Transformer Training Dynamics
di: Chen, Zheng-An, et al.
Pubblicazione: (2025) -
SGUQ: Staged Graph Convolution Neural Network for Alzheimer's Disease Diagnosis using Multi-Omics Data
di: Tao, Liang, et al.
Pubblicazione: (2024) -
Accurate Multi-Category Student Performance Forecasting at Early Stages of Online Education Using Neural Networks
di: Junejo, Naveed Ur Rehman, et al.
Pubblicazione: (2024) -
Generalization Guarantees of Gradient Descent for Multi-Layer Neural Networks
di: Wang, Puyu, et al.
Pubblicazione: (2023) -
Stochastic Gradient Descent for Two-layer Neural Networks
di: Cao, Dinghao, et al.
Pubblicazione: (2024)