Dynamic Sparse Training versus Dense Training: The Unexpected Winner in Image Corruption Robustness
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Boqian, Xiao, Qiao, Wang, Shunxin, Strisciuglio, Nicola, Pechenizkiy, Mykola, van Keulen, Maurice, Mocanu, Decebal Constantin, Mocanu, Elena |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
When Data Is Scarce: Scaling Sparse Language Models with Repeated Training
par: Wu, Boqian, et autres
Publié: (2026)
par: Wu, Boqian, et autres
Publié: (2026)
E2ENet: Dynamic Sparse Feature Fusion for Accurate and Efficient 3D Medical Image Segmentation
par: Wu, Boqian, et autres
Publié: (2023)
par: Wu, Boqian, et autres
Publié: (2023)
Memory-Efficient LLM Training with Dynamic Sparsity: From Stability to Practical Scaling
par: Xiao, Qiao, et autres
Publié: (2026)
par: Xiao, Qiao, et autres
Publié: (2026)
NeuroTrails: Training with Dynamic Sparse Heads as the Key to Effective Ensembling
par: Grooten, Bram, et autres
Publié: (2025)
par: Grooten, Bram, et autres
Publié: (2025)
Addressing the Collaboration Dilemma in Low-Data Federated Learning via Transient Sparsity
par: Xiao, Qiao, et autres
Publié: (2025)
par: Xiao, Qiao, et autres
Publié: (2025)
Adaptive Sparsity Level during Training for Efficient Time Series Forecasting with Transformers
par: Atashgahi, Zahra, et autres
Publié: (2023)
par: Atashgahi, Zahra, et autres
Publié: (2023)
Leave it to the Specialist: Repair Sparse LLMs with Sparse Fine-Tuning via Sparsity Evolution
par: Xiao, Qiao, et autres
Publié: (2025)
par: Xiao, Qiao, et autres
Publié: (2025)
Are Sparse Neural Networks Better Hard Sample Learners?
par: Xiao, Qiao, et autres
Publié: (2024)
par: Xiao, Qiao, et autres
Publié: (2024)
Deep Ensembling with No Overhead for either Training or Testing: The All-Round Blessings of Dynamic Sparsity
par: Liu, Shiwei, et autres
Publié: (2021)
par: Liu, Shiwei, et autres
Publié: (2021)
Sparse-to-Sparse Training of Diffusion Models
par: Oliveira, Inês Cardoso, et autres
Publié: (2025)
par: Oliveira, Inês Cardoso, et autres
Publié: (2025)
Unveiling the Power of Sparse Neural Networks for Feature Selection
par: Atashgahi, Zahra, et autres
Publié: (2024)
par: Atashgahi, Zahra, et autres
Publié: (2024)
Boosting Robustness in Preference-Based Reinforcement Learning with Dynamic Sparsity
par: Muslimani, Calarina, et autres
Publié: (2024)
par: Muslimani, Calarina, et autres
Publié: (2024)
Dynamic Data Pruning for Automatic Speech Recognition
par: Xiao, Qiao, et autres
Publié: (2024)
par: Xiao, Qiao, et autres
Publié: (2024)
A Survey on the Robustness of Computer Vision Models against Common Corruptions
par: Wang, Shunxin, et autres
Publié: (2023)
par: Wang, Shunxin, et autres
Publié: (2023)
You Can Have Better Graph Neural Networks by Not Training Weights at All: Finding Untrained GNNs Tickets
par: Huang, Tianjin, et autres
Publié: (2022)
par: Huang, Tianjin, et autres
Publié: (2022)
Batch Matrix-form Equations and Implementation of Multilayer Perceptrons
par: Wesselink, Wieger, et autres
Publié: (2025)
par: Wesselink, Wieger, et autres
Publié: (2025)
Fourier-basis Functions to Bridge Augmentation Gap: Rethinking Frequency Augmentation in Image Classification
par: Vaish, Puru, et autres
Publié: (2024)
par: Vaish, Puru, et autres
Publié: (2024)
Do ImageNet-trained models learn shortcuts? The impact of frequency shortcuts on generalization
par: Wang, Shunxin, et autres
Publié: (2025)
par: Wang, Shunxin, et autres
Publié: (2025)
Self-Regulated Neurogenesis for Online Data-Incremental Learning
par: Yildirim, Murat Onur, et autres
Publié: (2024)
par: Yildirim, Murat Onur, et autres
Publié: (2024)
LiMTR: Time Series Motion Prediction for Diverse Road Users through Multimodal Feature Integration
par: Oerlemans, Camiel, et autres
Publié: (2024)
par: Oerlemans, Camiel, et autres
Publié: (2024)
Dificultăți emoționale și psihosociale ale veteranilor din teatrele de operații
par: Mocanu, Sorin, et autres
Publié: (2026)
par: Mocanu, Sorin, et autres
Publié: (2026)
Generalizations of four hyperbolic-type metrics and Gromov hyperbolicity
par: Mocanu, Marcelina
Publié: (2024)
par: Mocanu, Marcelina
Publié: (2024)
Nerva: a Truly Sparse Implementation of Neural Networks
par: Wesselink, Wieger, et autres
Publié: (2024)
par: Wesselink, Wieger, et autres
Publié: (2024)
Case-level Breast Cancer Prediction for Real Hospital Settings
par: Pathak, Shreyasi, et autres
Publié: (2023)
par: Pathak, Shreyasi, et autres
Publié: (2023)
Local points on twists of $X(p)$ with applications
par: Freitas, Nuno, et autres
Publié: (2025)
par: Freitas, Nuno, et autres
Publié: (2025)
English in Spain: Education, attitudes and native‐speakerism
par: Enric Llurda, et autres
Publié: (2024)
par: Enric Llurda, et autres
Publié: (2024)
The Stochastic-Dissipative Störmer Problem-Trajectories and Radiation Patterns
par: Harko, Tiberiu, et autres
Publié: (2025)
par: Harko, Tiberiu, et autres
Publié: (2025)
Fertility preservation in cancer patients: Data collection, analysis, and continuous improvement of cryostorage
par: Edgar Mocanu, et autres
Publié: (2025)
par: Edgar Mocanu, et autres
Publié: (2025)
The Stochastic‐Dissipative Störmer Problem‐Trajectories and Radiation Patterns
par: Tiberiu Harko, et autres
Publié: (2025)
par: Tiberiu Harko, et autres
Publié: (2025)
Robust Active Learning (RoAL): Countering Dynamic Adversaries in Active Learning with Elastic Weight Consolidation
par: Fajri, Ricky Maulana, et autres
Publié: (2024)
par: Fajri, Ricky Maulana, et autres
Publié: (2024)
On Adversarial Robustness of Language Models in Transfer Learning
par: Turbal, Bohdan, et autres
Publié: (2024)
par: Turbal, Bohdan, et autres
Publié: (2024)
Self-Supervised Learning to Fly using Efficient Semantic Segmentation and Metric Depth Estimation for Low-Cost Autonomous UAVs
par: Mocanu, Sebastian, et autres
Publié: (2025)
par: Mocanu, Sebastian, et autres
Publié: (2025)
The Ptolemy-Alhazen problem and quadric surface mirror reflection
par: Fujimura, Masayo, et autres
Publié: (2021)
par: Fujimura, Masayo, et autres
Publié: (2021)
Non-trivial Integer Solutions of $x^r+y^r=Dz^p$
par: Kara, Yasemin, et autres
Publié: (2024)
par: Kara, Yasemin, et autres
Publié: (2024)
Barrlund's distance function and quasiconformal maps
par: Fujimura, Masayo, et autres
Publié: (2019)
par: Fujimura, Masayo, et autres
Publié: (2019)
HASARD: A Benchmark for Vision-Based Safe Reinforcement Learning in Embodied Agents
par: Tomilin, Tristan, et autres
Publié: (2025)
par: Tomilin, Tristan, et autres
Publié: (2025)
Everyone deserves their voice to be heard: Analyzing Predictive Gender Bias in ASR Models Applied to Dutch Speech Data
par: Raes, Rik, et autres
Publié: (2024)
par: Raes, Rik, et autres
Publié: (2024)
Efficient Exploration in Average-Reward Constrained Reinforcement Learning: Achieving Near-Optimal Regret With Posterior Sampling
par: Provodin, Danil, et autres
Publié: (2024)
par: Provodin, Danil, et autres
Publié: (2024)
FairSNA: Algorithmic Fairness in Social Network Analysis
par: Saxena, Akrati, et autres
Publié: (2022)
par: Saxena, Akrati, et autres
Publié: (2022)
Are There Exceptions to Goodhart's Law? On the Moral Justification of Fairness-Aware Machine Learning
par: Weerts, Hilde, et autres
Publié: (2022)
par: Weerts, Hilde, et autres
Publié: (2022)
Documents similaires
-
When Data Is Scarce: Scaling Sparse Language Models with Repeated Training
par: Wu, Boqian, et autres
Publié: (2026) -
E2ENet: Dynamic Sparse Feature Fusion for Accurate and Efficient 3D Medical Image Segmentation
par: Wu, Boqian, et autres
Publié: (2023) -
Memory-Efficient LLM Training with Dynamic Sparsity: From Stability to Practical Scaling
par: Xiao, Qiao, et autres
Publié: (2026) -
NeuroTrails: Training with Dynamic Sparse Heads as the Key to Effective Ensembling
par: Grooten, Bram, et autres
Publié: (2025) -
Addressing the Collaboration Dilemma in Low-Data Federated Learning via Transient Sparsity
par: Xiao, Qiao, et autres
Publié: (2025)