Better Schedules for Low Precision Training of Deep Neural Networks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wolfe, Cameron R., Kyrillidis, Anastasios |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adapting Multimodal Foundation Models for Few-Shot Learning: A Comprehensive Study on Contrastive Captioners
par: Narasinghe, N. K. B. M. P. K. B., et autres
Publié: (2025)
par: Narasinghe, N. K. B. M. P. K. B., et autres
Publié: (2025)
Once-For-All: A Train-Once and Select-Anytime Framework for Multimodal Instruction Tuning
par: Dong, Mingkang, et autres
Publié: (2026)
par: Dong, Mingkang, et autres
Publié: (2026)
Tiny models from tiny data: Textual and null-text inversion for few-shot distillation
par: Landolsi, Erik, et autres
Publié: (2024)
par: Landolsi, Erik, et autres
Publié: (2024)
Bridging SFT and DPO for Diffusion Model Alignment with Self-Sampling Preference Optimization
par: Zhang, Daoan, et autres
Publié: (2024)
par: Zhang, Daoan, et autres
Publié: (2024)
Efficient Neural Network Encoding for 3D Color Lookup Tables
par: Zehtab, Vahid, et autres
Publié: (2024)
par: Zehtab, Vahid, et autres
Publié: (2024)
Sample as You Infer: Predictive Coding With Langevin Dynamics
par: Zahid, Umais, et autres
Publié: (2023)
par: Zahid, Umais, et autres
Publié: (2023)
CCVA-FL: Cross-Client Variations Adaptive Federated Learning for Medical Imaging
par: Gupta, Sunny, et autres
Publié: (2024)
par: Gupta, Sunny, et autres
Publié: (2024)
Taming the Tail: Leveraging Asymmetric Loss and Pade Approximation to Overcome Medical Image Long-Tailed Class Imbalance
par: Kashyap, Pankhi, et autres
Publié: (2024)
par: Kashyap, Pankhi, et autres
Publié: (2024)
GLL: A Differentiable Graph Learning Layer for Neural Networks
par: Brown, Jason, et autres
Publié: (2024)
par: Brown, Jason, et autres
Publié: (2024)
Few-Shot Learning of a Graph-Based Neural Network Model Without Backpropagation
par: Lapin, Mykyta, et autres
Publié: (2025)
par: Lapin, Mykyta, et autres
Publié: (2025)
Reducing the Sensitivity of Neural Physics Simulators to Mesh Topology via Pretraining
par: Vaska, Nathan, et autres
Publié: (2025)
par: Vaska, Nathan, et autres
Publié: (2025)
Closed-Loop Neural Activation Control in Vision-Language-Action Models
par: Babu, Abhijith, et autres
Publié: (2026)
par: Babu, Abhijith, et autres
Publié: (2026)
EduFlow: Advancing MLLMs' Problem-Solving Proficiency through Multi-Stage, Multi-Perspective Critique
par: Zhu, Chenglin, et autres
Publié: (2025)
par: Zhu, Chenglin, et autres
Publié: (2025)
WaveMix: A Resource-efficient Neural Network for Image Analysis
par: Jeevan, Pranav, et autres
Publié: (2022)
par: Jeevan, Pranav, et autres
Publié: (2022)
Explainable Classifier for Malignant Lymphoma Subtyping via Cell Graph and Image Fusion
par: Nishiyama, Daiki, et autres
Publié: (2025)
par: Nishiyama, Daiki, et autres
Publié: (2025)
TensLoRA: Tensor Alternatives for Low-Rank Adaptation
par: Marmoret, Axel, et autres
Publié: (2025)
par: Marmoret, Axel, et autres
Publié: (2025)
Learning 3D object-centric representation through prediction
par: Day, John, et autres
Publié: (2024)
par: Day, John, et autres
Publié: (2024)
Fuzzy Convolution Neural Networks for Tabular Data Classification
par: Kulkarni, Arun D.
Publié: (2024)
par: Kulkarni, Arun D.
Publié: (2024)
GeoPos: A Minimal Positional Encoding for Enhanced Fine-Grained Details in Image Synthesis Using Convolutional Neural Networks
par: Hosseini, Mehran, et autres
Publié: (2024)
par: Hosseini, Mehran, et autres
Publié: (2024)
S-HR-VQVAE: Sequential Hierarchical Residual Learning Vector Quantized Variational Autoencoder for Video Prediction
par: Adiban, Mohammad, et autres
Publié: (2023)
par: Adiban, Mohammad, et autres
Publié: (2023)
Sparse Concept Bottleneck Models: Gumbel Tricks in Contrastive Learning
par: Semenov, Andrei, et autres
Publié: (2024)
par: Semenov, Andrei, et autres
Publié: (2024)
Efficient Attention: Attention with Linear Complexities
par: Shen, Zhuoran, et autres
Publié: (2018)
par: Shen, Zhuoran, et autres
Publié: (2018)
Human-Centric Anomaly Detection in Surveillance Videos Using YOLO-World and Spatio-Temporal Deep Learning
par: Naeen, Mohammad Ali Etemadi, et autres
Publié: (2025)
par: Naeen, Mohammad Ali Etemadi, et autres
Publié: (2025)
Perceptual Flow Network for Visually Grounded Reasoning
par: Li, Yangfu, et autres
Publié: (2026)
par: Li, Yangfu, et autres
Publié: (2026)
Lifelong Learning in Vision-Language Models: Enhanced EWC with Cross-Modal Knowledge Retention
par: Durrani, Hamza Ahmed, et autres
Publié: (2026)
par: Durrani, Hamza Ahmed, et autres
Publié: (2026)
From Basic Affordances to Symbolic Thought: A Computational Phylogenesis of Biological Intelligence
par: Hummel, John E., et autres
Publié: (2025)
par: Hummel, John E., et autres
Publié: (2025)
A Comparative Survey of PyTorch vs TensorFlow for Deep Learning: Usability, Performance, and Deployment Trade-offs
par: Alawi, Zakariya Ba
Publié: (2025)
par: Alawi, Zakariya Ba
Publié: (2025)
KGTN-ens: Few-Shot Image Classification with Knowledge Graph Ensembles
par: Filipiak, Dominik, et autres
Publié: (2022)
par: Filipiak, Dominik, et autres
Publié: (2022)
Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
par: Aida, Adriana, et autres
Publié: (2026)
par: Aida, Adriana, et autres
Publié: (2026)
RoboPack: Learning Tactile-Informed Dynamics Models for Dense Packing
par: Ai, Bo, et autres
Publié: (2024)
par: Ai, Bo, et autres
Publié: (2024)
Analyzing Quality, Bias, and Performance in Text-to-Image Generative Models
par: Masrourisaadat, Nila, et autres
Publié: (2024)
par: Masrourisaadat, Nila, et autres
Publié: (2024)
ForAug: Recombining Foregrounds and Backgrounds to Improve Vision Transformer Training with Bias Mitigation
par: Nauen, Tobias Christian, et autres
Publié: (2025)
par: Nauen, Tobias Christian, et autres
Publié: (2025)
Physics-Informed Spectral Modeling for Hyperspectral Imaging
par: Gawrysiak, Zuzanna, et autres
Publié: (2025)
par: Gawrysiak, Zuzanna, et autres
Publié: (2025)
Interpreting Structured Perturbations in Image Protection Methods for Diffusion Models
par: Martin, Michael R., et autres
Publié: (2025)
par: Martin, Michael R., et autres
Publié: (2025)
Which Backbone to Use: A Resource-efficient Domain Specific Comparison for Computer Vision
par: Jeevan, Pranav, et autres
Publié: (2024)
par: Jeevan, Pranav, et autres
Publié: (2024)
ExpReS-VLA: Specializing Vision-Language-Action Models Through Experience Replay and Retrieval
par: Syed, Shahram Najam, et autres
Publié: (2025)
par: Syed, Shahram Najam, et autres
Publié: (2025)
Flex: End-to-End Text-Instructed Visual Navigation from Foundation Model Features
par: Chahine, Makram, et autres
Publié: (2024)
par: Chahine, Makram, et autres
Publié: (2024)
FEDTAIL: Federated Long-Tailed Domain Generalization with Sharpness-Guided Gradient Matching
par: Gupta, Sunny, et autres
Publié: (2025)
par: Gupta, Sunny, et autres
Publié: (2025)
Spatially Optimized Compact Deep Metric Learning Model for Similarity Search
par: Islam, Md. Farhadul, et autres
Publié: (2024)
par: Islam, Md. Farhadul, et autres
Publié: (2024)
Ultra-Low-Latency Spiking Neural Networks with Temporal-Dependent Integrate-and-Fire Neuron Model for Objects Detection
par: Zhang, Chengjun, et autres
Publié: (2025)
par: Zhang, Chengjun, et autres
Publié: (2025)
Documents similaires
-
Adapting Multimodal Foundation Models for Few-Shot Learning: A Comprehensive Study on Contrastive Captioners
par: Narasinghe, N. K. B. M. P. K. B., et autres
Publié: (2025) -
Once-For-All: A Train-Once and Select-Anytime Framework for Multimodal Instruction Tuning
par: Dong, Mingkang, et autres
Publié: (2026) -
Tiny models from tiny data: Textual and null-text inversion for few-shot distillation
par: Landolsi, Erik, et autres
Publié: (2024) -
Bridging SFT and DPO for Diffusion Model Alignment with Self-Sampling Preference Optimization
par: Zhang, Daoan, et autres
Publié: (2024) -
Efficient Neural Network Encoding for 3D Color Lookup Tables
par: Zehtab, Vahid, et autres
Publié: (2024)