Memory-Efficient Training with In-Place FFT Implementation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ding, Xinyu, Liu, Bangtian, Liao, Siyu, Wang, Zhongfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Off-policy Evaluation with Deeply-abstracted States
par: Hao, Meiling, et autres
Publié: (2024)
par: Hao, Meiling, et autres
Publié: (2024)
Randomized Approach to Matrix Completion: Applications in Recommendation Systems and Image Inpainting
par: Krajewska, Antonina, et autres
Publié: (2024)
par: Krajewska, Antonina, et autres
Publié: (2024)
Closing the Curvature Gap: Full Transformer Hessians and Their Implications for Scaling Laws
par: Petrov, Egor, et autres
Publié: (2025)
par: Petrov, Egor, et autres
Publié: (2025)
Scalable and Interpretable Scientific Discovery via Sparse Variational Gaussian Process Kolmogorov-Arnold Networks (SVGP KAN)
par: Ju, Y. Sungtaek
Publié: (2025)
par: Ju, Y. Sungtaek
Publié: (2025)
Uncertainty Quantification for Scientific Machine Learning using Sparse Variational Gaussian Process Kolmogorov-Arnold Networks (SVGP KAN)
par: Ju, Y. Sungtaek
Publié: (2025)
par: Ju, Y. Sungtaek
Publié: (2025)
S$^3$: Structured Sparsity Specification
par: Ghriss, Ayoub
Publié: (2026)
par: Ghriss, Ayoub
Publié: (2026)
GraphPerf-RT: A Graph-Driven Performance Model for Hardware-Aware Scheduling of OpenMP Codes
par: Pivezhandi, Mohammad, et autres
Publié: (2025)
par: Pivezhandi, Mohammad, et autres
Publié: (2025)
Illuminating Patterns of Divergence: DataDios SmartDiff for Large-Scale Data Difference Analysis
par: Poduri, Aryan, et autres
Publié: (2025)
par: Poduri, Aryan, et autres
Publié: (2025)
Static Batching of Irregular Workloads on GPUs: Framework and Application to Efficient MoE Model Inference
par: Li, Yinghan, et autres
Publié: (2025)
par: Li, Yinghan, et autres
Publié: (2025)
Scattered Forest Search: Smarter Code Space Exploration with LLMs
par: Light, Jonathan, et autres
Publié: (2024)
par: Light, Jonathan, et autres
Publié: (2024)
Isotropic Activation Functions Enable Deindividuated Neurons and Adaptive Topologies
par: Bird, George
Publié: (2026)
par: Bird, George
Publié: (2026)
RANDSMAPs: Random-Feature/multi-Scale Neural Decoders with Mass Preservation
par: Patsatzis, Dimitrios G., et autres
Publié: (2026)
par: Patsatzis, Dimitrios G., et autres
Publié: (2026)
CUDABeaver: Benchmarking LLM-Based Automated CUDA Debugging
par: Li, Shiyang, et autres
Publié: (2026)
par: Li, Shiyang, et autres
Publié: (2026)
Non-convex cost functionals in boosting algorithms and methods for panel selection
par: Visentin, Marco
Publié: (2001)
par: Visentin, Marco
Publié: (2001)
CDFlow: Building Invertible Layers with Circulant and Diagonal Matrices
par: Feng, Xuchen, et autres
Publié: (2025)
par: Feng, Xuchen, et autres
Publié: (2025)
Coflex: Enhancing HW-NAS with Sparse Gaussian Processes for Efficient and Scalable DNN Accelerator Design
par: Ma, Yinhui, et autres
Publié: (2025)
par: Ma, Yinhui, et autres
Publié: (2025)
Variational Search Distributions
par: Steinberg, Daniel M., et autres
Publié: (2024)
par: Steinberg, Daniel M., et autres
Publié: (2024)
Deriving Coding-Specific Sub-Models from LLMs using Resource-Efficient Pruning
par: Puccioni, Laura, et autres
Publié: (2025)
par: Puccioni, Laura, et autres
Publié: (2025)
An objective function for order preserving hierarchical clustering
par: Bakkelund, Daniel
Publié: (2021)
par: Bakkelund, Daniel
Publié: (2021)
Bayesian Optimization in Linear Time
par: Schneider, Jesse, et autres
Publié: (2026)
par: Schneider, Jesse, et autres
Publié: (2026)
Optimizing Large Language Models for OpenAPI Code Completion
par: Petryshyn, Bohdan, et autres
Publié: (2024)
par: Petryshyn, Bohdan, et autres
Publié: (2024)
Exponential Approximation Rates and Parameter Efficiency of Learnable Bernstein Activations
par: Albool, Ibrahim, et autres
Publié: (2026)
par: Albool, Ibrahim, et autres
Publié: (2026)
Assessing the Performance-Efficiency Trade-off of Foundation Models in Probabilistic Electricity Price Forecasting
par: Lettner, Jan Niklas, et autres
Publié: (2026)
par: Lettner, Jan Niklas, et autres
Publié: (2026)
Optimizing Latent Dimension Allocation in Hierarchical VAEs: Balancing Attenuation and Information Retention for OOD Detection
par: Williamson, Dane, et autres
Publié: (2025)
par: Williamson, Dane, et autres
Publié: (2025)
Aggregating Direct and Indirect Neighbors through Graph Linear Transformations
par: Rosenhoover, Marshall, et autres
Publié: (2025)
par: Rosenhoover, Marshall, et autres
Publié: (2025)
Bayesian X-Learner: Calibrated Posterior Inference for Heterogeneous Treatment Effects under Heavy-Tailed Outcomes
par: Uehara, Eichi
Publié: (2026)
par: Uehara, Eichi
Publié: (2026)
Sprecher Networks: A Parameter-Efficient Kolmogorov-Arnold Architecture
par: Hägg, Christian, et autres
Publié: (2025)
par: Hägg, Christian, et autres
Publié: (2025)
Vectorized Adaptive Histograms for Sparse Oblique Forests
par: Lubonja, Ariel, et autres
Publié: (2026)
par: Lubonja, Ariel, et autres
Publié: (2026)
Deep Learning for Solving and Estimating Dynamic Models in Economics and Finance
par: Scheidegger, Simon
Publié: (2026)
par: Scheidegger, Simon
Publié: (2026)
Momentum Attention: The Physics of In-Context Learning and Spectral Forensics for Mechanistic Interpretability
par: Maitra, Kingsuk
Publié: (2026)
par: Maitra, Kingsuk
Publié: (2026)
Plug-and-Play Spiking Operators: Breaking the Nonlinearity Bottleneck in Spiking Transformers
par: Yuan, Xinzhe, et autres
Publié: (2026)
par: Yuan, Xinzhe, et autres
Publié: (2026)
A Comparative Analysis of Distributed Linear Solvers under Data Heterogeneity
par: Velasevic, Boris, et autres
Publié: (2023)
par: Velasevic, Boris, et autres
Publié: (2023)
Problems from Optimization and Computational Algebra Equivalent to Hilbert's Nullstellensatz
par: Bläser, Markus, et autres
Publié: (2025)
par: Bläser, Markus, et autres
Publié: (2025)
Beyond Normality: Reliable A/B Testing with Non-Gaussian Data
par: Gong, Junpeng, et autres
Publié: (2025)
par: Gong, Junpeng, et autres
Publié: (2025)
EmbeddedML: A New Optimized and Fast Machine Learning Library
par: Çalışkan, Halil Hüseyin, et autres
Publié: (2025)
par: Çalışkan, Halil Hüseyin, et autres
Publié: (2025)
BandiK: Efficient Multi-Task Decomposition Using a Multi-Bandit Framework
par: Millinghoffer, András, et autres
Publié: (2025)
par: Millinghoffer, András, et autres
Publié: (2025)
Linearization Turns Neural Operators into Function-Valued Gaussian Processes
par: Magnani, Emilia, et autres
Publié: (2024)
par: Magnani, Emilia, et autres
Publié: (2024)
Adaptive Candidate Point Thompson Sampling for High-Dimensional Bayesian Optimization
par: Fan, Donney, et autres
Publié: (2026)
par: Fan, Donney, et autres
Publié: (2026)
Towards Systematic Generalization for Power Grid Optimization Problems
par: Memon, Zeeshan, et autres
Publié: (2026)
par: Memon, Zeeshan, et autres
Publié: (2026)
Multi-frequency Neural Born Iterative Method for Solving 2-D Inverse Scattering Problems
par: Liu, Daoqi, et autres
Publié: (2024)
par: Liu, Daoqi, et autres
Publié: (2024)
Documents similaires
-
Off-policy Evaluation with Deeply-abstracted States
par: Hao, Meiling, et autres
Publié: (2024) -
Randomized Approach to Matrix Completion: Applications in Recommendation Systems and Image Inpainting
par: Krajewska, Antonina, et autres
Publié: (2024) -
Closing the Curvature Gap: Full Transformer Hessians and Their Implications for Scaling Laws
par: Petrov, Egor, et autres
Publié: (2025) -
Scalable and Interpretable Scientific Discovery via Sparse Variational Gaussian Process Kolmogorov-Arnold Networks (SVGP KAN)
par: Ju, Y. Sungtaek
Publié: (2025) -
Uncertainty Quantification for Scientific Machine Learning using Sparse Variational Gaussian Process Kolmogorov-Arnold Networks (SVGP KAN)
par: Ju, Y. Sungtaek
Publié: (2025)