Learning Neural Networks with Sparse Activations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Awasthi, Pranjal, Dikkala, Nishanth, Kamath, Pritish, Meka, Raghu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On Convex Optimization with Semi-Sensitive Features
par: Ghazi, Badih, et autres
Publié: (2024)
par: Ghazi, Badih, et autres
Publié: (2024)
Smoothed Agnostic Learning of Halfspaces over the Hypercube
par: Kou, Yiwen, et autres
Publié: (2025)
par: Kou, Yiwen, et autres
Publié: (2025)
Sparse Linear Regression is Easy on Random Supports
par: Chandrasekaran, Gautam, et autres
Publié: (2025)
par: Chandrasekaran, Gautam, et autres
Publié: (2025)
Agnostic Learning of General ReLU Activation Using Gradient Descent
par: Awasthi, Pranjal, et autres
Publié: (2022)
par: Awasthi, Pranjal, et autres
Publié: (2022)
Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles
par: Shah, Kulin, et autres
Publié: (2024)
par: Shah, Kulin, et autres
Publié: (2024)
Differentially Private Optimization with Sparse Gradients
par: Ghazi, Badih, et autres
Publié: (2024)
par: Ghazi, Badih, et autres
Publié: (2024)
Smoothed Analysis for Learning Concepts with Low Intrinsic Dimension
par: Chandrasekaran, Gautam, et autres
Publié: (2024)
par: Chandrasekaran, Gautam, et autres
Publié: (2024)
Sample, Scrutinize and Scale: Effective Inference-Time Search by Scaling Verification
par: Zhao, Eric, et autres
Publié: (2025)
par: Zhao, Eric, et autres
Publié: (2025)
From Style to Facts: Mapping the Boundaries of Knowledge Injection with Finetuning
par: Zhao, Eric, et autres
Publié: (2025)
par: Zhao, Eric, et autres
Publié: (2025)
Simple Mechanisms for Representing, Indexing and Manipulating Concepts
par: Li, Yuanzhi, et autres
Publié: (2023)
par: Li, Yuanzhi, et autres
Publié: (2023)
StagFormer: Time Staggering Transformer Decoding for RunningLayers In Parallel
par: Cutler, Dylan, et autres
Publié: (2025)
par: Cutler, Dylan, et autres
Publié: (2025)
Reasoning with Latent Thoughts: On the Power of Looped Transformers
par: Saunshi, Nikunj, et autres
Publié: (2025)
par: Saunshi, Nikunj, et autres
Publié: (2025)
Majority Kernels: An Approach to Leverage Big Model Dynamics for Efficient Small Model Training
par: Mazzawi, Hanna, et autres
Publié: (2024)
par: Mazzawi, Hanna, et autres
Publié: (2024)
Stacking as Accelerated Gradient Descent
par: Agarwal, Naman, et autres
Publié: (2024)
par: Agarwal, Naman, et autres
Publié: (2024)
Optimizing Federated Learning using Remote Embeddings for Graph Neural Networks
par: Naman, Pranjal, et autres
Publié: (2025)
par: Naman, Pranjal, et autres
Publié: (2025)
A Implies B: Circuit Analysis in LLMs for Propositional Logical Reasoning
par: Hong, Guan Zhe, et autres
Publié: (2024)
par: Hong, Guan Zhe, et autres
Publié: (2024)
Lasso with Latents: Efficient Estimation, Covariate Rescaling, and Computational-Statistical Gaps
par: Kelner, Jonathan, et autres
Publié: (2024)
par: Kelner, Jonathan, et autres
Publié: (2024)
Revolutionizing Personalized Cancer Vaccines with NEO: Novel Epitope Optimization Using an Aggregated Feed Forward and Recurrent Neural Network with LSTM Architecture
par: Basava, Nishanth
Publié: (2024)
par: Basava, Nishanth
Publié: (2024)
The Limits of Preference Data for Post-Training
par: Zhao, Eric, et autres
Publié: (2025)
par: Zhao, Eric, et autres
Publié: (2025)
Sample-Efficient Optimization over Generative Priors via Coarse Learnability
par: Awasthi, Pranjal, et autres
Publié: (2025)
par: Awasthi, Pranjal, et autres
Publié: (2025)
Denoising the US Census: Succinct Block Hierarchical Regression
par: Ghazi, Badih, et autres
Publié: (2026)
par: Ghazi, Badih, et autres
Publié: (2026)
Indiscriminate Data Poisoning Attacks on Neural Networks
par: Lu, Yiwei, et autres
Publié: (2022)
par: Lu, Yiwei, et autres
Publié: (2022)
PREM: Privately Answering Statistical Queries with Relative Error
par: Ghazi, Badih, et autres
Publié: (2025)
par: Ghazi, Badih, et autres
Publié: (2025)
A Survey of Reinforcement Learning For Economics
par: Rawat, Pranjal
Publié: (2026)
par: Rawat, Pranjal
Publié: (2026)
Sparsely Activated Networks
par: Bizopoulos, Paschalis, et autres
Publié: (2019)
par: Bizopoulos, Paschalis, et autres
Publié: (2019)
Neural Networks with Sparse Activation Induced by Large Bias: Tighter Analysis with Bias-Generalized NTK
par: Yang, Hongru, et autres
Publié: (2023)
par: Yang, Hongru, et autres
Publié: (2023)
LASER: Low-Rank Activation SVD for Efficient Recursion
par: Çakar, Ege, et autres
Publié: (2026)
par: Çakar, Ege, et autres
Publié: (2026)
Learning a Sparse Neural Network using IHT
par: Damadi, Saeed, et autres
Publié: (2024)
par: Damadi, Saeed, et autres
Publié: (2024)
On Generalization Bounds for Deep Compound Gaussian Neural Networks
par: Lyons, Carter, et autres
Publié: (2024)
par: Lyons, Carter, et autres
Publié: (2024)
Sparse Covariance Neural Networks
par: Cavallo, Andrea, et autres
Publié: (2024)
par: Cavallo, Andrea, et autres
Publié: (2024)
MANGO: Meta-Adaptive Network Gradient Optimization for Online Continual Learning
par: Awasthi, Ankita, et autres
Publié: (2026)
par: Awasthi, Ankita, et autres
Publié: (2026)
Learning Sparse Compositional Functions with Norm-Constrained Neural Networks
par: Huang, Shuo, et autres
Publié: (2026)
par: Huang, Shuo, et autres
Publié: (2026)
Cross-fitted Proximal Learning for Model-Based Reinforcement Learning
par: Venkatesh, Nishanth, et autres
Publié: (2026)
par: Venkatesh, Nishanth, et autres
Publié: (2026)
Semiring Activation in Neural Networks
par: Smets, Bart M. N., et autres
Publié: (2024)
par: Smets, Bart M. N., et autres
Publié: (2024)
Position Coupling: Improving Length Generalization of Arithmetic Transformers Using Task Structure
par: Cho, Hanseul, et autres
Publié: (2024)
par: Cho, Hanseul, et autres
Publié: (2024)
SPARLING: Learning Latent Representations with Extremely Sparse Activations
par: Gupta, Kavi, et autres
Publié: (2023)
par: Gupta, Kavi, et autres
Publié: (2023)
Model-Based Reinforcement Learning Under Confounding
par: Venkatesh, Nishanth, et autres
Publié: (2025)
par: Venkatesh, Nishanth, et autres
Publié: (2025)
Scaling Embedding Layers in Language Models
par: Yu, Da, et autres
Publié: (2025)
par: Yu, Da, et autres
Publié: (2025)
Empirical Privacy Variance
par: Hu, Yuzheng, et autres
Publié: (2025)
par: Hu, Yuzheng, et autres
Publié: (2025)
Learning from Historical Activations in Graph Neural Networks
par: Galron, Yaniv, et autres
Publié: (2026)
par: Galron, Yaniv, et autres
Publié: (2026)
Documents similaires
-
On Convex Optimization with Semi-Sensitive Features
par: Ghazi, Badih, et autres
Publié: (2024) -
Smoothed Agnostic Learning of Halfspaces over the Hypercube
par: Kou, Yiwen, et autres
Publié: (2025) -
Sparse Linear Regression is Easy on Random Supports
par: Chandrasekaran, Gautam, et autres
Publié: (2025) -
Agnostic Learning of General ReLU Activation Using Gradient Descent
par: Awasthi, Pranjal, et autres
Publié: (2022) -
Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles
par: Shah, Kulin, et autres
Publié: (2024)