Risultati della ricerca - Soudry, Daniel
- Mostra 1 - 20 risultati su 29
- Vai alla pagina seguente
-
1
PLUMAGE: Probabilistic Low rank Unbiased Min Variance Gradient Estimator for Efficient Large Model Training di Haroush, Matan, Soudry, Daniel
Pubblicazione 2025Testo
Preprint -
2
Alias-Free ViT: Fractional Shift Invariance via Linear Attention di Michaeli, Hagay, Soudry, Daniel
Pubblicazione 2025Testo
Preprint -
3
Alias-Free Convnets: Fractional Shift Invariance via Polynomial Activations di Michaeli, Hagay, Michaeli, Tomer, Soudry, Daniel
Pubblicazione 2023Testo
Preprint -
4
Towards Cheaper Inference in Deep Networks with Lower Bit-Width Accumulators di Blumenfeld, Yaniv, Hubara, Itay, Soudry, Daniel
Pubblicazione 2024Testo
Preprint -
5
Minimum Variance Unbiased N:M Sparsity for the Neural Gradients di Chmiel, Brian, Hubara, Itay, Banner, Ron, Soudry, Daniel
Pubblicazione 2022Testo
Preprint -
6
Explore to Generalize in Zero-Shot RL di Zisselman, Ev, Lavie, Itai, Soudry, Daniel, Tamar, Aviv
Pubblicazione 2023Testo
Preprint -
7
Scaling FP8 training to trillion-token LLMs di Fishman, Maxim, Chmiel, Brian, Banner, Ron, Soudry, Daniel
Pubblicazione 2024Testo
Preprint -
8
Foldable SuperNets: Scalable Merging of Transformers with Different Initializations and Tasks di Kinderman, Edan, Hubara, Itay, Maron, Haggai, Soudry, Daniel
Pubblicazione 2024Testo
Preprint -
9
The Implicit Bias of Gradient Descent on Separable Multiclass Data di Ravi, Hrithik, Scott, Clayton, Soudry, Daniel, Wang, Yutong
Pubblicazione 2024Testo
Preprint -
10
FP4 All the Way: Fully Quantized Training of LLMs di Chmiel, Brian, Fishman, Maxim, Banner, Ron, Soudry, Daniel
Pubblicazione 2025Testo
Preprint -
11
Exponential Quantum Communication Advantage in Distributed Inference and Learning di Gilboa, Dar, Michaeli, Hagay, Soudry, Daniel, McClean, Jarrod R.
Pubblicazione 2023Testo
Preprint -
12
How do Minimum-Norm Shallow Denoisers Look in Function Space? di Zeno, Chen, Ongie, Greg, Blumenfeld, Yaniv, Weinberger, Nir, Soudry, Daniel
Pubblicazione 2023Testo
Preprint -
13
-
14
-
15
Tensor-Parallelism with Partially Synchronized Activations di Lamprecht, Itay, Karnieli, Asaf, Hanani, Yair, Giladi, Niv, Soudry, Daniel
Pubblicazione 2025Testo
Preprint -
16
Normalized Architectures are Natively 4-Bit di Fishman, Maxim, Chmiel, Brian, Banner, Ron, Soudry, Daniel, Ginsburg, Boris
Pubblicazione 2026Testo
Preprint -
17
Workspace Optimization: How to Train Your Agent di Sarafian, Elad, Kaplun, Gal, Banner, Ron, Soudry, Daniel, Ginsburg, Boris
Pubblicazione 2026Testo
Preprint -
18
The Implicit Bias of Gradient Descent on Separable Data di Soudry, Daniel, Hoffer, Elad, Nacson, Mor Shpigel, Gunasekar, Suriya, Srebro, Nathan
Pubblicazione 2017Testo
Preprint -
19
Accurate Neural Training with 4-bit Matrix Multiplications at Standard Formats di Chmiel, Brian, Banner, Ron, Hoffer, Elad, Yaacov, Hilla Ben, Soudry, Daniel
Pubblicazione 2021Testo
Preprint -
20
Stable Minima Cannot Overfit in Univariate ReLU Networks: Generalization by Large Step Sizes di Qiao, Dan, Zhang, Kaiqi, Singh, Esha, Soudry, Daniel, Wang, Yu-Xiang
Pubblicazione 2024Testo
Preprint