Truncated multiplication and batch software SIMD AVX512 implementation for faster Montgomery multiplications and modular exponentiation
Fuente:
arXiv
Salvato in:
| Autori principali: | Didier, Laurent-Stéphane, Mrabet, Nadia, Glandus, Léa, Robert, Jean-Marc |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Residue Number System Comparison revisited, a software perspective
di: Didier, Laurent-Stéphane, et al.
Pubblicazione: (2026)
di: Didier, Laurent-Stéphane, et al.
Pubblicazione: (2026)
RISC-V Word-Size Modular Instructions for Residue Number Systems
di: Didier, Laurent-Stéphane, et al.
Pubblicazione: (2024)
di: Didier, Laurent-Stéphane, et al.
Pubblicazione: (2024)
A Study of Performance Programming of CPU, GPU accelerated Computers and SIMD Architecture
di: Yi, Xinyao
Pubblicazione: (2024)
di: Yi, Xinyao
Pubblicazione: (2024)
Leveraging SIMD for Accelerating Large-number Arithmetic
di: Das, Subhrajit, et al.
Pubblicazione: (2026)
di: Das, Subhrajit, et al.
Pubblicazione: (2026)
A sparsity-aware distributed-memory algorithm for sparse-sparse matrix multiplication
di: Hong, Yuxi, et al.
Pubblicazione: (2024)
di: Hong, Yuxi, et al.
Pubblicazione: (2024)
Accelerating high-order continuum kinetic plasma simulations using multiple GPUs
di: Ho, Andrew, et al.
Pubblicazione: (2024)
di: Ho, Andrew, et al.
Pubblicazione: (2024)
Hiding Communication Cost in Distributed LLM Training via Micro-batch Co-execution
di: Wang, Haiquan, et al.
Pubblicazione: (2024)
di: Wang, Haiquan, et al.
Pubblicazione: (2024)
A task-based data-flow methodology for programming heterogeneous systems with multiple accelerator APIs
di: Boné, Aleix, et al.
Pubblicazione: (2026)
di: Boné, Aleix, et al.
Pubblicazione: (2026)
Accelerating Optimal Power Flow with GPUs: SIMD Abstraction of Nonlinear Programs and Condensed-Space Interior-Point Methods
di: Shin, Sungho, et al.
Pubblicazione: (2023)
di: Shin, Sungho, et al.
Pubblicazione: (2023)
Task queue implementation for edge computing platform
di: Maksimovic, Veljko, et al.
Pubblicazione: (2024)
di: Maksimovic, Veljko, et al.
Pubblicazione: (2024)
Flotilla: A scalable, modular and resilient federated learning framework for heterogeneous resources
di: Banerjee, Roopkatha, et al.
Pubblicazione: (2025)
di: Banerjee, Roopkatha, et al.
Pubblicazione: (2025)
Breaking through the $Ω(n)$-space barrier: Population Protocols Decide Double-exponential Thresholds
di: Czerner, Philipp
Pubblicazione: (2022)
di: Czerner, Philipp
Pubblicazione: (2022)
Towards Designing an Energy Aware Data Replication Strategy for Cloud Systems Using Reinforcement Learning
di: Najjar, Amir, et al.
Pubblicazione: (2025)
di: Najjar, Amir, et al.
Pubblicazione: (2025)
RadixMLP -- Intra-batch Deduplication for Causal Transformers
di: Feil, Michael, et al.
Pubblicazione: (2026)
di: Feil, Michael, et al.
Pubblicazione: (2026)
Effective implementation of the High Performance Conjugate Gradient benchmark on GraphBLAS
di: Scolari, Alberto, et al.
Pubblicazione: (2023)
di: Scolari, Alberto, et al.
Pubblicazione: (2023)
Sedna: Sharding transactions in multiple concurrent proposer blockchains
di: Ranchal-Pedrosa, Alejandro, et al.
Pubblicazione: (2025)
di: Ranchal-Pedrosa, Alejandro, et al.
Pubblicazione: (2025)
Blockchain in a box: A portable blockchain network implementation on Raspberry Pi's
di: Piškorec, Matija, et al.
Pubblicazione: (2024)
di: Piškorec, Matija, et al.
Pubblicazione: (2024)
Truncated Non-Uniform Quantization for Distributed SGD
di: Yan, Guangfeng, et al.
Pubblicazione: (2024)
di: Yan, Guangfeng, et al.
Pubblicazione: (2024)
Arbitrageurs' profits, LVR, and sandwich attacks: batch trading as an AMM design response
di: Canidio, Andrea, et al.
Pubblicazione: (2023)
di: Canidio, Andrea, et al.
Pubblicazione: (2023)
Scalability of 3D-DFT by block tensor-matrix multiplication on the JUWELS Cluster
di: Malapally, Nitin, et al.
Pubblicazione: (2023)
di: Malapally, Nitin, et al.
Pubblicazione: (2023)
Towards Efficient Verification of Parallel Applications with Mc SimGrid
di: Laurent, Matthieu, et al.
Pubblicazione: (2025)
di: Laurent, Matthieu, et al.
Pubblicazione: (2025)
Polynomial Time Local Decision Revisited
di: Feuilloley, Laurent, et al.
Pubblicazione: (2026)
di: Feuilloley, Laurent, et al.
Pubblicazione: (2026)
How local constraints influence network diameter and applications to LCL generalizations
di: Bousquet, Nicolas, et al.
Pubblicazione: (2024)
di: Bousquet, Nicolas, et al.
Pubblicazione: (2024)
LCI: a Lightweight Communication Interface for Efficient Asynchronous Multithreaded Communication
di: Yan, Jiakun, et al.
Pubblicazione: (2025)
di: Yan, Jiakun, et al.
Pubblicazione: (2025)
Contemplating a Lightweight Communication Interface for Asynchronous Many-Task Systems
di: Yan, Jiakun, et al.
Pubblicazione: (2025)
di: Yan, Jiakun, et al.
Pubblicazione: (2025)
Not eXactly Byzantine: Efficient and Resilient TEE-Based State Machine Replication
di: Leinweber, Marc, et al.
Pubblicazione: (2025)
di: Leinweber, Marc, et al.
Pubblicazione: (2025)
Proving there is a leader without naming it
di: Feuilloley, Laurent, et al.
Pubblicazione: (2025)
di: Feuilloley, Laurent, et al.
Pubblicazione: (2025)
VMT19937: A SIMD-Friendly Pseudo Random Number Generator based on Mersenne Twister 19937
di: Cannizzo, Fabio
Pubblicazione: (2023)
di: Cannizzo, Fabio
Pubblicazione: (2023)
Examining MPI and its Extensions for Asynchronous Multithreaded Communication
di: Yan, Jiakun, et al.
Pubblicazione: (2025)
di: Yan, Jiakun, et al.
Pubblicazione: (2025)
General Convex Agreement with Near-Optimal Communication
di: Dufay, Marc, et al.
Pubblicazione: (2026)
di: Dufay, Marc, et al.
Pubblicazione: (2026)
Understanding the Communication Needs of Asynchronous Many-Task Systems -- A Case Study of HPX+LCI
di: Yan, Jiakun, et al.
Pubblicazione: (2025)
di: Yan, Jiakun, et al.
Pubblicazione: (2025)
Multithreaded Fine-Grained Asynchronous BSP for Integer Sorting with LCI and OpenMP
di: Cheng, Minyu, et al.
Pubblicazione: (2026)
di: Cheng, Minyu, et al.
Pubblicazione: (2026)
Preliminary report: Initial evaluation of StdPar implementations on AMD GPUs for HPC
di: Lin, Wei-Chen, et al.
Pubblicazione: (2024)
di: Lin, Wei-Chen, et al.
Pubblicazione: (2024)
Evaluation of computational and energy performance in matrix multiplication algorithms on CPU and GPU using MKL, cuBLAS and SYCL
di: Torres, L. A., et al.
Pubblicazione: (2024)
di: Torres, L. A., et al.
Pubblicazione: (2024)
Decreasing verification radius in local certification
di: Feuilloley, Laurent, et al.
Pubblicazione: (2024)
di: Feuilloley, Laurent, et al.
Pubblicazione: (2024)
Dissecting the software-based measurement of CPU energy consumption: a comparative analysis
di: Raffin, Guillaume, et al.
Pubblicazione: (2024)
di: Raffin, Guillaume, et al.
Pubblicazione: (2024)
Round and Resilience-Optimal Approximate Agreement on Trees and Block Graphs
di: Fuchs, Marc, et al.
Pubblicazione: (2025)
di: Fuchs, Marc, et al.
Pubblicazione: (2025)
Validity in Network-Agnostic Byzantine Agreement
di: Constantinescu, Andrei, et al.
Pubblicazione: (2024)
di: Constantinescu, Andrei, et al.
Pubblicazione: (2024)
From Few to Many Faults: Optimal Adaptive Byzantine Agreement
di: Constantinescu, Andrei, et al.
Pubblicazione: (2025)
di: Constantinescu, Andrei, et al.
Pubblicazione: (2025)
Byzantine Stable Matching
di: Constantinescu, Andrei, et al.
Pubblicazione: (2025)
di: Constantinescu, Andrei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Residue Number System Comparison revisited, a software perspective
di: Didier, Laurent-Stéphane, et al.
Pubblicazione: (2026) -
RISC-V Word-Size Modular Instructions for Residue Number Systems
di: Didier, Laurent-Stéphane, et al.
Pubblicazione: (2024) -
A Study of Performance Programming of CPU, GPU accelerated Computers and SIMD Architecture
di: Yi, Xinyao
Pubblicazione: (2024) -
Leveraging SIMD for Accelerating Large-number Arithmetic
di: Das, Subhrajit, et al.
Pubblicazione: (2026) -
A sparsity-aware distributed-memory algorithm for sparse-sparse matrix multiplication
di: Hong, Yuxi, et al.
Pubblicazione: (2024)