A Novel SIMD-Optimized Implementation for Fast and Memory-Efficient Trigonometric Computation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Goyal, Nikhil Dev, Arora, Parth |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Implementation of McMurchie-Davidson algorithm for Gaussian AO integrals suited for SIMD processors
par: Asadchev, Andrey, et autres
Publié: (2025)
par: Asadchev, Andrey, et autres
Publié: (2025)
Efficient Computation of Collatz Sequence Stopping Times: A Novel Algorithmic Approach
par: Getachew, Eyob Solomon, et autres
Publié: (2025)
par: Getachew, Eyob Solomon, et autres
Publié: (2025)
Acceleration of multi-component multiple-precision arithmetic with branch-free algorithms and SIMD vectorization
par: Kouya, Tomonori
Publié: (2026)
par: Kouya, Tomonori
Publié: (2026)
optHIM: Hybrid Iterative Methods for Continuous Optimization in PyTorch
par: Sridhar, Nikhil, et autres
Publié: (2025)
par: Sridhar, Nikhil, et autres
Publié: (2025)
Fast Large-Scale Model-Based Iterative Tomography via Exploiting Mathematical Structure, Hierarchical Optimization, Smart Initialization, and Distributed GPU Computing
par: Kumar, Dinesh, et autres
Publié: (2026)
par: Kumar, Dinesh, et autres
Publié: (2026)
A Computational Framework and Implementation of Implicit Priors in Bayesian Inverse Problems
par: Everink, Jasper M., et autres
Publié: (2025)
par: Everink, Jasper M., et autres
Publié: (2025)
Tensor Evolution: A Framework for Fast Evaluation of Tensor Computations using Recurrences
par: Absar, Javed, et autres
Publié: (2025)
par: Absar, Javed, et autres
Publié: (2025)
Towards Richer Challenge Problems for Scientific Computing Correctness
par: Sottile, Matthew, et autres
Publié: (2025)
par: Sottile, Matthew, et autres
Publié: (2025)
Odd but Error-Free FastTwoSum: More General Conditions for FastTwoSum as an Error-Free Transformation for Faithful Rounding Modes
par: Park, Sehyeok, et autres
Publié: (2026)
par: Park, Sehyeok, et autres
Publié: (2026)
LongMemory.jl: Generating, Estimating, and Forecasting Long Memory Models in Julia
par: Vera-Valdés, J. Eduardo
Publié: (2024)
par: Vera-Valdés, J. Eduardo
Publié: (2024)
Revealing Floating-Point Accumulation Orders in Software/Hardware Implementations
par: Xie, Peichen, et autres
Publié: (2024)
par: Xie, Peichen, et autres
Publié: (2024)
QMCPy: A Python Software for Randomized Low-Discrepancy Sequences, Quasi-Monte Carlo, and Fast Kernel Methods
par: Sorokin, Aleksei G
Publié: (2025)
par: Sorokin, Aleksei G
Publié: (2025)
SARIS: Accelerating Stencil Computations on Energy-Efficient RISC-V Compute Clusters with Indirect Stream Registers
par: Scheffler, Paul, et autres
Publié: (2024)
par: Scheffler, Paul, et autres
Publié: (2024)
A Monadic, Functional Implementation of Real Numbers
par: O'Connor, Russell
Publié: (2006)
par: O'Connor, Russell
Publié: (2006)
Analyzing Computational Approaches for Differential Equations: A Study of MATLAB, Mathematica, and Maple
par: Ogethakpo, Arhonefe Joseph, et autres
Publié: (2025)
par: Ogethakpo, Arhonefe Joseph, et autres
Publié: (2025)
svds-C: A Multi-Thread C Code for Computing Truncated Singular Value Decomposition
par: Feng, Xu, et autres
Publié: (2024)
par: Feng, Xu, et autres
Publié: (2024)
Performance Portable Gradient Computations Using Source Transformation
par: Liegeois, Kim, et autres
Publié: (2025)
par: Liegeois, Kim, et autres
Publié: (2025)
Efficient Implementation of Interior-Point Methods for Quantum Relative Entropy
par: Karimi, Mehdi, et autres
Publié: (2023)
par: Karimi, Mehdi, et autres
Publié: (2023)
Grassland: A Rapid Algebraic Modeling System for Million-variable Optimization
par: Li, Xihan, et autres
Publié: (2021)
par: Li, Xihan, et autres
Publié: (2021)
Implementing Multi-GPU Scientific Computing Miniapps Across Performance Portable Frameworks
par: Villalobos, Johansell, et autres
Publié: (2025)
par: Villalobos, Johansell, et autres
Publié: (2025)
Computing FFTs at Target Precision Using Lower-Precision FFTs
par: Kawakami, Shota, et autres
Publié: (2026)
par: Kawakami, Shota, et autres
Publié: (2026)
Implementation of the Emulator-based Component Analysis
par: Vladyka, Anton, et autres
Publié: (2023)
par: Vladyka, Anton, et autres
Publié: (2023)
Designing and Implementing a Generator Framework for a SIMD Abstraction Library
par: Pietrzyk, Johannes, et autres
Publié: (2024)
par: Pietrzyk, Johannes, et autres
Publié: (2024)
Memory-Efficient Recursive Evaluation of 3-Center Gaussian Integrals
par: Asadchev, Andrey, et autres
Publié: (2022)
par: Asadchev, Andrey, et autres
Publié: (2022)
An Efficient Batch Solver for the Singular Value Decomposition on GPUs
par: Abdelfattah, Ahmad, et autres
Publié: (2026)
par: Abdelfattah, Ahmad, et autres
Publié: (2026)
HOBOTAN: Efficient Higher Order Binary Optimization Solver with Tensor Networks and PyTorch
par: Yasuda, Shoya, et autres
Publié: (2024)
par: Yasuda, Shoya, et autres
Publié: (2024)
Fast computation of Ehrhart polynomials of Gelfand--Tsetlin polytopes via Macdonald reciprocity
par: Alexandersson, Per
Publié: (2026)
par: Alexandersson, Per
Publié: (2026)
Implementing a Restricted Function Space Class in Firedrake
par: Rothwell, Emma
Publié: (2024)
par: Rothwell, Emma
Publié: (2024)
Fast Mixed-Precision Real Evaluation
par: Yadrov, Artem, et autres
Publié: (2025)
par: Yadrov, Artem, et autres
Publié: (2025)
Fast Mixed-Precision Real Evaluation
par: Yadrov, Artem, et autres
Publié: (2024)
par: Yadrov, Artem, et autres
Publié: (2024)
Porting the Nonlinear Optimization Library HiOp to Accelerator-Based Hardware Architectures
par: Peles, Slaven, et autres
Publié: (2026)
par: Peles, Slaven, et autres
Publié: (2026)
Efficient Calculations for Inverse of $k$-diagonal Circulant Matrices and Cyclic Banded Matrices
par: Wang, Chen, et autres
Publié: (2024)
par: Wang, Chen, et autres
Publié: (2024)
A Fast and Scalable Pathwise-Solver for Group Lasso and Elastic Net Penalized Regression via Block-Coordinate Descent
par: Yang, James, et autres
Publié: (2024)
par: Yang, James, et autres
Publié: (2024)
The Awkward World of Python and C++
par: Goyal, Manasvi, et autres
Publié: (2023)
par: Goyal, Manasvi, et autres
Publié: (2023)
A Million-Point Fast Trajectory Optimization Solver
par: Javeed, A., et autres
Publié: (2025)
par: Javeed, A., et autres
Publié: (2025)
GlycoPy: A CasADi-based Python Framework for Hierarchical Modeling, Optimization, and Control of Bioprocesses
par: Ma, Yingjie, et autres
Publié: (2026)
par: Ma, Yingjie, et autres
Publié: (2026)
Implementation of QR factorization of tall and very skinny matrices on current GPUs
par: Thies, Jonas, et autres
Publié: (2026)
par: Thies, Jonas, et autres
Publié: (2026)
QCLAB: A Matlab Toolbox for Quantum Computing
par: Keip, Sophia, et autres
Publié: (2025)
par: Keip, Sophia, et autres
Publié: (2025)
A Graph-Based, Distributed Memory, Modeling Abstraction for Optimization
par: Cole, David L., et autres
Publié: (2025)
par: Cole, David L., et autres
Publié: (2025)
Transformations of Computational Meshes
par: Knepley, Matthew G.
Publié: (2025)
par: Knepley, Matthew G.
Publié: (2025)
Documents similaires
-
Implementation of McMurchie-Davidson algorithm for Gaussian AO integrals suited for SIMD processors
par: Asadchev, Andrey, et autres
Publié: (2025) -
Efficient Computation of Collatz Sequence Stopping Times: A Novel Algorithmic Approach
par: Getachew, Eyob Solomon, et autres
Publié: (2025) -
Acceleration of multi-component multiple-precision arithmetic with branch-free algorithms and SIMD vectorization
par: Kouya, Tomonori
Publié: (2026) -
optHIM: Hybrid Iterative Methods for Continuous Optimization in PyTorch
par: Sridhar, Nikhil, et autres
Publié: (2025) -
Fast Large-Scale Model-Based Iterative Tomography via Exploiting Mathematical Structure, Hierarchical Optimization, Smart Initialization, and Distributed GPU Computing
par: Kumar, Dinesh, et autres
Publié: (2026)