oneDAL Optimization for ARM Scalable Vector Extension: Maximizing Efficiency for High-Performance Data Science
Fuente:
arXiv
Salvato in:
| Autori principali: | Sharma, Chandan, GB, Rakshith, Patel, Ajay Kumar, Lal, Dhanus M, Patel, Darshan, Hajela, Ragesh, Doteguchi, Masahiro, Sharma, Priyanka |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Performance Optimization of 3D Stencil Computation on ARM Scalable Vector Extension
di: Chen, Hongguang
Pubblicazione: (2025)
di: Chen, Hongguang
Pubblicazione: (2025)
Comparison of Vectorization Capabilities of Different Compilers for X86 and ARM CPUs
di: Sakib, Nazmus, et al.
Pubblicazione: (2025)
di: Sakib, Nazmus, et al.
Pubblicazione: (2025)
FLEXIS: FLEXible Frequent Subgraph Mining using Maximal Independent Sets
di: Sharma, Akshit, et al.
Pubblicazione: (2024)
di: Sharma, Akshit, et al.
Pubblicazione: (2024)
Scalable Packed Layouts for Vector-Length-Agnostic ML Code Generation
di: Beysel, Ege, et al.
Pubblicazione: (2026)
di: Beysel, Ege, et al.
Pubblicazione: (2026)
Acceleration and energy consumption optimization in cascading classifiers for face detection on low-cost ARM big.LITTLE asymmetric architectures
di: Corpas, Alberto, et al.
Pubblicazione: (2024)
di: Corpas, Alberto, et al.
Pubblicazione: (2024)
Embedding Retrofitting: Data Engineering for better RAG
di: Sharma, Anantha
Pubblicazione: (2026)
di: Sharma, Anantha
Pubblicazione: (2026)
Dancing with a Robot: An Experimental Study of Child-Robot Interaction in a Performative Art Setting
di: Ngo, Victor, et al.
Pubblicazione: (2025)
di: Ngo, Victor, et al.
Pubblicazione: (2025)
Biases in Edge Language Models: Detection, Analysis, and Mitigation
di: Sharma, Vinamra, et al.
Pubblicazione: (2025)
di: Sharma, Vinamra, et al.
Pubblicazione: (2025)
On the Performance of Cloud-based ARM SVE for Zero-Knowledge Proving Systems
di: Loghin, Dumitrel, et al.
Pubblicazione: (2025)
di: Loghin, Dumitrel, et al.
Pubblicazione: (2025)
Performance Evaluation of CMOS Annealing with Support Vector Machine
di: Fukuhara, Ryoga, et al.
Pubblicazione: (2024)
di: Fukuhara, Ryoga, et al.
Pubblicazione: (2024)
Beamforming-based Achievable Rate Maximization in ISAC System for Multi-UAV Networking
di: Zhou, Shengcai, et al.
Pubblicazione: (2025)
di: Zhou, Shengcai, et al.
Pubblicazione: (2025)
Accurate and Scalable Many-Node Simulation
di: Eyerman, Stijn, et al.
Pubblicazione: (2024)
di: Eyerman, Stijn, et al.
Pubblicazione: (2024)
From HNSW to Information-Theoretic Binarization: Rethinking the Architecture of Scalable Vector Search
di: Abtahi, Seyed Moein, et al.
Pubblicazione: (2025)
di: Abtahi, Seyed Moein, et al.
Pubblicazione: (2025)
A Hybrid Heuristic Framework for Resource-Efficient Querying of Scientific Experiments Data
di: Patel, Mayank, et al.
Pubblicazione: (2025)
di: Patel, Mayank, et al.
Pubblicazione: (2025)
FlipFlop: A Static Analysis-based Energy Optimization Framework for GPU Kernels
di: Rajput, Saurabhsingh, et al.
Pubblicazione: (2026)
di: Rajput, Saurabhsingh, et al.
Pubblicazione: (2026)
Toward Efficient and Scalable Design of In-Memory Graph-Based Vector Search
di: Azizi, Ilias, et al.
Pubblicazione: (2025)
di: Azizi, Ilias, et al.
Pubblicazione: (2025)
RAVE: RISC-V Analyzer of Vector Executions, a QEMU tracing plugin
di: Vizcaino, Pablo, et al.
Pubblicazione: (2024)
di: Vizcaino, Pablo, et al.
Pubblicazione: (2024)
On Combining Two Server Control Policies for Energy Efficiency
di: Dai, Jingze, et al.
Pubblicazione: (2025)
di: Dai, Jingze, et al.
Pubblicazione: (2025)
DSO: A GPU Energy Efficiency Optimizer by Fusing Dynamic and Static Information
di: Wang, Qiang, et al.
Pubblicazione: (2024)
di: Wang, Qiang, et al.
Pubblicazione: (2024)
Flashlight: PyTorch Compiler Extensions to Accelerate Attention Variants
di: You, Bozhi, et al.
Pubblicazione: (2025)
di: You, Bozhi, et al.
Pubblicazione: (2025)
Energy Efficiency Analysis of Active RIS-enhanced Wireless Network under Power-Sum Constraint
di: Xin, Jingdie, et al.
Pubblicazione: (2025)
di: Xin, Jingdie, et al.
Pubblicazione: (2025)
AI Work Quantization Model: Closed-System AI Computational Effort Metric
di: Sharma, Aasish Kumar, et al.
Pubblicazione: (2025)
di: Sharma, Aasish Kumar, et al.
Pubblicazione: (2025)
LLM-Driven Design Space Exploration of FPGA-based Accelerators
di: Sharma, Vinamra, et al.
Pubblicazione: (2026)
di: Sharma, Vinamra, et al.
Pubblicazione: (2026)
Scalable Software as a Service Architecture
di: Dedase, Ardy
Pubblicazione: (2024)
di: Dedase, Ardy
Pubblicazione: (2024)
Graph-Based Vector Search: An Experimental Evaluation of the State-of-the-Art
di: Azizi, Ilias, et al.
Pubblicazione: (2025)
di: Azizi, Ilias, et al.
Pubblicazione: (2025)
GPT-OSS-20B: A Comprehensive Deployment-Centric Analysis of OpenAI's Open-Weight Mixture of Experts Model
di: Kumar, Deepak, et al.
Pubblicazione: (2025)
di: Kumar, Deepak, et al.
Pubblicazione: (2025)
Scalable Scheduling Policies for Quantum Satellite Networks
di: Williams, Albert, et al.
Pubblicazione: (2024)
di: Williams, Albert, et al.
Pubblicazione: (2024)
A Comparison of the Performance of the Molecular Dynamics Simulation Package GROMACS Implemented in the SYCL and CUDA Programming Models
di: Apanasevich, L., et al.
Pubblicazione: (2024)
di: Apanasevich, L., et al.
Pubblicazione: (2024)
Scalable Binary CUR Low-Rank Approximation Algorithm
di: Su, Bowen
Pubblicazione: (2025)
di: Su, Bowen
Pubblicazione: (2025)
Enhanced Scalability in Assessing Quantum Integer Factorization Performance
di: Lee, Junseo
Pubblicazione: (2023)
di: Lee, Junseo
Pubblicazione: (2023)
Towards a Higher Roofline for Matrix-Vector Multiplication in Matrix-Free HOSFEM
di: Cao, Zijian, et al.
Pubblicazione: (2025)
di: Cao, Zijian, et al.
Pubblicazione: (2025)
On the Sustainability of AI Inferences in the Edge
di: Sobhani, Ghazal, et al.
Pubblicazione: (2025)
di: Sobhani, Ghazal, et al.
Pubblicazione: (2025)
It's Not Easy Being Green: On the Energy Efficiency of Programming Languages
di: van Kempen, Nicolas, et al.
Pubblicazione: (2024)
di: van Kempen, Nicolas, et al.
Pubblicazione: (2024)
Hyperdimensional Computing for Sustainable Manufacturing: An Initial Assessment
di: Hoang, Danny, et al.
Pubblicazione: (2025)
di: Hoang, Danny, et al.
Pubblicazione: (2025)
A Scalable k-Medoids Clustering via Whale Optimization Algorithm
di: Chenan, Huang, et al.
Pubblicazione: (2024)
di: Chenan, Huang, et al.
Pubblicazione: (2024)
Delegation with Trust<T>: A Scalable, Type- and Memory-Safe Alternative to Locks
di: Ahmad, Noaman, et al.
Pubblicazione: (2024)
di: Ahmad, Noaman, et al.
Pubblicazione: (2024)
VDTuner: Automated Performance Tuning for Vector Data Management Systems
di: Yang, Tiannuo, et al.
Pubblicazione: (2024)
di: Yang, Tiannuo, et al.
Pubblicazione: (2024)
How to Increase Energy Efficiency with a Single Linux Command
di: Jelvani, Alborz, et al.
Pubblicazione: (2025)
di: Jelvani, Alborz, et al.
Pubblicazione: (2025)
LLM-Vectorizer: LLM-based Verified Loop Vectorizer
di: Taneja, Jubi, et al.
Pubblicazione: (2024)
di: Taneja, Jubi, et al.
Pubblicazione: (2024)
SweetSpot: An Analytical Model for Predicting Energy Efficiency of LLM Inference
di: Cavagna, Hiari Pizzini, et al.
Pubblicazione: (2026)
di: Cavagna, Hiari Pizzini, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Performance Optimization of 3D Stencil Computation on ARM Scalable Vector Extension
di: Chen, Hongguang
Pubblicazione: (2025) -
Comparison of Vectorization Capabilities of Different Compilers for X86 and ARM CPUs
di: Sakib, Nazmus, et al.
Pubblicazione: (2025) -
FLEXIS: FLEXible Frequent Subgraph Mining using Maximal Independent Sets
di: Sharma, Akshit, et al.
Pubblicazione: (2024) -
Scalable Packed Layouts for Vector-Length-Agnostic ML Code Generation
di: Beysel, Ege, et al.
Pubblicazione: (2026) -
Acceleration and energy consumption optimization in cascading classifiers for face detection on low-cost ARM big.LITTLE asymmetric architectures
di: Corpas, Alberto, et al.
Pubblicazione: (2024)