Caspar: CUDA Accelerator for Symbolic Programming with Adaptive Reordering
Fuente:
arXiv
Salvato in:
| Autori principali: | Martens, Emil, Miller, Aaron, Varnum, Matias, Stahl, Annette |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Motion-to-Motion Latency Measurement Framework for Connected and Autonomous Vehicle Teleoperation
di: Provost, François, et al.
Pubblicazione: (2025)
di: Provost, François, et al.
Pubblicazione: (2025)
Dancing with a Robot: An Experimental Study of Child-Robot Interaction in a Performative Art Setting
di: Ngo, Victor, et al.
Pubblicazione: (2025)
di: Ngo, Victor, et al.
Pubblicazione: (2025)
Muninn: Your Trajectory Diffusion Model But Faster
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2026)
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2026)
Robust stability of moving horizon estimation for nonlinear systems with bounded disturbances using adaptive arrival cost
di: Deniz, Nestor N., et al.
Pubblicazione: (2019)
di: Deniz, Nestor N., et al.
Pubblicazione: (2019)
PyBatchRender: A Python Library for Batched 3D Rendering at Up to One Million FPS
di: Rudakov, Evgenii, et al.
Pubblicazione: (2026)
di: Rudakov, Evgenii, et al.
Pubblicazione: (2026)
A Comparison of the Performance of the Molecular Dynamics Simulation Package GROMACS Implemented in the SYCL and CUDA Programming Models
di: Apanasevich, L., et al.
Pubblicazione: (2024)
di: Apanasevich, L., et al.
Pubblicazione: (2024)
Characterizing VLA Models: Identifying the Action Generation Bottleneck for Edge AI Architectures
di: Vishwanathan, Manoj, et al.
Pubblicazione: (2026)
di: Vishwanathan, Manoj, et al.
Pubblicazione: (2026)
Stochastic Q-learning for Large Discrete Action Spaces
di: Fourati, Fares, et al.
Pubblicazione: (2024)
di: Fourati, Fares, et al.
Pubblicazione: (2024)
Kino-PAX: Highly Parallel Kinodynamic Sampling-based Planner
di: Perrault, Nicolas, et al.
Pubblicazione: (2024)
di: Perrault, Nicolas, et al.
Pubblicazione: (2024)
How Cars Move: Analyzing Driving Dynamics for Safer Urban Traffic
di: Qian, Kangan, et al.
Pubblicazione: (2024)
di: Qian, Kangan, et al.
Pubblicazione: (2024)
Is Sparse Matrix Reordering Effective for Sparse Matrix-Vector Multiplication?
di: Asudeh, Omid, et al.
Pubblicazione: (2025)
di: Asudeh, Omid, et al.
Pubblicazione: (2025)
Can Graph Reordering Speed Up Graph Neural Network Training? An Experimental Study
di: Merkel, Nikolai, et al.
Pubblicazione: (2024)
di: Merkel, Nikolai, et al.
Pubblicazione: (2024)
AutoSAGE: Input-Aware CUDA Scheduling for Sparse GNN Aggregation (SpMM/SDDMM) and CSR Attention
di: Stankovic, Aleksandar
Pubblicazione: (2025)
di: Stankovic, Aleksandar
Pubblicazione: (2025)
Kevin: Multi-Turn RL for Generating CUDA Kernels
di: Baronio, Carlo, et al.
Pubblicazione: (2025)
di: Baronio, Carlo, et al.
Pubblicazione: (2025)
Scaling Multi Agent Reinforcement Learning for Underwater Acoustic Tracking via Autonomous Vehicles
di: Gallici, Matteo, et al.
Pubblicazione: (2025)
di: Gallici, Matteo, et al.
Pubblicazione: (2025)
Fast Entropy Decoding for Sparse MVM on GPUs
di: Schätzle, Emil, et al.
Pubblicazione: (2026)
di: Schätzle, Emil, et al.
Pubblicazione: (2026)
Efficient Transpilation of OpenQASM 3.0 Dynamic Circuits to CUDA-Q: Performance and Expressiveness Advantages
di: Kulkarni, Vinooth, et al.
Pubblicazione: (2026)
di: Kulkarni, Vinooth, et al.
Pubblicazione: (2026)
Sawtooth Wavefront Reordering: Enhanced CuTile FlashAttention on NVIDIA GB10
di: Zhu, Yifan, et al.
Pubblicazione: (2026)
di: Zhu, Yifan, et al.
Pubblicazione: (2026)
Women in the Silent Cinema
di: Förster, Annette
Pubblicazione: (2020)
di: Förster, Annette
Pubblicazione: (2020)
TINA: Acceleration of Non-NN Signal Processing Algorithms Using NN Accelerators
di: Boerkamp, Christiaan, et al.
Pubblicazione: (2024)
di: Boerkamp, Christiaan, et al.
Pubblicazione: (2024)
PASTA: A Modular Program Analysis Tool Framework for Accelerators
di: Lin, Mao, et al.
Pubblicazione: (2026)
di: Lin, Mao, et al.
Pubblicazione: (2026)
Accelerated Feature Detectors for Visual SLAM: A Comparative Study of FPGA vs GPU
di: Ye, Ruiqi, et al.
Pubblicazione: (2025)
di: Ye, Ruiqi, et al.
Pubblicazione: (2025)
Robust Hole-Detection in Triangular Meshes Irrespective of the Presence of Singular Vertices
di: Yip, Mauhing, et al.
Pubblicazione: (2023)
di: Yip, Mauhing, et al.
Pubblicazione: (2023)
CuSfM: CUDA-Accelerated Structure-from-Motion
di: Yu, Jingrui, et al.
Pubblicazione: (2025)
di: Yu, Jingrui, et al.
Pubblicazione: (2025)
Tempus: A Temporally Scalable Resource-Invariant GEMM Streaming Framework for Versal AI Edge
di: Grailoo, M., et al.
Pubblicazione: (2026)
di: Grailoo, M., et al.
Pubblicazione: (2026)
Numerical Kernels on a Spatial Accelerator: A Study of Tenstorrent Wormhole
di: Taylor, Maya, et al.
Pubblicazione: (2026)
di: Taylor, Maya, et al.
Pubblicazione: (2026)
Optimal local storage policy based on stochastic intensities and its large scale behavior
di: Carrasco, Matias, et al.
Pubblicazione: (2024)
di: Carrasco, Matias, et al.
Pubblicazione: (2024)
AFarePart: Accuracy-aware Fault-resilient Partitioner for DNN Edge Accelerators
di: Debnath, Mukta, et al.
Pubblicazione: (2025)
di: Debnath, Mukta, et al.
Pubblicazione: (2025)
CUDA-Accelerated Soft Robot Neural Evolution with Large Language Model Supervision
di: Zhang, Lechen
Pubblicazione: (2024)
di: Zhang, Lechen
Pubblicazione: (2024)
snnTrans-DHZ: A Lightweight Spiking Neural Network Architecture for Underwater Image Dehazing
di: Sudevan, Vidya, et al.
Pubblicazione: (2025)
di: Sudevan, Vidya, et al.
Pubblicazione: (2025)
Dynamic Precision Math Engine for Linear Algebra and Trigonometry Acceleration on Xtensa LX6 Microcontrollers
di: Preciado, Elian Alfonso Lopez
Pubblicazione: (2026)
di: Preciado, Elian Alfonso Lopez
Pubblicazione: (2026)
Accelerating Diffusion LLMs via Adaptive Parallel Decoding
di: Israel, Daniel, et al.
Pubblicazione: (2025)
di: Israel, Daniel, et al.
Pubblicazione: (2025)
cuTeSpMM: Accelerating Sparse-Dense Matrix Multiplication using GPU Tensor Cores
di: Xiang, Lizhi, et al.
Pubblicazione: (2025)
di: Xiang, Lizhi, et al.
Pubblicazione: (2025)
Accelerating Vertical Federated Learning
di: Cai, Dongqi, et al.
Pubblicazione: (2022)
di: Cai, Dongqi, et al.
Pubblicazione: (2022)
Accelerating Machine Learning Queries with Linear Algebra Query Processing
di: Sun, Wenbo, et al.
Pubblicazione: (2023)
di: Sun, Wenbo, et al.
Pubblicazione: (2023)
Acceleration and energy consumption optimization in cascading classifiers for face detection on low-cost ARM big.LITTLE asymmetric architectures
di: Corpas, Alberto, et al.
Pubblicazione: (2024)
di: Corpas, Alberto, et al.
Pubblicazione: (2024)
GraphMini: Accelerating Graph Pattern Matching Using Auxiliary Graphs
di: Liu, Juelin, et al.
Pubblicazione: (2024)
di: Liu, Juelin, et al.
Pubblicazione: (2024)
Ecoscape: Fault Tolerance Benchmark for Adaptive Remediation Strategies in Real-Time Edge ML
di: Reiter, Hendrik, et al.
Pubblicazione: (2025)
di: Reiter, Hendrik, et al.
Pubblicazione: (2025)
Characterizing Adaptive Mesh Refinement on Heterogeneous Platforms with Parthenon-VIBE
di: Poptani, Akash, et al.
Pubblicazione: (2025)
di: Poptani, Akash, et al.
Pubblicazione: (2025)
GPU-Accelerated Parallel Selected Inversion for Structured Matrices Using sTiles
di: Fattah, Esmail Abdul, et al.
Pubblicazione: (2025)
di: Fattah, Esmail Abdul, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Motion-to-Motion Latency Measurement Framework for Connected and Autonomous Vehicle Teleoperation
di: Provost, François, et al.
Pubblicazione: (2025) -
Dancing with a Robot: An Experimental Study of Child-Robot Interaction in a Performative Art Setting
di: Ngo, Victor, et al.
Pubblicazione: (2025) -
Muninn: Your Trajectory Diffusion Model But Faster
di: Puthumanaillam, Gokul, et al.
Pubblicazione: (2026) -
Robust stability of moving horizon estimation for nonlinear systems with bounded disturbances using adaptive arrival cost
di: Deniz, Nestor N., et al.
Pubblicazione: (2019) -
PyBatchRender: A Python Library for Batched 3D Rendering at Up to One Million FPS
di: Rudakov, Evgenii, et al.
Pubblicazione: (2026)