Exploring the Versal AI Engine for 3D Gaussian Splatting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shimamura, Kotaro, Ohno, Ayumi, Takamaeda-Yamazaki, Shinya |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Accelerating Elliptic Curve Point Additions on Versal AI Engine for Multi-scalar Multiplication
par: Ohno, Ayumi, et autres
Publié: (2025)
par: Ohno, Ayumi, et autres
Publié: (2025)
Accelerating CRONet on AMD Versal AIE-ML Engines
par: Mhatre, Kaustubh, et autres
Publié: (2026)
par: Mhatre, Kaustubh, et autres
Publié: (2026)
Relational Hoare Logic for High-Level Synthesis of Hardware Accelerators
par: Tanaka, Izumi, et autres
Publié: (2026)
par: Tanaka, Izumi, et autres
Publié: (2026)
GAMA: High-Performance GEMM Acceleration on AMD Versal ML-Optimized AI Engines
par: Mhatre, Kaustubh, et autres
Publié: (2025)
par: Mhatre, Kaustubh, et autres
Publié: (2025)
Enabling Mixed criticality applications for the Versal AI-Engines
par: Sprave, Vincent, et autres
Publié: (2026)
par: Sprave, Vincent, et autres
Publié: (2026)
PACiM: A Sparsity-Centric Hybrid Compute-in-Memory Architecture via Probabilistic Approximation
par: Zhang, Wenlun, et autres
Publié: (2024)
par: Zhang, Wenlun, et autres
Publié: (2024)
PUDTune: Multi-Level Charging for High-Precision Calibration in Processing-Using-DRAM
par: Kubo, Tatsuya, et autres
Publié: (2025)
par: Kubo, Tatsuya, et autres
Publié: (2025)
AMD Versal Implementations of FAM and SSCA Estimators
par: Li, Carol Jingyi, et autres
Publié: (2025)
par: Li, Carol Jingyi, et autres
Publié: (2025)
Optimizing GEMM for Energy and Performance on Versal ACAP Architectures
par: Papalamprou, Ilias, et autres
Publié: (2025)
par: Papalamprou, Ilias, et autres
Publié: (2025)
CAT: Customized Transformer Accelerator Framework on Versal ACAP
par: Zhang, Wenbo, et autres
Publié: (2024)
par: Zhang, Wenbo, et autres
Publié: (2024)
MVDRAM: Enabling GeMV Execution in Unmodified DRAM for Low-Bit LLM Acceleration
par: Kubo, Tatsuya, et autres
Publié: (2025)
par: Kubo, Tatsuya, et autres
Publié: (2025)
No Redundancy, No Stall: Lightweight Streaming 3D Gaussian Splatting for Real-time Rendering
par: Wei, Linye, et autres
Publié: (2025)
par: Wei, Linye, et autres
Publié: (2025)
Splatonic: Architecture Support for 3D Gaussian Splatting SLAM via Sparse Processing
par: Huang, Xiaotong, et autres
Publié: (2025)
par: Huang, Xiaotong, et autres
Publié: (2025)
RTGS: Real-Time 3D Gaussian Splatting SLAM via Multi-Level Redundancy Reduction
par: Li, Leshu, et autres
Publié: (2025)
par: Li, Leshu, et autres
Publié: (2025)
FLICKER: A Fine-Grained Contribution-Aware Accelerator for Real-Time 3D Gaussian Splatting
par: Ou, Wenhui, et autres
Publié: (2026)
par: Ou, Wenhui, et autres
Publié: (2026)
WideSA: A High Array Utilization Mapping Scheme for Uniform Recurrences on the Versal ACAP Architecture
par: Dai, Tuo, et autres
Publié: (2024)
par: Dai, Tuo, et autres
Publié: (2024)
Nebula: Enable City-Scale 3D Gaussian Splatting in Virtual Reality via Collaborative Rendering and Accelerated Stereo Rasterization
par: Zhu, He, et autres
Publié: (2025)
par: Zhu, He, et autres
Publié: (2025)
GEMM-GS: Accelerating 3D Gaussian Splatting on Tensor Cores with GEMM-Compatible Blending
par: Li, Haomin, et autres
Publié: (2026)
par: Li, Haomin, et autres
Publié: (2026)
LLM-Powered Code Analysis and Optimization for Gaussian Splatting Kernels
par: Hu, Yi, et autres
Publié: (2025)
par: Hu, Yi, et autres
Publié: (2025)
AGS: Accelerating 3D Gaussian Splatting SLAM via CODEC-Assisted Frame Covisibility Detection
par: He, Houshu, et autres
Publié: (2025)
par: He, Houshu, et autres
Publié: (2025)
3DGauCIM: Accelerating Static/Dynamic 3D Gaussian Splatting via Digital CIM for High Frame Rate Real-Time Edge Rendering
par: Huang, Wei-Hsing, et autres
Publié: (2025)
par: Huang, Wei-Hsing, et autres
Publié: (2025)
DPUV4E: High-Throughput DPU Architecture Design for CNN on Versal ACAP
par: Li, Guoyu, et autres
Publié: (2025)
par: Li, Guoyu, et autres
Publié: (2025)
SRAM Based Digital Custom Compute Engine for Improved Area Efficiency of AI Hardware
par: Dhakad, Narendra Singh, et autres
Publié: (2026)
par: Dhakad, Narendra Singh, et autres
Publié: (2026)
Identifying Unnecessary 3D Gaussians using Clustering for Fast Rendering of 3D Gaussian Splatting
par: Jo, Joongho, et autres
Publié: (2024)
par: Jo, Joongho, et autres
Publié: (2024)
GauRast: Enhancing GPU Triangle Rasterizers to Accelerate 3D Gaussian Splatting
par: Li, Sixu, et autres
Publié: (2025)
par: Li, Sixu, et autres
Publié: (2025)
AP-DRL: A Synergistic Algorithm-Hardware Framework for Automatic Task Partitioning of Deep Reinforcement Learning on Versal ACAP
par: Li, Enlai, et autres
Publié: (2026)
par: Li, Enlai, et autres
Publié: (2026)
IMAGine: An In-Memory Accelerated GEMV Engine Overlay
par: Kabir, MD Arafat, et autres
Publié: (2024)
par: Kabir, MD Arafat, et autres
Publié: (2024)
TransDot: An Area-efficient Reconfigurable Floating-Point Unit for Trans-Precision Dot-Product Accumulation for FPGA AI Engines
par: Wang, Jiayi, et autres
Publié: (2026)
par: Wang, Jiayi, et autres
Publié: (2026)
Tensor Memory Engine: On-the-fly Data Reorganization for Ideal Locality
par: Hoornaert, Denis, et autres
Publié: (2026)
par: Hoornaert, Denis, et autres
Publié: (2026)
STAR: An Efficient Softmax Engine for Attention Model with RRAM Crossbar
par: Zhai, Yifeng, et autres
Publié: (2024)
par: Zhai, Yifeng, et autres
Publié: (2024)
PULSE: Parametric Hardware Units for Low-power Sparsity-Aware Convolution Engine
par: Aliyev, Ilkin, et autres
Publié: (2024)
par: Aliyev, Ilkin, et autres
Publié: (2024)
EN-T: Optimizing Tensor Computing Engines Performance via Encoder-Based Methodology
par: Wu, Qizhe, et autres
Publié: (2024)
par: Wu, Qizhe, et autres
Publié: (2024)
Floating-Point Multiply-Add with Approximate Normalization for Low-Cost Matrix Engines
par: Alexandridis, Kosmas, et autres
Publié: (2024)
par: Alexandridis, Kosmas, et autres
Publié: (2024)
Revealing Untapped DSP Optimization Potentials for FPGA-Based Systolic Matrix Engines
par: Li, Jindong, et autres
Publié: (2024)
par: Li, Jindong, et autres
Publié: (2024)
TYTAN: Taylor-series based Non-Linear Activation Engine for Deep Learning Accelerators
par: Pramanik, Soham, et autres
Publié: (2025)
par: Pramanik, Soham, et autres
Publié: (2025)
LogicSparse: Enabling Engine-Free Unstructured Sparsity for Quantised Deep-learning Accelerators
par: Li, Changhong, et autres
Publié: (2025)
par: Li, Changhong, et autres
Publié: (2025)
DeMM: A Decoupled Matrix Multiplication Engine Supporting Relaxed Structured Sparsity
par: Peltekis, Christodoulos, et autres
Publié: (2024)
par: Peltekis, Christodoulos, et autres
Publié: (2024)
Neo: Real-Time On-Device 3D Gaussian Splatting with Reuse-and-Update Sorting Acceleration
par: Oh, Changhun, et autres
Publié: (2025)
par: Oh, Changhun, et autres
Publié: (2025)
A 129FPS Full HD Real-Time Accelerator for 3D Gaussian Splatting
par: Chang, Fang-Chi, et autres
Publié: (2026)
par: Chang, Fang-Chi, et autres
Publié: (2026)
Cognition Engines: A Row-Scale HVDC Architecture for Computational Continuity of AI
par: Churnock, Paul
Publié: (2025)
par: Churnock, Paul
Publié: (2025)
Documents similaires
-
Accelerating Elliptic Curve Point Additions on Versal AI Engine for Multi-scalar Multiplication
par: Ohno, Ayumi, et autres
Publié: (2025) -
Accelerating CRONet on AMD Versal AIE-ML Engines
par: Mhatre, Kaustubh, et autres
Publié: (2026) -
Relational Hoare Logic for High-Level Synthesis of Hardware Accelerators
par: Tanaka, Izumi, et autres
Publié: (2026) -
GAMA: High-Performance GEMM Acceleration on AMD Versal ML-Optimized AI Engines
par: Mhatre, Kaustubh, et autres
Publié: (2025) -
Enabling Mixed criticality applications for the Versal AI-Engines
par: Sprave, Vincent, et autres
Publié: (2026)