Analyzing Modern NVIDIA GPU cores
Fuente:
arXiv
Salvato in:
| Autori principali: | Huerta, Rodrigo, Shoushtary, Mojtaba Abaie, Cruz, José-Lorenzo, González, Antonio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Analyzing and Improving Hardware Modeling of Accel-Sim
di: Huerta, Rodrigo, et al.
Pubblicazione: (2024)
di: Huerta, Rodrigo, et al.
Pubblicazione: (2024)
Control Flow Management in Modern GPUs
di: Shoushtary, Mojtaba Abaie, et al.
Pubblicazione: (2024)
di: Shoushtary, Mojtaba Abaie, et al.
Pubblicazione: (2024)
Thermal Analysis for NVIDIA GTX480 Fermi GPU Architecture
di: Nagendra, Savinay
Pubblicazione: (2024)
di: Nagendra, Savinay
Pubblicazione: (2024)
Parallelizing a modern GPU simulator
di: Huerta, Rodrigo, et al.
Pubblicazione: (2025)
di: Huerta, Rodrigo, et al.
Pubblicazione: (2025)
Microbenchmarking NVIDIA's Blackwell Architecture: An in-depth Architectural Analysis
di: Jarmusch, Aaron, et al.
Pubblicazione: (2025)
di: Jarmusch, Aaron, et al.
Pubblicazione: (2025)
FTTN: Feature-Targeted Testing for Numerical Properties of NVIDIA & AMD Matrix Accelerators
di: Li, Xinyi, et al.
Pubblicazione: (2024)
di: Li, Xinyi, et al.
Pubblicazione: (2024)
Design of a GPU with Heterogeneous Cores for Graphics
di: Tomás, Aurora, et al.
Pubblicazione: (2026)
di: Tomás, Aurora, et al.
Pubblicazione: (2026)
Towards Efficient LUT-based PIM: A Scalable and Low-Power Approach for Modern Workloads
di: Khabbazan, Bahareh, et al.
Pubblicazione: (2025)
di: Khabbazan, Bahareh, et al.
Pubblicazione: (2025)
How Much Progress Has There Been in NVIDIA Datacenter GPUs?
di: Del Sozzo, Emanuele, et al.
Pubblicazione: (2026)
di: Del Sozzo, Emanuele, et al.
Pubblicazione: (2026)
CXL-GPU: Pushing GPU Memory Boundaries with the Integration of CXL Technologies
di: Gouk, Donghyun, et al.
Pubblicazione: (2025)
di: Gouk, Donghyun, et al.
Pubblicazione: (2025)
Accurate Models of NVIDIA Tensor Cores
di: Khattak, Faizan A., et al.
Pubblicazione: (2025)
di: Khattak, Faizan A., et al.
Pubblicazione: (2025)
RoboGPU: Accelerating GPU Collision Detection for Robotics
di: Liu, Lufei, et al.
Pubblicazione: (2026)
di: Liu, Lufei, et al.
Pubblicazione: (2026)
Benchmarking and Dissecting the Nvidia Hopper GPU Architecture
di: Luo, Weile, et al.
Pubblicazione: (2024)
di: Luo, Weile, et al.
Pubblicazione: (2024)
COOK Access Control on an embedded Volta GPU
di: Lesage, Benjamin, et al.
Pubblicazione: (2024)
di: Lesage, Benjamin, et al.
Pubblicazione: (2024)
Multiport Support for Vortex OpenGPU Memory Hierarchy
di: Shin, Injae, et al.
Pubblicazione: (2025)
di: Shin, Injae, et al.
Pubblicazione: (2025)
CuLifter: Lifting GPU Binaries to Typed IR
di: Zhao, Jisheng, et al.
Pubblicazione: (2026)
di: Zhao, Jisheng, et al.
Pubblicazione: (2026)
GAP-LA: GPU-Accelerated Performance-Driven Layer Assignment
di: Zhao, Chunyuan, et al.
Pubblicazione: (2025)
di: Zhao, Chunyuan, et al.
Pubblicazione: (2025)
CMD: A Cache-assisted GPU Memory Deduplication Architecture
di: Zhao, Wei, et al.
Pubblicazione: (2024)
di: Zhao, Wei, et al.
Pubblicazione: (2024)
Cost-effective Deep Learning Infrastructure with NVIDIA GPU
di: Ghimire, Aatiz, et al.
Pubblicazione: (2025)
di: Ghimire, Aatiz, et al.
Pubblicazione: (2025)
The Anatomy of Silent Data Corruption: GPU Error Pattern Study and Modeling Guidance
di: Tung, Chung-Hsuan, et al.
Pubblicazione: (2026)
di: Tung, Chung-Hsuan, et al.
Pubblicazione: (2026)
Empirical Measurements of AI Training Power Demand on a GPU-Accelerated Node
di: Latif, Imran, et al.
Pubblicazione: (2024)
di: Latif, Imran, et al.
Pubblicazione: (2024)
EnergAIzer: Fast and Accurate GPU Power Estimation Framework for AI Workloads
di: Lee, Kyungmi, et al.
Pubblicazione: (2026)
di: Lee, Kyungmi, et al.
Pubblicazione: (2026)
Towards Performance-Aware Allocation for Accelerated Machine Learning on GPU-SSD Systems
di: Gundawar, Ayush, et al.
Pubblicazione: (2024)
di: Gundawar, Ayush, et al.
Pubblicazione: (2024)
Edge GPU Aware Multiple AI Model Pipeline for Accelerated MRI Reconstruction and Analysis
di: Majeed, Ashiyana Abdul, et al.
Pubblicazione: (2025)
di: Majeed, Ashiyana Abdul, et al.
Pubblicazione: (2025)
Hardware vs. Software Implementation of Warp-Level Features in Vortex RISC-V GPU
di: Pu, Huanzhi, et al.
Pubblicazione: (2025)
di: Pu, Huanzhi, et al.
Pubblicazione: (2025)
GPU-Accelerated Simulated Oscillator Ising/Potts Machine Solving Combinatorial Optimization Problems
di: Gonul, Yilmaz Ege, et al.
Pubblicazione: (2025)
di: Gonul, Yilmaz Ege, et al.
Pubblicazione: (2025)
TLX: Hardware-Native, Evolvable MIMW GPU Compiler for Large-scale Production Environments
di: Guan, Yue, et al.
Pubblicazione: (2026)
di: Guan, Yue, et al.
Pubblicazione: (2026)
Analyzing the capabilities of HLS and RTL tools in the design of an FPGA Montgomery Multiplier
di: Ifrim, Rares, et al.
Pubblicazione: (2025)
di: Ifrim, Rares, et al.
Pubblicazione: (2025)
Evaluation of GPU Video Encoder for Low-Latency Real-Time 4K UHD Encoding
di: Arunruangsirilert, Kasidis, et al.
Pubblicazione: (2025)
di: Arunruangsirilert, Kasidis, et al.
Pubblicazione: (2025)
HERO-Sign: Hierarchical Tuning and Efficient Compiler-Time GPU Optimizations for SPHINCS+ Signature Generation
di: Zhou, Yaoyun, et al.
Pubblicazione: (2025)
di: Zhou, Yaoyun, et al.
Pubblicazione: (2025)
LLM-PRISM: Characterizing Silent Data Corruption from Permanent GPU Faults in LLM Training
di: Tyagi, Abhishek, et al.
Pubblicazione: (2026)
di: Tyagi, Abhishek, et al.
Pubblicazione: (2026)
Rethinking the Producer-Consumer Relationship in Modern DRAM-Based Systems
di: Patel, Minesh, et al.
Pubblicazione: (2024)
di: Patel, Minesh, et al.
Pubblicazione: (2024)
Compromising the Intelligence of Modern DNNs: On the Effectiveness of Targeted RowPress
di: Zhou, Ranyang, et al.
Pubblicazione: (2024)
di: Zhou, Ranyang, et al.
Pubblicazione: (2024)
Microbenchmark-Driven Analytical Performance Modeling Across Modern GPU Architectures
di: Jarmusch, Aaron, et al.
Pubblicazione: (2026)
di: Jarmusch, Aaron, et al.
Pubblicazione: (2026)
CarbonSet: A Dataset to Analyze Trends and Benchmark the Sustainability of CPUs and GPUs
di: Hu, Jiajun, et al.
Pubblicazione: (2025)
di: Hu, Jiajun, et al.
Pubblicazione: (2025)
AraOS: Analyzing the Impact of Virtual Memory Management on Vector Unit Performance
di: Perotti, Matteo, et al.
Pubblicazione: (2025)
di: Perotti, Matteo, et al.
Pubblicazione: (2025)
e-GPU: An Open-Source and Configurable RISC-V Graphic Processing Unit for TinyAI Applications
di: Machetti, Simone, et al.
Pubblicazione: (2025)
di: Machetti, Simone, et al.
Pubblicazione: (2025)
A Comparison of the Cerebras Wafer-Scale Integration Technology with Nvidia GPU-based Systems for Artificial Intelligence
di: Kundu, Yudhishthira, et al.
Pubblicazione: (2025)
di: Kundu, Yudhishthira, et al.
Pubblicazione: (2025)
Analyzing the Single Event Upset Vulnerability of Binarized Neural Networks on SRAM FPGAs
di: Souvatzoglou, Ioanna, et al.
Pubblicazione: (2024)
di: Souvatzoglou, Ioanna, et al.
Pubblicazione: (2024)
Analyzing Reverse Address Translation Overheads in Multi-GPU Scale-Up Pods
di: Fatima, Amel, et al.
Pubblicazione: (2026)
di: Fatima, Amel, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Analyzing and Improving Hardware Modeling of Accel-Sim
di: Huerta, Rodrigo, et al.
Pubblicazione: (2024) -
Control Flow Management in Modern GPUs
di: Shoushtary, Mojtaba Abaie, et al.
Pubblicazione: (2024) -
Thermal Analysis for NVIDIA GTX480 Fermi GPU Architecture
di: Nagendra, Savinay
Pubblicazione: (2024) -
Parallelizing a modern GPU simulator
di: Huerta, Rodrigo, et al.
Pubblicazione: (2025) -
Microbenchmarking NVIDIA's Blackwell Architecture: An in-depth Architectural Analysis
di: Jarmusch, Aaron, et al.
Pubblicazione: (2025)