Enregistré dans:
| Auteurs principaux: | Canakci, Burcu, Liu, Junyi, Wu, Xingbo, Cheriere, Nathanaël, Costa, Paolo, Legtchenko, Sergey, Narayanan, Dushyanth, Rowstron, Ant |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2501.10187 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Managed-Retention Memory: A New Class of Memory for the AI Era
par: Legtchenko, Sergey, et autres
Publié: (2025)
par: Legtchenko, Sergey, et autres
Publié: (2025)
Towards Memory Specialization: A Case for Long-Term and Short-Term RAM
par: Li, Peijing, et autres
Publié: (2025)
par: Li, Peijing, et autres
Publié: (2025)
Control Flow Management in Modern GPUs
par: Shoushtary, Mojtaba Abaie, et autres
Publié: (2024)
par: Shoushtary, Mojtaba Abaie, et autres
Publié: (2024)
Privacy-Preserving Performance Profiling of In-The-Wild GPUs
par: McDougall, Ian, et autres
Publié: (2025)
par: McDougall, Ian, et autres
Publié: (2025)
A Systematic Characterization of LLM Inference on GPUs
par: Wang, Haonan, et autres
Publié: (2025)
par: Wang, Haonan, et autres
Publié: (2025)
RulePlanner: All-in-One Reinforcement Learner for Unifying Design Rules in 3D Floorplanning
par: Zhong, Ruizhe, et autres
Publié: (2026)
par: Zhong, Ruizhe, et autres
Publié: (2026)
Fault Injection in On-Chip Interconnects: A Comparative Study of Wishbone, AXI-Lite, and AXI
par: Zhao, Hongwei, et autres
Publié: (2025)
par: Zhao, Hongwei, et autres
Publié: (2025)
Bandwidth-Effective DRAM Cache for GPUs with Storage-Class Memory
par: Hong, Jeongmin, et autres
Publié: (2024)
par: Hong, Jeongmin, et autres
Publié: (2024)
Fleet: Hierarchical Task-based Abstraction for Megakernels on Multi-Die GPUs
par: Chowdhary, Sangeeta, et autres
Publié: (2026)
par: Chowdhary, Sangeeta, et autres
Publié: (2026)
Virgo: Cluster-level Matrix Unit Integration in GPUs for Scalability and Energy Efficiency
par: Kim, Hansung, et autres
Publié: (2024)
par: Kim, Hansung, et autres
Publié: (2024)
CarbonSet: A Dataset to Analyze Trends and Benchmark the Sustainability of CPUs and GPUs
par: Hu, Jiajun, et autres
Publié: (2025)
par: Hu, Jiajun, et autres
Publié: (2025)
GPIR: Enabling Practical Private Information Retrieval with GPUs
par: Ji, Hyesung, et autres
Publié: (2026)
par: Ji, Hyesung, et autres
Publié: (2026)
Hidden Risks of Unmonitored GPUs in Intelligent Transportation Systems
par: Puspa, Sefatun-Noor, et autres
Publié: (2026)
par: Puspa, Sefatun-Noor, et autres
Publié: (2026)
Hardware and software build flow with SoCMake
par: Pejašinović, Risto, et autres
Publié: (2025)
par: Pejašinović, Risto, et autres
Publié: (2025)
Study on the Particle Sorting Performance for Reactor Monte Carlo Neutron Transport on Apple Unified Memory GPUs
par: Liu, Changyuan
Publié: (2024)
par: Liu, Changyuan
Publié: (2024)
How Much Progress Has There Been in NVIDIA Datacenter GPUs?
par: Del Sozzo, Emanuele, et autres
Publié: (2026)
par: Del Sozzo, Emanuele, et autres
Publié: (2026)
Kitsune: Enabling Dataflow Execution on GPUs
par: Davies, Michael, et autres
Publié: (2025)
par: Davies, Michael, et autres
Publié: (2025)
SnipSnap: A Joint Compression Format and Dataflow Co-Optimization Framework for Efficient Sparse LLM Accelerator Design
par: Wu, Junyi, et autres
Publié: (2025)
par: Wu, Junyi, et autres
Publié: (2025)
Characterizing and Understanding HGNN Training on GPUs
par: Han, Dengke, et autres
Publié: (2024)
par: Han, Dengke, et autres
Publié: (2024)
Evaluating Computing Platforms for Sustainability: A Comparative Analysis of FPGAs against ASICs, GPUs, and CPUs
par: Sudarshan, Chetan Choppali, et autres
Publié: (2026)
par: Sudarshan, Chetan Choppali, et autres
Publié: (2026)
HetGPU: The pursuit of making binary compatibility towards GPUs
par: Yang, Yiwei, et autres
Publié: (2025)
par: Yang, Yiwei, et autres
Publié: (2025)
Optimal Software Pipelining and Warp Specialization for Tensor Core GPUs
par: Soi, Rupanshu, et autres
Publié: (2025)
par: Soi, Rupanshu, et autres
Publié: (2025)
Tawa: Automatic Warp Specialization for Modern GPUs with Asynchronous References
par: Chen, Hongzheng, et autres
Publié: (2025)
par: Chen, Hongzheng, et autres
Publié: (2025)
Evaluating CUDA Tile for AI Workloads on Hopper and Blackwell GPUs
par: Yadav, Divakar Kumar, et autres
Publié: (2026)
par: Yadav, Divakar Kumar, et autres
Publié: (2026)
Accelerating MoE with Dynamic In-Switch Computing on Multi-GPUs
par: Zhang, Qijun, et autres
Publié: (2026)
par: Zhang, Qijun, et autres
Publié: (2026)
An integrated design of energy and indoor environmental quality monitoring system for effective building performance management
par: Zakka, Vincent Gbouna, et autres
Publié: (2025)
par: Zakka, Vincent Gbouna, et autres
Publié: (2025)
A Reconfigurable Computing In-Memory Macro with Charge-sharing-based Weighted Accumulator
par: Yang, Junyi, et autres
Publié: (2026)
par: Yang, Junyi, et autres
Publié: (2026)
CADC: Crossbar-Aware Dendritic Convolution for Efficient In-memory Computing
par: Dong, Shuai, et autres
Publié: (2025)
par: Dong, Shuai, et autres
Publié: (2025)
Fusing Depthwise and Pointwise Convolutions for Efficient Inference on GPUs
par: Qararyah, Fareed, et autres
Publié: (2024)
par: Qararyah, Fareed, et autres
Publié: (2024)
Efficient stereo matching on embedded GPUs with zero-means cross correlation
par: Chang, Qiong, et autres
Publié: (2022)
par: Chang, Qiong, et autres
Publié: (2022)
Characterizing the Behavior of Training Mamba-based State Space Models on GPUs
par: Baruah, Trinayan, et autres
Publié: (2025)
par: Baruah, Trinayan, et autres
Publié: (2025)
Near-Memory Architecture for Threshold-Ordinal Surface-Based Corner Detection of Event Cameras
par: Shang, Hongyang, et autres
Publié: (2025)
par: Shang, Hongyang, et autres
Publié: (2025)
Acore-CIM: build accurate and reliable mixed-signal CIM cores with RISC-V controlled self-calibration
par: Numan, Omar, et autres
Publié: (2025)
par: Numan, Omar, et autres
Publié: (2025)
ControlPULPlet: A Flexible Real-time Multi-core RISC-V Controller for 2.5D Systems-in-package
par: Ottaviano, Alessandro, et autres
Publié: (2024)
par: Ottaviano, Alessandro, et autres
Publié: (2024)
In-Memory ADC-Based Nonlinear Activation Quantization for Efficient In-Memory Computing
par: Dong, Shuai, et autres
Publié: (2026)
par: Dong, Shuai, et autres
Publié: (2026)
Evaluation of Hardware-based Video Encoders on Modern GPUs for UHD Live-Streaming
par: Arunruangsirilert, Kasidis, et autres
Publié: (2025)
par: Arunruangsirilert, Kasidis, et autres
Publié: (2025)
Are LLMs Any Good for High-Level Synthesis?
par: Liao, Yuchao, et autres
Publié: (2024)
par: Liao, Yuchao, et autres
Publié: (2024)
smallNet: Implementation of a convolutional layer in tiny FPGAs
par: Bascuñán, Fernanda Zapata, et autres
Publié: (2025)
par: Bascuñán, Fernanda Zapata, et autres
Publié: (2025)
AnalogGenie: A Generative Engine for Automatic Discovery of Analog Circuit Topologies
par: Gao, Jian, et autres
Publié: (2025)
par: Gao, Jian, et autres
Publié: (2025)
EdgeReasoning: Characterizing Reasoning LLM Deployment on Edge GPUs
par: Kubwimana, Benjamin, et autres
Publié: (2025)
par: Kubwimana, Benjamin, et autres
Publié: (2025)
Documents similaires
-
Managed-Retention Memory: A New Class of Memory for the AI Era
par: Legtchenko, Sergey, et autres
Publié: (2025) -
Towards Memory Specialization: A Case for Long-Term and Short-Term RAM
par: Li, Peijing, et autres
Publié: (2025) -
Control Flow Management in Modern GPUs
par: Shoushtary, Mojtaba Abaie, et autres
Publié: (2024) -
Privacy-Preserving Performance Profiling of In-The-Wild GPUs
par: McDougall, Ian, et autres
Publié: (2025) -
A Systematic Characterization of LLM Inference on GPUs
par: Wang, Haonan, et autres
Publié: (2025)