Enregistré dans:
| Auteurs principaux: | Langarita, Rubén, Alastruey-Benedé, Jesús, Ibáñez-Marín, Pablo, Marco-Sola, Santiago, Moretó, Miquel, Armejach, Adrià |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.20400 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpChar: Characterizing the Sparse Puzzle via Decision Trees
par: Sgherzi, Francesco, et autres
Publié: (2023)
par: Sgherzi, Francesco, et autres
Publié: (2023)
EMiX: Emulating Beyond Single-FPGA Limits
par: Kropotov, Alexander, et autres
Publié: (2026)
par: Kropotov, Alexander, et autres
Publié: (2026)
A Mess of Memory System Benchmarking, Simulation and Application Profiling
par: Esmaili-Dokht, Pouya, et autres
Publié: (2024)
par: Esmaili-Dokht, Pouya, et autres
Publié: (2024)
Floating Point HUB Adder for RISC-V Sargantana Processor
par: Bandera, Gerardo, et autres
Publié: (2024)
par: Bandera, Gerardo, et autres
Publié: (2024)
A Flexible Instruction Set Architecture for Efficient GEMMs
par: Santana, Alexandre de Limas, et autres
Publié: (2025)
par: Santana, Alexandre de Limas, et autres
Publié: (2025)
Ember: A Compiler for Efficient Embedding Operations on Decoupled Access-Execute Architectures
par: Siracusa, Marco, et autres
Publié: (2025)
par: Siracusa, Marco, et autres
Publié: (2025)
FREESS: A Web-Based Educational Simulator for a RISC-V-Inspired Superscalar Processor with Tomasulo-Style Dynamic Scheduling
par: Giorgi, Roberto, et autres
Publié: (2026)
par: Giorgi, Roberto, et autres
Publié: (2026)
SpyHammer: Understanding and Exploiting RowHammer under Fine-Grained Temperature Variations
par: Orosa, Lois, et autres
Publié: (2022)
par: Orosa, Lois, et autres
Publié: (2022)
Trinity: A General Purpose FHE Accelerator
par: Deng, Xianglong, et autres
Publié: (2024)
par: Deng, Xianglong, et autres
Publié: (2024)
Implementation and Evaluation of Stable Diffusion on a General-Purpose CGLA Accelerator
par: Ando, Takuto, et autres
Publié: (2025)
par: Ando, Takuto, et autres
Publié: (2025)
LEAP: LLM Inference on Scalable PIM-NoC Architecture with Balanced Dataflow and Fine-Grained Parallelism
par: Wang, Yimin, et autres
Publié: (2025)
par: Wang, Yimin, et autres
Publié: (2025)
Fine-Grained Fusion: The Missing Piece in Area-Efficient State Space Model Acceleration
par: Geens, Robin, et autres
Publié: (2025)
par: Geens, Robin, et autres
Publié: (2025)
RuC: HDL-Agnostic Rule Completion Benchmark Generation
par: Domingo, Arnau Ayguadé, et autres
Publié: (2026)
par: Domingo, Arnau Ayguadé, et autres
Publié: (2026)
Asynchronous Memory Access Unit: Exploiting Massive Parallelism for Far Memory Access
par: Wang, Luming, et autres
Publié: (2024)
par: Wang, Luming, et autres
Publié: (2024)
BARD: Reducing Write Latency of DDR5 Memory by Exploiting Bank-Parallelism
par: Vittal, Suhas, et autres
Publié: (2025)
par: Vittal, Suhas, et autres
Publié: (2025)
Performance and Energy Benefits of MRDIMMs
par: Díaz, Pau, et autres
Publié: (2026)
par: Díaz, Pau, et autres
Publié: (2026)
FLICKER: A Fine-Grained Contribution-Aware Accelerator for Real-Time 3D Gaussian Splatting
par: Ou, Wenhui, et autres
Publié: (2026)
par: Ou, Wenhui, et autres
Publié: (2026)
Accelerating Mini-batch HGNN Training by Reducing CUDA Kernels
par: Wu, Meng, et autres
Publié: (2024)
par: Wu, Meng, et autres
Publié: (2024)
Empowering Vector Architectures for ML: The CAMP Architecture for Matrix Multiplication
par: Nojehdeh, Mohammadreza Esmali, et autres
Publié: (2025)
par: Nojehdeh, Mohammadreza Esmali, et autres
Publié: (2025)
DICE: Enabling Efficient General-Purpose SIMT Execution with Statically Scheduled Coarse-Grained Reconfigurable Arrays
par: Wang, Jiayi, et autres
Publié: (2026)
par: Wang, Jiayi, et autres
Publié: (2026)
ILVES: Accurate and efficient bond length and angle constraints in molecular dynamics
par: López-Villellas, Lorién, et autres
Publié: (2025)
par: López-Villellas, Lorién, et autres
Publié: (2025)
ACS: Concurrent Kernel Execution on Irregular, Input-Dependent Computational Graphs
par: Durvasula, Sankeerth, et autres
Publié: (2024)
par: Durvasula, Sankeerth, et autres
Publié: (2024)
NotSoTiny: A Large, Living Benchmark for RTL Code Generation
par: Ghorab, Razine Moundir, et autres
Publié: (2025)
par: Ghorab, Razine Moundir, et autres
Publié: (2025)
FGMP: Fine-Grained Mixed-Precision Weight and Activation Quantization for Hardware-Accelerated LLM Inference
par: Hooper, Coleman, et autres
Publié: (2025)
par: Hooper, Coleman, et autres
Publié: (2025)
HiHGNN: Accelerating HGNNs through Parallelism and Data Reusability Exploitation
par: Xue, Runzhen, et autres
Publié: (2023)
par: Xue, Runzhen, et autres
Publié: (2023)
Manticore: Hardware-Accelerated RTL Simulation with Static Bulk-Synchronous Parallelism
par: Emami, Mahyar, et autres
Publié: (2023)
par: Emami, Mahyar, et autres
Publié: (2023)
Efficient Kernel Mapping and Comprehensive System Evaluation of LLM Acceleration on a CGLA
par: Ando, Takuto, et autres
Publié: (2025)
par: Ando, Takuto, et autres
Publié: (2025)
L-PCN: A Point Cloud Accelerator Exploiting Spatial Locality through Octree-based Islandization
par: Gao, Yiming, et autres
Publié: (2026)
par: Gao, Yiming, et autres
Publié: (2026)
FireFly-S: Exploiting Dual-Side Sparsity for Spiking Neural Networks Acceleration with Reconfigurable Spatial Architecture
par: Li, Tenglong, et autres
Publié: (2024)
par: Li, Tenglong, et autres
Publié: (2024)
Highly Optimized Kernels and Fine-Grained Codebooks for LLM Inference on Arm CPUs
par: Gope, Dibakar, et autres
Publié: (2024)
par: Gope, Dibakar, et autres
Publié: (2024)
Hardware Efficient Accelerator for Spiking Transformer With Reconfigurable Parallel Time Step Computing
par: Chen, Bo-Yu, et autres
Publié: (2025)
par: Chen, Bo-Yu, et autres
Publié: (2025)
DiSC: Resolution-Scalable Acceleration of Diffusion Models by Exploiting Sparsity and Cached Token Reuse with Hash-based Distribution
par: Yoon, Jieon, et autres
Publié: (2026)
par: Yoon, Jieon, et autres
Publié: (2026)
FractalSync: Lightweight Scalable Global Synchronization of Massive Bulk Synchronous Parallel AI Accelerators
par: Isachi, Victor, et autres
Publié: (2025)
par: Isachi, Victor, et autres
Publié: (2025)
ISAAC: Intelligent, Scalable, Agile, and Accelerated CPU Verification via LLM-aided FPGA Parallelism
par: Sun, Jialin, et autres
Publié: (2025)
par: Sun, Jialin, et autres
Publié: (2025)
TuRTLe: A Unified Evaluation of LLMs for RTL Generation
par: Garcia-Gasulla, Dario, et autres
Publié: (2025)
par: Garcia-Gasulla, Dario, et autres
Publié: (2025)
Piccolo: Large-Scale Graph Processing with Fine-Grained In-Memory Scatter-Gather
par: Shin, Changmin, et autres
Publié: (2025)
par: Shin, Changmin, et autres
Publié: (2025)
Choreographer: A Full-System Framework for Fine-Grained Tasks in Cache Hierarchies
par: Nguyen, Hoa, et autres
Publié: (2025)
par: Nguyen, Hoa, et autres
Publié: (2025)
Kratos: An FPGA Benchmark for Unrolled DNNs with Fine-Grained Sparsity and Mixed Precision
par: Dai, Xilai, et autres
Publié: (2024)
par: Dai, Xilai, et autres
Publié: (2024)
DEFA: Efficient Deformable Attention Acceleration via Pruning-Assisted Grid-Sampling and Multi-Scale Parallel Processing
par: Xu, Yansong, et autres
Publié: (2024)
par: Xu, Yansong, et autres
Publié: (2024)
THOR: A Non-Speculative Value Dependent Timing Side Channel Attack Exploiting Intel AMX
par: Dizani, Farshad, et autres
Publié: (2025)
par: Dizani, Farshad, et autres
Publié: (2025)
Documents similaires
-
SpChar: Characterizing the Sparse Puzzle via Decision Trees
par: Sgherzi, Francesco, et autres
Publié: (2023) -
EMiX: Emulating Beyond Single-FPGA Limits
par: Kropotov, Alexander, et autres
Publié: (2026) -
A Mess of Memory System Benchmarking, Simulation and Application Profiling
par: Esmaili-Dokht, Pouya, et autres
Publié: (2024) -
Floating Point HUB Adder for RISC-V Sargantana Processor
par: Bandera, Gerardo, et autres
Publié: (2024) -
A Flexible Instruction Set Architecture for Efficient GEMMs
par: Santana, Alexandre de Limas, et autres
Publié: (2025)