DRIFT: Harnessing Inherent Fault Tolerance for Efficient and Reliable Diffusion Model Inference
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wen, Jinqi, Xie, Tong, Wang, Runsheng, Li, Meng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
ReaLM: Reliable and Efficient Large Language Model Inference with Statistical Algorithm-Based Fault Tolerance
von: Xie, Tong, et al.
Veröffentlicht: (2025)
von: Xie, Tong, et al.
Veröffentlicht: (2025)
The Quest for Reliable AI Accelerators: Cross-Layer Evaluation and Design Optimization
von: Li, Meng, et al.
Veröffentlicht: (2026)
von: Li, Meng, et al.
Veröffentlicht: (2026)
CREATE: Cross-Layer Resilience Characterization and Optimization for Efficient yet Reliable Embodied AI Systems
von: Xie, Tong, et al.
Veröffentlicht: (2026)
von: Xie, Tong, et al.
Veröffentlicht: (2026)
Aging Aware Adaptive Voltage Scaling for Reliable and Efficient AI Accelerators
von: Xie, Tong, et al.
Veröffentlicht: (2026)
von: Xie, Tong, et al.
Veröffentlicht: (2026)
SpecMamba: Accelerating Mamba Inference on FPGA with Speculative Decoding
von: Zhong, Linfeng, et al.
Veröffentlicht: (2025)
von: Zhong, Linfeng, et al.
Veröffentlicht: (2025)
Oobleck: Low-Compromise Design for Fault Tolerant Accelerators
von: Wilks, Guy, et al.
Veröffentlicht: (2025)
von: Wilks, Guy, et al.
Veröffentlicht: (2025)
Efficient yet Accurate End-to-End SC Accelerator Design
von: Li, Meng, et al.
Veröffentlicht: (2024)
von: Li, Meng, et al.
Veröffentlicht: (2024)
An ECC-based Fault Tolerance Approach for DNNs
von: Raji, Mohsen, et al.
Veröffentlicht: (2025)
von: Raji, Mohsen, et al.
Veröffentlicht: (2025)
FORTALESA: Fault-Tolerant Reconfigurable Systolic Array for DNN Inference
von: Cherezova, Natalia, et al.
Veröffentlicht: (2025)
von: Cherezova, Natalia, et al.
Veröffentlicht: (2025)
RePart: Efficient Hypergraph Partitioning with Logic Replication Optimization for Multi-FPGA System
von: Fu, Zizhuo, et al.
Veröffentlicht: (2026)
von: Fu, Zizhuo, et al.
Veröffentlicht: (2026)
Testing and Fault Tolerance Techniques for CNT-Based FPGAs
von: Lu, Siyuan, et al.
Veröffentlicht: (2025)
von: Lu, Siyuan, et al.
Veröffentlicht: (2025)
No Redundancy, No Stall: Lightweight Streaming 3D Gaussian Splatting for Real-time Rendering
von: Wei, Linye, et al.
Veröffentlicht: (2025)
von: Wei, Linye, et al.
Veröffentlicht: (2025)
A Reconfigurable Approximate Computing RISC-V Platform for Fault-Tolerant Applications
von: Delavari, Arvin, et al.
Veröffentlicht: (2024)
von: Delavari, Arvin, et al.
Veröffentlicht: (2024)
Combining Fault Tolerance Techniques and COTS SoC Accelerators for Payload Processing in Space
von: Leon, Vasileios, et al.
Veröffentlicht: (2025)
von: Leon, Vasileios, et al.
Veröffentlicht: (2025)
ENFOR-SA: End-to-end Cross-layer Transient Fault Injector for Efficient and Accurate DNN Reliability Assessment on Systolic Arrays
von: Tonetto, Rafael Billig, et al.
Veröffentlicht: (2026)
von: Tonetto, Rafael Billig, et al.
Veröffentlicht: (2026)
Synchronization for Fault-Tolerant Quantum Computers
von: Maurya, Satvik, et al.
Veröffentlicht: (2025)
von: Maurya, Satvik, et al.
Veröffentlicht: (2025)
Trikarenos: A Fault-Tolerant RISC-V-based Microcontroller for CubeSats in 28nm
von: Rogenmoser, Michael, et al.
Veröffentlicht: (2023)
von: Rogenmoser, Michael, et al.
Veröffentlicht: (2023)
Weight Transformations in Bit-Sliced Crossbar Arrays for Fault Tolerant Computing-in-Memory: Design Techniques and Evaluation Framework
von: Malhotra, Akul, et al.
Veröffentlicht: (2025)
von: Malhotra, Akul, et al.
Veröffentlicht: (2025)
LOCALUT: Harnessing Capacity-Computation Tradeoffs for LUT-Based Inference in DRAM-PIM
von: Hong, Junguk, et al.
Veröffentlicht: (2026)
von: Hong, Junguk, et al.
Veröffentlicht: (2026)
LSQCA: Resource-Efficient Load/Store Architecture for Limited-Scale Fault-Tolerant Quantum Computing
von: Kobori, Takumi, et al.
Veröffentlicht: (2024)
von: Kobori, Takumi, et al.
Veröffentlicht: (2024)
Who Checks the Checker? Enhancing Component-level Architectural SEU Fault Tolerance for End-to-End SoC Protection
von: Rogenmoser, Michael, et al.
Veröffentlicht: (2026)
von: Rogenmoser, Michael, et al.
Veröffentlicht: (2026)
ReTern: Exploiting Natural Redundancy and Sign Transformations for Enhanced Fault Tolerance in Compute-in-Memory based Ternary LLMs
von: Malhotra, Akul, et al.
Veröffentlicht: (2025)
von: Malhotra, Akul, et al.
Veröffentlicht: (2025)
Ironman: Accelerating Oblivious Transfer Extension for Privacy-Preserving AI with Near-Memory Processing
von: Lin, Chenqi, et al.
Veröffentlicht: (2025)
von: Lin, Chenqi, et al.
Veröffentlicht: (2025)
Zero-Space Cost Fault Tolerance for Transformer-based Language Models on ReRAM
von: Li, Bingbing, et al.
Veröffentlicht: (2024)
von: Li, Bingbing, et al.
Veröffentlicht: (2024)
ReadyPower: A Reliable, Interpretable, and Handy Architectural Power Model Based on Analytical Framework
von: Zhang, Qijun, et al.
Veröffentlicht: (2025)
von: Zhang, Qijun, et al.
Veröffentlicht: (2025)
LinkBo: An Adaptive Single-Wire, Low-Latency, and Fault-Tolerant Communications Interface for Variable-Distance Chip-to-Chip Systems
von: Ye, Bochen, et al.
Veröffentlicht: (2025)
von: Ye, Bochen, et al.
Veröffentlicht: (2025)
FsimNNs: An Open-Source Graph Neural Network Platform for SEU Simulation-based Fault Injection
von: Lu, Li, et al.
Veröffentlicht: (2025)
von: Lu, Li, et al.
Veröffentlicht: (2025)
Late Breaking Result: FPGA-Based Emulation and Fault Injection for CNN Inference Accelerators
von: Masar, Filip, et al.
Veröffentlicht: (2025)
von: Masar, Filip, et al.
Veröffentlicht: (2025)
Theseus: Exploring Efficient Wafer-Scale Chip Design for Large Language Models
von: Zhu, Jingchen, et al.
Veröffentlicht: (2024)
von: Zhu, Jingchen, et al.
Veröffentlicht: (2024)
Fault Tolerant Design of IGZO-based Binary Search ADCs
von: Duarte, Paula Carolina Lozano, et al.
Veröffentlicht: (2026)
von: Duarte, Paula Carolina Lozano, et al.
Veröffentlicht: (2026)
Custom Algorithm-based Fault Tolerance for Attention Layers in Transformers
von: Titopoulos, Vasileios, et al.
Veröffentlicht: (2025)
von: Titopoulos, Vasileios, et al.
Veröffentlicht: (2025)
CellE: Automated Standard Cell Library Extension via Equality Saturation
von: Ren, Yi, et al.
Veröffentlicht: (2026)
von: Ren, Yi, et al.
Veröffentlicht: (2026)
UniCAIM: A Unified CAM/CIM Architecture with Static-Dynamic KV Cache Pruning for Efficient Long-Context LLM Inference
von: Xu, Weikai, et al.
Veröffentlicht: (2025)
von: Xu, Weikai, et al.
Veröffentlicht: (2025)
Laser Fault Injection Attacks against Radiation Tolerant TMR Registers
von: Petryk, Dmytro, et al.
Veröffentlicht: (2024)
von: Petryk, Dmytro, et al.
Veröffentlicht: (2024)
Leveraging Compute-in-Memory for Efficient Generative Model Inference in TPUs
von: Zhu, Zhantong, et al.
Veröffentlicht: (2025)
von: Zhu, Zhantong, et al.
Veröffentlicht: (2025)
NASiC: 3D NAND-based CAM-Selected Multibit CIM Architecture for Efficient On-Device Mixture-of-Experts LLM Inference
von: Xu, Weikai, et al.
Veröffentlicht: (2026)
von: Xu, Weikai, et al.
Veröffentlicht: (2026)
Harmonia: Algorithm-Hardware Co-Design for Memory- and Compute-Efficient BFP-based LLM Inference
von: Wang, Xinyu, et al.
Veröffentlicht: (2026)
von: Wang, Xinyu, et al.
Veröffentlicht: (2026)
Reimagining Memory Access for LLM Inference: Compression-Aware Memory Controller Design
von: Xie, Rui, et al.
Veröffentlicht: (2025)
von: Xie, Rui, et al.
Veröffentlicht: (2025)
TerEffic: Highly Efficient Ternary LLM Inference on FPGA
von: Yin, Chenyang, et al.
Veröffentlicht: (2025)
von: Yin, Chenyang, et al.
Veröffentlicht: (2025)
Making Strong Error-Correcting Codes Work Effectively for HBM in AI Inference
von: Xie, Rui, et al.
Veröffentlicht: (2025)
von: Xie, Rui, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
ReaLM: Reliable and Efficient Large Language Model Inference with Statistical Algorithm-Based Fault Tolerance
von: Xie, Tong, et al.
Veröffentlicht: (2025) -
The Quest for Reliable AI Accelerators: Cross-Layer Evaluation and Design Optimization
von: Li, Meng, et al.
Veröffentlicht: (2026) -
CREATE: Cross-Layer Resilience Characterization and Optimization for Efficient yet Reliable Embodied AI Systems
von: Xie, Tong, et al.
Veröffentlicht: (2026) -
Aging Aware Adaptive Voltage Scaling for Reliable and Efficient AI Accelerators
von: Xie, Tong, et al.
Veröffentlicht: (2026) -
SpecMamba: Accelerating Mamba Inference on FPGA with Speculative Decoding
von: Zhong, Linfeng, et al.
Veröffentlicht: (2025)