Efficient transformer adaptation for analog in-memory computing via low-rank adapters
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Chen, Ferro, Elena, Lammie, Corey, Gallo, Manuel Le, Boybat, Irem, Rajendran, Bipin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Precision-Optimized Fixed-Point Near-Memory Digital Processing Unit for Analog In-Memory Computing
di: Ferro, Elena, et al.
Pubblicazione: (2024)
di: Ferro, Elena, et al.
Pubblicazione: (2024)
Kernel Approximation using Analog In-Memory Computing
di: Büchel, Julian, et al.
Pubblicazione: (2024)
di: Büchel, Julian, et al.
Pubblicazione: (2024)
Toward A Formalized Approach for Spike Sorting Algorithms and Hardware Evaluation
di: Zhang, Tim, et al.
Pubblicazione: (2022)
di: Zhang, Tim, et al.
Pubblicazione: (2022)
IMSSA: Deploying modern state-space models on memristive in-memory compute hardware
di: Siegel, Sebastian, et al.
Pubblicazione: (2024)
di: Siegel, Sebastian, et al.
Pubblicazione: (2024)
CiMBA: Accelerating Genome Sequencing through On-Device Basecalling via Compute-in-Memory
di: Simon, William Andrew, et al.
Pubblicazione: (2025)
di: Simon, William Andrew, et al.
Pubblicazione: (2025)
Xpikeformer: Hybrid Analog-Digital Hardware Acceleration for Spiking Transformers
di: Song, Zihang, et al.
Pubblicazione: (2024)
di: Song, Zihang, et al.
Pubblicazione: (2024)
EVA: Accelerating LLM Decoding via an Efficient Vector Quantization Architecture
di: Duan, Bowen, et al.
Pubblicazione: (2026)
di: Duan, Bowen, et al.
Pubblicazione: (2026)
Stochastic Spiking Attention: Accelerating Attention with Stochastic Computing in Spiking Networks
di: Song, Zihang, et al.
Pubblicazione: (2024)
di: Song, Zihang, et al.
Pubblicazione: (2024)
Bayesian Inference on Binary Spiking Networks Leveraging Nanoscale Device Stochasticity
di: Katti, Prabodh, et al.
Pubblicazione: (2023)
di: Katti, Prabodh, et al.
Pubblicazione: (2023)
An Analog and Digital Hybrid Attention Accelerator for Transformers with Charge-based In-memory Computing
di: Moradifirouzabadi, Ashkan, et al.
Pubblicazione: (2024)
di: Moradifirouzabadi, Ashkan, et al.
Pubblicazione: (2024)
Processing-in-memory for genomics workloads
di: Simon, William Andrew, et al.
Pubblicazione: (2025)
di: Simon, William Andrew, et al.
Pubblicazione: (2025)
PDA-LSTM: Knowledge-driven page data arrangement based on LSTM for LCM supression in QLC 3D NAND flash memories
di: Li, Qianhui, et al.
Pubblicazione: (2025)
di: Li, Qianhui, et al.
Pubblicazione: (2025)
BiHDTrans: binary hyperdimensional transformer for efficient multivariate time series classification
di: Zhang, Jingtao, et al.
Pubblicazione: (2025)
di: Zhang, Jingtao, et al.
Pubblicazione: (2025)
SoberDSE: Sample-Efficient Design Space Exploration via Learning-Based Algorithm Selection
di: Xu, Lei, et al.
Pubblicazione: (2026)
di: Xu, Lei, et al.
Pubblicazione: (2026)
TCL: Enabling Fast and Efficient Cross-Hardware Tensor Program Optimization via Continual Learning
di: Shen, Chaoyao, et al.
Pubblicazione: (2026)
di: Shen, Chaoyao, et al.
Pubblicazione: (2026)
In-memory Training on Analog Devices with Limited Conductance States via Multi-tile Residual Learning
di: Li, Jindan, et al.
Pubblicazione: (2025)
di: Li, Jindan, et al.
Pubblicazione: (2025)
Algorithm and Hardware Co-Design for Efficient Complex-Valued Uncertainty Estimation
di: Zhang, Zehuan, et al.
Pubblicazione: (2026)
di: Zhang, Zehuan, et al.
Pubblicazione: (2026)
PolyLUT: Ultra-low Latency Polynomial Inference with Hardware-Aware Structured Pruning
di: Andronic, Marta, et al.
Pubblicazione: (2025)
di: Andronic, Marta, et al.
Pubblicazione: (2025)
TeLLMe: An Energy-Efficient Ternary LLM Accelerator for Prefilling and Decoding on Edge FPGAs
di: Qiao, Ye, et al.
Pubblicazione: (2025)
di: Qiao, Ye, et al.
Pubblicazione: (2025)
TinyFormer: Efficient Transformer Design and Deployment on Tiny Devices
di: Yang, Jianlei, et al.
Pubblicazione: (2023)
di: Yang, Jianlei, et al.
Pubblicazione: (2023)
ROSA: Robust and Energy-Efficient Microring-Based Optical Neural Networks via Optical Shift-and-Add and Layer-Wise Hybrid Mapping
di: Zhang, Huifan, et al.
Pubblicazione: (2026)
di: Zhang, Huifan, et al.
Pubblicazione: (2026)
TeLLMe v2: An Efficient End-to-End Ternary LLM Prefill and Decode Accelerator with Table-Lookup Matmul on Edge FPGAs
di: Qiao, Ye, et al.
Pubblicazione: (2025)
di: Qiao, Ye, et al.
Pubblicazione: (2025)
Towards Exact Gradient-based Training on Analog In-memory Computing
di: Wu, Zhaoxian, et al.
Pubblicazione: (2024)
di: Wu, Zhaoxian, et al.
Pubblicazione: (2024)
Estimation of Energy-dissipation Lower-bounds for Neuromorphic Learning-in-memory
di: Chen, Zihao, et al.
Pubblicazione: (2024)
di: Chen, Zihao, et al.
Pubblicazione: (2024)
Efficient Tabular Data Preprocessing of ML Pipelines
di: Zhu, Yu, et al.
Pubblicazione: (2024)
di: Zhu, Yu, et al.
Pubblicazione: (2024)
TransAxx: Efficient Transformers with Approximate Computing
di: Danopoulos, Dimitrios, et al.
Pubblicazione: (2024)
di: Danopoulos, Dimitrios, et al.
Pubblicazione: (2024)
Designing Efficient LLM Accelerators for Edge Devices
di: Haris, Jude, et al.
Pubblicazione: (2024)
di: Haris, Jude, et al.
Pubblicazione: (2024)
Mugi: Value Level Parallelism For Efficient LLMs
di: Price, Daniel, et al.
Pubblicazione: (2026)
di: Price, Daniel, et al.
Pubblicazione: (2026)
On the Convergence Theory of Pipeline Gradient-based Analog In-memory Training
di: Wu, Zhaoxian, et al.
Pubblicazione: (2024)
di: Wu, Zhaoxian, et al.
Pubblicazione: (2024)
Efficient In-Memory Acceleration of Sparse Block Diagonal LLMs
di: de Lima, João Paulo Cardoso, et al.
Pubblicazione: (2025)
di: de Lima, João Paulo Cardoso, et al.
Pubblicazione: (2025)
EPIM: Efficient Processing-In-Memory Accelerators based on Epitome
di: Wang, Chenyu, et al.
Pubblicazione: (2023)
di: Wang, Chenyu, et al.
Pubblicazione: (2023)
Memory-Efficient FPGA Implementation of Stochastic Simulated Annealing
di: Shin, Duckgyu, et al.
Pubblicazione: (2026)
di: Shin, Duckgyu, et al.
Pubblicazione: (2026)
CircuitVAE: Efficient and Scalable Latent Circuit Optimization
di: Song, Jialin, et al.
Pubblicazione: (2024)
di: Song, Jialin, et al.
Pubblicazione: (2024)
ITA: An Energy-Efficient Attention and Softmax Accelerator for Quantized Transformers
di: İslamoğlu, Gamze, et al.
Pubblicazione: (2023)
di: İslamoğlu, Gamze, et al.
Pubblicazione: (2023)
Efficient and Mathematically Robust Operations for Certified Neural Networks Inference
di: Geyer, Fabien, et al.
Pubblicazione: (2024)
di: Geyer, Fabien, et al.
Pubblicazione: (2024)
Beyond Tokens: Enhancing RTL Quality Estimation via Structural Graph Learning
di: Liu, Yi, et al.
Pubblicazione: (2025)
di: Liu, Yi, et al.
Pubblicazione: (2025)
Fast offset corrected in-memory training
di: Rasch, Malte J., et al.
Pubblicazione: (2023)
di: Rasch, Malte J., et al.
Pubblicazione: (2023)
Energy-adaptive Buffering for Efficient, Responsive, and Persistent Batteryless Systems
di: Williams, Harrison, et al.
Pubblicazione: (2024)
di: Williams, Harrison, et al.
Pubblicazione: (2024)
Efficient VQ-QAT and Mixed Vector/Linear quantized Neural Networks
di: Gou, Terry, et al.
Pubblicazione: (2026)
di: Gou, Terry, et al.
Pubblicazione: (2026)
Effective and Memory-Efficient Alternatives to ECC for Reliable Large-Scale DNNs
di: Ahmadilivani, Mohammad Hasan, et al.
Pubblicazione: (2026)
di: Ahmadilivani, Mohammad Hasan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
A Precision-Optimized Fixed-Point Near-Memory Digital Processing Unit for Analog In-Memory Computing
di: Ferro, Elena, et al.
Pubblicazione: (2024) -
Kernel Approximation using Analog In-Memory Computing
di: Büchel, Julian, et al.
Pubblicazione: (2024) -
Toward A Formalized Approach for Spike Sorting Algorithms and Hardware Evaluation
di: Zhang, Tim, et al.
Pubblicazione: (2022) -
IMSSA: Deploying modern state-space models on memristive in-memory compute hardware
di: Siegel, Sebastian, et al.
Pubblicazione: (2024) -
CiMBA: Accelerating Genome Sequencing through On-Device Basecalling via Compute-in-Memory
di: Simon, William Andrew, et al.
Pubblicazione: (2025)