Basis Selection: Low-Rank Decomposition of Pretrained Large Language Models for Target Applications
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yang, Asante, Daniel Agyei, Zhao, Changsheng, Chang, Ernie, Shi, Yangyang, Chandra, Vikas |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Importance-Guided Basis Selection for Low-Rank Decomposition of Large Language Models
par: Asante, Daniel Agyei, et autres
Publié: (2026)
par: Asante, Daniel Agyei, et autres
Publié: (2026)
HaLoRA: Hardware-aware Low-Rank Adaptation for Large Language Models Based on Hybrid Compute-in-Memory Architecture
par: Wu, Taiqiang, et autres
Publié: (2025)
par: Wu, Taiqiang, et autres
Publié: (2025)
Folding Attention: Memory and Power Optimization for On-Device Transformer-based Streaming Speech Recognition
par: Li, Yang, et autres
Publié: (2023)
par: Li, Yang, et autres
Publié: (2023)
Enhancing Finite State Machine Design Automation with Large Language Models and Prompt Engineering Techniques
par: Lin, Qun-Kai, et autres
Publié: (2025)
par: Lin, Qun-Kai, et autres
Publié: (2025)
A Matrix Decomposition Method for Odd-Type Gaussian Normal Basis Multiplication
par: Phalakarn, Kittiphon, et autres
Publié: (2025)
par: Phalakarn, Kittiphon, et autres
Publié: (2025)
VRank: Enhancing Verilog Code Generation from Large Language Models via Self-Consistency
par: Zhao, Zhuorui, et autres
Publié: (2025)
par: Zhao, Zhuorui, et autres
Publié: (2025)
Optimizing High-Level Synthesis Designs with Retrieval-Augmented Large Language Models
par: Xu, Haocheng, et autres
Publié: (2024)
par: Xu, Haocheng, et autres
Publié: (2024)
Hardwired-Neurons Language Processing Units as General-Purpose Cognitive Substrates
par: Liu, Yang, et autres
Publié: (2025)
par: Liu, Yang, et autres
Publié: (2025)
Workload Characterization for Branch Predictability
par: Vikas, FNU, et autres
Publié: (2025)
par: Vikas, FNU, et autres
Publié: (2025)
HADES: Hardware Accelerated Decoding for Efficient Speculation in Large Language Models
par: Yang, Ze, et autres
Publié: (2024)
par: Yang, Ze, et autres
Publié: (2024)
HDLxGraph: Bridging Large Language Models and HDL Repositories via HDL Graph Databases
par: Zheng, Pingqing, et autres
Publié: (2025)
par: Zheng, Pingqing, et autres
Publié: (2025)
CraftRTL: High-quality Synthetic Data Generation for Verilog Code Models with Correct-by-Construction Non-Textual Representations and Targeted Code Repair
par: Liu, Mingjie, et autres
Publié: (2024)
par: Liu, Mingjie, et autres
Publié: (2024)
VFocus: Better Verilog Generation from Large Language Model via Focused Reasoning
par: Zhao, Zhuorui, et autres
Publié: (2025)
par: Zhao, Zhuorui, et autres
Publié: (2025)
SpecLoop: An Agentic RTL-to-Specification Framework with Formal Verification Feedback Loop
par: Chang, Fu-Chieh, et autres
Publié: (2026)
par: Chang, Fu-Chieh, et autres
Publié: (2026)
Hardware Phi-1.5B: A Large Language Model Encodes Hardware Domain Specific Knowledge
par: Fu, Weimin, et autres
Publié: (2024)
par: Fu, Weimin, et autres
Publié: (2024)
ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition
par: Zheng, Keran, et autres
Publié: (2025)
par: Zheng, Keran, et autres
Publié: (2025)
SSR: Spatial Sequential Hybrid Architecture for Latency Throughput Tradeoff in Transformer Acceleration
par: Zhuang, Jinming, et autres
Publié: (2024)
par: Zhuang, Jinming, et autres
Publié: (2024)
Beyond Static Policies: Exploring Dynamic Policy Selection for Single-Thread Performance Optimization
par: Zhang, Yanxin, et autres
Publié: (2026)
par: Zhang, Yanxin, et autres
Publié: (2026)
PRIMAL: Processing-In-Memory Based Low-Rank Adaptation for LLM Inference Accelerator
par: Chong, Yue Jiet, et autres
Publié: (2026)
par: Chong, Yue Jiet, et autres
Publié: (2026)
Zoozve: A Strip-Mining-Free RISC-V Vector Extension with Arbitrary Register Grouping Compilation Support (WIP)
par: Xu, Siyi, et autres
Publié: (2025)
par: Xu, Siyi, et autres
Publié: (2025)
VeriPy -- A New Python-Based Approach for SDR Pipelined/Unrolled Hardware Accelerator Generation
par: Zhao, Yuqin, et autres
Publié: (2025)
par: Zhao, Yuqin, et autres
Publié: (2025)
From English to ASIC: Hardware Implementation with Large Language Model
par: Goh, Emil, et autres
Publié: (2024)
par: Goh, Emil, et autres
Publié: (2024)
An Optimizing Framework on MLIR for Efficient FPGA-based Accelerator Generation
par: Zhang, Weichuang, et autres
Publié: (2024)
par: Zhang, Weichuang, et autres
Publié: (2024)
HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference
par: Duan, Cenlin, et autres
Publié: (2025)
par: Duan, Cenlin, et autres
Publié: (2025)
MGS: Markov Greedy Sums for Accurate Low-Bitwidth Floating-Point Accumulation
par: Natesh, Vikas, et autres
Publié: (2025)
par: Natesh, Vikas, et autres
Publié: (2025)
OPAL: Outlier-Preserved Microscaling Quantization Accelerator for Generative Large Language Models
par: Koo, Jahyun, et autres
Publié: (2024)
par: Koo, Jahyun, et autres
Publié: (2024)
Scaling Program Synthesis Based Technology Mapping with Equality Saturation
par: Smith, Gus Henry, et autres
Publié: (2024)
par: Smith, Gus Henry, et autres
Publié: (2024)
A System Architecture for Low Latency Multiprogramming Quantum Computing
par: Zhao, Yilun, et autres
Publié: (2026)
par: Zhao, Yilun, et autres
Publié: (2026)
Unveiling Environmental Impacts of Large Language Model Serving: A Functional Unit View
par: Wu, Yanran, et autres
Publié: (2025)
par: Wu, Yanran, et autres
Publié: (2025)
EDA Corpus: A Large Language Model Dataset for Enhanced Interaction with OpenROAD
par: Wu, Bing-Yue, et autres
Publié: (2024)
par: Wu, Bing-Yue, et autres
Publié: (2024)
Chiplet Cloud: Building AI Supercomputers for Serving Large Generative Language Models
par: Peng, Huwan, et autres
Publié: (2023)
par: Peng, Huwan, et autres
Publié: (2023)
HaVen: Hallucination-Mitigated LLM for Verilog Code Generation Aligned with HDL Engineers
par: Yang, Yiyao, et autres
Publié: (2025)
par: Yang, Yiyao, et autres
Publié: (2025)
DocEDA: Automated Extraction and Design of Analog Circuits from Documents with Large Language Model
par: Chen, Hong Cai, et autres
Publié: (2024)
par: Chen, Hong Cai, et autres
Publié: (2024)
LLM-FSM: Scaling Large Language Models for Finite-State Reasoning in RTL Code Generation
par: Wu, Yuheng, et autres
Publié: (2026)
par: Wu, Yuheng, et autres
Publié: (2026)
Low-Rank Compression for IMC Arrays
par: Jeon, Kang Eun, et autres
Publié: (2025)
par: Jeon, Kang Eun, et autres
Publié: (2025)
Tender: Accelerating Large Language Models via Tensor Decomposition and Runtime Requantization
par: Lee, Jungi, et autres
Publié: (2024)
par: Lee, Jungi, et autres
Publié: (2024)
CODMAS: A Dialectic Multi-Agent Collaborative Framework for Structured RTL Optimization
par: Chang, Che-Ming, et autres
Publié: (2026)
par: Chang, Che-Ming, et autres
Publié: (2026)
A Low-Power Sparse Deep Learning Accelerator with Optimized Data Reuse
par: Hsu, Kai-Chieh, et autres
Publié: (2025)
par: Hsu, Kai-Chieh, et autres
Publié: (2025)
The Argument for Meta-Modeling-Based Approaches to Hardware Generation Languages
par: Schreiner, Johannes, et autres
Publié: (2024)
par: Schreiner, Johannes, et autres
Publié: (2024)
LintLLM: An Open-Source Verilog Linting Framework Based on Large Language Models
par: Fang, Zhigang, et autres
Publié: (2025)
par: Fang, Zhigang, et autres
Publié: (2025)
Documents similaires
-
Importance-Guided Basis Selection for Low-Rank Decomposition of Large Language Models
par: Asante, Daniel Agyei, et autres
Publié: (2026) -
HaLoRA: Hardware-aware Low-Rank Adaptation for Large Language Models Based on Hybrid Compute-in-Memory Architecture
par: Wu, Taiqiang, et autres
Publié: (2025) -
Folding Attention: Memory and Power Optimization for On-Device Transformer-based Streaming Speech Recognition
par: Li, Yang, et autres
Publié: (2023) -
Enhancing Finite State Machine Design Automation with Large Language Models and Prompt Engineering Techniques
par: Lin, Qun-Kai, et autres
Publié: (2025) -
A Matrix Decomposition Method for Odd-Type Gaussian Normal Basis Multiplication
par: Phalakarn, Kittiphon, et autres
Publié: (2025)