T-SAR: A Full-Stack Co-design for CPU-Only Ternary LLM Inference via In-Place SIMD ALU Reorganization
Fuente:
arXiv
Saved in:
| Main Authors: | Oh, Hyunwoo, Nam, KyungIn, Bhattacharjya, Rajat, Chen, Hanning, Das, Tamoghno, Yun, Sanggeon, Jang, Suyeon, Ding, Andrew, Dutt, Nikil, Imani, Mohsen |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TorR: Towards Brain-Inspired Task-Oriented Reasoning via Cache-Oriented Algorithm-Architecture Co-design
by: Oh, Hyunwoo, et al.
Published: (2026)
by: Oh, Hyunwoo, et al.
Published: (2026)
AVERY: Intent-Driven Adaptive VLM Split Computing via Embodied Self-Awareness for Efficient Disaster Response Systems
by: Bhattacharjya, Rajat, et al.
Published: (2025)
by: Bhattacharjya, Rajat, et al.
Published: (2025)
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
by: Oh, Hyunwoo, et al.
Published: (2025)
by: Oh, Hyunwoo, et al.
Published: (2025)
HYPERDOA: Robust and Efficient DoA Estimation using Hyperdimensional Computing
by: Bhattacharjya, Rajat, et al.
Published: (2025)
by: Bhattacharjya, Rajat, et al.
Published: (2025)
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
by: Oh, Hyunwoo, et al.
Published: (2026)
by: Oh, Hyunwoo, et al.
Published: (2026)
MUSIC-lite: Efficient MUSIC using Approximate Computing: An OFDM Radar Case Study
by: Bhattacharjya, Rajat, et al.
Published: (2024)
by: Bhattacharjya, Rajat, et al.
Published: (2024)
ASTER: Attention-based Spiking Transformer Engine for Event-driven Reasoning
by: Das, Tamoghno, et al.
Published: (2025)
by: Das, Tamoghno, et al.
Published: (2025)
ACCESS-AV: Adaptive Communication-Computation Codesign for Sustainable Autonomous Vehicle Localization in Smart Factories
by: Bhattacharjya, Rajat, et al.
Published: (2025)
by: Bhattacharjya, Rajat, et al.
Published: (2025)
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
by: Chen, Hanning, et al.
Published: (2025)
by: Chen, Hanning, et al.
Published: (2025)
DecoHD: Decomposed Hyperdimensional Classification under Extreme Memory Budgets
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
Internal Flow Signatures for Self-Checking and Refinement in LLMs
by: Jeong, Sungheon, et al.
Published: (2026)
by: Jeong, Sungheon, et al.
Published: (2026)
A Few Large Shifts: Layer-Inconsistency Based Minimal Overhead Adversarial Example Detection
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
by: Yun, Sanggeon, et al.
Published: (2026)
by: Yun, Sanggeon, et al.
Published: (2026)
Draft and Refine with Visual Experts
by: Jeong, Sungheon, et al.
Published: (2025)
by: Jeong, Sungheon, et al.
Published: (2025)
A Plug-in Tiny AI Module for Intelligent and Selective Sensor Data Transmission
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
Expanding Event Modality Applications through a Robust CLIP-Based Encoder
by: Jeong, Sungheon, et al.
Published: (2024)
by: Jeong, Sungheon, et al.
Published: (2024)
Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?
by: Chen, Zhiling, et al.
Published: (2025)
by: Chen, Zhiling, et al.
Published: (2025)
State-Centric Decision Process
by: Jeong, Sungheon, et al.
Published: (2026)
by: Jeong, Sungheon, et al.
Published: (2026)
LogHD: Robust Compression of Hyperdimensional Classifiers via Logarithmic Class-Axis Reduction
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
Promoting Fairness in Link Prediction with Graph Enhancement
by: Liu, Yezi, et al.
Published: (2024)
by: Liu, Yezi, et al.
Published: (2024)
$n$-Musketeers: Reinforcement Learning Shapes Collaboration Among Language Models
by: Masukawa, Ryozo, et al.
Published: (2026)
by: Masukawa, Ryozo, et al.
Published: (2026)
PV-VTT: A Privacy-Centric Dataset for Mission-Specific Anomaly Detection and Natural Language Interpretation
by: Masukawa, Ryozo, et al.
Published: (2024)
by: Masukawa, Ryozo, et al.
Published: (2024)
MissionGNN: Hierarchical Multimodal GNN-based Weakly Supervised Video Anomaly Recognition with Mission-Specific Knowledge Graph Generation
by: Yun, Sanggeon, et al.
Published: (2024)
by: Yun, Sanggeon, et al.
Published: (2024)
Dependable Embedded Systems
by: Henkel, Jörg, et al.
Published: (2020)
by: Henkel, Jörg, et al.
Published: (2020)
Robust Reasoning and Learning with Brain-Inspired Representations under Hardware-Induced Nonlinearities
by: Chung, William Youngwoo, et al.
Published: (2026)
by: Chung, William Youngwoo, et al.
Published: (2026)
EcoSense: Energy-Efficient Intelligent Sensing for In-Shore Ship Detection through Edge-Cloud Collaboration
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
NeuroHash: A Hyperdimensional Neuro-Symbolic Framework for Spatially-Aware Image Hashing and Retrieval
by: Yun, Sanggeon, et al.
Published: (2024)
by: Yun, Sanggeon, et al.
Published: (2024)
Vision Language Model for Interpretable and Fine-grained Detection of Safety Compliance in Diverse Workplaces
by: Chen, Zhiling, et al.
Published: (2024)
by: Chen, Zhiling, et al.
Published: (2024)
HopFormer: Sparse Graph Transformers with Explicit Receptive Field Control
by: Yun, Sanggeon, et al.
Published: (2026)
by: Yun, Sanggeon, et al.
Published: (2026)
TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
FusionSense: Tri-Stage Near-Sensor Learning for Runtime-Adaptive Multimodal Edge Intelligence
by: Yun, Sanggeon, et al.
Published: (2026)
by: Yun, Sanggeon, et al.
Published: (2026)
Orion: Enabling Self-adaptive Memory Management for On-device Online Continual Learning
by: Li, Zexin, et al.
Published: (2026)
by: Li, Zexin, et al.
Published: (2026)
Hyperdimensional Intelligent Sensing for Efficient Real-Time Audio Processing on Extreme Edge
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
HyperSense: Hyperdimensional Intelligent Sensing for Energy-Efficient Sparse Data Processing
by: Yun, Sanggeon, et al.
Published: (2024)
by: Yun, Sanggeon, et al.
Published: (2024)
HyperSense: Hyperdimensional Intelligent Sensing for Energy‐Efficient Sparse Data Processing
by: Sanggeon Yun, et al.
Published: (2024)
by: Sanggeon Yun, et al.
Published: (2024)
MissionHD: Hyperdimensional Refinement of Distribution-Deficient Reasoning Graphs for Video Anomaly Detection
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
A Study of Performance Programming of CPU, GPU accelerated Computers and SIMD Architecture
by: Yi, Xinyao
Published: (2024)
by: Yi, Xinyao
Published: (2024)
HDReason: Algorithm-Hardware Codesign for Hyperdimensional Knowledge Graph Reasoning
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Similar Items
-
TorR: Towards Brain-Inspired Task-Oriented Reasoning via Cache-Oriented Algorithm-Architecture Co-design
by: Oh, Hyunwoo, et al.
Published: (2026) -
AVERY: Intent-Driven Adaptive VLM Split Computing via Embodied Self-Awareness for Efficient Disaster Response Systems
by: Bhattacharjya, Rajat, et al.
Published: (2025) -
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
by: Oh, Hyunwoo, et al.
Published: (2025) -
HYPERDOA: Robust and Efficient DoA Estimation using Hyperdimensional Computing
by: Bhattacharjya, Rajat, et al.
Published: (2025) -
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
by: Oh, Hyunwoo, et al.
Published: (2026)