TorR: Towards Brain-Inspired Task-Oriented Reasoning via Cache-Oriented Algorithm-Architecture Co-design
Fuente:
arXiv
Salvato in:
| Autori principali: | Oh, Hyunwoo, Jeong, SungHeon, Jang, Suyeon, Chen, Hanning, Yun, Sanggeon, Das, Tamoghno, Imani, Mohsen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025)
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025)
T-SAR: A Full-Stack Co-design for CPU-Only Ternary LLM Inference via In-Place SIMD ALU Reorganization
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025)
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025)
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
di: Oh, Hyunwoo, et al.
Pubblicazione: (2026)
di: Oh, Hyunwoo, et al.
Pubblicazione: (2026)
Neuro-Photonix: Enabling Near-Sensor Neuro-Symbolic AI Computing on Silicon Photonics Substrate
di: Najafi, Deniz, et al.
Pubblicazione: (2024)
di: Najafi, Deniz, et al.
Pubblicazione: (2024)
ASTER: Attention-based Spiking Transformer Engine for Event-driven Reasoning
di: Das, Tamoghno, et al.
Pubblicazione: (2025)
di: Das, Tamoghno, et al.
Pubblicazione: (2025)
NeuroHash: A Hyperdimensional Neuro-Symbolic Framework for Spatially-Aware Image Hashing and Retrieval
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
HyperSense: Hyperdimensional Intelligent Sensing for Energy-Efficient Sparse Data Processing
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2024)
di: Chen, Hanning, et al.
Pubblicazione: (2024)
FusionSense: Tri-Stage Near-Sensor Learning for Runtime-Adaptive Multimodal Edge Intelligence
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
HDReason: Algorithm-Hardware Codesign for Hyperdimensional Knowledge Graph Reasoning
di: Chen, Hanning, et al.
Pubblicazione: (2024)
di: Chen, Hanning, et al.
Pubblicazione: (2024)
Exploiting Boosting in Hyperdimensional Computing for Enhanced Reliability in Healthcare
di: Jeong, SungHeon, et al.
Pubblicazione: (2024)
di: Jeong, SungHeon, et al.
Pubblicazione: (2024)
Towards Efficient Hyperdimensional Computing Using Photonics
di: Fayza, Farbin, et al.
Pubblicazione: (2023)
di: Fayza, Farbin, et al.
Pubblicazione: (2023)
Energy-Oriented Computing Architecture Simulator for SNN Training
di: Ma, Yunhao, et al.
Pubblicazione: (2025)
di: Ma, Yunhao, et al.
Pubblicazione: (2025)
An Architectural Error Metric for CNN-Oriented Approximate Multipliers
di: Liu, Ao, et al.
Pubblicazione: (2024)
di: Liu, Ao, et al.
Pubblicazione: (2024)
HYPERDOA: Robust and Efficient DoA Estimation using Hyperdimensional Computing
di: Bhattacharjya, Rajat, et al.
Pubblicazione: (2025)
di: Bhattacharjya, Rajat, et al.
Pubblicazione: (2025)
Hyperdimensional Intelligent Sensing for Efficient Real-Time Audio Processing on Extreme Edge
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
AVERY: Intent-Driven Adaptive VLM Split Computing via Embodied Self-Awareness for Efficient Disaster Response Systems
di: Bhattacharjya, Rajat, et al.
Pubblicazione: (2025)
di: Bhattacharjya, Rajat, et al.
Pubblicazione: (2025)
DecoHD: Decomposed Hyperdimensional Classification under Extreme Memory Budgets
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
LFOC: A Lightweight Fairness-Oriented Cache Clustering Policy for Commodity Multicores
di: García-García, Adrián, et al.
Pubblicazione: (2024)
di: García-García, Adrián, et al.
Pubblicazione: (2024)
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2025)
di: Chen, Hanning, et al.
Pubblicazione: (2025)
TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
di: Chen, Hanning, et al.
Pubblicazione: (2024)
di: Chen, Hanning, et al.
Pubblicazione: (2024)
The Avatar Cache: Enabling On-Demand Security with Morphable Cache Architecture
di: Bhatla, Anubhav, et al.
Pubblicazione: (2026)
di: Bhatla, Anubhav, et al.
Pubblicazione: (2026)
Random and Safe Cache Architecture to Defeat Cache Timing Attacks
di: Hu, Guangyuan, et al.
Pubblicazione: (2023)
di: Hu, Guangyuan, et al.
Pubblicazione: (2023)
CMD: A Cache-assisted GPU Memory Deduplication Architecture
di: Zhao, Wei, et al.
Pubblicazione: (2024)
di: Zhao, Wei, et al.
Pubblicazione: (2024)
Robust Reasoning and Learning with Brain-Inspired Representations under Hardware-Induced Nonlinearities
di: Chung, William Youngwoo, et al.
Pubblicazione: (2026)
di: Chung, William Youngwoo, et al.
Pubblicazione: (2026)
Design-Oriented Modeling of TSV Substrate Noise Coupling to Ring VCOs
di: Exouzidis, Ilias, et al.
Pubblicazione: (2026)
di: Exouzidis, Ilias, et al.
Pubblicazione: (2026)
ARCANE: Adaptive RISC-V Cache Architecture for Near-memory Extensions
di: Petrolo, Vincenzo, et al.
Pubblicazione: (2025)
di: Petrolo, Vincenzo, et al.
Pubblicazione: (2025)
Choreographer: A Full-System Framework for Fine-Grained Tasks in Cache Hierarchies
di: Nguyen, Hoa, et al.
Pubblicazione: (2025)
di: Nguyen, Hoa, et al.
Pubblicazione: (2025)
Nexus Machine: An Active Message Inspired Reconfigurable Architecture for Irregular Workloads
di: Juneja, Rohan, et al.
Pubblicazione: (2025)
di: Juneja, Rohan, et al.
Pubblicazione: (2025)
A Near-Cache Architectural Framework for Cryptographic Computing
di: Zhang, Jingyao, et al.
Pubblicazione: (2025)
di: Zhang, Jingyao, et al.
Pubblicazione: (2025)
Multi-Dimensional Vector ISA Extension for Mobile In-Cache Computing
di: Khadem, Alireza, et al.
Pubblicazione: (2025)
di: Khadem, Alireza, et al.
Pubblicazione: (2025)
Per-Bank Bandwidth Regulation of Shared Last-Level Cache for Real-Time Systems
di: Sullivan, Connor, et al.
Pubblicazione: (2024)
di: Sullivan, Connor, et al.
Pubblicazione: (2024)
SwiftKV: An Edge-Oriented Attention Algorithm and Multi-Head Accelerator for Fast, Efficient LLM Decoding
di: Zhang, Junming, et al.
Pubblicazione: (2026)
di: Zhang, Junming, et al.
Pubblicazione: (2026)
COmPOSER: Circuit Optimization of mm-wave/RF circuits with Performance-Oriented Synthesis for Efficient Realizations
di: Ghosh, Subhadip, et al.
Pubblicazione: (2026)
di: Ghosh, Subhadip, et al.
Pubblicazione: (2026)
$n$-Musketeers: Reinforcement Learning Shapes Collaboration Among Language Models
di: Masukawa, Ryozo, et al.
Pubblicazione: (2026)
di: Masukawa, Ryozo, et al.
Pubblicazione: (2026)
Cross-Layer Design of Vector-Symbolic Computing: Bridging Cognition and Brain-Inspired Hardware Acceleration
di: Du, Shuting, et al.
Pubblicazione: (2025)
di: Du, Shuting, et al.
Pubblicazione: (2025)
Garibaldi: A Pairwise Instruction-Data Management for Enhancing Shared Last-Level Cache Performance in Server Workloads
di: Kwon, Jaewon, et al.
Pubblicazione: (2025)
di: Kwon, Jaewon, et al.
Pubblicazione: (2025)
SynDCIM: A Performance-Aware Digital Computing-in-Memory Compiler with Multi-Spec-Oriented Subcircuit Synthesis
di: Shao, Kunming, et al.
Pubblicazione: (2024)
di: Shao, Kunming, et al.
Pubblicazione: (2024)
Recoverable Anonymization for Pose Estimation: A Privacy-Enhancing Approach
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025) -
T-SAR: A Full-Stack Co-design for CPU-Only Ternary LLM Inference via In-Place SIMD ALU Reorganization
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025) -
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
di: Oh, Hyunwoo, et al.
Pubblicazione: (2026) -
Neuro-Photonix: Enabling Near-Sensor Neuro-Symbolic AI Computing on Silicon Photonics Substrate
di: Najafi, Deniz, et al.
Pubblicazione: (2024) -
ASTER: Attention-based Spiking Transformer Engine for Event-driven Reasoning
di: Das, Tamoghno, et al.
Pubblicazione: (2025)