LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Hanning, Ni, Yang, Huang, Wenjun, Oh, Hyunwoo, Liu, Yezi, Das, Tamoghno, Imani, Mohsen |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ASTER: Attention-based Spiking Transformer Engine for Event-driven Reasoning
by: Das, Tamoghno, et al.
Published: (2025)
by: Das, Tamoghno, et al.
Published: (2025)
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
by: Oh, Hyunwoo, et al.
Published: (2025)
by: Oh, Hyunwoo, et al.
Published: (2025)
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
TorR: Towards Brain-Inspired Task-Oriented Reasoning via Cache-Oriented Algorithm-Architecture Co-design
by: Oh, Hyunwoo, et al.
Published: (2026)
by: Oh, Hyunwoo, et al.
Published: (2026)
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Cauchy-Schwarz Fairness Regularizer
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Enabling Group Fairness in Graph Unlearning via Bi-level Debiasing
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
Promoting Fairness in Link Prediction with Graph Enhancement
by: Liu, Yezi, et al.
Published: (2024)
by: Liu, Yezi, et al.
Published: (2024)
Tell Me What to Track: Infusing Robust Language Guidance for Enhanced Referring Multi-Object Tracking
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
Encoder-Free Knowledge-Graph Reasoning with LLMs via Hyperdimensional Path Retrieval
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Mitigating Bias in Graph Hyperdimensional Computing
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
T-SAR: A Full-Stack Co-design for CPU-Only Ternary LLM Inference via In-Place SIMD ALU Reorganization
by: Oh, Hyunwoo, et al.
Published: (2025)
by: Oh, Hyunwoo, et al.
Published: (2025)
Recoverable Anonymization for Pose Estimation: A Privacy-Enhancing Approach
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
Robust Reasoning and Learning with Brain-Inspired Representations under Hardware-Induced Nonlinearities
by: Chung, William Youngwoo, et al.
Published: (2026)
by: Chung, William Youngwoo, et al.
Published: (2026)
Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?
by: Chen, Zhiling, et al.
Published: (2025)
by: Chen, Zhiling, et al.
Published: (2025)
Vision Language Model for Interpretable and Fine-grained Detection of Safety Compliance in Diverse Workplaces
by: Chen, Zhiling, et al.
Published: (2024)
by: Chen, Zhiling, et al.
Published: (2024)
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
by: Yun, Sanggeon, et al.
Published: (2026)
by: Yun, Sanggeon, et al.
Published: (2026)
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
by: Oh, Hyunwoo, et al.
Published: (2026)
by: Oh, Hyunwoo, et al.
Published: (2026)
Short-LVLM: Compressing and Accelerating Large Vision-Language Models by Pruning Redundant Layers
by: Ma, Ji, et al.
Published: (2025)
by: Ma, Ji, et al.
Published: (2025)
$n$-Musketeers: Reinforcement Learning Shapes Collaboration Among Language Models
by: Masukawa, Ryozo, et al.
Published: (2026)
by: Masukawa, Ryozo, et al.
Published: (2026)
A Plug-in Tiny AI Module for Intelligent and Selective Sensor Data Transmission
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
DecoHD: Decomposed Hyperdimensional Classification under Extreme Memory Budgets
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
EcoSense: Energy-Efficient Intelligent Sensing for In-Shore Ship Detection through Edge-Cloud Collaboration
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
A Few Large Shifts: Layer-Inconsistency Based Minimal Overhead Adversarial Example Detection
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
Draft and Refine with Visual Experts
by: Jeong, Sungheon, et al.
Published: (2025)
by: Jeong, Sungheon, et al.
Published: (2025)
PacketCLIP: Multi-Modal Embedding of Network Traffic and Language for Cybersecurity Reasoning
by: Masukawa, Ryozo, et al.
Published: (2025)
by: Masukawa, Ryozo, et al.
Published: (2025)
Internal Flow Signatures for Self-Checking and Refinement in LLMs
by: Jeong, Sungheon, et al.
Published: (2026)
by: Jeong, Sungheon, et al.
Published: (2026)
Expanding Event Modality Applications through a Robust CLIP-Based Encoder
by: Jeong, Sungheon, et al.
Published: (2024)
by: Jeong, Sungheon, et al.
Published: (2024)
MERIT: Multi-domain Efficient RAW Image Translation
by: Huang, Wenjun, et al.
Published: (2026)
by: Huang, Wenjun, et al.
Published: (2026)
HEAL: Brain-inspired Hyperdimensional Efficient Active Learning
by: Ni, Yang, et al.
Published: (2024)
by: Ni, Yang, et al.
Published: (2024)
FusionSense: Tri-Stage Near-Sensor Learning for Runtime-Adaptive Multimodal Edge Intelligence
by: Yun, Sanggeon, et al.
Published: (2026)
by: Yun, Sanggeon, et al.
Published: (2026)
LogHD: Robust Compression of Hyperdimensional Classifiers via Logarithmic Class-Axis Reduction
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
HYPERDOA: Robust and Efficient DoA Estimation using Hyperdimensional Computing
by: Bhattacharjya, Rajat, et al.
Published: (2025)
by: Bhattacharjya, Rajat, et al.
Published: (2025)
HDReason: Algorithm-Hardware Codesign for Hyperdimensional Knowledge Graph Reasoning
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
LVLM-Interpret: An Interpretability Tool for Large Vision-Language Models
by: Stan, Gabriela Ben Melech, et al.
Published: (2024)
by: Stan, Gabriela Ben Melech, et al.
Published: (2024)
ViTCoP: Accelerating Large Vision-Language Models via Visual and Textual Semantic Collaborative Pruning
by: Luo, Wen, et al.
Published: (2026)
by: Luo, Wen, et al.
Published: (2026)
LVLM-COUNT: Enhancing the Counting Ability of Large Vision-Language Models
by: Qharabagh, Muhammad Fetrat, et al.
Published: (2024)
by: Qharabagh, Muhammad Fetrat, et al.
Published: (2024)
SoMeLVLM: A Large Vision Language Model for Social Media Processing
by: Zhang, Xinnong, et al.
Published: (2024)
by: Zhang, Xinnong, et al.
Published: (2024)
Similar Items
-
ASTER: Attention-based Spiking Transformer Engine for Event-driven Reasoning
by: Das, Tamoghno, et al.
Published: (2025) -
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
by: Oh, Hyunwoo, et al.
Published: (2025) -
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
by: Chen, Hanning, et al.
Published: (2024) -
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
by: Liu, Yezi, et al.
Published: (2025) -
TorR: Towards Brain-Inspired Task-Oriented Reasoning via Cache-Oriented Algorithm-Architecture Co-design
by: Oh, Hyunwoo, et al.
Published: (2026)