VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Hanning, Ni, Yang, Huang, Wenjun, Liu, Yezi, Jeong, SungHeon, Wen, Fei, Bastian, Nathaniel, Latapie, Hugo, Imani, Mohsen |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
Recoverable Anonymization for Pose Estimation: A Privacy-Enhancing Approach
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
by: Yun, Sanggeon, et al.
Published: (2026)
by: Yun, Sanggeon, et al.
Published: (2026)
TorR: Towards Brain-Inspired Task-Oriented Reasoning via Cache-Oriented Algorithm-Architecture Co-design
by: Oh, Hyunwoo, et al.
Published: (2026)
by: Oh, Hyunwoo, et al.
Published: (2026)
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
by: Chen, Hanning, et al.
Published: (2025)
by: Chen, Hanning, et al.
Published: (2025)
Generalized Holographic Reduced Representations
by: Yeung, Calvin, et al.
Published: (2024)
by: Yeung, Calvin, et al.
Published: (2024)
NeuroHash: A Hyperdimensional Neuro-Symbolic Framework for Spatially-Aware Image Hashing and Retrieval
by: Yun, Sanggeon, et al.
Published: (2024)
by: Yun, Sanggeon, et al.
Published: (2024)
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Cauchy-Schwarz Fairness Regularizer
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Promoting Fairness in Link Prediction with Graph Enhancement
by: Liu, Yezi, et al.
Published: (2024)
by: Liu, Yezi, et al.
Published: (2024)
Hyperdimensional Intelligent Sensing for Efficient Real-Time Audio Processing on Extreme Edge
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
Enabling Group Fairness in Graph Unlearning via Bi-level Debiasing
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
MERIT: Multi-domain Efficient RAW Image Translation
by: Huang, Wenjun, et al.
Published: (2026)
by: Huang, Wenjun, et al.
Published: (2026)
Tell Me What to Track: Infusing Robust Language Guidance for Enhanced Referring Multi-Object Tracking
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
$n$-Musketeers: Reinforcement Learning Shapes Collaboration Among Language Models
by: Masukawa, Ryozo, et al.
Published: (2026)
by: Masukawa, Ryozo, et al.
Published: (2026)
FusionSense: Tri-Stage Near-Sensor Learning for Runtime-Adaptive Multimodal Edge Intelligence
by: Yun, Sanggeon, et al.
Published: (2026)
by: Yun, Sanggeon, et al.
Published: (2026)
Exploiting Boosting in Hyperdimensional Computing for Enhanced Reliability in Healthcare
by: Jeong, SungHeon, et al.
Published: (2024)
by: Jeong, SungHeon, et al.
Published: (2024)
Mitigating Bias in Graph Hyperdimensional Computing
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?
by: Chen, Zhiling, et al.
Published: (2025)
by: Chen, Zhiling, et al.
Published: (2025)
HDReason: Algorithm-Hardware Codesign for Hyperdimensional Knowledge Graph Reasoning
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
Encoder-Free Knowledge-Graph Reasoning with LLMs via Hyperdimensional Path Retrieval
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Vision Language Model for Interpretable and Fine-grained Detection of Safety Compliance in Diverse Workplaces
by: Chen, Zhiling, et al.
Published: (2024)
by: Chen, Zhiling, et al.
Published: (2024)
PacketCLIP: Multi-Modal Embedding of Network Traffic and Language for Cybersecurity Reasoning
by: Masukawa, Ryozo, et al.
Published: (2025)
by: Masukawa, Ryozo, et al.
Published: (2025)
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
by: Oh, Hyunwoo, et al.
Published: (2026)
by: Oh, Hyunwoo, et al.
Published: (2026)
A Plug-in Tiny AI Module for Intelligent and Selective Sensor Data Transmission
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
Internal Flow Signatures for Self-Checking and Refinement in LLMs
by: Jeong, Sungheon, et al.
Published: (2026)
by: Jeong, Sungheon, et al.
Published: (2026)
Neuro-Photonix: Enabling Near-Sensor Neuro-Symbolic AI Computing on Silicon Photonics Substrate
by: Najafi, Deniz, et al.
Published: (2024)
by: Najafi, Deniz, et al.
Published: (2024)
Draft and Refine with Visual Experts
by: Jeong, Sungheon, et al.
Published: (2025)
by: Jeong, Sungheon, et al.
Published: (2025)
Common Sense Is All You Need
by: Latapie, Hugo
Published: (2025)
by: Latapie, Hugo
Published: (2025)
Towards A Litmus Test for Common Sense
by: Latapie, Hugo
Published: (2025)
by: Latapie, Hugo
Published: (2025)
Expanding Event Modality Applications through a Robust CLIP-Based Encoder
by: Jeong, Sungheon, et al.
Published: (2024)
by: Jeong, Sungheon, et al.
Published: (2024)
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
by: Oh, Hyunwoo, et al.
Published: (2025)
by: Oh, Hyunwoo, et al.
Published: (2025)
EcoSense: Energy-Efficient Intelligent Sensing for In-Shore Ship Detection through Edge-Cloud Collaboration
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
by: Wang, Yahong, et al.
Published: (2026)
by: Wang, Yahong, et al.
Published: (2026)
A Few Large Shifts: Layer-Inconsistency Based Minimal Overhead Adversarial Example Detection
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
MissionHD: Hyperdimensional Refinement of Distribution-Deficient Reasoning Graphs for Video Anomaly Detection
by: Yun, Sanggeon, et al.
Published: (2025)
by: Yun, Sanggeon, et al.
Published: (2025)
Decoupled Similarity for Task-Aware Token Pruning in Large Vision-Language Models
by: Ma, Kexin, et al.
Published: (2026)
by: Ma, Kexin, et al.
Published: (2026)
HEAL: Brain-inspired Hyperdimensional Efficient Active Learning
by: Ni, Yang, et al.
Published: (2024)
by: Ni, Yang, et al.
Published: (2024)
Continuous GNN-based Anomaly Detection on Edge using Efficient Adaptive Knowledge Graph Learning
by: Yun, Sanggeon, et al.
Published: (2024)
by: Yun, Sanggeon, et al.
Published: (2024)
Similar Items
-
TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
by: Chen, Hanning, et al.
Published: (2024) -
Recoverable Anonymization for Pose Estimation: A Privacy-Enhancing Approach
by: Huang, Wenjun, et al.
Published: (2024) -
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
by: Yun, Sanggeon, et al.
Published: (2026) -
TorR: Towards Brain-Inspired Task-Oriented Reasoning via Cache-Oriented Algorithm-Architecture Co-design
by: Oh, Hyunwoo, et al.
Published: (2026) -
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
by: Chen, Hanning, et al.
Published: (2025)