TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Hanning, Huang, Wenjun, Ni, Yang, Yun, Sanggeon, Liu, Yezi, Wen, Fei, Velasquez, Alvaro, Latapie, Hugo, Imani, Mohsen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2024)
di: Chen, Hanning, et al.
Pubblicazione: (2024)
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2025)
di: Chen, Hanning, et al.
Pubblicazione: (2025)
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
di: Liu, Yezi, et al.
Pubblicazione: (2025)
di: Liu, Yezi, et al.
Pubblicazione: (2025)
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
di: Liu, Yezi, et al.
Pubblicazione: (2025)
di: Liu, Yezi, et al.
Pubblicazione: (2025)
Cauchy-Schwarz Fairness Regularizer
di: Liu, Yezi, et al.
Pubblicazione: (2025)
di: Liu, Yezi, et al.
Pubblicazione: (2025)
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
Expanding Event Modality Applications through a Robust CLIP-Based Encoder
di: Jeong, Sungheon, et al.
Pubblicazione: (2024)
di: Jeong, Sungheon, et al.
Pubblicazione: (2024)
TorR: Towards Brain-Inspired Task-Oriented Reasoning via Cache-Oriented Algorithm-Architecture Co-design
di: Oh, Hyunwoo, et al.
Pubblicazione: (2026)
di: Oh, Hyunwoo, et al.
Pubblicazione: (2026)
Tell Me What to Track: Infusing Robust Language Guidance for Enhanced Referring Multi-Object Tracking
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
HDReason: Algorithm-Hardware Codesign for Hyperdimensional Knowledge Graph Reasoning
di: Chen, Hanning, et al.
Pubblicazione: (2024)
di: Chen, Hanning, et al.
Pubblicazione: (2024)
Promoting Fairness in Link Prediction with Graph Enhancement
di: Liu, Yezi, et al.
Pubblicazione: (2024)
di: Liu, Yezi, et al.
Pubblicazione: (2024)
Enabling Group Fairness in Graph Unlearning via Bi-level Debiasing
di: Liu, Yezi, et al.
Pubblicazione: (2025)
di: Liu, Yezi, et al.
Pubblicazione: (2025)
A Plug-in Tiny AI Module for Intelligent and Selective Sensor Data Transmission
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
EcoSense: Energy-Efficient Intelligent Sensing for In-Shore Ship Detection through Edge-Cloud Collaboration
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
PacketCLIP: Multi-Modal Embedding of Network Traffic and Language for Cybersecurity Reasoning
di: Masukawa, Ryozo, et al.
Pubblicazione: (2025)
di: Masukawa, Ryozo, et al.
Pubblicazione: (2025)
Internal Flow Signatures for Self-Checking and Refinement in LLMs
di: Jeong, Sungheon, et al.
Pubblicazione: (2026)
di: Jeong, Sungheon, et al.
Pubblicazione: (2026)
Recoverable Anonymization for Pose Estimation: A Privacy-Enhancing Approach
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
Draft and Refine with Visual Experts
di: Jeong, Sungheon, et al.
Pubblicazione: (2025)
di: Jeong, Sungheon, et al.
Pubblicazione: (2025)
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025)
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025)
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
di: Oh, Hyunwoo, et al.
Pubblicazione: (2026)
di: Oh, Hyunwoo, et al.
Pubblicazione: (2026)
Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?
di: Chen, Zhiling, et al.
Pubblicazione: (2025)
di: Chen, Zhiling, et al.
Pubblicazione: (2025)
Mitigating Bias in Graph Hyperdimensional Computing
di: Liu, Yezi, et al.
Pubblicazione: (2025)
di: Liu, Yezi, et al.
Pubblicazione: (2025)
PV-VTT: A Privacy-Centric Dataset for Mission-Specific Anomaly Detection and Natural Language Interpretation
di: Masukawa, Ryozo, et al.
Pubblicazione: (2024)
di: Masukawa, Ryozo, et al.
Pubblicazione: (2024)
Vision Language Model for Interpretable and Fine-grained Detection of Safety Compliance in Diverse Workplaces
di: Chen, Zhiling, et al.
Pubblicazione: (2024)
di: Chen, Zhiling, et al.
Pubblicazione: (2024)
Encoder-Free Knowledge-Graph Reasoning with LLMs via Hyperdimensional Path Retrieval
di: Liu, Yezi, et al.
Pubblicazione: (2025)
di: Liu, Yezi, et al.
Pubblicazione: (2025)
$n$-Musketeers: Reinforcement Learning Shapes Collaboration Among Language Models
di: Masukawa, Ryozo, et al.
Pubblicazione: (2026)
di: Masukawa, Ryozo, et al.
Pubblicazione: (2026)
A Few Large Shifts: Layer-Inconsistency Based Minimal Overhead Adversarial Example Detection
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
MERIT: Multi-domain Efficient RAW Image Translation
di: Huang, Wenjun, et al.
Pubblicazione: (2026)
di: Huang, Wenjun, et al.
Pubblicazione: (2026)
State-Centric Decision Process
di: Jeong, Sungheon, et al.
Pubblicazione: (2026)
di: Jeong, Sungheon, et al.
Pubblicazione: (2026)
DecoHD: Decomposed Hyperdimensional Classification under Extreme Memory Budgets
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
MissionGNN: Hierarchical Multimodal GNN-based Weakly Supervised Video Anomaly Recognition with Mission-Specific Knowledge Graph Generation
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
Hyperdimensional Intelligent Sensing for Efficient Real-Time Audio Processing on Extreme Edge
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
HyperSense: Hyperdimensional Intelligent Sensing for Energy-Efficient Sparse Data Processing
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
HyperSense: Hyperdimensional Intelligent Sensing for Energy‐Efficient Sparse Data Processing
di: Sanggeon Yun, et al.
Pubblicazione: (2024)
di: Sanggeon Yun, et al.
Pubblicazione: (2024)
NeuroHash: A Hyperdimensional Neuro-Symbolic Framework for Spatially-Aware Image Hashing and Retrieval
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
MissionHD: Hyperdimensional Refinement of Distribution-Deficient Reasoning Graphs for Video Anomaly Detection
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
HopFormer: Sparse Graph Transformers with Explicit Receptive Field Control
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
Common Sense Is All You Need
di: Latapie, Hugo
Pubblicazione: (2025)
di: Latapie, Hugo
Pubblicazione: (2025)
Towards A Litmus Test for Common Sense
di: Latapie, Hugo
Pubblicazione: (2025)
di: Latapie, Hugo
Pubblicazione: (2025)
Continuous GNN-based Anomaly Detection on Edge using Efficient Adaptive Knowledge Graph Learning
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
Documenti analoghi
-
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2024) -
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2025) -
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
di: Liu, Yezi, et al.
Pubblicazione: (2025) -
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
di: Liu, Yezi, et al.
Pubblicazione: (2025) -
Cauchy-Schwarz Fairness Regularizer
di: Liu, Yezi, et al.
Pubblicazione: (2025)