Draft and Refine with Visual Experts
Fuente:
arXiv
Salvato in:
| Autori principali: | Jeong, Sungheon, Masukawa, Ryozo, Park, Jihong, Yun, Sanggeon, Huang, Wenjun, Chen, Hanning, Imani, Mahdi, Imani, Mohsen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
NeuroHash: A Hyperdimensional Neuro-Symbolic Framework for Spatially-Aware Image Hashing and Retrieval
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
PV-VTT: A Privacy-Centric Dataset for Mission-Specific Anomaly Detection and Natural Language Interpretation
di: Masukawa, Ryozo, et al.
Pubblicazione: (2024)
di: Masukawa, Ryozo, et al.
Pubblicazione: (2024)
Uncertainty-Weighted Image-Event Multimodal Fusion for Video Anomaly Detection
di: Jeong, Sungheon, et al.
Pubblicazione: (2025)
di: Jeong, Sungheon, et al.
Pubblicazione: (2025)
Expanding Event Modality Applications through a Robust CLIP-Based Encoder
di: Jeong, Sungheon, et al.
Pubblicazione: (2024)
di: Jeong, Sungheon, et al.
Pubblicazione: (2024)
Internal Flow Signatures for Self-Checking and Refinement in LLMs
di: Jeong, Sungheon, et al.
Pubblicazione: (2026)
di: Jeong, Sungheon, et al.
Pubblicazione: (2026)
State-Centric Decision Process
di: Jeong, Sungheon, et al.
Pubblicazione: (2026)
di: Jeong, Sungheon, et al.
Pubblicazione: (2026)
EcoSense: Energy-Efficient Intelligent Sensing for In-Shore Ship Detection through Edge-Cloud Collaboration
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
HopFormer: Sparse Graph Transformers with Explicit Receptive Field Control
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?
di: Chen, Zhiling, et al.
Pubblicazione: (2025)
di: Chen, Zhiling, et al.
Pubblicazione: (2025)
MERIT: Multi-domain Efficient RAW Image Translation
di: Huang, Wenjun, et al.
Pubblicazione: (2026)
di: Huang, Wenjun, et al.
Pubblicazione: (2026)
TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
di: Chen, Hanning, et al.
Pubblicazione: (2024)
di: Chen, Hanning, et al.
Pubblicazione: (2024)
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025)
di: Oh, Hyunwoo, et al.
Pubblicazione: (2025)
Vision Language Model for Interpretable and Fine-grained Detection of Safety Compliance in Diverse Workplaces
di: Chen, Zhiling, et al.
Pubblicazione: (2024)
di: Chen, Zhiling, et al.
Pubblicazione: (2024)
DecoHD: Decomposed Hyperdimensional Classification under Extreme Memory Budgets
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
MissionGNN: Hierarchical Multimodal GNN-based Weakly Supervised Video Anomaly Recognition with Mission-Specific Knowledge Graph Generation
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2025)
di: Chen, Hanning, et al.
Pubblicazione: (2025)
PacketCLIP: Multi-Modal Embedding of Network Traffic and Language for Cybersecurity Reasoning
di: Masukawa, Ryozo, et al.
Pubblicazione: (2025)
di: Masukawa, Ryozo, et al.
Pubblicazione: (2025)
Tell Me What to Track: Infusing Robust Language Guidance for Enhanced Referring Multi-Object Tracking
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
MissionHD: Hyperdimensional Refinement of Distribution-Deficient Reasoning Graphs for Video Anomaly Detection
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
di: Chen, Hanning, et al.
Pubblicazione: (2024)
di: Chen, Hanning, et al.
Pubblicazione: (2024)
Recoverable Anonymization for Pose Estimation: A Privacy-Enhancing Approach
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
A Plug-in Tiny AI Module for Intelligent and Selective Sensor Data Transmission
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
di: Huang, Wenjun, et al.
Pubblicazione: (2024)
$n$-Musketeers: Reinforcement Learning Shapes Collaboration Among Language Models
di: Masukawa, Ryozo, et al.
Pubblicazione: (2026)
di: Masukawa, Ryozo, et al.
Pubblicazione: (2026)
A Few Large Shifts: Layer-Inconsistency Based Minimal Overhead Adversarial Example Detection
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
Hyperdimensional Intelligent Sensing for Efficient Real-Time Audio Processing on Extreme Edge
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
Self-Attention Based Semantic Decomposition in Vector Symbolic Architectures
di: Yeung, Calvin, et al.
Pubblicazione: (2024)
di: Yeung, Calvin, et al.
Pubblicazione: (2024)
HyperSense: Hyperdimensional Intelligent Sensing for Energy-Efficient Sparse Data Processing
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
HyperSense: Hyperdimensional Intelligent Sensing for Energy‐Efficient Sparse Data Processing
di: Sanggeon Yun, et al.
Pubblicazione: (2024)
di: Sanggeon Yun, et al.
Pubblicazione: (2024)
Explainable Differential Privacy-Hyperdimensional Computing for Balancing Privacy and Transparency in Additive Manufacturing Monitoring
di: Piran, Fardin Jalil, et al.
Pubblicazione: (2024)
di: Piran, Fardin Jalil, et al.
Pubblicazione: (2024)
FusionSense: Tri-Stage Near-Sensor Learning for Runtime-Adaptive Multimodal Edge Intelligence
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
di: Yun, Sanggeon, et al.
Pubblicazione: (2026)
Quantization Robustness to Input Degradations for Object Detection
di: Karimov, Toghrul, et al.
Pubblicazione: (2025)
di: Karimov, Toghrul, et al.
Pubblicazione: (2025)
A comprehensive Persian offline handwritten database for investigating the effects of heritability and family relationships on handwriting
di: Zohrevand, Abbas, et al.
Pubblicazione: (2025)
di: Zohrevand, Abbas, et al.
Pubblicazione: (2025)
LogHD: Robust Compression of Hyperdimensional Classifiers via Logarithmic Class-Axis Reduction
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
Continuous GNN-based Anomaly Detection on Edge using Efficient Adaptive Knowledge Graph Learning
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
di: Yun, Sanggeon, et al.
Pubblicazione: (2024)
Coupled Inference in Diffusion Models for Semantic Decomposition
di: Yeung, Calvin, et al.
Pubblicazione: (2026)
di: Yeung, Calvin, et al.
Pubblicazione: (2026)
Learning How To Ask: Cycle-Consistency Refines Prompts in Multimodal Foundation Models
di: Diesendruck, Maurice, et al.
Pubblicazione: (2024)
di: Diesendruck, Maurice, et al.
Pubblicazione: (2024)
Region-Aware Deformable Convolutions
di: Maleki, Abolfazl Saheban, et al.
Pubblicazione: (2025)
di: Maleki, Abolfazl Saheban, et al.
Pubblicazione: (2025)
TorchTraceAP: A New Benchmark Dataset for Detecting Performance Anti-Patterns in Computer Vision Models
di: Chen, Hanning, et al.
Pubblicazione: (2025)
di: Chen, Hanning, et al.
Pubblicazione: (2025)
Seeing the Unseen: Towards Zero-Shot Inspection for Wind Turbine Blades using Knowledge-Augmented Vision Language Models
di: Zhang, Yang, et al.
Pubblicazione: (2025)
di: Zhang, Yang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
di: Yun, Sanggeon, et al.
Pubblicazione: (2026) -
NeuroHash: A Hyperdimensional Neuro-Symbolic Framework for Spatially-Aware Image Hashing and Retrieval
di: Yun, Sanggeon, et al.
Pubblicazione: (2024) -
PV-VTT: A Privacy-Centric Dataset for Mission-Specific Anomaly Detection and Natural Language Interpretation
di: Masukawa, Ryozo, et al.
Pubblicazione: (2024) -
Uncertainty-Weighted Image-Event Multimodal Fusion for Video Anomaly Detection
di: Jeong, Sungheon, et al.
Pubblicazione: (2025) -
Expanding Event Modality Applications through a Robust CLIP-Based Encoder
di: Jeong, Sungheon, et al.
Pubblicazione: (2024)