EventFlash: Towards Efficient MLLMs for Event-Based Vision
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Shaoyu, Li, Jianing, Zhao, Guanghui, Zhang, Yunjian, Jiang, Wen, Li, Ming, Ji, Xiangyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EventBench: Towards Comprehensive Benchmarking of Event-based MLLMs
di: Liu, Shaoyu, et al.
Pubblicazione: (2025)
di: Liu, Shaoyu, et al.
Pubblicazione: (2025)
EventGPT: Event Stream Understanding with Multimodal Large Language Models
di: Liu, Shaoyu, et al.
Pubblicazione: (2024)
di: Liu, Shaoyu, et al.
Pubblicazione: (2024)
Towards Understanding How Knowledge Evolves in Large Vision-Language Models
di: Wang, Sudong, et al.
Pubblicazione: (2025)
di: Wang, Sudong, et al.
Pubblicazione: (2025)
FlashCap: Millisecond-Accurate Human Motion Capture via Flashing LEDs and Event-Based Vision
di: Wu, Zekai, et al.
Pubblicazione: (2026)
di: Wu, Zekai, et al.
Pubblicazione: (2026)
Learning to Remove Lens Flare in Event Camera
di: Han, Haiqian, et al.
Pubblicazione: (2025)
di: Han, Haiqian, et al.
Pubblicazione: (2025)
Memory Helps, but Confabulation Misleads: Understanding Streaming Events in Videos with MLLMs
di: Zhang, Gengyuan, et al.
Pubblicazione: (2025)
di: Zhang, Gengyuan, et al.
Pubblicazione: (2025)
EventZoom: A Progressive Approach to Event-Based Data Augmentation for Enhanced Neuromorphic Vision
di: Dong, Yiting, et al.
Pubblicazione: (2024)
di: Dong, Yiting, et al.
Pubblicazione: (2024)
LongFly: Long-Horizon UAV Vision-and-Language Navigation with Spatiotemporal Context Integration
di: Jiang, Wen, et al.
Pubblicazione: (2025)
di: Jiang, Wen, et al.
Pubblicazione: (2025)
Moment-Video: Diagnosing Temporal Fidelity of Video MLLMs on Momentary Visual Events
di: Liu, Xiaolin, et al.
Pubblicazione: (2026)
di: Liu, Xiaolin, et al.
Pubblicazione: (2026)
Adaptive Event Stream Slicing for Open-Vocabulary Event-Based Object Detection via Vision-Language Knowledge Distillation
di: Zhang, Jinchang, et al.
Pubblicazione: (2025)
di: Zhang, Jinchang, et al.
Pubblicazione: (2025)
Towards Event-oriented Long Video Understanding
di: Du, Yifan, et al.
Pubblicazione: (2024)
di: Du, Yifan, et al.
Pubblicazione: (2024)
Event-Priori-Based Vision-Language Model for Efficient Visual Understanding
di: Qin, Haotong, et al.
Pubblicazione: (2025)
di: Qin, Haotong, et al.
Pubblicazione: (2025)
Patch-as-Decodable-Token: Towards Unified Multi-Modal Vision Tasks in MLLMs
di: Su, Yongyi, et al.
Pubblicazione: (2025)
di: Su, Yongyi, et al.
Pubblicazione: (2025)
ExtraVAR: Stage-Aware RoPE Remapping for Resolution Extrapolation in Visual Autoregressive Models
di: Yan, Feihong, et al.
Pubblicazione: (2026)
di: Yan, Feihong, et al.
Pubblicazione: (2026)
Zebrafish Counting Using Event Stream Data
di: Chen, Qianghua, et al.
Pubblicazione: (2025)
di: Chen, Qianghua, et al.
Pubblicazione: (2025)
Bridging the Gap Between Ideal and Real-world Evaluation: Benchmarking AI-Generated Image Detection in Challenging Scenarios
di: Li, Chunxiao, et al.
Pubblicazione: (2025)
di: Li, Chunxiao, et al.
Pubblicazione: (2025)
HDI-Former: Hybrid Dynamic Interaction ANN-SNN Transformer for Object Detection Using Frames and Events
di: Li, Dianze, et al.
Pubblicazione: (2024)
di: Li, Dianze, et al.
Pubblicazione: (2024)
Efficient Event-Based Semantic Segmentation via Exploiting Frame-Event Fusion: A Hybrid Neural Network Approach
di: Li, Hebei, et al.
Pubblicazione: (2025)
di: Li, Hebei, et al.
Pubblicazione: (2025)
SpatialFly: Geometry-Guided Representation Alignment for UAV Vision-and-Language Navigation in Urban Environments
di: Jiang, Wen, et al.
Pubblicazione: (2026)
di: Jiang, Wen, et al.
Pubblicazione: (2026)
VLDrive: Vision-Augmented Lightweight MLLMs for Efficient Language-grounded Autonomous Driving
di: Zhang, Ruifei, et al.
Pubblicazione: (2025)
di: Zhang, Ruifei, et al.
Pubblicazione: (2025)
EventGait: Towards Robust Gait Recognition with Event Streams
di: Xu, Senyan, et al.
Pubblicazione: (2026)
di: Xu, Senyan, et al.
Pubblicazione: (2026)
EventHallusion: Diagnosing Event Hallucinations in Video LLMs
di: Zhang, Jiacheng, et al.
Pubblicazione: (2024)
di: Zhang, Jiacheng, et al.
Pubblicazione: (2024)
Event Transformer
di: Jiang, Bin, et al.
Pubblicazione: (2022)
di: Jiang, Bin, et al.
Pubblicazione: (2022)
Magic-MM-Embedding: Towards Visual-Token-Efficient Universal Multimodal Embedding with MLLMs
di: Li, Qi, et al.
Pubblicazione: (2026)
di: Li, Qi, et al.
Pubblicazione: (2026)
FreqTrack: Frequency Learning based Vision Transformer for RGB-Event Object Tracking
di: You, Jinlin, et al.
Pubblicazione: (2026)
di: You, Jinlin, et al.
Pubblicazione: (2026)
RS-OOD: A Vision-Language Augmented Framework for Out-of-Distribution Detection in Remote Sensing
di: Wang, Chenhao, et al.
Pubblicazione: (2025)
di: Wang, Chenhao, et al.
Pubblicazione: (2025)
Research, Applications and Prospects of Event-Based Pedestrian Detection: A Survey
di: Wang, Han, et al.
Pubblicazione: (2024)
di: Wang, Han, et al.
Pubblicazione: (2024)
CAS-ViT: Convolutional Additive Self-attention Vision Transformers for Efficient Mobile Applications
di: Zhang, Tianfang, et al.
Pubblicazione: (2024)
di: Zhang, Tianfang, et al.
Pubblicazione: (2024)
Towards Universal Video MLLMs with Attribute-Structured and Quality-Verified Instructions
di: Li, Yunheng, et al.
Pubblicazione: (2026)
di: Li, Yunheng, et al.
Pubblicazione: (2026)
Temporal-Guided Visual Foundation Models for Event-Based Vision
di: Xia, Ruihao, et al.
Pubblicazione: (2025)
di: Xia, Ruihao, et al.
Pubblicazione: (2025)
evMLP: An Efficient Event-Driven MLP Architecture for Vision
di: Zheng, Zhentan
Pubblicazione: (2025)
di: Zheng, Zhentan
Pubblicazione: (2025)
Self-supervised Event-based Monocular Depth Estimation using Cross-modal Consistency
di: Zhu, Junyu, et al.
Pubblicazione: (2024)
di: Zhu, Junyu, et al.
Pubblicazione: (2024)
Towards Camera-Robust 3D Localization: Equation-Anchored Tool-Use for MLLMs
di: Jiang, Xueying, et al.
Pubblicazione: (2026)
di: Jiang, Xueying, et al.
Pubblicazione: (2026)
Learning from Dense Events: Towards Fast Spiking Neural Networks Training via Event Dataset Distillation
di: Ye, Shuhan, et al.
Pubblicazione: (2025)
di: Ye, Shuhan, et al.
Pubblicazione: (2025)
From Events to Enhancement: A Survey on Event-Based Imaging Technologies
di: Lu, Yunfan, et al.
Pubblicazione: (2025)
di: Lu, Yunfan, et al.
Pubblicazione: (2025)
EventSTU: Event-Guided Efficient Spatio-Temporal Understanding for Video Large Language Models
di: Xu, Wenhao, et al.
Pubblicazione: (2025)
di: Xu, Wenhao, et al.
Pubblicazione: (2025)
V2V: Scaling Event-Based Vision through Efficient Video-to-Voxel Simulation
di: Lou, Hanyue, et al.
Pubblicazione: (2025)
di: Lou, Hanyue, et al.
Pubblicazione: (2025)
FPGA-Based Hardware Architecture for Contrast Maximization in Event-Based Vision
di: Filipkowski, Michal, et al.
Pubblicazione: (2026)
di: Filipkowski, Michal, et al.
Pubblicazione: (2026)
StreamForest: Efficient Online Video Understanding with Persistent Event Memory
di: Zeng, Xiangyu, et al.
Pubblicazione: (2025)
di: Zeng, Xiangyu, et al.
Pubblicazione: (2025)
Making MLLMs Blind: Adversarial Smuggling Attacks in MLLM Content Moderation
di: Li, Zhiheng, et al.
Pubblicazione: (2026)
di: Li, Zhiheng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
EventBench: Towards Comprehensive Benchmarking of Event-based MLLMs
di: Liu, Shaoyu, et al.
Pubblicazione: (2025) -
EventGPT: Event Stream Understanding with Multimodal Large Language Models
di: Liu, Shaoyu, et al.
Pubblicazione: (2024) -
Towards Understanding How Knowledge Evolves in Large Vision-Language Models
di: Wang, Sudong, et al.
Pubblicazione: (2025) -
FlashCap: Millisecond-Accurate Human Motion Capture via Flashing LEDs and Event-Based Vision
di: Wu, Zekai, et al.
Pubblicazione: (2026) -
Learning to Remove Lens Flare in Event Camera
di: Han, Haiqian, et al.
Pubblicazione: (2025)