Learning to See through Illumination Extremes with Event Streaming in Multimodal Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Baoheng, Liu, Jiahui, Zhao, Gui, Zhang, Weizhou, Ma, Yixuan, Jiang, Jun, Chen, Yingxian, Fok, Wilton W. T., Qi, Xiaojuan, So, Hayden Kwok-Hay |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A Composable Dynamic Sparse Dataflow Architecture for Efficient Event-based Vision Processing on FPGA
by: Gao, Yizhao, et al.
Published: (2024)
by: Gao, Yizhao, et al.
Published: (2024)
Co-designing a Sub-millisecond Latency Event-based Eye Tracking System with Submanifold Sparse CNN
by: Zhang, Baoheng, et al.
Published: (2024)
by: Zhang, Baoheng, et al.
Published: (2024)
SpikeMOT: Event-based Multi-Object Tracking with Sparse Motion Features
by: Wang, Song, et al.
Published: (2023)
by: Wang, Song, et al.
Published: (2023)
Aligning Effective Tokens with Video Anomaly in Large Language Models
by: Chen, Yingxian, et al.
Published: (2025)
by: Chen, Yingxian, et al.
Published: (2025)
EAG3R: Event-Augmented 3D Geometry Estimation for Dynamic and Extreme-Lighting Scenes
by: Wu, Xiaoshan, et al.
Published: (2025)
by: Wu, Xiaoshan, et al.
Published: (2025)
Validation of Consumer-grade Digital Camera-based Human Activity Evaluation for Upper Limb Exercises and Development of a Therapist-guided, Automated Telerehabilitation Framework and Platform for Stroke Rehabilitation
by: Yeung, Elton H. L., et al.
Published: (2023)
by: Yeung, Elton H. L., et al.
Published: (2023)
Can OOD Object Detectors Learn from Foundation Models?
by: Liu, Jiahui, et al.
Published: (2024)
by: Liu, Jiahui, et al.
Published: (2024)
Fully Integrated Memristive Spiking Neural Network with Analog Neurons for High-Speed Event-Based Data Processing
by: Wang, Zhu, et al.
Published: (2025)
by: Wang, Zhu, et al.
Published: (2025)
See, Remember, Explore: A Benchmark and Baselines for Streaming Spatial Reasoning
by: Wei, Yuxi, et al.
Published: (2026)
by: Wei, Yuxi, et al.
Published: (2026)
TATAA: Programmable Mixed-Precision Transformer Acceleration with a Transformable Arithmetic Architecture
by: Wu, Jiajun, et al.
Published: (2024)
by: Wu, Jiajun, et al.
Published: (2024)
EventGPT: Event Stream Understanding with Multimodal Large Language Models
by: Liu, Shaoyu, et al.
Published: (2024)
by: Liu, Shaoyu, et al.
Published: (2024)
See through the Dark: Learning Illumination-affined Representations for Nighttime Occupancy Prediction
by: Wu, Yuan, et al.
Published: (2025)
by: Wu, Yuan, et al.
Published: (2025)
Lifecycle Cost-Effectiveness Modeling for Redundancy-Enhanced Multi-Chiplet Architectures
by: Liu, Zizhen, et al.
Published: (2026)
by: Liu, Zizhen, et al.
Published: (2026)
Localizing Events in Videos with Multimodal Queries
by: Zhang, Gengyuan, et al.
Published: (2024)
by: Zhang, Gengyuan, et al.
Published: (2024)
Residual Decoding: Mitigating Hallucinations in Large Vision-Language Models via History-Aware Residual Guidance
by: Chen, Xinrong, et al.
Published: (2026)
by: Chen, Xinrong, et al.
Published: (2026)
TreeReview: A Dynamic Tree of Questions Framework for Deep and Efficient LLM-based Scientific Peer Review
by: Chang, Yuan, et al.
Published: (2025)
by: Chang, Yuan, et al.
Published: (2025)
EventVL: Understand Event Streams via Multimodal Large Language Model
by: Li, Pengteng, et al.
Published: (2025)
by: Li, Pengteng, et al.
Published: (2025)
Groma: Localized Visual Tokenization for Grounding Multimodal Large Language Models
by: Ma, Chuofan, et al.
Published: (2024)
by: Ma, Chuofan, et al.
Published: (2024)
Extreme Kinetic Stability and RNase Resistance of Human Telomerase RNA G‐Quadruplexes Overcome by DHX36 Helicase
by: Qun Luo, et al.
Published: (2026)
by: Qun Luo, et al.
Published: (2026)
ILLUME: Illuminating Your LLMs to See, Draw, and Self-Enhance
by: Wang, Chunwei, et al.
Published: (2024)
by: Wang, Chunwei, et al.
Published: (2024)
Learning to See in the Extremely Dark
by: Jiang, Hai, et al.
Published: (2025)
by: Jiang, Hai, et al.
Published: (2025)
GuiLoMo: Allocating Expert Number and Rank for LoRA-MoE via Bilevel Optimization with GuidedSelection Vectors
by: Zhang, Hengyuan, et al.
Published: (2025)
by: Zhang, Hengyuan, et al.
Published: (2025)
See Less, See Right: Bi-directional Perceptual Shaping For Multimodal Reasoning
by: Zhang, Shuoshuo, et al.
Published: (2025)
by: Zhang, Shuoshuo, et al.
Published: (2025)
Find Your Optimal Teacher: Personalized Data Synthesis via Router-Guided Multi-Teacher Distillation
by: Zhang, Hengyuan, et al.
Published: (2025)
by: Zhang, Hengyuan, et al.
Published: (2025)
Interplay Between the N→C Dative Bond, Intramolecular Chalcogen Bond and π Conjugation in the Complexes Formed by Cyclo[18]carbon and C 14 Polyyne with 1,2,5‐Chalcogenadiazoles
by: Yu Zhang, et al.
Published: (2024)
by: Yu Zhang, et al.
Published: (2024)
Beyond Illumination: Fine-Grained Detail Preservation in Extreme Dark Image Restoration
by: Zhang, Tongshun, et al.
Published: (2025)
by: Zhang, Tongshun, et al.
Published: (2025)
Graph-GRPO: Training Graph Flow Models with Reinforcement Learning
by: Zhu, Baoheng, et al.
Published: (2026)
by: Zhu, Baoheng, et al.
Published: (2026)
SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs
by: Gao, Yizhao, et al.
Published: (2024)
by: Gao, Yizhao, et al.
Published: (2024)
Beyond Outliers: A Data-Free Layer-wise Mixed-Precision Quantization Approach Driven by Numerical and Structural Dual-Sensitivity
by: Zhang, Hengyuan, et al.
Published: (2026)
by: Zhang, Hengyuan, et al.
Published: (2026)
Seeing the Unseen: Structured Illumination Microscopy for Organelles Dynamics
by: Adrian Tan, et al.
Published: (2025)
by: Adrian Tan, et al.
Published: (2025)
Seeing Through Transparency in Education Reform: Illuminating the “Local”
by: Jill Koyama
Published: (2016)
by: Jill Koyama
Published: (2016)
Seeing culture from below: Counter‐curating, counter‐ethnography, counter‐mapping
by: Gavin Grindon, et al.
Published: (2024)
by: Gavin Grindon, et al.
Published: (2024)
A psychoanalytic exploration of female to male transition. By SerenaHeller. Routledge, London, 2025. pp. 178. £112 (hardback). £25.59 (paperback) 9781032718576
by: Marcella Fok
Published: (2026)
by: Marcella Fok
Published: (2026)
Event-Based Method for High-Speed 3D Deformation Measurement under Extreme Illumination Conditions
by: Guan, Banglei, et al.
Published: (2026)
by: Guan, Banglei, et al.
Published: (2026)
From Efficiency to Adaptivity: A Deeper Look at Adaptive Reasoning in Large Language Models
by: Wu, Chao, et al.
Published: (2025)
by: Wu, Chao, et al.
Published: (2025)
DefenSee: Dissecting Threat from Sight and Text -- A Multi-View Defensive Pipeline for Multi-modal Jailbreaks
by: Wang, Zihao, et al.
Published: (2025)
by: Wang, Zihao, et al.
Published: (2025)
Train Short, Inference Long: Training-free Horizon Extension for Autoregressive Video Generation
by: Li, Jia, et al.
Published: (2026)
by: Li, Jia, et al.
Published: (2026)
Seeing is Believing? Mitigating OCR Hallucinations in Multimodal Large Language Models
by: He, Zhentao, et al.
Published: (2025)
by: He, Zhentao, et al.
Published: (2025)
Think-as-You-See: Streaming Chain-of-Thought Reasoning for Large Vision-Language Models
by: Zhang, Jialiang, et al.
Published: (2026)
by: Zhang, Jialiang, et al.
Published: (2026)
Unveiling Linguistic Regions in Large Language Models
by: Zhang, Zhihao, et al.
Published: (2024)
by: Zhang, Zhihao, et al.
Published: (2024)
Similar Items
-
A Composable Dynamic Sparse Dataflow Architecture for Efficient Event-based Vision Processing on FPGA
by: Gao, Yizhao, et al.
Published: (2024) -
Co-designing a Sub-millisecond Latency Event-based Eye Tracking System with Submanifold Sparse CNN
by: Zhang, Baoheng, et al.
Published: (2024) -
SpikeMOT: Event-based Multi-Object Tracking with Sparse Motion Features
by: Wang, Song, et al.
Published: (2023) -
Aligning Effective Tokens with Video Anomaly in Large Language Models
by: Chen, Yingxian, et al.
Published: (2025) -
EAG3R: Event-Augmented 3D Geometry Estimation for Dynamic and Extreme-Lighting Scenes
by: Wu, Xiaoshan, et al.
Published: (2025)