Learning to See through Illumination Extremes with Event Streaming in Multimodal Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Baoheng, Liu, Jiahui, Zhao, Gui, Zhang, Weizhou, Ma, Yixuan, Jiang, Jun, Chen, Yingxian, Fok, Wilton W. T., Qi, Xiaojuan, So, Hayden Kwok-Hay |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Composable Dynamic Sparse Dataflow Architecture for Efficient Event-based Vision Processing on FPGA
di: Gao, Yizhao, et al.
Pubblicazione: (2024)
di: Gao, Yizhao, et al.
Pubblicazione: (2024)
Co-designing a Sub-millisecond Latency Event-based Eye Tracking System with Submanifold Sparse CNN
di: Zhang, Baoheng, et al.
Pubblicazione: (2024)
di: Zhang, Baoheng, et al.
Pubblicazione: (2024)
SpikeMOT: Event-based Multi-Object Tracking with Sparse Motion Features
di: Wang, Song, et al.
Pubblicazione: (2023)
di: Wang, Song, et al.
Pubblicazione: (2023)
Aligning Effective Tokens with Video Anomaly in Large Language Models
di: Chen, Yingxian, et al.
Pubblicazione: (2025)
di: Chen, Yingxian, et al.
Pubblicazione: (2025)
EAG3R: Event-Augmented 3D Geometry Estimation for Dynamic and Extreme-Lighting Scenes
di: Wu, Xiaoshan, et al.
Pubblicazione: (2025)
di: Wu, Xiaoshan, et al.
Pubblicazione: (2025)
Validation of Consumer-grade Digital Camera-based Human Activity Evaluation for Upper Limb Exercises and Development of a Therapist-guided, Automated Telerehabilitation Framework and Platform for Stroke Rehabilitation
di: Yeung, Elton H. L., et al.
Pubblicazione: (2023)
di: Yeung, Elton H. L., et al.
Pubblicazione: (2023)
Can OOD Object Detectors Learn from Foundation Models?
di: Liu, Jiahui, et al.
Pubblicazione: (2024)
di: Liu, Jiahui, et al.
Pubblicazione: (2024)
Fully Integrated Memristive Spiking Neural Network with Analog Neurons for High-Speed Event-Based Data Processing
di: Wang, Zhu, et al.
Pubblicazione: (2025)
di: Wang, Zhu, et al.
Pubblicazione: (2025)
See, Remember, Explore: A Benchmark and Baselines for Streaming Spatial Reasoning
di: Wei, Yuxi, et al.
Pubblicazione: (2026)
di: Wei, Yuxi, et al.
Pubblicazione: (2026)
TATAA: Programmable Mixed-Precision Transformer Acceleration with a Transformable Arithmetic Architecture
di: Wu, Jiajun, et al.
Pubblicazione: (2024)
di: Wu, Jiajun, et al.
Pubblicazione: (2024)
EventGPT: Event Stream Understanding with Multimodal Large Language Models
di: Liu, Shaoyu, et al.
Pubblicazione: (2024)
di: Liu, Shaoyu, et al.
Pubblicazione: (2024)
See through the Dark: Learning Illumination-affined Representations for Nighttime Occupancy Prediction
di: Wu, Yuan, et al.
Pubblicazione: (2025)
di: Wu, Yuan, et al.
Pubblicazione: (2025)
Lifecycle Cost-Effectiveness Modeling for Redundancy-Enhanced Multi-Chiplet Architectures
di: Liu, Zizhen, et al.
Pubblicazione: (2026)
di: Liu, Zizhen, et al.
Pubblicazione: (2026)
Localizing Events in Videos with Multimodal Queries
di: Zhang, Gengyuan, et al.
Pubblicazione: (2024)
di: Zhang, Gengyuan, et al.
Pubblicazione: (2024)
Residual Decoding: Mitigating Hallucinations in Large Vision-Language Models via History-Aware Residual Guidance
di: Chen, Xinrong, et al.
Pubblicazione: (2026)
di: Chen, Xinrong, et al.
Pubblicazione: (2026)
TreeReview: A Dynamic Tree of Questions Framework for Deep and Efficient LLM-based Scientific Peer Review
di: Chang, Yuan, et al.
Pubblicazione: (2025)
di: Chang, Yuan, et al.
Pubblicazione: (2025)
EventVL: Understand Event Streams via Multimodal Large Language Model
di: Li, Pengteng, et al.
Pubblicazione: (2025)
di: Li, Pengteng, et al.
Pubblicazione: (2025)
Groma: Localized Visual Tokenization for Grounding Multimodal Large Language Models
di: Ma, Chuofan, et al.
Pubblicazione: (2024)
di: Ma, Chuofan, et al.
Pubblicazione: (2024)
Extreme Kinetic Stability and RNase Resistance of Human Telomerase RNA G‐Quadruplexes Overcome by DHX36 Helicase
di: Qun Luo, et al.
Pubblicazione: (2026)
di: Qun Luo, et al.
Pubblicazione: (2026)
ILLUME: Illuminating Your LLMs to See, Draw, and Self-Enhance
di: Wang, Chunwei, et al.
Pubblicazione: (2024)
di: Wang, Chunwei, et al.
Pubblicazione: (2024)
Learning to See in the Extremely Dark
di: Jiang, Hai, et al.
Pubblicazione: (2025)
di: Jiang, Hai, et al.
Pubblicazione: (2025)
GuiLoMo: Allocating Expert Number and Rank for LoRA-MoE via Bilevel Optimization with GuidedSelection Vectors
di: Zhang, Hengyuan, et al.
Pubblicazione: (2025)
di: Zhang, Hengyuan, et al.
Pubblicazione: (2025)
See Less, See Right: Bi-directional Perceptual Shaping For Multimodal Reasoning
di: Zhang, Shuoshuo, et al.
Pubblicazione: (2025)
di: Zhang, Shuoshuo, et al.
Pubblicazione: (2025)
Find Your Optimal Teacher: Personalized Data Synthesis via Router-Guided Multi-Teacher Distillation
di: Zhang, Hengyuan, et al.
Pubblicazione: (2025)
di: Zhang, Hengyuan, et al.
Pubblicazione: (2025)
Interplay Between the N→C Dative Bond, Intramolecular Chalcogen Bond and π Conjugation in the Complexes Formed by Cyclo[18]carbon and C 14 Polyyne with 1,2,5‐Chalcogenadiazoles
di: Yu Zhang, et al.
Pubblicazione: (2024)
di: Yu Zhang, et al.
Pubblicazione: (2024)
Beyond Illumination: Fine-Grained Detail Preservation in Extreme Dark Image Restoration
di: Zhang, Tongshun, et al.
Pubblicazione: (2025)
di: Zhang, Tongshun, et al.
Pubblicazione: (2025)
Graph-GRPO: Training Graph Flow Models with Reinforcement Learning
di: Zhu, Baoheng, et al.
Pubblicazione: (2026)
di: Zhu, Baoheng, et al.
Pubblicazione: (2026)
SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs
di: Gao, Yizhao, et al.
Pubblicazione: (2024)
di: Gao, Yizhao, et al.
Pubblicazione: (2024)
Beyond Outliers: A Data-Free Layer-wise Mixed-Precision Quantization Approach Driven by Numerical and Structural Dual-Sensitivity
di: Zhang, Hengyuan, et al.
Pubblicazione: (2026)
di: Zhang, Hengyuan, et al.
Pubblicazione: (2026)
Seeing the Unseen: Structured Illumination Microscopy for Organelles Dynamics
di: Adrian Tan, et al.
Pubblicazione: (2025)
di: Adrian Tan, et al.
Pubblicazione: (2025)
Seeing Through Transparency in Education Reform: Illuminating the “Local”
di: Jill Koyama
Pubblicazione: (2016)
di: Jill Koyama
Pubblicazione: (2016)
Seeing culture from below: Counter‐curating, counter‐ethnography, counter‐mapping
di: Gavin Grindon, et al.
Pubblicazione: (2024)
di: Gavin Grindon, et al.
Pubblicazione: (2024)
A psychoanalytic exploration of female to male transition. By SerenaHeller. Routledge, London, 2025. pp. 178. £112 (hardback). £25.59 (paperback) 9781032718576
di: Marcella Fok
Pubblicazione: (2026)
di: Marcella Fok
Pubblicazione: (2026)
Event-Based Method for High-Speed 3D Deformation Measurement under Extreme Illumination Conditions
di: Guan, Banglei, et al.
Pubblicazione: (2026)
di: Guan, Banglei, et al.
Pubblicazione: (2026)
From Efficiency to Adaptivity: A Deeper Look at Adaptive Reasoning in Large Language Models
di: Wu, Chao, et al.
Pubblicazione: (2025)
di: Wu, Chao, et al.
Pubblicazione: (2025)
DefenSee: Dissecting Threat from Sight and Text -- A Multi-View Defensive Pipeline for Multi-modal Jailbreaks
di: Wang, Zihao, et al.
Pubblicazione: (2025)
di: Wang, Zihao, et al.
Pubblicazione: (2025)
Train Short, Inference Long: Training-free Horizon Extension for Autoregressive Video Generation
di: Li, Jia, et al.
Pubblicazione: (2026)
di: Li, Jia, et al.
Pubblicazione: (2026)
Seeing is Believing? Mitigating OCR Hallucinations in Multimodal Large Language Models
di: He, Zhentao, et al.
Pubblicazione: (2025)
di: He, Zhentao, et al.
Pubblicazione: (2025)
Think-as-You-See: Streaming Chain-of-Thought Reasoning for Large Vision-Language Models
di: Zhang, Jialiang, et al.
Pubblicazione: (2026)
di: Zhang, Jialiang, et al.
Pubblicazione: (2026)
Unveiling Linguistic Regions in Large Language Models
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Composable Dynamic Sparse Dataflow Architecture for Efficient Event-based Vision Processing on FPGA
di: Gao, Yizhao, et al.
Pubblicazione: (2024) -
Co-designing a Sub-millisecond Latency Event-based Eye Tracking System with Submanifold Sparse CNN
di: Zhang, Baoheng, et al.
Pubblicazione: (2024) -
SpikeMOT: Event-based Multi-Object Tracking with Sparse Motion Features
di: Wang, Song, et al.
Pubblicazione: (2023) -
Aligning Effective Tokens with Video Anomaly in Large Language Models
di: Chen, Yingxian, et al.
Pubblicazione: (2025) -
EAG3R: Event-Augmented 3D Geometry Estimation for Dynamic and Extreme-Lighting Scenes
di: Wu, Xiaoshan, et al.
Pubblicazione: (2025)