E-VLA: Event-Augmented Vision-Language-Action Model for Dark and Blurred Scenes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhai, Jiajun, Shi, Hao, Guo, Shangwei, Yang, Kailun, Wang, Kaiwei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Event-guided 3D Gaussian Splatting for Dynamic Human and Scene Reconstruction
par: Yin, Xiaoting, et autres
Publié: (2025)
par: Yin, Xiaoting, et autres
Publié: (2025)
Exploring Event-based Human Pose Estimation with 3D Event Representations
par: Yin, Xiaoting, et autres
Publié: (2023)
par: Yin, Xiaoting, et autres
Publié: (2023)
Event-aided Semantic Scene Completion
par: Guo, Shangwei, et autres
Publié: (2025)
par: Guo, Shangwei, et autres
Publié: (2025)
MambaMOS: LiDAR-based 3D Moving Object Segmentation with Motion-aware State Space Model
par: Zeng, Kang, et autres
Publié: (2024)
par: Zeng, Kang, et autres
Publié: (2024)
EgoEV-HandPose: Egocentric 3D Hand Pose Estimation and Gesture Recognition with Stereo Event Cameras
par: Wang, Luming, et autres
Publié: (2026)
par: Wang, Luming, et autres
Publié: (2026)
Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision
par: Wei, Yiping, et autres
Publié: (2023)
par: Wei, Yiping, et autres
Publié: (2023)
Exploring Self-supervised Skeleton-based Action Recognition in Occluded Environments
par: Chen, Yifei, et autres
Publié: (2023)
par: Chen, Yifei, et autres
Publié: (2023)
RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
par: Peng, Kunyu, et autres
Publié: (2025)
par: Peng, Kunyu, et autres
Publié: (2025)
CFMW: Cross-modality Fusion Mamba for Robust Object Detection under Adverse Weather
par: Li, Haoyuan, et autres
Publié: (2024)
par: Li, Haoyuan, et autres
Publié: (2024)
HopaDIFF: Holistic-Partial Aware Fourier Conditioned Diffusion for Referring Human Action Segmentation in Multi-Person Scenarios
par: Peng, Kunyu, et autres
Publié: (2025)
par: Peng, Kunyu, et autres
Publié: (2025)
E-3DGS: Gaussian Splatting with Exposure and Motion Events
par: Yin, Xiaoting, et autres
Publié: (2024)
par: Yin, Xiaoting, et autres
Publié: (2024)
OneOcc: Semantic Occupancy Prediction for Legged Robots with a Single Panoramic Camera
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
EgoEvGesture: Gesture Recognition Based on Egocentric Event Camera
par: Wang, Luming, et autres
Publié: (2025)
par: Wang, Luming, et autres
Publié: (2025)
Towards Anytime Optical Flow Estimation with Event Cameras
par: Ye, Yaozu, et autres
Publié: (2023)
par: Ye, Yaozu, et autres
Publié: (2023)
EI-Nexus: Towards Unmediated and Flexible Inter-Modality Local Feature Extraction and Matching for Event-Image Data
par: Yi, Zhonghua, et autres
Publié: (2024)
par: Yi, Zhonghua, et autres
Publié: (2024)
P2U-SLAM: A Monocular Wide-FoV SLAM System Based on Point Uncertainty and Pose Uncertainty
par: Zhang, Yufan, et autres
Publié: (2024)
par: Zhang, Yufan, et autres
Publié: (2024)
LF-PGVIO: A Visual-Inertial-Odometry Framework for Large Field-of-View Cameras using Points and Geodesic Segments
par: Wang, Ze, et autres
Publié: (2023)
par: Wang, Ze, et autres
Publié: (2023)
OmniTrack++: Omnidirectional Multi-Object Tracking by Learning Large-FoV Trajectory Feedback
par: Luo, Kai, et autres
Publié: (2025)
par: Luo, Kai, et autres
Publié: (2025)
QuaDreamer: Controllable Panoramic Video Generation for Quadruped Robots
par: Wu, Sheng, et autres
Publié: (2025)
par: Wu, Sheng, et autres
Publié: (2025)
Behind Every Domain There is a Shift: Adapting Distortion-aware Vision Transformers for Panoramic Semantic Segmentation
par: Zhang, Jiaming, et autres
Publié: (2022)
par: Zhang, Jiaming, et autres
Publié: (2022)
Benchmarking the Robustness of Optical Flow Estimation to Corruptions
par: Yi, Zhonghua, et autres
Publié: (2024)
par: Yi, Zhonghua, et autres
Publié: (2024)
Offboard Occupancy Refinement with Hybrid Propagation for Autonomous Driving
par: Shi, Hao, et autres
Publié: (2024)
par: Shi, Hao, et autres
Publié: (2024)
Event Camera Demosaicing via Swin Transformer and Pixel-focus Loss
par: Lu, Yunfan, et autres
Publié: (2024)
par: Lu, Yunfan, et autres
Publié: (2024)
Omnidirectional Multi-Object Tracking
par: Luo, Kai, et autres
Publié: (2025)
par: Luo, Kai, et autres
Publié: (2025)
CoBEV: Elevating Roadside 3D Object Detection with Depth and Height Complementarity
par: Shi, Hao, et autres
Publié: (2023)
par: Shi, Hao, et autres
Publié: (2023)
HippoMM: Hippocampal-inspired Multimodal Memory for Long Audiovisual Event Understanding
par: Lin, Yueqian, et autres
Publié: (2025)
par: Lin, Yueqian, et autres
Publié: (2025)
EvEnhancer: Empowering Effectiveness, Efficiency and Generalizability for Continuous Space-Time Video Super-Resolution with Events
par: Wei, Shuoyan, et autres
Publié: (2025)
par: Wei, Shuoyan, et autres
Publié: (2025)
Training-Free Adaptive 360-degree Video Streaming via Semantic Potential Fields
par: Aiersilan, Aizierjiang, et autres
Publié: (2026)
par: Aiersilan, Aizierjiang, et autres
Publié: (2026)
LLIC: Large Receptive Field Transform Coding with Adaptive Weights for Learned Image Compression
par: Jiang, Wei, et autres
Publié: (2023)
par: Jiang, Wei, et autres
Publié: (2023)
Scalable Event-Based Video Streaming for Machines with MoQ
par: Freeman, Andrew C.
Publié: (2025)
par: Freeman, Andrew C.
Publié: (2025)
Beyond the Field-of-View: Enhancing Scene Visibility and Perception with Clip-Recurrent Transformer
par: Shi, Hao, et autres
Publié: (2022)
par: Shi, Hao, et autres
Publié: (2022)
Robust Live Streaming over LEO Satellite Constellations: Measurement, Analysis, and Handover-Aware Adaptation
par: Fang, Hao, et autres
Publié: (2025)
par: Fang, Hao, et autres
Publié: (2025)
ReCon-GS: Continuum-Preserved Gaussian Streaming for Fast and Compact Reconstruction of Dynamic Scenes
par: Fu, Jiaye, et autres
Publié: (2025)
par: Fu, Jiaye, et autres
Publié: (2025)
SANR: Scene-Aware Neural Representation for Light Field Image Compression with Rate-Distortion Optimization
par: Zhang, Gai, et autres
Publié: (2025)
par: Zhang, Gai, et autres
Publié: (2025)
From Darkness to Detail: Frequency-Aware SSMs for Low-Light Vision
par: Adhikarla, Eashan, et autres
Publié: (2024)
par: Adhikarla, Eashan, et autres
Publié: (2024)
Towards Robust and Generalizable Continuous Space-Time Video Super-Resolution with Events
par: Wei, Shuoyan, et autres
Publié: (2025)
par: Wei, Shuoyan, et autres
Publié: (2025)
Exploring Quasi-Global Solutions to Compound Lens Based Computational Imaging Systems
par: Gao, Yao, et autres
Publié: (2024)
par: Gao, Yao, et autres
Publié: (2024)
Streaming Real-Time Rendered Scenes as 3D Gaussians
par: Siekkinen, Matti, et autres
Publié: (2026)
par: Siekkinen, Matti, et autres
Publié: (2026)
Perceptual Video Quality Assessment: A Survey
par: Min, Xiongkuo, et autres
Publié: (2024)
par: Min, Xiongkuo, et autres
Publié: (2024)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
par: Cao, Yuqin, et autres
Publié: (2023)
par: Cao, Yuqin, et autres
Publié: (2023)
Documents similaires
-
Event-guided 3D Gaussian Splatting for Dynamic Human and Scene Reconstruction
par: Yin, Xiaoting, et autres
Publié: (2025) -
Exploring Event-based Human Pose Estimation with 3D Event Representations
par: Yin, Xiaoting, et autres
Publié: (2023) -
Event-aided Semantic Scene Completion
par: Guo, Shangwei, et autres
Publié: (2025) -
MambaMOS: LiDAR-based 3D Moving Object Segmentation with Motion-aware State Space Model
par: Zeng, Kang, et autres
Publié: (2024) -
EgoEV-HandPose: Egocentric 3D Hand Pose Estimation and Gesture Recognition with Stereo Event Cameras
par: Wang, Luming, et autres
Publié: (2026)