CS3D: An Efficient Facial Expression Recognition via Event Vision
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Zhe, Song, Qijin, Peng, Yucen, Bai, Weibang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Keypoint-based Dynamic Object 6-DoF Pose Tracking via Event Camera
por: Wang, Zhe, et al.
Publicado: (2026)
por: Wang, Zhe, et al.
Publicado: (2026)
Driving Animatronic Robot Facial Expression From Speech
por: Li, Boren, et al.
Publicado: (2024)
por: Li, Boren, et al.
Publicado: (2024)
SLAM-Former: Putting SLAM into One Transformer
por: Yuan, Yijun, et al.
Publicado: (2025)
por: Yuan, Yijun, et al.
Publicado: (2025)
Map Imagination Like Blind Humans: Group Diffusion Model for Robotic Map Generation
por: Song, Qijin, et al.
Publicado: (2024)
por: Song, Qijin, et al.
Publicado: (2024)
Enhancing Visual Place Recognition via Fast and Slow Adaptive Biasing in Event Cameras
por: Nair, Gokul B., et al.
Publicado: (2024)
por: Nair, Gokul B., et al.
Publicado: (2024)
3DVLA: Enhancing Vision-Language-Action Models via 3D Spatial and Instance Understanding
por: Xia, Zhongyu, et al.
Publicado: (2026)
por: Xia, Zhongyu, et al.
Publicado: (2026)
EVI-SAM: Robust, Real-time, Tightly-coupled Event-Visual-Inertial State Estimation and 3D Dense Mapping
por: Guan, Weipeng, et al.
Publicado: (2023)
por: Guan, Weipeng, et al.
Publicado: (2023)
Sim-to-Real Transfer via 3D Feature Fields for Vision-and-Language Navigation
por: Wang, Zihan, et al.
Publicado: (2024)
por: Wang, Zihan, et al.
Publicado: (2024)
Facial Emotion Learning with Text-Guided Multiview Fusion via Vision-Language Model for 3D/4D Facial Expression Recognition
por: Behzad, Muzammil
Publicado: (2025)
por: Behzad, Muzammil
Publicado: (2025)
Reading in the Dark with Foveated Event Vision
por: Brander, Carl, et al.
Publicado: (2025)
por: Brander, Carl, et al.
Publicado: (2025)
Shuffle Vision Transformer: Lightweight, Fast and Efficient Recognition of Driver Facial Expression
por: Saadi, Ibtissam, et al.
Publicado: (2024)
por: Saadi, Ibtissam, et al.
Publicado: (2024)
Structured Observation Language for Efficient and Generalizable Vision-Language Navigation
por: Peng, Daojie, et al.
Publicado: (2026)
por: Peng, Daojie, et al.
Publicado: (2026)
ZING-3D: Zero-shot Incremental 3D Scene Graphs via Vision-Language Models
por: Saxena, Pranav, et al.
Publicado: (2025)
por: Saxena, Pranav, et al.
Publicado: (2025)
Multimodal Graph Representation Learning for Robust Surgical Workflow Recognition with Adversarial Feature Disentanglement
por: Bai, Long, et al.
Publicado: (2025)
por: Bai, Long, et al.
Publicado: (2025)
LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition
por: Xiong, Songsong, et al.
Publicado: (2025)
por: Xiong, Songsong, et al.
Publicado: (2025)
Robust and Accurate Multi-view 2D/3D Image Registration with Differentiable X-ray Rendering and Dual Cross-view Constraints
por: Cui, Yuxin, et al.
Publicado: (2025)
por: Cui, Yuxin, et al.
Publicado: (2025)
D3D-VLP: Dynamic 3D Vision-Language-Planning Model for Embodied Grounding and Navigation
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
Dynam3D: Dynamic Layered 3D Tokens Empower VLM for Vision-and-Language Navigation
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
M3: 3D-Spatial MultiModal Memory
por: Zou, Xueyan, et al.
Publicado: (2025)
por: Zou, Xueyan, et al.
Publicado: (2025)
LiteViLNet: Lightweight Vision-LiDAR Fusion Network for Efficient Road Segmentation
por: Peng, Daojie, et al.
Publicado: (2026)
por: Peng, Daojie, et al.
Publicado: (2026)
Enhancing Vision-Language Navigation with Multimodal Event Knowledge from Real-World Indoor Tour Videos
por: Xu, Haoxuan, et al.
Publicado: (2026)
por: Xu, Haoxuan, et al.
Publicado: (2026)
Re$^2$MoGen: Open-Vocabulary Motion Generation via LLM Reasoning and Physics-Aware Refinement
por: Zheng, Jiakun, et al.
Publicado: (2026)
por: Zheng, Jiakun, et al.
Publicado: (2026)
Ensemble-Based Event Camera Place Recognition Under Varying Illumination
por: Joseph, Therese, et al.
Publicado: (2025)
por: Joseph, Therese, et al.
Publicado: (2025)
Embodied Scene Understanding for Vision Language Models via MetaVQA
por: Wang, Weizhen, et al.
Publicado: (2025)
por: Wang, Weizhen, et al.
Publicado: (2025)
Efficient Event Camera Volume System
por: Soto, Juan Camilo, et al.
Publicado: (2026)
por: Soto, Juan Camilo, et al.
Publicado: (2026)
A Two-Stage Dual-Modality Model for Facial Emotional Expression Recognition
por: Sun, Jiajun, et al.
Publicado: (2026)
por: Sun, Jiajun, et al.
Publicado: (2026)
From Monocular Vision to Autonomous Action: Guiding Tumor Resection via 3D Reconstruction
por: Acar, Ayberk, et al.
Publicado: (2025)
por: Acar, Ayberk, et al.
Publicado: (2025)
Advances in Global Solvers for 3D Vision
por: Zhao, Zhenjun, et al.
Publicado: (2026)
por: Zhao, Zhenjun, et al.
Publicado: (2026)
RoEL: Robust Event-based 3D Line Reconstruction
por: Bae, Gwangtak, et al.
Publicado: (2026)
por: Bae, Gwangtak, et al.
Publicado: (2026)
Stop Wandering: Efficient Vision-Language Navigation via Metacognitive Reasoning
por: Li, Xueying, et al.
Publicado: (2026)
por: Li, Xueying, et al.
Publicado: (2026)
Interp3R: Continuous-time 3D Geometry Estimation with Frames and Events
por: Guo, Shuang, et al.
Publicado: (2026)
por: Guo, Shuang, et al.
Publicado: (2026)
CronusVLA: Towards Efficient and Robust Manipulation via Multi-Frame Vision-Language-Action Modeling
por: Li, Hao, et al.
Publicado: (2025)
por: Li, Hao, et al.
Publicado: (2025)
LLM-enhanced Scene Graph Learning for Household Rearrangement
por: Li, Wenhao, et al.
Publicado: (2024)
por: Li, Wenhao, et al.
Publicado: (2024)
A Review of 3D Reconstruction Techniques for Deformable Tissues in Robotic Surgery
por: Xu, Mengya, et al.
Publicado: (2024)
por: Xu, Mengya, et al.
Publicado: (2024)
Scalable 3D Registration via Truncated Entry-wise Absolute Residuals
por: Huang, Tianyu, et al.
Publicado: (2024)
por: Huang, Tianyu, et al.
Publicado: (2024)
End-to-end 2D-3D Registration between Image and LiDAR Point Cloud for Vehicle Localization
por: Wang, Guangming, et al.
Publicado: (2023)
por: Wang, Guangming, et al.
Publicado: (2023)
Open-Set Video-based Facial Expression Recognition with Human Expression-sensitive Prompting
por: Liu, Yuanyuan, et al.
Publicado: (2024)
por: Liu, Yuanyuan, et al.
Publicado: (2024)
Talk2Radar: Bridging Natural Language with 4D mmWave Radar for 3D Referring Expression Comprehension
por: Guan, Runwei, et al.
Publicado: (2024)
por: Guan, Runwei, et al.
Publicado: (2024)
Inverse++: Vision-Centric 3D Semantic Occupancy Prediction Assisted with 3D Object Detection
por: Ming, Zhenxing, et al.
Publicado: (2025)
por: Ming, Zhenxing, et al.
Publicado: (2025)
FOMO-3D: Using Vision Foundation Models for Long-Tailed 3D Object Detection
por: Yang, Anqi Joyce, et al.
Publicado: (2026)
por: Yang, Anqi Joyce, et al.
Publicado: (2026)
Ejemplares similares
-
Keypoint-based Dynamic Object 6-DoF Pose Tracking via Event Camera
por: Wang, Zhe, et al.
Publicado: (2026) -
Driving Animatronic Robot Facial Expression From Speech
por: Li, Boren, et al.
Publicado: (2024) -
SLAM-Former: Putting SLAM into One Transformer
por: Yuan, Yijun, et al.
Publicado: (2025) -
Map Imagination Like Blind Humans: Group Diffusion Model for Robotic Map Generation
por: Song, Qijin, et al.
Publicado: (2024) -
Enhancing Visual Place Recognition via Fast and Slow Adaptive Biasing in Event Cameras
por: Nair, Gokul B., et al.
Publicado: (2024)