End-to-End Facial Expression Detection in Long Videos
Fuente:
arXiv
Guardado en:
| Autores principales: | Fang, Yini, Diallo, Alec, Shi, Yiqi, Jumelle, Frederic, Shi, Bertram |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
End-to-End Dense Video Grounding via Parallel Regression
por: Shi, Fengyuan, et al.
Publicado: (2021)
por: Shi, Fengyuan, et al.
Publicado: (2021)
ImmersePro: End-to-End Stereo Video Synthesis Via Implicit Disparity Learning
por: Shi, Jian, et al.
Publicado: (2024)
por: Shi, Jian, et al.
Publicado: (2024)
OAT: Object-Level Attention Transformer for Gaze Scanpath Prediction
por: Fang, Yini, et al.
Publicado: (2024)
por: Fang, Yini, et al.
Publicado: (2024)
FEA-SLT: A Gloss-Free End-to-End Framework for Facial-Expression-Aware Sign Language Translation
por: Tu, Guobin, et al.
Publicado: (2026)
por: Tu, Guobin, et al.
Publicado: (2026)
Weaver: End-to-End Agentic System Training for Video Interleaved Reasoning
por: Shi, Yudi, et al.
Publicado: (2026)
por: Shi, Yudi, et al.
Publicado: (2026)
MoGA: Mixture-of-Groups Attention for End-to-End Long Video Generation
por: Jia, Weinan, et al.
Publicado: (2025)
por: Jia, Weinan, et al.
Publicado: (2025)
Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation
por: Ma, Enhui, et al.
Publicado: (2024)
por: Ma, Enhui, et al.
Publicado: (2024)
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving
por: Chen, Xuesong, et al.
Publicado: (2025)
por: Chen, Xuesong, et al.
Publicado: (2025)
RT-DETRv3: Real-time End-to-End Object Detection with Hierarchical Dense Positive Supervision
por: Wang, Shuo, et al.
Publicado: (2024)
por: Wang, Shuo, et al.
Publicado: (2024)
Referring Expression Instance Retrieval and A Strong End-to-End Baseline
por: Hao, Xiangzhao, et al.
Publicado: (2025)
por: Hao, Xiangzhao, et al.
Publicado: (2025)
Global Multiple Extraction Network for Low-Resolution Facial Expression Recognition
por: Shi, Jingyi
Publicado: (2025)
por: Shi, Jingyi
Publicado: (2025)
TE-TAD: Towards Full End-to-End Temporal Action Detection via Time-Aligned Coordinate Expression
por: Kim, Ho-Joong, et al.
Publicado: (2024)
por: Kim, Ho-Joong, et al.
Publicado: (2024)
Is Self-Supervision Enough? Benchmarking Foundation Models Against End-to-End Training for Mitotic Figure Classification
por: Ganz, Jonathan, et al.
Publicado: (2024)
por: Ganz, Jonathan, et al.
Publicado: (2024)
TimeLoc: A Unified End-to-End Framework for Precise Timestamp Localization in Long Videos
por: Zhang, Chen-Lin, et al.
Publicado: (2025)
por: Zhang, Chen-Lin, et al.
Publicado: (2025)
Towards End-to-End Explainable Facial Action Unit Recognition via Vision-Language Joint Learning
por: Ge, Xuri, et al.
Publicado: (2024)
por: Ge, Xuri, et al.
Publicado: (2024)
LMVC: An End-to-End Learned Multiview Video Coding Framework
por: Sheng, Xihua, et al.
Publicado: (2025)
por: Sheng, Xihua, et al.
Publicado: (2025)
An End-to-End Framework for Video Multi-Person Pose Estimation
por: Wei, Zhihong
Publicado: (2025)
por: Wei, Zhihong
Publicado: (2025)
Action Unit Enhance Dynamic Facial Expression Recognition
por: Liu, Feng, et al.
Publicado: (2025)
por: Liu, Feng, et al.
Publicado: (2025)
PaCo-FR: Patch-Pixel Aligned End-to-End Codebook Learning for Facial Representation Pre-training
por: Xie, Yin, et al.
Publicado: (2025)
por: Xie, Yin, et al.
Publicado: (2025)
SparseDrive: End-to-End Autonomous Driving via Sparse Scene Representation
por: Sun, Wenchao, et al.
Publicado: (2024)
por: Sun, Wenchao, et al.
Publicado: (2024)
DEYO: DETR with YOLO for End-to-End Object Detection
por: Ouyang, Haodong
Publicado: (2024)
por: Ouyang, Haodong
Publicado: (2024)
DeepSight: Long-Horizon World Modeling via Latent States Prediction for End-to-End Autonomous Driving
por: Zhang, Lingjun, et al.
Publicado: (2026)
por: Zhang, Lingjun, et al.
Publicado: (2026)
Blur-Robust Detection via Feature Restoration: An End-to-End Framework for Prior-Guided Infrared UAV Target Detection
por: Wang, Xiaolin, et al.
Publicado: (2025)
por: Wang, Xiaolin, et al.
Publicado: (2025)
End-to-End Training for Autoregressive Video Diffusion via Self-Resampling
por: Guo, Yuwei, et al.
Publicado: (2025)
por: Guo, Yuwei, et al.
Publicado: (2025)
End-to-End Streaming Video Temporal Action Segmentation with Reinforce Learning
por: Zhang, Jinrong, et al.
Publicado: (2023)
por: Zhang, Jinrong, et al.
Publicado: (2023)
Spatially Visual Perception for End-to-End Robotic Learning
por: Davies, Travis, et al.
Publicado: (2024)
por: Davies, Travis, et al.
Publicado: (2024)
rFaceNet: An End-to-End Network for Enhanced Physiological Signal Extraction through Identity-Specific Facial Contours
por: Zhu, Dali, et al.
Publicado: (2024)
por: Zhu, Dali, et al.
Publicado: (2024)
Generative Scenario Rollouts for End-to-End Autonomous Driving
por: Yasarla, Rajeev, et al.
Publicado: (2026)
por: Yasarla, Rajeev, et al.
Publicado: (2026)
YOLOv10: Real-Time End-to-End Object Detection
por: Wang, Ao, et al.
Publicado: (2024)
por: Wang, Ao, et al.
Publicado: (2024)
Automated Deception Detection from Videos: Using End-to-End Learning Based High-Level Features and Classification Approaches
por: Dinges, Laslo, et al.
Publicado: (2023)
por: Dinges, Laslo, et al.
Publicado: (2023)
End-to-End Multi-Person Pose Estimation with Pose-Aware Video Transformer
por: Yu, Yonghui, et al.
Publicado: (2025)
por: Yu, Yonghui, et al.
Publicado: (2025)
Drive&Gen: Co-Evaluating End-to-End Driving and Video Generation Models
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
EVE: Towards End-to-End Video Subtitle Extraction with Vision-Language Models
por: Yu, Haiyang, et al.
Publicado: (2025)
por: Yu, Haiyang, et al.
Publicado: (2025)
MoCha:End-to-End Video Character Replacement without Structural Guidance
por: Xu, Zhengbo, et al.
Publicado: (2026)
por: Xu, Zhengbo, et al.
Publicado: (2026)
WorldJen: An End-to-End Multi-Dimensional Benchmark for Generative Video Models
por: Inbasekar, Karthik, et al.
Publicado: (2026)
por: Inbasekar, Karthik, et al.
Publicado: (2026)
Rethinking the Spatio-Temporal Alignment of End-to-End 3D Perception
por: Li, Xiaoyu, et al.
Publicado: (2025)
por: Li, Xiaoyu, et al.
Publicado: (2025)
RoCA: Robust Cross-Domain End-to-End Autonomous Driving
por: Yasarla, Rajeev, et al.
Publicado: (2025)
por: Yasarla, Rajeev, et al.
Publicado: (2025)
Fast-SmartWay: Panoramic-Free End-to-End Zero-Shot Vision-and-Language Navigation
por: Shi, Xiangyu, et al.
Publicado: (2025)
por: Shi, Xiangyu, et al.
Publicado: (2025)
UFO-DETR: Frequency-Guided End-to-End Detector for UAV Tiny Objects
por: Chen, Yuankai, et al.
Publicado: (2026)
por: Chen, Yuankai, et al.
Publicado: (2026)
RG-SAN: Rule-Guided Spatial Awareness Network for End-to-End 3D Referring Expression Segmentation
por: Wu, Changli, et al.
Publicado: (2024)
por: Wu, Changli, et al.
Publicado: (2024)
Ejemplares similares
-
End-to-End Dense Video Grounding via Parallel Regression
por: Shi, Fengyuan, et al.
Publicado: (2021) -
ImmersePro: End-to-End Stereo Video Synthesis Via Implicit Disparity Learning
por: Shi, Jian, et al.
Publicado: (2024) -
OAT: Object-Level Attention Transformer for Gaze Scanpath Prediction
por: Fang, Yini, et al.
Publicado: (2024) -
FEA-SLT: A Gloss-Free End-to-End Framework for Facial-Expression-Aware Sign Language Translation
por: Tu, Guobin, et al.
Publicado: (2026) -
Weaver: End-to-End Agentic System Training for Video Interleaved Reasoning
por: Shi, Yudi, et al.
Publicado: (2026)