On the Pitfalls of Batch Normalization for End-to-End Video Learning: A Study on Surgical Workflow Analysis
Fuente:
arXiv
Salvato in:
| Autori principali: | Rivoir, Dominik, Funke, Isabel, Speidel, Stefanie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TUNeS: A Temporal U-Net with Self-Attention for Video-based Surgical Phase Recognition
di: Funke, Isabel, et al.
Pubblicazione: (2023)
di: Funke, Isabel, et al.
Pubblicazione: (2023)
SurgicaL-CD: Generating Surgical Images via Unpaired Image Translation with Latent Consistency Diffusion Models
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2024)
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2024)
Data Augmentation for Surgical Scene Segmentation with Anatomy-Aware Diffusion Models
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2024)
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2024)
Exploring Semantic Consistency in Unpaired Image Translation to Generate Data for Surgical Applications
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2023)
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2023)
Towards Application Aligned Synthetic Surgical Image Synthesis
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2025)
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2025)
Mission Balance: Generating Under-represented Class Samples using Video Diffusion Models
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2025)
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2025)
STARFlow-V: End-to-End Video Generative Modeling with Normalizing Flows
di: Gu, Jiatao, et al.
Pubblicazione: (2025)
di: Gu, Jiatao, et al.
Pubblicazione: (2025)
LMVC: An End-to-End Learned Multiview Video Coding Framework
di: Sheng, Xihua, et al.
Pubblicazione: (2025)
di: Sheng, Xihua, et al.
Pubblicazione: (2025)
SimFlow: Simplified and End-to-End Training of Latent Normalizing Flows
di: Zhao, Qinyu, et al.
Pubblicazione: (2025)
di: Zhao, Qinyu, et al.
Pubblicazione: (2025)
End-to-End Streaming Video Temporal Action Segmentation with Reinforce Learning
di: Zhang, Jinrong, et al.
Pubblicazione: (2023)
di: Zhang, Jinrong, et al.
Pubblicazione: (2023)
Enhancing Traffic Safety with Parallel Dense Video Captioning for End-to-End Event Analysis
di: Shoman, Maged, et al.
Pubblicazione: (2024)
di: Shoman, Maged, et al.
Pubblicazione: (2024)
A benchmark for video-based laparoscopic skill analysis and assessment
di: Funke, Isabel, et al.
Pubblicazione: (2026)
di: Funke, Isabel, et al.
Pubblicazione: (2026)
End-to-End Facial Expression Detection in Long Videos
di: Fang, Yini, et al.
Pubblicazione: (2025)
di: Fang, Yini, et al.
Pubblicazione: (2025)
ImmersePro: End-to-End Stereo Video Synthesis Via Implicit Disparity Learning
di: Shi, Jian, et al.
Pubblicazione: (2024)
di: Shi, Jian, et al.
Pubblicazione: (2024)
An End-to-End Framework for Video Multi-Person Pose Estimation
di: Wei, Zhihong
Pubblicazione: (2025)
di: Wei, Zhihong
Pubblicazione: (2025)
End-to-End Dense Video Grounding via Parallel Regression
di: Shi, Fengyuan, et al.
Pubblicazione: (2021)
di: Shi, Fengyuan, et al.
Pubblicazione: (2021)
ResAD: Normalized Residual Trajectory Modeling for End-to-End Autonomous Driving
di: Zheng, Zhiyu, et al.
Pubblicazione: (2025)
di: Zheng, Zhiyu, et al.
Pubblicazione: (2025)
Action Images: End-to-End Policy Learning via Multiview Video Generation
di: Zhen, Haoyu, et al.
Pubblicazione: (2026)
di: Zhen, Haoyu, et al.
Pubblicazione: (2026)
End-to-End Training for Autoregressive Video Diffusion via Self-Resampling
di: Guo, Yuwei, et al.
Pubblicazione: (2025)
di: Guo, Yuwei, et al.
Pubblicazione: (2025)
Weaver: End-to-End Agentic System Training for Video Interleaved Reasoning
di: Shi, Yudi, et al.
Pubblicazione: (2026)
di: Shi, Yudi, et al.
Pubblicazione: (2026)
EVA: Efficient Reinforcement Learning for End-to-End Video Agent
di: Zhang, Yaolun, et al.
Pubblicazione: (2026)
di: Zhang, Yaolun, et al.
Pubblicazione: (2026)
CLEAR: Context-Aware Learning with End-to-End Mask-Free Inference for Adaptive Video Subtitle Removal
di: He, Qingdong, et al.
Pubblicazione: (2026)
di: He, Qingdong, et al.
Pubblicazione: (2026)
DLAFormer: An End-to-End Transformer For Document Layout Analysis
di: Wang, Jiawei, et al.
Pubblicazione: (2024)
di: Wang, Jiawei, et al.
Pubblicazione: (2024)
End-to-End Multi-Person Pose Estimation with Pose-Aware Video Transformer
di: Yu, Yonghui, et al.
Pubblicazione: (2025)
di: Yu, Yonghui, et al.
Pubblicazione: (2025)
Drive&Gen: Co-Evaluating End-to-End Driving and Video Generation Models
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation
di: Ma, Enhui, et al.
Pubblicazione: (2024)
di: Ma, Enhui, et al.
Pubblicazione: (2024)
MoCha:End-to-End Video Character Replacement without Structural Guidance
di: Xu, Zhengbo, et al.
Pubblicazione: (2026)
di: Xu, Zhengbo, et al.
Pubblicazione: (2026)
EVE: Towards End-to-End Video Subtitle Extraction with Vision-Language Models
di: Yu, Haiyang, et al.
Pubblicazione: (2025)
di: Yu, Haiyang, et al.
Pubblicazione: (2025)
MoGA: Mixture-of-Groups Attention for End-to-End Long Video Generation
di: Jia, Weinan, et al.
Pubblicazione: (2025)
di: Jia, Weinan, et al.
Pubblicazione: (2025)
WorldJen: An End-to-End Multi-Dimensional Benchmark for Generative Video Models
di: Inbasekar, Karthik, et al.
Pubblicazione: (2026)
di: Inbasekar, Karthik, et al.
Pubblicazione: (2026)
Body of Her: A Preliminary Study on End-to-End Humanoid Agent
di: Ao, Tenglong
Pubblicazione: (2024)
di: Ao, Tenglong
Pubblicazione: (2024)
Text-to-Edit: Controllable End-to-End Video Ad Creation via Multimodal LLMs
di: Cheng, Dabing, et al.
Pubblicazione: (2025)
di: Cheng, Dabing, et al.
Pubblicazione: (2025)
Puzzles: Unbounded Video-Depth Augmentation for Scalable End-to-End 3D Reconstruction
di: Ma, Jiahao, et al.
Pubblicazione: (2025)
di: Ma, Jiahao, et al.
Pubblicazione: (2025)
Drive-JEPA: Video JEPA Meets Multimodal Trajectory Distillation for End-to-End Driving
di: Wang, Linhan, et al.
Pubblicazione: (2026)
di: Wang, Linhan, et al.
Pubblicazione: (2026)
M2SVid: End-to-End Inpainting and Refinement for Monocular-to-Stereo Video Conversion
di: Shvetsova, Nina, et al.
Pubblicazione: (2025)
di: Shvetsova, Nina, et al.
Pubblicazione: (2025)
End-To-End Underwater Video Enhancement: Dataset and Model
di: Du, Dazhao, et al.
Pubblicazione: (2024)
di: Du, Dazhao, et al.
Pubblicazione: (2024)
End to End AI System for Surgical Gesture Sequence Recognition and Clinical Outcome Prediction
di: Li, Xi, et al.
Pubblicazione: (2025)
di: Li, Xi, et al.
Pubblicazione: (2025)
Automated Deception Detection from Videos: Using End-to-End Learning Based High-Level Features and Classification Approaches
di: Dinges, Laslo, et al.
Pubblicazione: (2023)
di: Dinges, Laslo, et al.
Pubblicazione: (2023)
Residual Learning and Filtering Networks for End-to-End Lossless Video Compression
di: Islam, Md baharul, et al.
Pubblicazione: (2025)
di: Islam, Md baharul, et al.
Pubblicazione: (2025)
Normalizing Batch Normalization for Long-Tailed Recognition
di: Bao, Yuxiang, et al.
Pubblicazione: (2025)
di: Bao, Yuxiang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TUNeS: A Temporal U-Net with Self-Attention for Video-based Surgical Phase Recognition
di: Funke, Isabel, et al.
Pubblicazione: (2023) -
SurgicaL-CD: Generating Surgical Images via Unpaired Image Translation with Latent Consistency Diffusion Models
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2024) -
Data Augmentation for Surgical Scene Segmentation with Anatomy-Aware Diffusion Models
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2024) -
Exploring Semantic Consistency in Unpaired Image Translation to Generate Data for Surgical Applications
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2023) -
Towards Application Aligned Synthetic Surgical Image Synthesis
di: Venkatesh, Danush Kumar, et al.
Pubblicazione: (2025)