TSdetector: Temporal-Spatial Self-correction Collaborative Learning for Colonoscopy Video Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Kaini, Wang, Haolin, Zhou, Guang-Quan, Wang, Yangang, Yang, Ling, Chen, Yang, Li, Shuo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Universal Medical Image Representation Learning with Compositional Decoders
por: Wang, Kaini, et al.
Publicado: (2024)
por: Wang, Kaini, et al.
Publicado: (2024)
Contrastive Learning under Noisy Temporal Self-Supervision for Colonoscopy Videos
por: Parolari, Luca, et al.
Publicado: (2026)
por: Parolari, Luca, et al.
Publicado: (2026)
Endo-CLIP: Progressive Self-Supervised Pre-training on Raw Colonoscopy Records
por: He, Yili, et al.
Publicado: (2025)
por: He, Yili, et al.
Publicado: (2025)
STNMamba: Mamba-based Spatial-Temporal Normality Learning for Video Anomaly Detection
por: Li, Zhangxun, et al.
Publicado: (2024)
por: Li, Zhangxun, et al.
Publicado: (2024)
DepthPilot: From Controllability to Interpretability in Colonoscopy Video Generation
por: Fu, Junhu, et al.
Publicado: (2026)
por: Fu, Junhu, et al.
Publicado: (2026)
SparseTem: Boosting the Efficiency of CNN-Based Video Encoders by Exploiting Temporal Continuity
por: Wang, Kunyun, et al.
Publicado: (2024)
por: Wang, Kunyun, et al.
Publicado: (2024)
Semantic Parsing of Colonoscopy Videos with Multi-Label Temporal Networks
por: Kelner, Ori, et al.
Publicado: (2023)
por: Kelner, Ori, et al.
Publicado: (2023)
Towards Generalizable Deepfake Detection with Spatial-Frequency Collaborative Learning and Hierarchical Cross-Modal Fusion
por: Qiao, Mengyu, et al.
Publicado: (2025)
por: Qiao, Mengyu, et al.
Publicado: (2025)
Unlocking the Potential of Grounding DINO in Videos: Parameter-Efficient Adaptation for Limited-Data Spatial-Temporal Localization
por: Wang, Zanyi, et al.
Publicado: (2026)
por: Wang, Zanyi, et al.
Publicado: (2026)
Towards Successful Implementation of Automated Raveling Detection: Effects of Training Data Size, Illumination Difference, and Spatial Shift
por: Zhang, Xinan, et al.
Publicado: (2026)
por: Zhang, Xinan, et al.
Publicado: (2026)
Self-Supervised Representation Learning with Spatial-Temporal Consistency for Sign Language Recognition
por: Zhao, Weichao, et al.
Publicado: (2024)
por: Zhao, Weichao, et al.
Publicado: (2024)
FRESCO: Spatial-Temporal Correspondence for Zero-Shot Video Translation
por: Yang, Shuai, et al.
Publicado: (2024)
por: Yang, Shuai, et al.
Publicado: (2024)
PosMLP-Video: Spatial and Temporal Relative Position Encoding for Efficient Video Recognition
por: Hao, Yanbin, et al.
Publicado: (2024)
por: Hao, Yanbin, et al.
Publicado: (2024)
ColoDiff: Integrating Dynamic Consistency With Content Awareness for Colonoscopy Video Generation
por: Fu, Junhu, et al.
Publicado: (2026)
por: Fu, Junhu, et al.
Publicado: (2026)
VTok: A Unified Video Tokenizer with Decoupled Spatial-Temporal Latents
por: Wang, Feng, et al.
Publicado: (2026)
por: Wang, Feng, et al.
Publicado: (2026)
Structure-preserving Image Translation for Depth Estimation in Colonoscopy Video
por: Wang, Shuxian, et al.
Publicado: (2024)
por: Wang, Shuxian, et al.
Publicado: (2024)
SALI: Short-term Alignment and Long-term Interaction Network for Colonoscopy Video Polyp Segmentation
por: Hu, Qiang, et al.
Publicado: (2024)
por: Hu, Qiang, et al.
Publicado: (2024)
Joint Spatial-Temporal Modeling and Contrastive Learning for Self-supervised Heart Rate Measurement
por: Qian, Wei, et al.
Publicado: (2024)
por: Qian, Wei, et al.
Publicado: (2024)
STAR: Spatial-Temporal Augmentation with Text-to-Video Models for Real-World Video Super-Resolution
por: Xie, Rui, et al.
Publicado: (2025)
por: Xie, Rui, et al.
Publicado: (2025)
Described Spatial-Temporal Video Detection
por: Ji, Wei, et al.
Publicado: (2024)
por: Ji, Wei, et al.
Publicado: (2024)
CollaMamba: Efficient Collaborative Perception with Cross-Agent Spatial-Temporal State Space Model
por: Li, Yang, et al.
Publicado: (2024)
por: Li, Yang, et al.
Publicado: (2024)
Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence
por: Yang, Shuai, et al.
Publicado: (2025)
por: Yang, Shuai, et al.
Publicado: (2025)
METOR: A Unified Framework for Mutual Enhancement of Objects and Relationships in Open-vocabulary Video Visual Relationship Detection
por: Wang, Yongqi, et al.
Publicado: (2025)
por: Wang, Yongqi, et al.
Publicado: (2025)
Colonoscopy polyp detection with massive endoscopic images
por: Yu, Jialin, et al.
Publicado: (2022)
por: Yu, Jialin, et al.
Publicado: (2022)
Collaborative Temporal Consistency Learning for Point-supervised Natural Language Video Localization
por: Tao, Zhuo, et al.
Publicado: (2025)
por: Tao, Zhuo, et al.
Publicado: (2025)
CSDN: A Context-Gated Self-Adaptive Detection Network for Real-Time Object Detection
por: Wei, Haolin
Publicado: (2025)
por: Wei, Haolin
Publicado: (2025)
LaneTCA: Enhancing Video Lane Detection with Temporal Context Aggregation
por: Zhou, Keyi, et al.
Publicado: (2024)
por: Zhou, Keyi, et al.
Publicado: (2024)
YUNet: Improved YOLOv11 Network for Skyline Detection
por: Yang, Gang, et al.
Publicado: (2025)
por: Yang, Gang, et al.
Publicado: (2025)
Self-Creative Text-to-Object Generation using Semantic-Aware Spatial Weighting
por: Yu, Yue, et al.
Publicado: (2026)
por: Yu, Yue, et al.
Publicado: (2026)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
por: Xi, Haocheng, et al.
Publicado: (2025)
por: Xi, Haocheng, et al.
Publicado: (2025)
End-to-end Open-vocabulary Video Visual Relationship Detection using Multi-modal Prompting
por: Wang, Yongqi, et al.
Publicado: (2024)
por: Wang, Yongqi, et al.
Publicado: (2024)
ATSS: Detecting AI-Generated Videos via Anomalous Temporal Self-Similarity
por: Wang, Hang, et al.
Publicado: (2026)
por: Wang, Hang, et al.
Publicado: (2026)
Video2Layout: Recall and Reconstruct Metric-Grounded Cognitive Map for Spatial Reasoning
por: Huang, Yibin, et al.
Publicado: (2025)
por: Huang, Yibin, et al.
Publicado: (2025)
Learning Temporally Consistent Video Depth from Video Diffusion Priors
por: Shao, Jiahao, et al.
Publicado: (2024)
por: Shao, Jiahao, et al.
Publicado: (2024)
LVAgent: Long Video Understanding by Multi-Round Dynamical Collaboration of MLLM Agents
por: Chen, Boyu, et al.
Publicado: (2025)
por: Chen, Boyu, et al.
Publicado: (2025)
Learning Spatial-Temporal Coherent Correlations for Speech-Preserving Facial Expression Manipulation
por: Chen, Tianshui, et al.
Publicado: (2026)
por: Chen, Tianshui, et al.
Publicado: (2026)
VideoCompressa: Data-Efficient Video Understanding via Joint Temporal Compression and Spatial Reconstruction
por: Wang, Shaobo, et al.
Publicado: (2025)
por: Wang, Shaobo, et al.
Publicado: (2025)
DDSB: An Unsupervised and Training-free Method for Phase Detection in Echocardiography
por: Bu, Zhenyu, et al.
Publicado: (2024)
por: Bu, Zhenyu, et al.
Publicado: (2024)
Temporal2Seq: A Unified Framework for Temporal Video Understanding Tasks
por: Yang, Min, et al.
Publicado: (2024)
por: Yang, Min, et al.
Publicado: (2024)
Low-Light Video Enhancement via Spatial-Temporal Consistent Decomposition
por: Xu, Xiaogang, et al.
Publicado: (2024)
por: Xu, Xiaogang, et al.
Publicado: (2024)
Ejemplares similares
-
Universal Medical Image Representation Learning with Compositional Decoders
por: Wang, Kaini, et al.
Publicado: (2024) -
Contrastive Learning under Noisy Temporal Self-Supervision for Colonoscopy Videos
por: Parolari, Luca, et al.
Publicado: (2026) -
Endo-CLIP: Progressive Self-Supervised Pre-training on Raw Colonoscopy Records
por: He, Yili, et al.
Publicado: (2025) -
STNMamba: Mamba-based Spatial-Temporal Normality Learning for Video Anomaly Detection
por: Li, Zhangxun, et al.
Publicado: (2024) -
DepthPilot: From Controllability to Interpretability in Colonoscopy Video Generation
por: Fu, Junhu, et al.
Publicado: (2026)