SurgCoT: Advancing Spatiotemporal Reasoning in Surgical Videos through a Chain-of-Thought Benchmark
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Gui, Zhou, YongSong, Deng, Kaijun, Cheah, Wooi Ping, Qu, Rong, Ren, Jianfeng, Shen, Linlin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
X-PCR: A Benchmark for Cross-modality Progressive Clinical Reasoning in Ophthalmic Diagnosis
par: Wang, Gui, et autres
Publié: (2026)
par: Wang, Gui, et autres
Publié: (2026)
EyePCR: A Comprehensive Benchmark for Fine-Grained Perception, Knowledge Comprehension and Clinical Reasoning in Ophthalmic Surgery
par: Wang, Gui, et autres
Publié: (2025)
par: Wang, Gui, et autres
Publié: (2025)
{S$^3$-Mamba}: Small-Size-Sensitive Mamba for Lesion Segmentation
par: Wang, Gui, et autres
Publié: (2024)
par: Wang, Gui, et autres
Publié: (2024)
SurgRAW: Multi-Agent Workflow with Chain of Thought Reasoning for Robotic Surgical Video Analysis
par: Low, Chang Han, et autres
Publié: (2025)
par: Low, Chang Han, et autres
Publié: (2025)
CoAT: Chain-of-Associated-Thoughts Framework for Enhancing Large Language Models Reasoning
par: Pan, Jianfeng, et autres
Publié: (2025)
par: Pan, Jianfeng, et autres
Publié: (2025)
Video-CoT: A Comprehensive Dataset for Spatiotemporal Understanding of Videos Based on Chain-of-Thought
par: Zhang, Shuyi, et autres
Publié: (2025)
par: Zhang, Shuyi, et autres
Publié: (2025)
FaithCoT-Bench: Benchmarking Instance-Level Faithfulness of Chain-of-Thought Reasoning
par: Shen, Xu, et autres
Publié: (2025)
par: Shen, Xu, et autres
Publié: (2025)
LongCoT: Benchmarking Long-Horizon Chain-of-Thought Reasoning
par: Motwani, Sumeet Ramesh, et autres
Publié: (2026)
par: Motwani, Sumeet Ramesh, et autres
Publié: (2026)
SurgWound-Bench: A Benchmark for Surgical Wound Diagnosis
par: Xu, Jiahao, et autres
Publié: (2025)
par: Xu, Jiahao, et autres
Publié: (2025)
SurgBench: A Unified Large-Scale Benchmark for Surgical Video Analysis
par: Wei, Jianhui, et autres
Publié: (2025)
par: Wei, Jianhui, et autres
Publié: (2025)
CoT-RVS: Zero-Shot Chain-of-Thought Reasoning Segmentation for Videos
par: Kao, Shiu-hong, et autres
Publié: (2025)
par: Kao, Shiu-hong, et autres
Publié: (2025)
Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning
par: Shao, Hao, et autres
Publié: (2024)
par: Shao, Hao, et autres
Publié: (2024)
MotionMERGE: A Multi-granular Framework for Human Motion Editing, Reasoning, Generation, and Explanation
par: Wu, Bizhu, et autres
Publié: (2026)
par: Wu, Bizhu, et autres
Publié: (2026)
DriveCoT: Integrating Chain-of-Thought Reasoning with End-to-End Driving
par: Wang, Tianqi, et autres
Publié: (2024)
par: Wang, Tianqi, et autres
Publié: (2024)
Rethinking Chain-of-Thought Reasoning for Videos
par: Zhong, Yiwu, et autres
Publié: (2025)
par: Zhong, Yiwu, et autres
Publié: (2025)
Video-Skill-CoT: Skill-based Chain-of-Thoughts for Domain-Adaptive Video Reasoning
par: Lee, Daeun, et autres
Publié: (2025)
par: Lee, Daeun, et autres
Publié: (2025)
FineMotion: A Dataset and Benchmark with both Spatial and Temporal Annotation for Fine-grained Motion Generation and Editing
par: Wu, Bizhu, et autres
Publié: (2025)
par: Wu, Bizhu, et autres
Publié: (2025)
MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency
par: Jiang, Dongzhi, et autres
Publié: (2025)
par: Jiang, Dongzhi, et autres
Publié: (2025)
Cognitive Chain-of-Thought (CoCoT): Structured Multimodal Reasoning about Social Situations
par: Park, Eunkyu, et autres
Publié: (2025)
par: Park, Eunkyu, et autres
Publié: (2025)
SurgSora: Object-Aware Diffusion Model for Controllable Surgical Video Generation
par: Chen, Tong, et autres
Publié: (2024)
par: Chen, Tong, et autres
Publié: (2024)
CoTEvol: Self-Evolving Chain-of-Thoughts for Data Synthesis in Mathematical Reasoning
par: Wang, Zhuo, et autres
Publié: (2026)
par: Wang, Zhuo, et autres
Publié: (2026)
MM-CoT:A Benchmark for Probing Visual Chain-of-Thought Reasoning in Multimodal Models
par: Zhang, Jusheng, et autres
Publié: (2025)
par: Zhang, Jusheng, et autres
Publié: (2025)
SurgRIPE challenge: Benchmark of Surgical Robot Instrument Pose Estimation
par: Xu, Haozheng, et autres
Publié: (2025)
par: Xu, Haozheng, et autres
Publié: (2025)
Advancing Adaptive Multi-Stage Video Anomaly Reasoning: A Benchmark Dataset and Method
par: Huang, Chao, et autres
Publié: (2026)
par: Huang, Chao, et autres
Publié: (2026)
SurgMotion: A Video-Native Foundation Model for Universal Understanding of Surgical Videos
par: Wu, Jinlin, et autres
Publié: (2026)
par: Wu, Jinlin, et autres
Publié: (2026)
When Visualizing is the First Step to Reasoning: MIRA, a Benchmark for Visual Chain-of-Thought
par: Zhou, Yiyang, et autres
Publié: (2025)
par: Zhou, Yiyang, et autres
Publié: (2025)
DisFaceRep: Representation Disentanglement for Co-occurring Facial Components in Weakly Supervised Face Parsing
par: Wang, Xiaoqin, et autres
Publié: (2025)
par: Wang, Xiaoqin, et autres
Publié: (2025)
AgroCoT: A Chain-of-Thought Benchmark for Evaluating Reasoning in Vision-Language Models for Agriculture
par: Wen, Yibin, et autres
Publié: (2025)
par: Wen, Yibin, et autres
Publié: (2025)
EgoCoT-Bench: Benchmarking Grounded and Verifiable Operation-Centric Chain of Thought Reasoning for MLLMs
par: Dai, Yang, et autres
Publié: (2026)
par: Dai, Yang, et autres
Publié: (2026)
X-CoT: Explainable Text-to-Video Retrieval via LLM-based Chain-of-Thought Reasoning
par: Pulakurthi, Prasanna Reddy, et autres
Publié: (2025)
par: Pulakurthi, Prasanna Reddy, et autres
Publié: (2025)
MG-MotionLLM: A Unified Framework for Motion Comprehension and Generation across Multiple Granularities
par: Wu, Bizhu, et autres
Publié: (2025)
par: Wu, Bizhu, et autres
Publié: (2025)
FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning
par: Xie, Zhuohan, et autres
Publié: (2025)
par: Xie, Zhuohan, et autres
Publié: (2025)
SurgPub-Video: A Comprehensive Surgical Video Dataset for Enhanced Surgical Intelligence in Vision-Language Model
par: Li, Yaoqian, et autres
Publié: (2025)
par: Li, Yaoqian, et autres
Publié: (2025)
SpatialCoT: Advancing Spatial Reasoning through Coordinate Alignment and Chain-of-Thought for Embodied Task Planning
par: Liu, Yuecheng, et autres
Publié: (2025)
par: Liu, Yuecheng, et autres
Publié: (2025)
HieraSurg: Hierarchy-Aware Diffusion Model for Surgical Video Generation
par: Biagini, Diego, et autres
Publié: (2025)
par: Biagini, Diego, et autres
Publié: (2025)
SurgLQA: Scalable Long-Horizon Surgical Video Question Answering
par: Guo, Diandian, et autres
Publié: (2026)
par: Guo, Diandian, et autres
Publié: (2026)
SurgOnAir: Hierarchy-Aware Real-Time Surgical Video Commentary
par: He, Jingyi, et autres
Publié: (2026)
par: He, Jingyi, et autres
Publié: (2026)
SurgPETL: Parameter-Efficient Image-to-Surgical-Video Transfer Learning for Surgical Phase Recognition
par: Yang, Shu, et autres
Publié: (2024)
par: Yang, Shu, et autres
Publié: (2024)
LLaVA-Surg: Towards Multimodal Surgical Assistant via Structured Surgical Video Learning
par: Li, Jiajie, et autres
Publié: (2024)
par: Li, Jiajie, et autres
Publié: (2024)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
par: Feng, Kehua, et autres
Publié: (2025)
par: Feng, Kehua, et autres
Publié: (2025)
Documents similaires
-
X-PCR: A Benchmark for Cross-modality Progressive Clinical Reasoning in Ophthalmic Diagnosis
par: Wang, Gui, et autres
Publié: (2026) -
EyePCR: A Comprehensive Benchmark for Fine-Grained Perception, Knowledge Comprehension and Clinical Reasoning in Ophthalmic Surgery
par: Wang, Gui, et autres
Publié: (2025) -
{S$^3$-Mamba}: Small-Size-Sensitive Mamba for Lesion Segmentation
par: Wang, Gui, et autres
Publié: (2024) -
SurgRAW: Multi-Agent Workflow with Chain of Thought Reasoning for Robotic Surgical Video Analysis
par: Low, Chang Han, et autres
Publié: (2025) -
CoAT: Chain-of-Associated-Thoughts Framework for Enhancing Large Language Models Reasoning
par: Pan, Jianfeng, et autres
Publié: (2025)