Track Any Anomalous Object: A Granular Video Anomaly Detection Pipeline
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Yuzhi, Li, Chenxin, Zhang, Haitao, Lin, Zixu, Lin, Yunlong, Liu, Hengyu, Li, Wuyang, Liu, Xinyu, Gao, Jiechao, Huang, Yue, Ding, Xinghao, Yuan, Yixuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GaussianStego: A Generalizable Stenography Pipeline for Generative 3D Gaussians Splatting
par: Li, Chenxin, et autres
Publié: (2024)
par: Li, Chenxin, et autres
Publié: (2024)
LGS: A Light-weight 4D Gaussian Splatting for Efficient Surgical Scene Reconstruction
par: Liu, Hengyu, et autres
Publié: (2024)
par: Liu, Hengyu, et autres
Publié: (2024)
Endora: Video Generation Models as Endoscopy Simulators
par: Li, Chenxin, et autres
Publié: (2024)
par: Li, Chenxin, et autres
Publié: (2024)
U-KAN Makes Strong Backbone for Medical Image Segmentation and Generation
par: Li, Chenxin, et autres
Publié: (2024)
par: Li, Chenxin, et autres
Publié: (2024)
Harnessing Lightweight Transformer with Contextual Synergic Enhancement for Efficient 3D Medical Image Segmentation
par: Liu, Xinyu, et autres
Publié: (2026)
par: Liu, Xinyu, et autres
Publié: (2026)
JarvisIR: Elevating Autonomous Driving Perception with Intelligent Image Restoration
par: Lin, Yunlong, et autres
Publié: (2025)
par: Lin, Yunlong, et autres
Publié: (2025)
ConcealGS: Concealing Invisible Copyright Information in 3D Gaussian Splatting
par: Yang, Yifeng, et autres
Publié: (2025)
par: Yang, Yifeng, et autres
Publié: (2025)
DiffRect: Latent Diffusion Label Rectification for Semi-supervised Medical Image Segmentation
par: Liu, Xinyu, et autres
Publié: (2024)
par: Liu, Xinyu, et autres
Publié: (2024)
JarvisArt: Liberating Human Artistic Creativity via an Intelligent Photo Retouching Agent
par: Lin, Yunlong, et autres
Publié: (2025)
par: Lin, Yunlong, et autres
Publié: (2025)
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
par: Zhang, Huaxin, et autres
Publié: (2024)
par: Zhang, Huaxin, et autres
Publié: (2024)
Thinking in Dynamics: How Multimodal Large Language Models Perceive, Track, and Reason Dynamics in Physical 4D World
par: Huang, Yuzhi, et autres
Publié: (2026)
par: Huang, Yuzhi, et autres
Publié: (2026)
Position-Aware Self-supervised Representation Learning for Cross-mode Radar Signal Recognition
par: Zhang, Hongyang, et autres
Publié: (2026)
par: Zhang, Hongyang, et autres
Publié: (2026)
EndoGen: Conditional Autoregressive Endoscopic Video Generation
par: Liu, Xinyu, et autres
Publié: (2025)
par: Liu, Xinyu, et autres
Publié: (2025)
MetaScope: Optics-Driven Neural Network for Ultra-Micro Metalens Endoscopy
par: Li, Wuyang, et autres
Publié: (2025)
par: Li, Wuyang, et autres
Publié: (2025)
ID-Crafter: VLM-Grounded Online RL for Compositional Multi-Subject Video Generation
par: Pan, Panwang, et autres
Publié: (2025)
par: Pan, Panwang, et autres
Publié: (2025)
X-GRM: Large Gaussian Reconstruction Model for Sparse-view X-rays to Computed Tomography
par: Liu, Yifan, et autres
Publié: (2025)
par: Liu, Yifan, et autres
Publié: (2025)
SAM 2++: Tracking Anything at Any Granularity
par: Zhang, Jiaming, et autres
Publié: (2025)
par: Zhang, Jiaming, et autres
Publié: (2025)
PCMamba: Physics-Informed Cross-Modal State Space Model for Dual-Camera Compressive Hyperspectral Imaging
par: Meng, Ge, et autres
Publié: (2025)
par: Meng, Ge, et autres
Publié: (2025)
Claw-Eval-Live: A Live Agent Benchmark for Evolving Real-World Workflows
par: Li, Chenxin, et autres
Publié: (2026)
par: Li, Chenxin, et autres
Publié: (2026)
Dissecting Generalized Category Discovery: Multiplex Consensus under Self-Deconstruction
par: Tang, Luyao, et autres
Publié: (2025)
par: Tang, Luyao, et autres
Publié: (2025)
Single-Model and Any-Modality for Video Object Tracking
par: Wu, Zongwei, et autres
Publié: (2023)
par: Wu, Zongwei, et autres
Publié: (2023)
Track Any Motions under Any Disturbances
par: Zhang, Zhikai, et autres
Publié: (2025)
par: Zhang, Zhikai, et autres
Publié: (2025)
Count Anything at Any Granularity
par: Liu, Chang, et autres
Publié: (2026)
par: Liu, Chang, et autres
Publié: (2026)
IR3D-Bench: Evaluating Vision-Language Model Scene Understanding as Agentic Inverse Rendering
par: Liu, Parker, et autres
Publié: (2025)
par: Liu, Parker, et autres
Publié: (2025)
FlexGS: Train Once, Deploy Everywhere with Many-in-One Flexible 3D Gaussian Splatting
par: Liu, Hengyu, et autres
Publié: (2025)
par: Liu, Hengyu, et autres
Publié: (2025)
Pan-LUT: Efficient Pan-sharpening via Learnable Look-Up Tables
par: Cai, Zhongnan, et autres
Publié: (2025)
par: Cai, Zhongnan, et autres
Publié: (2025)
MedAD-R1: Eliciting Consistent Reasoning in Interpretible Medical Anomaly Detection via Consistency-Reinforced Policy Optimization
par: Zhang, Haitao, et autres
Publié: (2026)
par: Zhang, Haitao, et autres
Publié: (2026)
EndoSparse: Real-Time Sparse View Synthesis of Endoscopic Scenes using Gaussian Splatting
par: Li, Chenxin, et autres
Publié: (2024)
par: Li, Chenxin, et autres
Publié: (2024)
DynamicVerse: A Physically-Aware Multimodal Framework for 4D World Modeling
par: Wen, Kairun, et autres
Publié: (2025)
par: Wen, Kairun, et autres
Publié: (2025)
HumanCrafter: Synergizing Generalizable Human Reconstruction and Semantic 3D Segmentation
par: Pan, Panwang, et autres
Publié: (2025)
par: Pan, Panwang, et autres
Publié: (2025)
Bootstrap Segmentation Foundation Model under Distribution Shift via Object-Centric Learning
par: Tang, Luyao, et autres
Publié: (2024)
par: Tang, Luyao, et autres
Publié: (2024)
ReTrack: Evidence-Driven Dual-Stream Directional Anchor Calibration Network for Composed Video Retrieval
par: Li, Zixu, et autres
Publié: (2026)
par: Li, Zixu, et autres
Publié: (2026)
Theory for the Anomalous Phase Behavior of Inertial Active Brownian Particles
par: Feng, Jiechao, et autres
Publié: (2024)
par: Feng, Jiechao, et autres
Publié: (2024)
JarvisEvo: Towards a Self-Evolving Photo Editing Agent with Synergistic Editor-Evaluator Optimization
par: Lin, Yunlong, et autres
Publié: (2025)
par: Lin, Yunlong, et autres
Publié: (2025)
Bridge the Gap Between Visual and Linguistic Comprehension for Generalized Zero-shot Semantic Segmentation
par: Guo, Xiaoqing, et autres
Publié: (2025)
par: Guo, Xiaoqing, et autres
Publié: (2025)
Depth Any Video with Scalable Synthetic Data
par: Yang, Honghui, et autres
Publié: (2024)
par: Yang, Honghui, et autres
Publié: (2024)
Pareto-guided Pipeline for Distilling Featherweight AI Agents in Mobile MOBA Games
par: Yang, Xionghui, et autres
Publié: (2026)
par: Yang, Xionghui, et autres
Publié: (2026)
Out of Sight, Still in Mind: Reasoning and Planning about Unobserved Objects with Video Tracking Enabled Memory Models
par: Huang, Yixuan, et autres
Publié: (2023)
par: Huang, Yixuan, et autres
Publié: (2023)
EndoGaussian: Real-time Gaussian Splatting for Dynamic Endoscopic Scene Reconstruction
par: Liu, Yifan, et autres
Publié: (2024)
par: Liu, Yifan, et autres
Publié: (2024)
Tracking Reflected Objects: A Benchmark
par: Guo, Xiaoyu, et autres
Publié: (2024)
par: Guo, Xiaoyu, et autres
Publié: (2024)
Documents similaires
-
GaussianStego: A Generalizable Stenography Pipeline for Generative 3D Gaussians Splatting
par: Li, Chenxin, et autres
Publié: (2024) -
LGS: A Light-weight 4D Gaussian Splatting for Efficient Surgical Scene Reconstruction
par: Liu, Hengyu, et autres
Publié: (2024) -
Endora: Video Generation Models as Endoscopy Simulators
par: Li, Chenxin, et autres
Publié: (2024) -
U-KAN Makes Strong Backbone for Medical Image Segmentation and Generation
par: Li, Chenxin, et autres
Publié: (2024) -
Harnessing Lightweight Transformer with Contextual Synergic Enhancement for Efficient 3D Medical Image Segmentation
par: Liu, Xinyu, et autres
Publié: (2026)