Track Any Anomalous Object: A Granular Video Anomaly Detection Pipeline
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Yuzhi, Li, Chenxin, Zhang, Haitao, Lin, Zixu, Lin, Yunlong, Liu, Hengyu, Li, Wuyang, Liu, Xinyu, Gao, Jiechao, Huang, Yue, Ding, Xinghao, Yuan, Yixuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GaussianStego: A Generalizable Stenography Pipeline for Generative 3D Gaussians Splatting
por: Li, Chenxin, et al.
Publicado: (2024)
por: Li, Chenxin, et al.
Publicado: (2024)
LGS: A Light-weight 4D Gaussian Splatting for Efficient Surgical Scene Reconstruction
por: Liu, Hengyu, et al.
Publicado: (2024)
por: Liu, Hengyu, et al.
Publicado: (2024)
Endora: Video Generation Models as Endoscopy Simulators
por: Li, Chenxin, et al.
Publicado: (2024)
por: Li, Chenxin, et al.
Publicado: (2024)
U-KAN Makes Strong Backbone for Medical Image Segmentation and Generation
por: Li, Chenxin, et al.
Publicado: (2024)
por: Li, Chenxin, et al.
Publicado: (2024)
Harnessing Lightweight Transformer with Contextual Synergic Enhancement for Efficient 3D Medical Image Segmentation
por: Liu, Xinyu, et al.
Publicado: (2026)
por: Liu, Xinyu, et al.
Publicado: (2026)
JarvisIR: Elevating Autonomous Driving Perception with Intelligent Image Restoration
por: Lin, Yunlong, et al.
Publicado: (2025)
por: Lin, Yunlong, et al.
Publicado: (2025)
ConcealGS: Concealing Invisible Copyright Information in 3D Gaussian Splatting
por: Yang, Yifeng, et al.
Publicado: (2025)
por: Yang, Yifeng, et al.
Publicado: (2025)
DiffRect: Latent Diffusion Label Rectification for Semi-supervised Medical Image Segmentation
por: Liu, Xinyu, et al.
Publicado: (2024)
por: Liu, Xinyu, et al.
Publicado: (2024)
JarvisArt: Liberating Human Artistic Creativity via an Intelligent Photo Retouching Agent
por: Lin, Yunlong, et al.
Publicado: (2025)
por: Lin, Yunlong, et al.
Publicado: (2025)
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
por: Zhang, Huaxin, et al.
Publicado: (2024)
por: Zhang, Huaxin, et al.
Publicado: (2024)
Thinking in Dynamics: How Multimodal Large Language Models Perceive, Track, and Reason Dynamics in Physical 4D World
por: Huang, Yuzhi, et al.
Publicado: (2026)
por: Huang, Yuzhi, et al.
Publicado: (2026)
Position-Aware Self-supervised Representation Learning for Cross-mode Radar Signal Recognition
por: Zhang, Hongyang, et al.
Publicado: (2026)
por: Zhang, Hongyang, et al.
Publicado: (2026)
EndoGen: Conditional Autoregressive Endoscopic Video Generation
por: Liu, Xinyu, et al.
Publicado: (2025)
por: Liu, Xinyu, et al.
Publicado: (2025)
MetaScope: Optics-Driven Neural Network for Ultra-Micro Metalens Endoscopy
por: Li, Wuyang, et al.
Publicado: (2025)
por: Li, Wuyang, et al.
Publicado: (2025)
ID-Crafter: VLM-Grounded Online RL for Compositional Multi-Subject Video Generation
por: Pan, Panwang, et al.
Publicado: (2025)
por: Pan, Panwang, et al.
Publicado: (2025)
X-GRM: Large Gaussian Reconstruction Model for Sparse-view X-rays to Computed Tomography
por: Liu, Yifan, et al.
Publicado: (2025)
por: Liu, Yifan, et al.
Publicado: (2025)
SAM 2++: Tracking Anything at Any Granularity
por: Zhang, Jiaming, et al.
Publicado: (2025)
por: Zhang, Jiaming, et al.
Publicado: (2025)
PCMamba: Physics-Informed Cross-Modal State Space Model for Dual-Camera Compressive Hyperspectral Imaging
por: Meng, Ge, et al.
Publicado: (2025)
por: Meng, Ge, et al.
Publicado: (2025)
Claw-Eval-Live: A Live Agent Benchmark for Evolving Real-World Workflows
por: Li, Chenxin, et al.
Publicado: (2026)
por: Li, Chenxin, et al.
Publicado: (2026)
Dissecting Generalized Category Discovery: Multiplex Consensus under Self-Deconstruction
por: Tang, Luyao, et al.
Publicado: (2025)
por: Tang, Luyao, et al.
Publicado: (2025)
Single-Model and Any-Modality for Video Object Tracking
por: Wu, Zongwei, et al.
Publicado: (2023)
por: Wu, Zongwei, et al.
Publicado: (2023)
Track Any Motions under Any Disturbances
por: Zhang, Zhikai, et al.
Publicado: (2025)
por: Zhang, Zhikai, et al.
Publicado: (2025)
Count Anything at Any Granularity
por: Liu, Chang, et al.
Publicado: (2026)
por: Liu, Chang, et al.
Publicado: (2026)
IR3D-Bench: Evaluating Vision-Language Model Scene Understanding as Agentic Inverse Rendering
por: Liu, Parker, et al.
Publicado: (2025)
por: Liu, Parker, et al.
Publicado: (2025)
FlexGS: Train Once, Deploy Everywhere with Many-in-One Flexible 3D Gaussian Splatting
por: Liu, Hengyu, et al.
Publicado: (2025)
por: Liu, Hengyu, et al.
Publicado: (2025)
Pan-LUT: Efficient Pan-sharpening via Learnable Look-Up Tables
por: Cai, Zhongnan, et al.
Publicado: (2025)
por: Cai, Zhongnan, et al.
Publicado: (2025)
MedAD-R1: Eliciting Consistent Reasoning in Interpretible Medical Anomaly Detection via Consistency-Reinforced Policy Optimization
por: Zhang, Haitao, et al.
Publicado: (2026)
por: Zhang, Haitao, et al.
Publicado: (2026)
EndoSparse: Real-Time Sparse View Synthesis of Endoscopic Scenes using Gaussian Splatting
por: Li, Chenxin, et al.
Publicado: (2024)
por: Li, Chenxin, et al.
Publicado: (2024)
DynamicVerse: A Physically-Aware Multimodal Framework for 4D World Modeling
por: Wen, Kairun, et al.
Publicado: (2025)
por: Wen, Kairun, et al.
Publicado: (2025)
HumanCrafter: Synergizing Generalizable Human Reconstruction and Semantic 3D Segmentation
por: Pan, Panwang, et al.
Publicado: (2025)
por: Pan, Panwang, et al.
Publicado: (2025)
Bootstrap Segmentation Foundation Model under Distribution Shift via Object-Centric Learning
por: Tang, Luyao, et al.
Publicado: (2024)
por: Tang, Luyao, et al.
Publicado: (2024)
ReTrack: Evidence-Driven Dual-Stream Directional Anchor Calibration Network for Composed Video Retrieval
por: Li, Zixu, et al.
Publicado: (2026)
por: Li, Zixu, et al.
Publicado: (2026)
Theory for the Anomalous Phase Behavior of Inertial Active Brownian Particles
por: Feng, Jiechao, et al.
Publicado: (2024)
por: Feng, Jiechao, et al.
Publicado: (2024)
JarvisEvo: Towards a Self-Evolving Photo Editing Agent with Synergistic Editor-Evaluator Optimization
por: Lin, Yunlong, et al.
Publicado: (2025)
por: Lin, Yunlong, et al.
Publicado: (2025)
Bridge the Gap Between Visual and Linguistic Comprehension for Generalized Zero-shot Semantic Segmentation
por: Guo, Xiaoqing, et al.
Publicado: (2025)
por: Guo, Xiaoqing, et al.
Publicado: (2025)
Depth Any Video with Scalable Synthetic Data
por: Yang, Honghui, et al.
Publicado: (2024)
por: Yang, Honghui, et al.
Publicado: (2024)
Pareto-guided Pipeline for Distilling Featherweight AI Agents in Mobile MOBA Games
por: Yang, Xionghui, et al.
Publicado: (2026)
por: Yang, Xionghui, et al.
Publicado: (2026)
Out of Sight, Still in Mind: Reasoning and Planning about Unobserved Objects with Video Tracking Enabled Memory Models
por: Huang, Yixuan, et al.
Publicado: (2023)
por: Huang, Yixuan, et al.
Publicado: (2023)
EndoGaussian: Real-time Gaussian Splatting for Dynamic Endoscopic Scene Reconstruction
por: Liu, Yifan, et al.
Publicado: (2024)
por: Liu, Yifan, et al.
Publicado: (2024)
Tracking Reflected Objects: A Benchmark
por: Guo, Xiaoyu, et al.
Publicado: (2024)
por: Guo, Xiaoyu, et al.
Publicado: (2024)
Ejemplares similares
-
GaussianStego: A Generalizable Stenography Pipeline for Generative 3D Gaussians Splatting
por: Li, Chenxin, et al.
Publicado: (2024) -
LGS: A Light-weight 4D Gaussian Splatting for Efficient Surgical Scene Reconstruction
por: Liu, Hengyu, et al.
Publicado: (2024) -
Endora: Video Generation Models as Endoscopy Simulators
por: Li, Chenxin, et al.
Publicado: (2024) -
U-KAN Makes Strong Backbone for Medical Image Segmentation and Generation
por: Li, Chenxin, et al.
Publicado: (2024) -
Harnessing Lightweight Transformer with Contextual Synergic Enhancement for Efficient 3D Medical Image Segmentation
por: Liu, Xinyu, et al.
Publicado: (2026)