SpatialVID: A Large-Scale Video Dataset with Spatial Annotations
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Jiahao, Yuan, Yufeng, Zheng, Rujie, Lin, Youtian, Gao, Jian, Chen, Lin-Zhuo, Bao, Yajie, Zhang, Yi, Zeng, Chang, Zhou, Yanxi, Long, Xiao-Xiao, Zhu, Hao, Zhang, Zhaoxiang, Cao, Xun, Yao, Yao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention
di: Wu, Shuang, et al.
Pubblicazione: (2025)
di: Wu, Shuang, et al.
Pubblicazione: (2025)
STAG4D: Spatial-Temporal Anchored Generative 4D Gaussians
di: Zeng, Yifei, et al.
Pubblicazione: (2024)
di: Zeng, Yifei, et al.
Pubblicazione: (2024)
TEXTRIX: Latent Attribute Grid for Native Texture Generation and Beyond
di: Zeng, Yifei, et al.
Pubblicazione: (2025)
di: Zeng, Yifei, et al.
Pubblicazione: (2025)
Flow Distillation Sampling: Regularizing 3D Gaussians with Pre-trained Matching Priors
di: Chen, Lin-Zhuo, et al.
Pubblicazione: (2025)
di: Chen, Lin-Zhuo, et al.
Pubblicazione: (2025)
XS-VID: An Extremely Small Video Object Detection Dataset
di: Guo, Jiahao, et al.
Pubblicazione: (2024)
di: Guo, Jiahao, et al.
Pubblicazione: (2024)
Direct3D: Scalable Image-to-3D Generation via 3D Latent Diffusion Transformer
di: Wu, Shuang, et al.
Pubblicazione: (2024)
di: Wu, Shuang, et al.
Pubblicazione: (2024)
Relightable 3D Gaussians: Realistic Point Cloud Relighting with BRDF Decomposition and Ray Tracing
di: Gao, Jian, et al.
Pubblicazione: (2023)
di: Gao, Jian, et al.
Pubblicazione: (2023)
Network-Wide PAoI Guarantee in CF-mMIMO Networks with S&C Coexistence: A Unified Framework for Spatial Partitioning Toward xURLLC
di: Zhang, Yanxi, et al.
Pubblicazione: (2026)
di: Zhang, Yanxi, et al.
Pubblicazione: (2026)
Decoupled Hierarchical Reinforcement Learning with State Abstraction for Discrete Grids
di: Xiao, Qingyu, et al.
Pubblicazione: (2025)
di: Xiao, Qingyu, et al.
Pubblicazione: (2025)
CI-VID: A Coherent Interleaved Text-Video Dataset
di: Ju, Yiming, et al.
Pubblicazione: (2025)
di: Ju, Yiming, et al.
Pubblicazione: (2025)
MRSAudio: A Large-Scale Multimodal Recorded Spatial Audio Dataset with Refined Annotations
di: Guo, Wenxiang, et al.
Pubblicazione: (2025)
di: Guo, Wenxiang, et al.
Pubblicazione: (2025)
Advances in Spatial Omics Technologies
di: Tianxiao Hui, et al.
Pubblicazione: (2025)
di: Tianxiao Hui, et al.
Pubblicazione: (2025)
MozzaVID: Mozzarella Volumetric Image Dataset
di: Pieta, Pawel Tomasz, et al.
Pubblicazione: (2024)
di: Pieta, Pawel Tomasz, et al.
Pubblicazione: (2024)
ComGS: Efficient 3D Object-Scene Composition via Surface Octahedral Probes
di: Gao, Jian, et al.
Pubblicazione: (2025)
di: Gao, Jian, et al.
Pubblicazione: (2025)
SVD: Spatial Video Dataset
di: Izadimehr, M. H., et al.
Pubblicazione: (2025)
di: Izadimehr, M. H., et al.
Pubblicazione: (2025)
CrossView Suite: Harnessing Cross-view Spatial Intelligence of MLLMs with Dataset, Model and Benchmark
di: Wang, Wei, et al.
Pubblicazione: (2026)
di: Wang, Wei, et al.
Pubblicazione: (2026)
Spatially‐Uneven Observations Cause Overestimation of Global Soil Respiration
di: Li Cao, et al.
Pubblicazione: (2026)
di: Li Cao, et al.
Pubblicazione: (2026)
Bootstrap Inference under General Two-way Clustering with Serially and Spatially Dependent Common Effects
di: Hounyo, Ulrich, et al.
Pubblicazione: (2026)
di: Hounyo, Ulrich, et al.
Pubblicazione: (2026)
Non-parabolic Spatial Hybrid Framed Curves and Their Applications in the Spatial Hybrid Number Space
di: Yao, Kaixin
Pubblicazione: (2026)
di: Yao, Kaixin
Pubblicazione: (2026)
AutoSpatial: Visual-Language Reasoning for Social Robot Navigation through Efficient Spatial Reasoning Learning
di: Kong, Yangzhe, et al.
Pubblicazione: (2025)
di: Kong, Yangzhe, et al.
Pubblicazione: (2025)
Scaling Spatial Reasoning in MLLMs through Programmatic Data Synthesis
di: Helu, Zhi, et al.
Pubblicazione: (2025)
di: Helu, Zhi, et al.
Pubblicazione: (2025)
SpheriGait: Enriching Spatial Representation via Spherical Projection for LiDAR-based Gait Recognition
di: Wang, Yanxi, et al.
Pubblicazione: (2024)
di: Wang, Yanxi, et al.
Pubblicazione: (2024)
SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing
di: Xiao, Yicheng, et al.
Pubblicazione: (2026)
di: Xiao, Yicheng, et al.
Pubblicazione: (2026)
DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation
di: Yao, Jiawei, et al.
Pubblicazione: (2023)
di: Yao, Jiawei, et al.
Pubblicazione: (2023)
Holi-Spatial: Evolving Video Streams into Holistic 3D Spatial Intelligence
di: Gao, Yuanyuan, et al.
Pubblicazione: (2026)
di: Gao, Yuanyuan, et al.
Pubblicazione: (2026)
Denoise to Track: Harnessing Video Diffusion Priors for Robust Correspondence
di: Yuan, Tianyu, et al.
Pubblicazione: (2025)
di: Yuan, Tianyu, et al.
Pubblicazione: (2025)
SpatialForge: Bootstrapping 3D-Aware Spatial Reasoning from Open-World 2D Images
di: Liu, Zishan, et al.
Pubblicazione: (2026)
di: Liu, Zishan, et al.
Pubblicazione: (2026)
Spatial Interference Detection in Treatment Effect Model
di: Zhang, Wei, et al.
Pubblicazione: (2024)
di: Zhang, Wei, et al.
Pubblicazione: (2024)
FastVID: Dynamic Density Pruning for Fast Video Large Language Models
di: Shen, Leqi, et al.
Pubblicazione: (2025)
di: Shen, Leqi, et al.
Pubblicazione: (2025)
A Multi-Channel Spatial-Temporal Transformer Model for Traffic Flow Forecasting
di: Xiao, Jianli, et al.
Pubblicazione: (2024)
di: Xiao, Jianli, et al.
Pubblicazione: (2024)
Spatially Proximate Acid Sites in Zeolites Synergistically Boost Alkane Activation
di: Youdong Xing, et al.
Pubblicazione: (2026)
di: Youdong Xing, et al.
Pubblicazione: (2026)
Learning Spatial Adaptation and Temporal Coherence in Diffusion Models for Video Super-Resolution
di: Chen, Zhikai, et al.
Pubblicazione: (2024)
di: Chen, Zhikai, et al.
Pubblicazione: (2024)
Hybrid Transformer and Spatial-Temporal Self-Supervised Learning for Long-term Traffic Prediction
di: Zhu, Wang, et al.
Pubblicazione: (2024)
di: Zhu, Wang, et al.
Pubblicazione: (2024)
MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling
di: Men, Yifang, et al.
Pubblicazione: (2024)
di: Men, Yifang, et al.
Pubblicazione: (2024)
A Versatile Energy‐Based SPH Surface Tension With Spatial Gradients
di: Qianwei Wang, et al.
Pubblicazione: (2025)
di: Qianwei Wang, et al.
Pubblicazione: (2025)
IVAC-P2L: Leveraging Irregular Repetition Priors for Improving Video Action Counting
di: Wang, Hang, et al.
Pubblicazione: (2024)
di: Wang, Hang, et al.
Pubblicazione: (2024)
AngularFuse: A Closer Look at Angle-based Perception for Spatial-Sensitive Multi-Modality Image Fusion
di: Liu, Xiaopeng, et al.
Pubblicazione: (2025)
di: Liu, Xiaopeng, et al.
Pubblicazione: (2025)
Position: AI Scaling: From Up to Down and Out
di: Wang, Yunke, et al.
Pubblicazione: (2025)
di: Wang, Yunke, et al.
Pubblicazione: (2025)
ClimateVID -- Social Media Videos Analysis and Challenges Involved
di: Xu, Shiqi, et al.
Pubblicazione: (2026)
di: Xu, Shiqi, et al.
Pubblicazione: (2026)
Spatia: Video Generation with Updatable Spatial Memory
di: Zhao, Jinjing, et al.
Pubblicazione: (2025)
di: Zhao, Jinjing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Direct3D-S2: Gigascale 3D Generation Made Easy with Spatial Sparse Attention
di: Wu, Shuang, et al.
Pubblicazione: (2025) -
STAG4D: Spatial-Temporal Anchored Generative 4D Gaussians
di: Zeng, Yifei, et al.
Pubblicazione: (2024) -
TEXTRIX: Latent Attribute Grid for Native Texture Generation and Beyond
di: Zeng, Yifei, et al.
Pubblicazione: (2025) -
Flow Distillation Sampling: Regularizing 3D Gaussians with Pre-trained Matching Priors
di: Chen, Lin-Zhuo, et al.
Pubblicazione: (2025) -
XS-VID: An Extremely Small Video Object Detection Dataset
di: Guo, Jiahao, et al.
Pubblicazione: (2024)