VGGT4D: Mining Motion Cues in Visual Geometry Transformers for 4D Scene Reconstruction
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Yu, Cheng, Chong, Yu, Sicheng, Guo, Xiaoyang, Wang, Hao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
4DLangVGGT: 4D Language-Visual Geometry Grounded Transformer
di: Wu, Xianfeng, et al.
Pubblicazione: (2025)
di: Wu, Xianfeng, et al.
Pubblicazione: (2025)
HD-VGGT: High-Resolution Visual Geometry Transformer
di: Chen, Tianrun, et al.
Pubblicazione: (2026)
di: Chen, Tianrun, et al.
Pubblicazione: (2026)
VGGT: Visual Geometry Grounded Transformer
di: Wang, Jianyuan, et al.
Pubblicazione: (2025)
di: Wang, Jianyuan, et al.
Pubblicazione: (2025)
PAGE-4D: VGGT-4D Perception via Disentangled Pose and Geometry Estimation
di: Zhou, Kaichen, et al.
Pubblicazione: (2025)
di: Zhou, Kaichen, et al.
Pubblicazione: (2025)
DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving
di: He, Zhuolin, et al.
Pubblicazione: (2026)
di: He, Zhuolin, et al.
Pubblicazione: (2026)
4D-VGGT: A General Foundation Model with SpatioTemporal Awareness for Dynamic Scene Geometry Estimation
di: Wang, Haonan, et al.
Pubblicazione: (2025)
di: Wang, Haonan, et al.
Pubblicazione: (2025)
DriveVGGT: Calibration-Constrained Visual Geometry Transformers for Multi-Camera Autonomous Driving
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
di: Jia, Xiaosong, et al.
Pubblicazione: (2025)
VGGT-World: Transforming VGGT into an Autoregressive Geometry World Model
di: Sun, Xiangyu, et al.
Pubblicazione: (2026)
di: Sun, Xiangyu, et al.
Pubblicazione: (2026)
LiteVGGT: Boosting Vanilla VGGT via Geometry-aware Cached Token Merging
di: Shu, Zhijian, et al.
Pubblicazione: (2025)
di: Shu, Zhijian, et al.
Pubblicazione: (2025)
VGGT-Det: Mining VGGT Internal Priors for Sensor-Geometry-Free Multi-View Indoor 3D Object Detection
di: Cao, Yang, et al.
Pubblicazione: (2026)
di: Cao, Yang, et al.
Pubblicazione: (2026)
Reloc-VGGT: Visual Re-localization with Geometry Grounded Transformer
di: Deng, Tianchen, et al.
Pubblicazione: (2025)
di: Deng, Tianchen, et al.
Pubblicazione: (2025)
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
di: Li, Haotang, et al.
Pubblicazione: (2026)
di: Li, Haotang, et al.
Pubblicazione: (2026)
MotionScale: Reconstructing Appearance, Geometry, and Motion of Dynamic Scenes with Scalable 4D Gaussian Splatting
di: Zhou, Haoran, et al.
Pubblicazione: (2026)
di: Zhou, Haoran, et al.
Pubblicazione: (2026)
Unposed 3DGS Reconstruction with Probabilistic Procrustes Mapping
di: Cheng, Chong, et al.
Pubblicazione: (2025)
di: Cheng, Chong, et al.
Pubblicazione: (2025)
OmniVGGT: Omni-Modality Driven Visual Geometry Grounded Transformer
di: Peng, Haosong, et al.
Pubblicazione: (2025)
di: Peng, Haosong, et al.
Pubblicazione: (2025)
StereoVGGT: A Training-Free Visual Geometry Transformer for Stereo Vision
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
FastVGGT: Training-Free Acceleration of Visual Geometry Transformer
di: Shen, You, et al.
Pubblicazione: (2025)
di: Shen, You, et al.
Pubblicazione: (2025)
SwiftVGGT: A Scalable Visual Geometry Grounded Transformer for Large-Scale Scenes
di: Lee, Jungho, et al.
Pubblicazione: (2025)
di: Lee, Jungho, et al.
Pubblicazione: (2025)
InfiniteVGGT: Visual Geometry Grounded Transformer for Endless Streams
di: Yuan, Shuai, et al.
Pubblicazione: (2026)
di: Yuan, Shuai, et al.
Pubblicazione: (2026)
PanoVGGT: Feed-Forward 3D Reconstruction from Panoramic Imagery
di: Guo, Yijing, et al.
Pubblicazione: (2026)
di: Guo, Yijing, et al.
Pubblicazione: (2026)
TurboVGGT: Fast Visual Geometry Reconstruction with Adaptive Alternating Attention
di: Huang, David, et al.
Pubblicazione: (2026)
di: Huang, David, et al.
Pubblicazione: (2026)
FlashVGGT: Efficient and Scalable Visual Geometry Transformers with Compressed Descriptor Attention
di: Wang, Zipeng, et al.
Pubblicazione: (2025)
di: Wang, Zipeng, et al.
Pubblicazione: (2025)
Outdoor Monocular SLAM with Global Scale-Consistent 3D Gaussian Pointmaps
di: Cheng, Chong, et al.
Pubblicazione: (2025)
di: Cheng, Chong, et al.
Pubblicazione: (2025)
SpectroMotion: Dynamic 3D Reconstruction of Specular Scenes
di: Fan, Cheng-De, et al.
Pubblicazione: (2024)
di: Fan, Cheng-De, et al.
Pubblicazione: (2024)
Ground4D: Spatially-Grounded Feedforward 4D Reconstruction for Unstructured Off-Road Scenes
di: Wang, Shuo, et al.
Pubblicazione: (2026)
di: Wang, Shuo, et al.
Pubblicazione: (2026)
StreamCacheVGGT: Streaming Visual Geometry Transformers with Robust Scoring and Hybrid Cache Compression
di: Liu, Xuanyi, et al.
Pubblicazione: (2026)
di: Liu, Xuanyi, et al.
Pubblicazione: (2026)
4DVGGT-D: 4D Visual Geometry Transformer with Improved Dynamic Depth Estimation
di: Zang, Ying, et al.
Pubblicazione: (2026)
di: Zang, Ying, et al.
Pubblicazione: (2026)
MoRe: Motion-aware Feed-forward 4D Reconstruction Transformer
di: Fang, Juntong, et al.
Pubblicazione: (2026)
di: Fang, Juntong, et al.
Pubblicazione: (2026)
Sparse4DGS: 4D Gaussian Splatting for Sparse-Frame Dynamic Scene Reconstruction
di: Shi, Changyue, et al.
Pubblicazione: (2025)
di: Shi, Changyue, et al.
Pubblicazione: (2025)
4DSloMo: 4D Reconstruction for High Speed Scene with Asynchronous Capture
di: Chen, Yutian, et al.
Pubblicazione: (2025)
di: Chen, Yutian, et al.
Pubblicazione: (2025)
Advances in 4D Representation: Geometry, Motion, and Interaction
di: Zhao, Mingrui, et al.
Pubblicazione: (2025)
di: Zhao, Mingrui, et al.
Pubblicazione: (2025)
4D Monocular Surgical Reconstruction under Arbitrary Camera Motions
di: Shan, Jiwei, et al.
Pubblicazione: (2026)
di: Shan, Jiwei, et al.
Pubblicazione: (2026)
Robust 4D Visual Geometry Transformer with Uncertainty-Aware Priors
di: Zang, Ying, et al.
Pubblicazione: (2026)
di: Zang, Ying, et al.
Pubblicazione: (2026)
LongStream: Long-Sequence Streaming Autoregressive Visual Geometry
di: Cheng, Chong, et al.
Pubblicazione: (2026)
di: Cheng, Chong, et al.
Pubblicazione: (2026)
Split4D: Decomposed 4D Scene Reconstruction Without Video Segmentation
di: Hu, Yongzhen, et al.
Pubblicazione: (2025)
di: Hu, Yongzhen, et al.
Pubblicazione: (2025)
Graph-Guided Scene Reconstruction from Images with 3D Gaussian Splatting
di: Cheng, Chong, et al.
Pubblicazione: (2025)
di: Cheng, Chong, et al.
Pubblicazione: (2025)
Decoupling Motion and Geometry in 4D Gaussian Splatting
di: Zhang, Yi, et al.
Pubblicazione: (2026)
di: Zhang, Yi, et al.
Pubblicazione: (2026)
Motion4D: Learning 3D-Consistent Motion and Semantics for 4D Scene Understanding
di: Zhou, Haoran, et al.
Pubblicazione: (2025)
di: Zhou, Haoran, et al.
Pubblicazione: (2025)
Motion 3-to-4: 3D Motion Reconstruction for 4D Synthesis
di: Chen, Hongyuan, et al.
Pubblicazione: (2026)
di: Chen, Hongyuan, et al.
Pubblicazione: (2026)
Streaming 4D Visual Geometry Transformer
di: Zhuo, Dong, et al.
Pubblicazione: (2025)
di: Zhuo, Dong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
4DLangVGGT: 4D Language-Visual Geometry Grounded Transformer
di: Wu, Xianfeng, et al.
Pubblicazione: (2025) -
HD-VGGT: High-Resolution Visual Geometry Transformer
di: Chen, Tianrun, et al.
Pubblicazione: (2026) -
VGGT: Visual Geometry Grounded Transformer
di: Wang, Jianyuan, et al.
Pubblicazione: (2025) -
PAGE-4D: VGGT-4D Perception via Disentangled Pose and Geometry Estimation
di: Zhou, Kaichen, et al.
Pubblicazione: (2025) -
DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving
di: He, Zhuolin, et al.
Pubblicazione: (2026)