SirenPose: Dynamic Scene Reconstruction via Geometric Supervision
Fuente:
arXiv
Salvato in:
| Autori principali: | Cai, Kaitong, Zhang, Jensen, Yang, Jing, Wang, Keze |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
STORM: Search-Guided Generative World Models for Robotic Manipulation
di: Lin, Wenjun, et al.
Pubblicazione: (2025)
di: Lin, Wenjun, et al.
Pubblicazione: (2025)
3DAlign-DAER: Dynamic Attention Policy and Efficient Retrieval Strategy for Fine-grained 3D-Text Alignment at Scale
di: Fan, Yijia, et al.
Pubblicazione: (2025)
di: Fan, Yijia, et al.
Pubblicazione: (2025)
Top-Down Semantic Refinement for Image Captioning
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
di: Cai, Kaitong, et al.
Pubblicazione: (2025)
di: Cai, Kaitong, et al.
Pubblicazione: (2025)
PTTA: A Pure Text-to-Animation Framework for High-Quality Creation
di: Chen, Ruiqi, et al.
Pubblicazione: (2025)
di: Chen, Ruiqi, et al.
Pubblicazione: (2025)
CoAgent: Collaborative Planning and Consistency Agent for Coherent Video Generation
di: Zeng, Qinglin, et al.
Pubblicazione: (2025)
di: Zeng, Qinglin, et al.
Pubblicazione: (2025)
GTMA: Dynamic Representation Optimization for OOD Vision-Language Models
di: Zhang, Jensen, et al.
Pubblicazione: (2025)
di: Zhang, Jensen, et al.
Pubblicazione: (2025)
MAT-Agent: Adaptive Multi-Agent Training Optimization
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
Self-Rewarded Multimodal Coherent Reasoning Across Diverse Visual Domains
di: Zhang, Jesen, et al.
Pubblicazione: (2025)
di: Zhang, Jesen, et al.
Pubblicazione: (2025)
Process-of-Thought Reasoning for Videos
di: Zhang, Jusheng, et al.
Pubblicazione: (2026)
di: Zhang, Jusheng, et al.
Pubblicazione: (2026)
Free-DyGS: Camera-Pose-Free Scene Reconstruction for Dynamic Surgical Videos with Gaussian Splatting
di: Li, Qian, et al.
Pubblicazione: (2024)
di: Li, Qian, et al.
Pubblicazione: (2024)
Learning Dynamic Scene Reconstruction with Sinusoidal Geometric Priors
di: Guo, Tian, et al.
Pubblicazione: (2025)
di: Guo, Tian, et al.
Pubblicazione: (2025)
GCRayDiffusion: Pose-Free Surface Reconstruction via Geometric Consistent Ray Diffusion
di: Chen, Li-Heng, et al.
Pubblicazione: (2025)
di: Chen, Li-Heng, et al.
Pubblicazione: (2025)
HybridToken-VLM: Hybrid Token Compression for Vision-Language Models
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
Dense Dynamic Scene Reconstruction and Camera Pose Estimation from Multi-View Videos
di: Sun, Shuo, et al.
Pubblicazione: (2026)
di: Sun, Shuo, et al.
Pubblicazione: (2026)
DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving
di: He, Zhuolin, et al.
Pubblicazione: (2026)
di: He, Zhuolin, et al.
Pubblicazione: (2026)
Mem4D: Decoupling Static and Dynamic Memory for Dynamic Scene Reconstruction
di: Cai, Xudong, et al.
Pubblicazione: (2025)
di: Cai, Xudong, et al.
Pubblicazione: (2025)
Scene Coordinate Reconstruction: Posing of Image Collections via Incremental Learning of a Relocalizer
di: Brachmann, Eric, et al.
Pubblicazione: (2024)
di: Brachmann, Eric, et al.
Pubblicazione: (2024)
Image-Plane Geometric Decoding for View-Invariant Indoor Scene Reconstruction
di: Li, Mingyang, et al.
Pubblicazione: (2025)
di: Li, Mingyang, et al.
Pubblicazione: (2025)
PROFusion: Robust and Accurate Dense Reconstruction via Camera Pose Regression and Optimization
di: Dong, Siyan, et al.
Pubblicazione: (2025)
di: Dong, Siyan, et al.
Pubblicazione: (2025)
TraceFlow: Dynamic 3D Reconstruction of Specular Scenes Driven by Ray Tracing
di: Tao, Jiachen, et al.
Pubblicazione: (2025)
di: Tao, Jiachen, et al.
Pubblicazione: (2025)
Self-Supervised Implicit Attention Priors for Point Cloud Reconstruction
di: Fogarty, Kyle, et al.
Pubblicazione: (2025)
di: Fogarty, Kyle, et al.
Pubblicazione: (2025)
Diffusion-Driven Self-Supervised Learning for Shape Reconstruction and Pose Estimation
di: Sun, Jingtao, et al.
Pubblicazione: (2024)
di: Sun, Jingtao, et al.
Pubblicazione: (2024)
4DRadar-GS: Self-Supervised Dynamic Driving Scene Reconstruction with 4D Radar
di: Tang, Xiao, et al.
Pubblicazione: (2025)
di: Tang, Xiao, et al.
Pubblicazione: (2025)
CityGaussianV2: Efficient and Geometrically Accurate Reconstruction for Large-Scale Scenes
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
WorldStereo: Bridging Camera-Guided Video Generation and Scene Reconstruction via 3D Geometric Memories
di: Zhang, Yisu, et al.
Pubblicazione: (2026)
di: Zhang, Yisu, et al.
Pubblicazione: (2026)
UPGS: Unified Pose-aware Gaussian Splatting for Dynamic Scene Deblurring
di: Wu, Zhijing, et al.
Pubblicazione: (2025)
di: Wu, Zhijing, et al.
Pubblicazione: (2025)
Gaussian Scenes: Pose-Free Sparse-View Scene Reconstruction using Depth-Enhanced Diffusion Priors
di: Paul, Soumava, et al.
Pubblicazione: (2024)
di: Paul, Soumava, et al.
Pubblicazione: (2024)
UrbanGS: A Scalable and Efficient Architecture for Geometrically Accurate Large-Scene Reconstruction
di: Li, Changbai, et al.
Pubblicazione: (2026)
di: Li, Changbai, et al.
Pubblicazione: (2026)
SplitGaussian: Reconstructing Dynamic Scenes via Visual Geometry Decomposition
di: Li, Jiahui, et al.
Pubblicazione: (2025)
di: Li, Jiahui, et al.
Pubblicazione: (2025)
GRAFT: Geometric Refinement and Fitting Transformer for Human Scene Reconstruction
di: YM, Pradyumna, et al.
Pubblicazione: (2026)
di: YM, Pradyumna, et al.
Pubblicazione: (2026)
Instant Gaussian Stream: Fast and Generalizable Streaming of Dynamic Scene Reconstruction via Gaussian Splatting
di: Yan, Jinbo, et al.
Pubblicazione: (2025)
di: Yan, Jinbo, et al.
Pubblicazione: (2025)
Self-Supervised High Dynamic Range Imaging with Multi-Exposure Images in Dynamic Scenes
di: Zhang, Zhilu, et al.
Pubblicazione: (2023)
di: Zhang, Zhilu, et al.
Pubblicazione: (2023)
DynaPose4D: High-Quality 4D Dynamic Content Generation via Pose Alignment Loss
di: Yang, Jing, et al.
Pubblicazione: (2025)
di: Yang, Jing, et al.
Pubblicazione: (2025)
Back on Track: Bundle Adjustment for Dynamic Scene Reconstruction
di: Chen, Weirong, et al.
Pubblicazione: (2025)
di: Chen, Weirong, et al.
Pubblicazione: (2025)
Scene-agnostic Pose Regression for Visual Localization
di: Zheng, Junwei, et al.
Pubblicazione: (2025)
di: Zheng, Junwei, et al.
Pubblicazione: (2025)
Adaptive-VoCo: Complexity-Aware Visual Token Compression for Vision-Language Models
di: Guo, Xiaoyang, et al.
Pubblicazione: (2025)
di: Guo, Xiaoyang, et al.
Pubblicazione: (2025)
Talk2Move: Reinforcement Learning for Text-Instructed Object-Level Geometric Transformation in Scenes
di: Tan, Jing, et al.
Pubblicazione: (2026)
di: Tan, Jing, et al.
Pubblicazione: (2026)
Self-Supervised Monocular 4D Scene Reconstruction for Egocentric Videos
di: Yuan, Chengbo, et al.
Pubblicazione: (2024)
di: Yuan, Chengbo, et al.
Pubblicazione: (2024)
A Pose-only Geometric Constraint for Multi-Camera Pose Adjustment
di: Liang, Shunkun, et al.
Pubblicazione: (2026)
di: Liang, Shunkun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
STORM: Search-Guided Generative World Models for Robotic Manipulation
di: Lin, Wenjun, et al.
Pubblicazione: (2025) -
3DAlign-DAER: Dynamic Attention Policy and Efficient Retrieval Strategy for Fine-grained 3D-Text Alignment at Scale
di: Fan, Yijia, et al.
Pubblicazione: (2025) -
Top-Down Semantic Refinement for Image Captioning
di: Zhang, Jusheng, et al.
Pubblicazione: (2025) -
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
di: Cai, Kaitong, et al.
Pubblicazione: (2025) -
PTTA: A Pure Text-to-Animation Framework for High-Quality Creation
di: Chen, Ruiqi, et al.
Pubblicazione: (2025)