SirenPose: Dynamic Scene Reconstruction via Geometric Supervision
Fuente:
arXiv
Guardado en:
| Autores principales: | Cai, Kaitong, Zhang, Jensen, Yang, Jing, Wang, Keze |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
STORM: Search-Guided Generative World Models for Robotic Manipulation
por: Lin, Wenjun, et al.
Publicado: (2025)
por: Lin, Wenjun, et al.
Publicado: (2025)
3DAlign-DAER: Dynamic Attention Policy and Efficient Retrieval Strategy for Fine-grained 3D-Text Alignment at Scale
por: Fan, Yijia, et al.
Publicado: (2025)
por: Fan, Yijia, et al.
Publicado: (2025)
Top-Down Semantic Refinement for Image Captioning
por: Zhang, Jusheng, et al.
Publicado: (2025)
por: Zhang, Jusheng, et al.
Publicado: (2025)
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
por: Cai, Kaitong, et al.
Publicado: (2025)
por: Cai, Kaitong, et al.
Publicado: (2025)
PTTA: A Pure Text-to-Animation Framework for High-Quality Creation
por: Chen, Ruiqi, et al.
Publicado: (2025)
por: Chen, Ruiqi, et al.
Publicado: (2025)
CoAgent: Collaborative Planning and Consistency Agent for Coherent Video Generation
por: Zeng, Qinglin, et al.
Publicado: (2025)
por: Zeng, Qinglin, et al.
Publicado: (2025)
GTMA: Dynamic Representation Optimization for OOD Vision-Language Models
por: Zhang, Jensen, et al.
Publicado: (2025)
por: Zhang, Jensen, et al.
Publicado: (2025)
MAT-Agent: Adaptive Multi-Agent Training Optimization
por: Zhang, Jusheng, et al.
Publicado: (2025)
por: Zhang, Jusheng, et al.
Publicado: (2025)
Self-Rewarded Multimodal Coherent Reasoning Across Diverse Visual Domains
por: Zhang, Jesen, et al.
Publicado: (2025)
por: Zhang, Jesen, et al.
Publicado: (2025)
Process-of-Thought Reasoning for Videos
por: Zhang, Jusheng, et al.
Publicado: (2026)
por: Zhang, Jusheng, et al.
Publicado: (2026)
Free-DyGS: Camera-Pose-Free Scene Reconstruction for Dynamic Surgical Videos with Gaussian Splatting
por: Li, Qian, et al.
Publicado: (2024)
por: Li, Qian, et al.
Publicado: (2024)
Learning Dynamic Scene Reconstruction with Sinusoidal Geometric Priors
por: Guo, Tian, et al.
Publicado: (2025)
por: Guo, Tian, et al.
Publicado: (2025)
GCRayDiffusion: Pose-Free Surface Reconstruction via Geometric Consistent Ray Diffusion
por: Chen, Li-Heng, et al.
Publicado: (2025)
por: Chen, Li-Heng, et al.
Publicado: (2025)
HybridToken-VLM: Hybrid Token Compression for Vision-Language Models
por: Zhang, Jusheng, et al.
Publicado: (2025)
por: Zhang, Jusheng, et al.
Publicado: (2025)
Dense Dynamic Scene Reconstruction and Camera Pose Estimation from Multi-View Videos
por: Sun, Shuo, et al.
Publicado: (2026)
por: Sun, Shuo, et al.
Publicado: (2026)
DynamicVGGT: Learning Dynamic Point Maps for 4D Scene Reconstruction in Autonomous Driving
por: He, Zhuolin, et al.
Publicado: (2026)
por: He, Zhuolin, et al.
Publicado: (2026)
Mem4D: Decoupling Static and Dynamic Memory for Dynamic Scene Reconstruction
por: Cai, Xudong, et al.
Publicado: (2025)
por: Cai, Xudong, et al.
Publicado: (2025)
Scene Coordinate Reconstruction: Posing of Image Collections via Incremental Learning of a Relocalizer
por: Brachmann, Eric, et al.
Publicado: (2024)
por: Brachmann, Eric, et al.
Publicado: (2024)
Image-Plane Geometric Decoding for View-Invariant Indoor Scene Reconstruction
por: Li, Mingyang, et al.
Publicado: (2025)
por: Li, Mingyang, et al.
Publicado: (2025)
PROFusion: Robust and Accurate Dense Reconstruction via Camera Pose Regression and Optimization
por: Dong, Siyan, et al.
Publicado: (2025)
por: Dong, Siyan, et al.
Publicado: (2025)
TraceFlow: Dynamic 3D Reconstruction of Specular Scenes Driven by Ray Tracing
por: Tao, Jiachen, et al.
Publicado: (2025)
por: Tao, Jiachen, et al.
Publicado: (2025)
Self-Supervised Implicit Attention Priors for Point Cloud Reconstruction
por: Fogarty, Kyle, et al.
Publicado: (2025)
por: Fogarty, Kyle, et al.
Publicado: (2025)
Diffusion-Driven Self-Supervised Learning for Shape Reconstruction and Pose Estimation
por: Sun, Jingtao, et al.
Publicado: (2024)
por: Sun, Jingtao, et al.
Publicado: (2024)
4DRadar-GS: Self-Supervised Dynamic Driving Scene Reconstruction with 4D Radar
por: Tang, Xiao, et al.
Publicado: (2025)
por: Tang, Xiao, et al.
Publicado: (2025)
CityGaussianV2: Efficient and Geometrically Accurate Reconstruction for Large-Scale Scenes
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
WorldStereo: Bridging Camera-Guided Video Generation and Scene Reconstruction via 3D Geometric Memories
por: Zhang, Yisu, et al.
Publicado: (2026)
por: Zhang, Yisu, et al.
Publicado: (2026)
UPGS: Unified Pose-aware Gaussian Splatting for Dynamic Scene Deblurring
por: Wu, Zhijing, et al.
Publicado: (2025)
por: Wu, Zhijing, et al.
Publicado: (2025)
Gaussian Scenes: Pose-Free Sparse-View Scene Reconstruction using Depth-Enhanced Diffusion Priors
por: Paul, Soumava, et al.
Publicado: (2024)
por: Paul, Soumava, et al.
Publicado: (2024)
UrbanGS: A Scalable and Efficient Architecture for Geometrically Accurate Large-Scene Reconstruction
por: Li, Changbai, et al.
Publicado: (2026)
por: Li, Changbai, et al.
Publicado: (2026)
SplitGaussian: Reconstructing Dynamic Scenes via Visual Geometry Decomposition
por: Li, Jiahui, et al.
Publicado: (2025)
por: Li, Jiahui, et al.
Publicado: (2025)
GRAFT: Geometric Refinement and Fitting Transformer for Human Scene Reconstruction
por: YM, Pradyumna, et al.
Publicado: (2026)
por: YM, Pradyumna, et al.
Publicado: (2026)
Instant Gaussian Stream: Fast and Generalizable Streaming of Dynamic Scene Reconstruction via Gaussian Splatting
por: Yan, Jinbo, et al.
Publicado: (2025)
por: Yan, Jinbo, et al.
Publicado: (2025)
Self-Supervised High Dynamic Range Imaging with Multi-Exposure Images in Dynamic Scenes
por: Zhang, Zhilu, et al.
Publicado: (2023)
por: Zhang, Zhilu, et al.
Publicado: (2023)
DynaPose4D: High-Quality 4D Dynamic Content Generation via Pose Alignment Loss
por: Yang, Jing, et al.
Publicado: (2025)
por: Yang, Jing, et al.
Publicado: (2025)
Back on Track: Bundle Adjustment for Dynamic Scene Reconstruction
por: Chen, Weirong, et al.
Publicado: (2025)
por: Chen, Weirong, et al.
Publicado: (2025)
Scene-agnostic Pose Regression for Visual Localization
por: Zheng, Junwei, et al.
Publicado: (2025)
por: Zheng, Junwei, et al.
Publicado: (2025)
Adaptive-VoCo: Complexity-Aware Visual Token Compression for Vision-Language Models
por: Guo, Xiaoyang, et al.
Publicado: (2025)
por: Guo, Xiaoyang, et al.
Publicado: (2025)
Talk2Move: Reinforcement Learning for Text-Instructed Object-Level Geometric Transformation in Scenes
por: Tan, Jing, et al.
Publicado: (2026)
por: Tan, Jing, et al.
Publicado: (2026)
Self-Supervised Monocular 4D Scene Reconstruction for Egocentric Videos
por: Yuan, Chengbo, et al.
Publicado: (2024)
por: Yuan, Chengbo, et al.
Publicado: (2024)
A Pose-only Geometric Constraint for Multi-Camera Pose Adjustment
por: Liang, Shunkun, et al.
Publicado: (2026)
por: Liang, Shunkun, et al.
Publicado: (2026)
Ejemplares similares
-
STORM: Search-Guided Generative World Models for Robotic Manipulation
por: Lin, Wenjun, et al.
Publicado: (2025) -
3DAlign-DAER: Dynamic Attention Policy and Efficient Retrieval Strategy for Fine-grained 3D-Text Alignment at Scale
por: Fan, Yijia, et al.
Publicado: (2025) -
Top-Down Semantic Refinement for Image Captioning
por: Zhang, Jusheng, et al.
Publicado: (2025) -
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
por: Cai, Kaitong, et al.
Publicado: (2025) -
PTTA: A Pure Text-to-Animation Framework for High-Quality Creation
por: Chen, Ruiqi, et al.
Publicado: (2025)