LASER: Layer-wise Scale Alignment for Training-Free Streaming 4D Reconstruction
Fuente:
arXiv
Salvato in:
| Autori principali: | Ding, Tianye, Xie, Yiming, Liang, Yiqing, Chatterjee, Moitreya, Miraldo, Pedro, Jiang, Huaizu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UniCorrn: Unified Correspondence Transformer Across 2D and 3D
di: Goswami, Prajnan, et al.
Pubblicazione: (2026)
di: Goswami, Prajnan, et al.
Pubblicazione: (2026)
A Probability-guided Sampler for Neural Implicit Surface Rendering
di: Pais, Gonçalo Dias, et al.
Pubblicazione: (2025)
di: Pais, Gonçalo Dias, et al.
Pubblicazione: (2025)
FreBIS: Frequency-Based Stratification for Neural Implicit Surface Representations
di: Sawada, Naoko, et al.
Pubblicazione: (2025)
di: Sawada, Naoko, et al.
Pubblicazione: (2025)
ODTFormer: Efficient Obstacle Detection and Tracking with Stereo Cameras Based on Transformer
di: Ding, Tianye, et al.
Pubblicazione: (2024)
di: Ding, Tianye, et al.
Pubblicazione: (2024)
Struct2D: A Perception-Guided Framework for Spatial Reasoning in MLLMs
di: Zhu, Fangrui, et al.
Pubblicazione: (2025)
di: Zhu, Fangrui, et al.
Pubblicazione: (2025)
Gear-NeRF: Free-Viewpoint Rendering and Tracking with Motion-aware Spatio-Temporal Sampling
di: Liu, Xinhang, et al.
Pubblicazione: (2024)
di: Liu, Xinhang, et al.
Pubblicazione: (2024)
SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation
di: Yao, Chun-Han, et al.
Pubblicazione: (2025)
di: Yao, Chun-Han, et al.
Pubblicazione: (2025)
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
di: Xie, Yiming, et al.
Pubblicazione: (2024)
di: Xie, Yiming, et al.
Pubblicazione: (2024)
A Strong Baseline for Point Cloud Registration via Direct Superpoints Matching
di: Gupta, Aniket, et al.
Pubblicazione: (2023)
di: Gupta, Aniket, et al.
Pubblicazione: (2023)
HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models
di: Peng, Xiaogang, et al.
Pubblicazione: (2023)
di: Peng, Xiaogang, et al.
Pubblicazione: (2023)
Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression
di: Meng, Zichong, et al.
Pubblicazione: (2024)
di: Meng, Zichong, et al.
Pubblicazione: (2024)
Absolute Coordinates Make Motion Generation Easy
di: Meng, Zichong, et al.
Pubblicazione: (2025)
di: Meng, Zichong, et al.
Pubblicazione: (2025)
SMooDi: Stylized Motion Diffusion Model
di: Zhong, Lei, et al.
Pubblicazione: (2024)
di: Zhong, Lei, et al.
Pubblicazione: (2024)
OmniControl: Control Any Joint at Any Time for Human Motion Generation
di: Xie, Yiming, et al.
Pubblicazione: (2023)
di: Xie, Yiming, et al.
Pubblicazione: (2023)
SSR: A Training-Free Approach for Streaming 3D Reconstruction
di: Deng, Hui, et al.
Pubblicazione: (2026)
di: Deng, Hui, et al.
Pubblicazione: (2026)
Oriented-grid Encoder for 3D Implicit Representations
di: Gaur, Arihant, et al.
Pubblicazione: (2024)
di: Gaur, Arihant, et al.
Pubblicazione: (2024)
DCVNet: Dilated Cost Volume Networks for Fast Optical Flow
di: Jiang, Huaizu, et al.
Pubblicazione: (2021)
di: Jiang, Huaizu, et al.
Pubblicazione: (2021)
ParkingTwin: Training-Free Streaming 3D Reconstruction for Parking-Lot Digital Twins
di: Liu, Xinhao, et al.
Pubblicazione: (2026)
di: Liu, Xinhao, et al.
Pubblicazione: (2026)
A Training-Free Style-aligned Image Generation with Scale-wise Autoregressive Model
di: Park, Jihun, et al.
Pubblicazione: (2025)
di: Park, Jihun, et al.
Pubblicazione: (2025)
SurfR: Surface Reconstruction with Multi-scale Attention
di: Ranade, Siddhant, et al.
Pubblicazione: (2025)
di: Ranade, Siddhant, et al.
Pubblicazione: (2025)
Towards Flexible Visual Relationship Segmentation
di: Zhu, Fangrui, et al.
Pubblicazione: (2024)
di: Zhu, Fangrui, et al.
Pubblicazione: (2024)
TTSA3R: Training-Free Temporal-Spatial Adaptive Persistent State for Streaming 3D Reconstruction
di: Zheng, Zhijie, et al.
Pubblicazione: (2026)
di: Zheng, Zhijie, et al.
Pubblicazione: (2026)
HouseCrafter: Lifting Floorplans to 3D Scenes with 2D Diffusion Model
di: Nguyen, Hieu T., et al.
Pubblicazione: (2024)
di: Nguyen, Hieu T., et al.
Pubblicazione: (2024)
Layer-wise Alignment: Examining Safety Alignment Across Image Encoder Layers in Vision Language Models
di: Bachu, Saketh, et al.
Pubblicazione: (2024)
di: Bachu, Saketh, et al.
Pubblicazione: (2024)
QUEEN: QUantized Efficient ENcoding of Dynamic Gaussians for Streaming Free-viewpoint Videos
di: Girish, Sharath, et al.
Pubblicazione: (2024)
di: Girish, Sharath, et al.
Pubblicazione: (2024)
Attention Itself Could Retrieve.RetrieveVGGT: Training-Free Long Context Streaming 3D Reconstruction via Query-Key Similarity Retrieval
di: Zou, Zichen, et al.
Pubblicazione: (2026)
di: Zou, Zichen, et al.
Pubblicazione: (2026)
PAS3R: Pose-Adaptive Streaming 3D Reconstruction for Long Video Sequences
di: Xu, Lanbo, et al.
Pubblicazione: (2026)
di: Xu, Lanbo, et al.
Pubblicazione: (2026)
HorizonStream: Long-Horizon Attention for Streaming 3D Reconstruction
di: Cheng, Chong, et al.
Pubblicazione: (2026)
di: Cheng, Chong, et al.
Pubblicazione: (2026)
Motion Matters: Compact Gaussian Streaming for Free-Viewpoint Video Reconstruction
di: Chen, Jiacong, et al.
Pubblicazione: (2025)
di: Chen, Jiacong, et al.
Pubblicazione: (2025)
Programmatic Video Prediction Using Large Language Models
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
Scale-wise Bidirectional Alignment Network for Referring Remote Sensing Image Segmentation
di: Li, Kun, et al.
Pubblicazione: (2025)
di: Li, Kun, et al.
Pubblicazione: (2025)
NeuFlow: Real-time, High-accuracy Optical Flow Estimation on Robots Using Edge Devices
di: Zhang, Zhiyong, et al.
Pubblicazione: (2024)
di: Zhang, Zhiyong, et al.
Pubblicazione: (2024)
DyMO: Training-Free Diffusion Model Alignment with Dynamic Multi-Objective Scheduling
di: Xie, Xin, et al.
Pubblicazione: (2024)
di: Xie, Xin, et al.
Pubblicazione: (2024)
Zero-shot Referring Expression Comprehension via Structural Similarity Between Images and Captions
di: Han, Zeyu, et al.
Pubblicazione: (2023)
di: Han, Zeyu, et al.
Pubblicazione: (2023)
OmniStream: Mastering Perception, Reconstruction and Action in Continuous Streams
di: Yan, Yibin, et al.
Pubblicazione: (2026)
di: Yan, Yibin, et al.
Pubblicazione: (2026)
Improving Open-World Object Localization by Discovering Background
di: Singh, Ashish, et al.
Pubblicazione: (2025)
di: Singh, Ashish, et al.
Pubblicazione: (2025)
Layer-wise Noise Guided Selective Wavelet Reconstruction for Robust Medical Image Segmentation
di: Lu, Yuting, et al.
Pubblicazione: (2025)
di: Lu, Yuting, et al.
Pubblicazione: (2025)
TELA: Text to Layer-wise 3D Clothed Human Generation
di: Dong, Junting, et al.
Pubblicazione: (2024)
di: Dong, Junting, et al.
Pubblicazione: (2024)
ArtHOI: Taming Foundation Models for Monocular 4D Reconstruction of Hand-Articulated-Object Interactions
di: Wang, Zikai, et al.
Pubblicazione: (2026)
di: Wang, Zikai, et al.
Pubblicazione: (2026)
FLIGHT: Fibonacci Lattice-based Inference for Geometric Heading in real-Time
di: Dirnfeld, David, et al.
Pubblicazione: (2026)
di: Dirnfeld, David, et al.
Pubblicazione: (2026)
Documenti analoghi
-
UniCorrn: Unified Correspondence Transformer Across 2D and 3D
di: Goswami, Prajnan, et al.
Pubblicazione: (2026) -
A Probability-guided Sampler for Neural Implicit Surface Rendering
di: Pais, Gonçalo Dias, et al.
Pubblicazione: (2025) -
FreBIS: Frequency-Based Stratification for Neural Implicit Surface Representations
di: Sawada, Naoko, et al.
Pubblicazione: (2025) -
ODTFormer: Efficient Obstacle Detection and Tracking with Stereo Cameras Based on Transformer
di: Ding, Tianye, et al.
Pubblicazione: (2024) -
Struct2D: A Perception-Guided Framework for Spatial Reasoning in MLLMs
di: Zhu, Fangrui, et al.
Pubblicazione: (2025)