DEMOS: Dynamic Environment Motion Synthesis in 3D Scenes via Local Spherical-BEV Perception
Fuente:
arXiv
Salvato in:
| Autori principali: | Gong, Jingyu, Wang, Min, Liu, Wentao, Qian, Chen, Zhang, Zhizhong, Xie, Yuan, Ma, Lizhuang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Human Motion Synthesis in 3D Scenes via Unified Scene Semantic Occupancy
di: Jingyu, Gong, et al.
Pubblicazione: (2025)
di: Jingyu, Gong, et al.
Pubblicazione: (2025)
GSCompleter: A Distillation-Free Plugin for Metric-Aware 3D Gaussian Splatting Completion in Seconds
di: Gao, Ao, et al.
Pubblicazione: (2026)
di: Gao, Ao, et al.
Pubblicazione: (2026)
UniForward: Unified 3D Scene and Semantic Field Reconstruction via Feed-Forward Gaussian Splatting from Only Sparse-View Images
di: Tian, Qijian, et al.
Pubblicazione: (2025)
di: Tian, Qijian, et al.
Pubblicazione: (2025)
S2GS: Streaming Semantic Gaussian Splatting for Online Scene Understanding and Reconstruction
di: Zhang, Renhe, et al.
Pubblicazione: (2026)
di: Zhang, Renhe, et al.
Pubblicazione: (2026)
Diffusion Implicit Policy for Unpaired Scene-aware Motion Synthesis
di: Gong, Jingyu, et al.
Pubblicazione: (2024)
di: Gong, Jingyu, et al.
Pubblicazione: (2024)
COTR: Compact Occupancy TRansformer for Vision-based 3D Occupancy Prediction
di: Ma, Qihang, et al.
Pubblicazione: (2023)
di: Ma, Qihang, et al.
Pubblicazione: (2023)
Vision-language models lag human performance on physical dynamics and intent reasoning
di: Gu, Tianjun, et al.
Pubblicazione: (2026)
di: Gu, Tianjun, et al.
Pubblicazione: (2026)
DrivingForward: Feed-forward 3D Gaussian Splatting for Driving Scene Reconstruction from Flexible Surround-view Input
di: Tian, Qijian, et al.
Pubblicazione: (2024)
di: Tian, Qijian, et al.
Pubblicazione: (2024)
PFDepth: Heterogeneous Pinhole-Fisheye Joint Depth Estimation via Distortion-aware Gaussian-Splatted Volumetric Fusion
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
FreeMotion: A Unified Framework for Number-free Text-to-Motion Synthesis
di: Fan, Ke, et al.
Pubblicazione: (2024)
di: Fan, Ke, et al.
Pubblicazione: (2024)
Omni-Supervised Motion Editing: Balancing Change and Invariance through Positive-Negative Learning
di: Shi, Zhenwu, et al.
Pubblicazione: (2026)
di: Shi, Zhenwu, et al.
Pubblicazione: (2026)
YouTube-Occ: Learning Indoor 3D Semantic Occupancy Prediction from YouTube Videos
di: Chen, Haoming, et al.
Pubblicazione: (2025)
di: Chen, Haoming, et al.
Pubblicazione: (2025)
GEOcc: Geometrically Enhanced 3D Occupancy Network with Implicit-Explicit Depth Fusion and Contextual Self-Supervision
di: Tan, Xin, et al.
Pubblicazione: (2024)
di: Tan, Xin, et al.
Pubblicazione: (2024)
Privacy-Concealing Cooperative Perception for BEV Scene Segmentation
di: Wang, Song, et al.
Pubblicazione: (2026)
di: Wang, Song, et al.
Pubblicazione: (2026)
PIG: Prompt Images Guidance for Night-Time Scene Parsing
di: Xie, Zhifeng, et al.
Pubblicazione: (2024)
di: Xie, Zhifeng, et al.
Pubblicazione: (2024)
PromptAD: Learning Prompts with only Normal Samples for Few-Shot Anomaly Detection
di: Li, Xiaofan, et al.
Pubblicazione: (2024)
di: Li, Xiaofan, et al.
Pubblicazione: (2024)
Building a Strong Pre-Training Baseline for Universal 3D Large-Scale Perception
di: Chen, Haoming, et al.
Pubblicazione: (2024)
di: Chen, Haoming, et al.
Pubblicazione: (2024)
Video Perception Models for 3D Scene Synthesis
di: Huang, Rui, et al.
Pubblicazione: (2025)
di: Huang, Rui, et al.
Pubblicazione: (2025)
Motion-aware 3D Gaussian Splatting for Efficient Dynamic Scene Reconstruction
di: Guo, Zhiyang, et al.
Pubblicazione: (2024)
di: Guo, Zhiyang, et al.
Pubblicazione: (2024)
Textual Decomposition Then Sub-motion-space Scattering for Open-Vocabulary Motion Generation
di: Fan, Ke, et al.
Pubblicazione: (2024)
di: Fan, Ke, et al.
Pubblicazione: (2024)
VTGaussian-SLAM: RGBD SLAM for Large Scale Scenes with Splatting View-Tied 3D Gaussians
di: Hu, Pengchong, et al.
Pubblicazione: (2025)
di: Hu, Pengchong, et al.
Pubblicazione: (2025)
Micro-Expression Recognition via Fine-Grained Dynamic Perception
di: Shao, Zhiwen, et al.
Pubblicazione: (2025)
di: Shao, Zhiwen, et al.
Pubblicazione: (2025)
BEV-LLM: Leveraging Multimodal BEV Maps for Scene Captioning in Autonomous Driving
di: Brandstaetter, Felix, et al.
Pubblicazione: (2025)
di: Brandstaetter, Felix, et al.
Pubblicazione: (2025)
GOLD-BEV: GrOund and aeriaL Data for Dense Semantic BEV Mapping of Dynamic Scenes
di: Niemeijer, Joshua, et al.
Pubblicazione: (2026)
di: Niemeijer, Joshua, et al.
Pubblicazione: (2026)
BEV-TSR: Text-Scene Retrieval in BEV Space for Autonomous Driving
di: Tang, Tao, et al.
Pubblicazione: (2024)
di: Tang, Tao, et al.
Pubblicazione: (2024)
DenseBEV: Transforming BEV Grid Cells into 3D Objects
di: Dähling, Marius, et al.
Pubblicazione: (2025)
di: Dähling, Marius, et al.
Pubblicazione: (2025)
World2Minecraft: Occupancy-Driven Simulated Scenes Construction
di: Zhang, Lechao, et al.
Pubblicazione: (2026)
di: Zhang, Lechao, et al.
Pubblicazione: (2026)
SpectroMotion: Dynamic 3D Reconstruction of Specular Scenes
di: Fan, Cheng-De, et al.
Pubblicazione: (2024)
di: Fan, Cheng-De, et al.
Pubblicazione: (2024)
BIP3D: Bridging 2D Images and 3D Perception for Embodied Intelligence
di: Lin, Xuewu, et al.
Pubblicazione: (2024)
di: Lin, Xuewu, et al.
Pubblicazione: (2024)
InstanceBEV: Unifying Instance and BEV Representation for 3D Panoptic Segmentation
di: Li, Feng, et al.
Pubblicazione: (2025)
di: Li, Feng, et al.
Pubblicazione: (2025)
DA-BEV: Unsupervised Domain Adaptation for Bird's Eye View Perception
di: Jiang, Kai, et al.
Pubblicazione: (2024)
di: Jiang, Kai, et al.
Pubblicazione: (2024)
Robust Embodied Perception in Dynamic Environments via Disentangled Weight Fusion
di: Guo, Juncen, et al.
Pubblicazione: (2026)
di: Guo, Juncen, et al.
Pubblicazione: (2026)
3D-Fixer: Coarse-to-Fine In-place Completion for 3D Scenes from a Single Image
di: Yin, Ze-Xin, et al.
Pubblicazione: (2026)
di: Yin, Ze-Xin, et al.
Pubblicazione: (2026)
BEAR: A Video Dataset For Fine-grained Behaviors Recognition Oriented with Action and Environment Factors
di: Hu, Chengyang, et al.
Pubblicazione: (2025)
di: Hu, Chengyang, et al.
Pubblicazione: (2025)
RESBev: Making BEV Perception More Robust
di: Zhuo, Lifeng, et al.
Pubblicazione: (2026)
di: Zhuo, Lifeng, et al.
Pubblicazione: (2026)
BEVWorld: A Multimodal World Simulator for Autonomous Driving via Scene-Level BEV Latents
di: Zhang, Yumeng, et al.
Pubblicazione: (2024)
di: Zhang, Yumeng, et al.
Pubblicazione: (2024)
ROA-BEV: 2D Region-Oriented Attention for BEV-based 3D Object Detection
di: Chen, Jiwei, et al.
Pubblicazione: (2024)
di: Chen, Jiwei, et al.
Pubblicazione: (2024)
S2D: Sparse to Dense Lifting for 3D Reconstruction with Minimal Inputs
di: Ji, Yuzhou, et al.
Pubblicazione: (2026)
di: Ji, Yuzhou, et al.
Pubblicazione: (2026)
LSSInst: Improving Geometric Modeling in LSS-Based BEV Perception with Instance Representation
di: Ma, Weijie, et al.
Pubblicazione: (2024)
di: Ma, Weijie, et al.
Pubblicazione: (2024)
TiGDistill-BEV: Multi-view BEV 3D Object Detection via Target Inner-Geometry Learning Distillation
di: Xu, Shaoqing, et al.
Pubblicazione: (2024)
di: Xu, Shaoqing, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Human Motion Synthesis in 3D Scenes via Unified Scene Semantic Occupancy
di: Jingyu, Gong, et al.
Pubblicazione: (2025) -
GSCompleter: A Distillation-Free Plugin for Metric-Aware 3D Gaussian Splatting Completion in Seconds
di: Gao, Ao, et al.
Pubblicazione: (2026) -
UniForward: Unified 3D Scene and Semantic Field Reconstruction via Feed-Forward Gaussian Splatting from Only Sparse-View Images
di: Tian, Qijian, et al.
Pubblicazione: (2025) -
S2GS: Streaming Semantic Gaussian Splatting for Online Scene Understanding and Reconstruction
di: Zhang, Renhe, et al.
Pubblicazione: (2026) -
Diffusion Implicit Policy for Unpaired Scene-aware Motion Synthesis
di: Gong, Jingyu, et al.
Pubblicazione: (2024)