MASSTAR: A Multi-Modal and Large-Scale Scene Dataset with a Versatile Toolchain for Surface Prediction and Completion
Fuente:
arXiv
Saved in:
| Main Authors: | Zheng, Guiyong, Jiang, Jinqi, Feng, Chen, Shen, Shaojie, Zhou, Boyu |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MacFormer: Map-Agent Coupled Transformer for Real-time and Robust Trajectory Prediction
by: Feng, Chen, et al.
Published: (2023)
by: Feng, Chen, et al.
Published: (2023)
NuPlanQA: A Large-Scale Dataset and Benchmark for Multi-View Driving Scene Understanding in Multi-Modal Large Language Models
by: Park, Sung-Yeon, et al.
Published: (2025)
by: Park, Sung-Yeon, et al.
Published: (2025)
VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction
by: Yan, Xiaoyang, et al.
Published: (2026)
by: Yan, Xiaoyang, et al.
Published: (2026)
ST-GS: Vision-Based 3D Semantic Occupancy Prediction with Spatial-Temporal Gaussian Splatting
by: Yan, Xiaoyang, et al.
Published: (2025)
by: Yan, Xiaoyang, et al.
Published: (2025)
SG-Reg: Generalizable and Efficient Scene Graph Registration
by: Liu, Chuhao, et al.
Published: (2025)
by: Liu, Chuhao, et al.
Published: (2025)
Advancing Multi-agent Traffic Simulation via R1-Style Reinforcement Fine-Tuning
by: Pei, Muleilan, et al.
Published: (2025)
by: Pei, Muleilan, et al.
Published: (2025)
InternScenes: A Large-scale Simulatable Indoor Scene Dataset with Realistic Layouts
by: Zhong, Weipeng, et al.
Published: (2025)
by: Zhong, Weipeng, et al.
Published: (2025)
GS-LIVO: Real-Time LiDAR, Inertial, and Visual Multi-sensor Fused Odometry with Gaussian Mapping
by: Hong, Sheng, et al.
Published: (2025)
by: Hong, Sheng, et al.
Published: (2025)
SEPT: Standard-Definition Map Enhanced Scene Perception and Topology Reasoning for Autonomous Driving
by: Pei, Muleilan, et al.
Published: (2025)
by: Pei, Muleilan, et al.
Published: (2025)
Scene Completeness-Aware Lidar Depth Completion for Driving Scenario
by: Wu, Cho-Ying, et al.
Published: (2020)
by: Wu, Cho-Ying, et al.
Published: (2020)
Foresight in Motion: Reinforcing Trajectory Prediction with Reward Heuristics
by: Pei, Muleilan, et al.
Published: (2025)
by: Pei, Muleilan, et al.
Published: (2025)
MMScan: A Multi-Modal 3D Scene Dataset with Hierarchical Grounded Language Annotations
by: Lyu, Ruiyuan, et al.
Published: (2024)
by: Lyu, Ruiyuan, et al.
Published: (2024)
WaterScenes: A Multi-Task 4D Radar-Camera Fusion Dataset and Benchmarks for Autonomous Driving on Water Surfaces
by: Yao, Shanliang, et al.
Published: (2023)
by: Yao, Shanliang, et al.
Published: (2023)
GoIRL: Graph-Oriented Inverse Reinforcement Learning for Multimodal Trajectory Prediction
by: Pei, Muleilan, et al.
Published: (2025)
by: Pei, Muleilan, et al.
Published: (2025)
BEVPose: Unveiling Scene Semantics through Pose-Guided Multi-Modal BEV Alignment
by: Hosseinzadeh, Mehdi, et al.
Published: (2024)
by: Hosseinzadeh, Mehdi, et al.
Published: (2024)
The S3LI Vulcano Dataset: A Dataset for Multi-Modal SLAM in Unstructured Planetary Environments
by: Giubilato, Riccardo, et al.
Published: (2026)
by: Giubilato, Riccardo, et al.
Published: (2026)
G3Reg: Pyramid Graph-based Global Registration using Gaussian Ellipsoid Model
by: Qiao, Zhijian, et al.
Published: (2023)
by: Qiao, Zhijian, et al.
Published: (2023)
Label-efficient Semantic Scene Completion with Scribble Annotations
by: Wang, Song, et al.
Published: (2024)
by: Wang, Song, et al.
Published: (2024)
Combining Shape Completion and Grasp Prediction for Fast and Versatile Grasping with a Multi-Fingered Hand
by: Humt, Matthias, et al.
Published: (2023)
by: Humt, Matthias, et al.
Published: (2023)
AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond
by: Zhang, Haiming, et al.
Published: (2026)
by: Zhang, Haiming, et al.
Published: (2026)
LiDPM: Rethinking Point Diffusion for Lidar Scene Completion
by: Martyniuk, Tetiana, et al.
Published: (2025)
by: Martyniuk, Tetiana, et al.
Published: (2025)
Monocular Semantic Scene Completion via Masked Recurrent Networks
by: Wang, Xuzhi, et al.
Published: (2025)
by: Wang, Xuzhi, et al.
Published: (2025)
SIMPL: A Simple and Efficient Multi-agent Motion Prediction Baseline for Autonomous Driving
by: Zhang, Lu, et al.
Published: (2024)
by: Zhang, Lu, et al.
Published: (2024)
123D: Unifying Multi-Modal Autonomous Driving Data at Scale
by: Dauner, Daniel, et al.
Published: (2026)
by: Dauner, Daniel, et al.
Published: (2026)
SeePerSea: Multi-modal Perception Dataset of In-water Objects for Autonomous Surface Vehicles
by: Jeong, Mingi, et al.
Published: (2024)
by: Jeong, Mingi, et al.
Published: (2024)
FlowSSC: Universal Generative Monocular Semantic Scene Completion via One-Step Latent Diffusion
by: Xi, Zichen, et al.
Published: (2026)
by: Xi, Zichen, et al.
Published: (2026)
SGFormer: Satellite-Ground Fusion for 3D Semantic Scene Completion
by: Guo, Xiyue, et al.
Published: (2025)
by: Guo, Xiyue, et al.
Published: (2025)
DynamicCity: Large-Scale 4D Occupancy Generation from Dynamic Scenes
by: Bian, Hengwei, et al.
Published: (2024)
by: Bian, Hengwei, et al.
Published: (2024)
SceneStreamer: Continuous Scenario Generation as Next Token Group Prediction
by: Peng, Zhenghao, et al.
Published: (2025)
by: Peng, Zhenghao, et al.
Published: (2025)
Semi-SMD: Semi-Supervised Metric Depth Estimation via Surrounding Cameras for Autonomous Driving
by: Xie, Yusen, et al.
Published: (2025)
by: Xie, Yusen, et al.
Published: (2025)
ESVO2: Direct Visual-Inertial Odometry with Stereo Event Cameras
by: Niu, Junkai, et al.
Published: (2024)
by: Niu, Junkai, et al.
Published: (2024)
Temporal and Rotational Calibration for Event-Centric Multi-Sensor Systems
by: Mai, Jiayao, et al.
Published: (2025)
by: Mai, Jiayao, et al.
Published: (2025)
Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation
by: Wang, Song, et al.
Published: (2024)
by: Wang, Song, et al.
Published: (2024)
TartanGround: A Large-Scale Dataset for Ground Robot Perception and Navigation
by: Patel, Manthan, et al.
Published: (2025)
by: Patel, Manthan, et al.
Published: (2025)
Lift, Splat, Map: Lifting Foundation Masks for Label-Free Semantic Scene Completion
by: Zhang, Arthur, et al.
Published: (2024)
by: Zhang, Arthur, et al.
Published: (2024)
A Dataset and Benchmark for Shape Completion of Fruits for Agricultural Robotics
by: Magistri, Federico, et al.
Published: (2024)
by: Magistri, Federico, et al.
Published: (2024)
SGAligner++: Cross-Modal Language-Aided 3D Scene Graph Alignment
by: Singh, Binod, et al.
Published: (2025)
by: Singh, Binod, et al.
Published: (2025)
Multi-Modal Data-Efficient 3D Scene Understanding for Autonomous Driving
by: Kong, Lingdong, et al.
Published: (2024)
by: Kong, Lingdong, et al.
Published: (2024)
HRDexDB: A Large-Scale Dataset of Dexterous Human and Robotic Hand Grasps
by: Lim, Jongbin, et al.
Published: (2026)
by: Lim, Jongbin, et al.
Published: (2026)
LoopDB: A Loop Closure Dataset for Large Scale Simultaneous Localization and Mapping
by: Nakshbandi, Mohammad-Maher, et al.
Published: (2025)
by: Nakshbandi, Mohammad-Maher, et al.
Published: (2025)
Similar Items
-
MacFormer: Map-Agent Coupled Transformer for Real-time and Robust Trajectory Prediction
by: Feng, Chen, et al.
Published: (2023) -
NuPlanQA: A Large-Scale Dataset and Benchmark for Multi-View Driving Scene Understanding in Multi-Modal Large Language Models
by: Park, Sung-Yeon, et al.
Published: (2025) -
VG3S: Visual Geometry Grounded Gaussian Splatting for Semantic Occupancy Prediction
by: Yan, Xiaoyang, et al.
Published: (2026) -
ST-GS: Vision-Based 3D Semantic Occupancy Prediction with Spatial-Temporal Gaussian Splatting
by: Yan, Xiaoyang, et al.
Published: (2025) -
SG-Reg: Generalizable and Efficient Scene Graph Registration
by: Liu, Chuhao, et al.
Published: (2025)