Unposed-to-3D: Learning Simulation-Ready Vehicles from Real-World Images
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Hongyuan, Zou, Bochao, Liu, Qiankun, Yu, Haochen, Mei, Qi, Jiang, Jianfei, Liu, Chen, Bi, Cheng, Wang, Zhao, Zhang, Xueyang, Zhan, Yifei, Chen, Jiansheng, Ma, Huimin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
InstDrive: Instance-Aware 3D Gaussian Splatting for Driving Scenes
par: Liu, Hongyuan, et autres
Publié: (2025)
par: Liu, Hongyuan, et autres
Publié: (2025)
MonoMVSNet: Monocular Priors Guided Multi-View Stereo Network
par: Jiang, Jianfei, et autres
Publié: (2025)
par: Jiang, Jianfei, et autres
Publié: (2025)
MVSMamba: Multi-View Stereo with State Space Model
par: Jiang, Jianfei, et autres
Publié: (2025)
par: Jiang, Jianfei, et autres
Publié: (2025)
XYZCylinder: Towards Compatible Feed-Forward 3D Gaussian Splatting for Driving Scenes via Unified Cylinder Lifting Method
par: Yu, Haochen, et autres
Publié: (2025)
par: Yu, Haochen, et autres
Publié: (2025)
From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models
par: Li, Xinyang, et autres
Publié: (2025)
par: Li, Xinyang, et autres
Publié: (2025)
Video-Only ToM: Enhancing Theory of Mind in Multimodal Large Language Models
par: Liu, Siqi, et autres
Publié: (2026)
par: Liu, Siqi, et autres
Publié: (2026)
AGC-Drive: A Large-Scale Dataset for Real-World Aerial-Ground Collaboration in Driving Scenarios
par: Hou, Yunhao, et autres
Publié: (2025)
par: Hou, Yunhao, et autres
Publié: (2025)
$\textrm{A}^{\textrm{2}}$RNet: Adversarial Attack Resilient Network for Robust Infrared and Visible Image Fusion
par: Li, Jiawei, et autres
Publié: (2024)
par: Li, Jiawei, et autres
Publié: (2024)
RhythmFormer: Extracting Patterned rPPG Signals based on Periodic Sparse Attention
par: Zou, Bochao, et autres
Publié: (2024)
par: Zou, Bochao, et autres
Publié: (2024)
Exploring Information-Theoretic Metrics Associated with Neural Collapse in Supervised Training
par: Song, Kun, et autres
Publié: (2024)
par: Song, Kun, et autres
Publié: (2024)
DeCoDe: Defer-and-Complement Decision-Making via Decoupled Concept Bottleneck Models
par: He, Chengbo, et autres
Publié: (2025)
par: He, Chengbo, et autres
Publié: (2025)
Enhancing LLM Reasoning with Multi-Path Collaborative Reactive and Reflection agents
par: He, Chengbo, et autres
Publié: (2024)
par: He, Chengbo, et autres
Publié: (2024)
Kaleidoscopic Background Attack: Disrupting Pose Estimation with Multi-Fold Radial Symmetry Textures
par: Ding, Xinlong, et autres
Publié: (2025)
par: Ding, Xinlong, et autres
Publié: (2025)
TUN3D: Towards Real-World Scene Understanding from Unposed Images
par: Konushin, Anton, et autres
Publié: (2025)
par: Konushin, Anton, et autres
Publié: (2025)
PACT: Proactive Asking for Continual Task Assistance in Human-Robot Collaboration
par: He, Chengbo, et autres
Publié: (2026)
par: He, Chengbo, et autres
Publié: (2026)
Few-shot Image Generation via Masked Discrimination
par: Zhu, Jingyuan, et autres
Publié: (2022)
par: Zhu, Jingyuan, et autres
Publié: (2022)
StyledStreets: Multi-style Street Simulator with Spatial and Temporal Consistency
par: Chen, Yuyin, et autres
Publié: (2025)
par: Chen, Yuyin, et autres
Publié: (2025)
ME-TST+: Micro-expression Analysis via Temporal State Transition with ROI Relationship Awareness
par: Guo, Zizheng, et autres
Publié: (2025)
par: Guo, Zizheng, et autres
Publié: (2025)
RhythmMamba: Fast, Lightweight, and Accurate Remote Physiological Measurement
par: Zou, Bochao, et autres
Publié: (2024)
par: Zou, Bochao, et autres
Publié: (2024)
DomainStudio: Fine-Tuning Diffusion Models for Domain-Driven Image Generation using Limited Data
par: Zhu, Jingyuan, et autres
Publié: (2023)
par: Zhu, Jingyuan, et autres
Publié: (2023)
Isolated Diffusion: Optimizing Multi-Concept Text-to-Image Generation Training-Freely with Isolated Diffusion Guidance
par: Zhu, Jingyuan, et autres
Publié: (2024)
par: Zhu, Jingyuan, et autres
Publié: (2024)
LangFlash: Feed-forward 3D Language Gaussian Splatting from Sparse Unposed Images
par: Liu, Yilong, et autres
Publié: (2026)
par: Liu, Yilong, et autres
Publié: (2026)
SimScale: Learning to Drive via Real-World Simulation at Scale
par: Tian, Haochen, et autres
Publié: (2025)
par: Tian, Haochen, et autres
Publié: (2025)
Are Agents Ready to Teach? A Multi-Stage Benchmark for Real-World Teaching Workflows
par: Chen, Zixin, et autres
Publié: (2026)
par: Chen, Zixin, et autres
Publié: (2026)
Symmetrization of the Maxwell--Neumann--Poincar'e operator, spectral decomposition in $\mathbf{H}(\mathrm{curl},D)$ traces, and boundary localisation of SPRs
par: Chen, Bochao, et autres
Publié: (2026)
par: Chen, Bochao, et autres
Publié: (2026)
DynSUP: Dynamic Gaussian Splatting from An Unposed Image Pair
par: Li, Weihang, et autres
Publié: (2024)
par: Li, Weihang, et autres
Publié: (2024)
Bird-SR: Bidirectional Reward-Guided Diffusion for Real-World Image Super-Resolution
par: Fan, Zihao, et autres
Publié: (2026)
par: Fan, Zihao, et autres
Publié: (2026)
RealRestorer: Towards Generalizable Real-World Image Restoration with Large-Scale Image Editing Models
par: Yang, Yufeng, et autres
Publié: (2026)
par: Yang, Yufeng, et autres
Publié: (2026)
DiffAvatar: Simulation-Ready Garment Optimization with Differentiable Simulation
par: Li, Yifei, et autres
Publié: (2023)
par: Li, Yifei, et autres
Publié: (2023)
Unveiling the Dynamics of Information Interplay in Supervised Learning
par: Song, Kun, et autres
Publié: (2024)
par: Song, Kun, et autres
Publié: (2024)
Boosting Micro-Expression Analysis via Prior-Guided Video-Level Regression
par: Guo, Zizheng, et autres
Publié: (2025)
par: Guo, Zizheng, et autres
Publié: (2025)
UNOPose: Unseen Object Pose Estimation with an Unposed RGB-D Reference Image
par: Liu, Xingyu, et autres
Publié: (2024)
par: Liu, Xingyu, et autres
Publié: (2024)
MotionScape: A Large-Scale Real-World Highly Dynamic UAV Video Dataset for World Models
par: Guo, Zile, et autres
Publié: (2026)
par: Guo, Zile, et autres
Publié: (2026)
LongSplat: Robust Unposed 3D Gaussian Splatting for Casual Long Videos
par: Lin, Chin-Yang, et autres
Publié: (2025)
par: Lin, Chin-Yang, et autres
Publié: (2025)
PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration
par: Ni, Chaojun, et autres
Publié: (2024)
par: Ni, Chaojun, et autres
Publié: (2024)
DGGT: Feedforward 4D Reconstruction of Dynamic Driving Scenes using Unposed Images
par: Chen, Xiaoxue, et autres
Publié: (2025)
par: Chen, Xiaoxue, et autres
Publié: (2025)
LucidFusion: Reconstructing 3D Gaussians with Arbitrary Unposed Images
par: He, Hao, et autres
Publié: (2024)
par: He, Hao, et autres
Publié: (2024)
Edit3r: Instant 3D Scene Editing from Sparse Unposed Images
par: Liu, Jiageng, et autres
Publié: (2025)
par: Liu, Jiageng, et autres
Publié: (2025)
Zero-Shot CFC: Fast Real-World Image Denoising based on Cross-Frequency Consistency
par: Jiang, Yanlin, et autres
Publié: (2025)
par: Jiang, Yanlin, et autres
Publié: (2025)
Documents similaires
-
InstDrive: Instance-Aware 3D Gaussian Splatting for Driving Scenes
par: Liu, Hongyuan, et autres
Publié: (2025) -
MonoMVSNet: Monocular Priors Guided Multi-View Stereo Network
par: Jiang, Jianfei, et autres
Publié: (2025) -
MVSMamba: Multi-View Stereo with State Space Model
par: Jiang, Jianfei, et autres
Publié: (2025) -
XYZCylinder: Towards Compatible Feed-Forward 3D Gaussian Splatting for Driving Scenes via Unified Cylinder Lifting Method
par: Yu, Haochen, et autres
Publié: (2025) -
From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models
par: Li, Xinyang, et autres
Publié: (2025)