Unposed-to-3D: Learning Simulation-Ready Vehicles from Real-World Images
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Hongyuan, Zou, Bochao, Liu, Qiankun, Yu, Haochen, Mei, Qi, Jiang, Jianfei, Liu, Chen, Bi, Cheng, Wang, Zhao, Zhang, Xueyang, Zhan, Yifei, Chen, Jiansheng, Ma, Huimin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
InstDrive: Instance-Aware 3D Gaussian Splatting for Driving Scenes
por: Liu, Hongyuan, et al.
Publicado: (2025)
por: Liu, Hongyuan, et al.
Publicado: (2025)
MonoMVSNet: Monocular Priors Guided Multi-View Stereo Network
por: Jiang, Jianfei, et al.
Publicado: (2025)
por: Jiang, Jianfei, et al.
Publicado: (2025)
MVSMamba: Multi-View Stereo with State Space Model
por: Jiang, Jianfei, et al.
Publicado: (2025)
por: Jiang, Jianfei, et al.
Publicado: (2025)
XYZCylinder: Towards Compatible Feed-Forward 3D Gaussian Splatting for Driving Scenes via Unified Cylinder Lifting Method
por: Yu, Haochen, et al.
Publicado: (2025)
por: Yu, Haochen, et al.
Publicado: (2025)
From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models
por: Li, Xinyang, et al.
Publicado: (2025)
por: Li, Xinyang, et al.
Publicado: (2025)
Video-Only ToM: Enhancing Theory of Mind in Multimodal Large Language Models
por: Liu, Siqi, et al.
Publicado: (2026)
por: Liu, Siqi, et al.
Publicado: (2026)
AGC-Drive: A Large-Scale Dataset for Real-World Aerial-Ground Collaboration in Driving Scenarios
por: Hou, Yunhao, et al.
Publicado: (2025)
por: Hou, Yunhao, et al.
Publicado: (2025)
$\textrm{A}^{\textrm{2}}$RNet: Adversarial Attack Resilient Network for Robust Infrared and Visible Image Fusion
por: Li, Jiawei, et al.
Publicado: (2024)
por: Li, Jiawei, et al.
Publicado: (2024)
RhythmFormer: Extracting Patterned rPPG Signals based on Periodic Sparse Attention
por: Zou, Bochao, et al.
Publicado: (2024)
por: Zou, Bochao, et al.
Publicado: (2024)
Exploring Information-Theoretic Metrics Associated with Neural Collapse in Supervised Training
por: Song, Kun, et al.
Publicado: (2024)
por: Song, Kun, et al.
Publicado: (2024)
DeCoDe: Defer-and-Complement Decision-Making via Decoupled Concept Bottleneck Models
por: He, Chengbo, et al.
Publicado: (2025)
por: He, Chengbo, et al.
Publicado: (2025)
Enhancing LLM Reasoning with Multi-Path Collaborative Reactive and Reflection agents
por: He, Chengbo, et al.
Publicado: (2024)
por: He, Chengbo, et al.
Publicado: (2024)
Kaleidoscopic Background Attack: Disrupting Pose Estimation with Multi-Fold Radial Symmetry Textures
por: Ding, Xinlong, et al.
Publicado: (2025)
por: Ding, Xinlong, et al.
Publicado: (2025)
TUN3D: Towards Real-World Scene Understanding from Unposed Images
por: Konushin, Anton, et al.
Publicado: (2025)
por: Konushin, Anton, et al.
Publicado: (2025)
PACT: Proactive Asking for Continual Task Assistance in Human-Robot Collaboration
por: He, Chengbo, et al.
Publicado: (2026)
por: He, Chengbo, et al.
Publicado: (2026)
Few-shot Image Generation via Masked Discrimination
por: Zhu, Jingyuan, et al.
Publicado: (2022)
por: Zhu, Jingyuan, et al.
Publicado: (2022)
StyledStreets: Multi-style Street Simulator with Spatial and Temporal Consistency
por: Chen, Yuyin, et al.
Publicado: (2025)
por: Chen, Yuyin, et al.
Publicado: (2025)
ME-TST+: Micro-expression Analysis via Temporal State Transition with ROI Relationship Awareness
por: Guo, Zizheng, et al.
Publicado: (2025)
por: Guo, Zizheng, et al.
Publicado: (2025)
RhythmMamba: Fast, Lightweight, and Accurate Remote Physiological Measurement
por: Zou, Bochao, et al.
Publicado: (2024)
por: Zou, Bochao, et al.
Publicado: (2024)
DomainStudio: Fine-Tuning Diffusion Models for Domain-Driven Image Generation using Limited Data
por: Zhu, Jingyuan, et al.
Publicado: (2023)
por: Zhu, Jingyuan, et al.
Publicado: (2023)
Isolated Diffusion: Optimizing Multi-Concept Text-to-Image Generation Training-Freely with Isolated Diffusion Guidance
por: Zhu, Jingyuan, et al.
Publicado: (2024)
por: Zhu, Jingyuan, et al.
Publicado: (2024)
LangFlash: Feed-forward 3D Language Gaussian Splatting from Sparse Unposed Images
por: Liu, Yilong, et al.
Publicado: (2026)
por: Liu, Yilong, et al.
Publicado: (2026)
SimScale: Learning to Drive via Real-World Simulation at Scale
por: Tian, Haochen, et al.
Publicado: (2025)
por: Tian, Haochen, et al.
Publicado: (2025)
Are Agents Ready to Teach? A Multi-Stage Benchmark for Real-World Teaching Workflows
por: Chen, Zixin, et al.
Publicado: (2026)
por: Chen, Zixin, et al.
Publicado: (2026)
Symmetrization of the Maxwell--Neumann--Poincar'e operator, spectral decomposition in $\mathbf{H}(\mathrm{curl},D)$ traces, and boundary localisation of SPRs
por: Chen, Bochao, et al.
Publicado: (2026)
por: Chen, Bochao, et al.
Publicado: (2026)
DynSUP: Dynamic Gaussian Splatting from An Unposed Image Pair
por: Li, Weihang, et al.
Publicado: (2024)
por: Li, Weihang, et al.
Publicado: (2024)
Bird-SR: Bidirectional Reward-Guided Diffusion for Real-World Image Super-Resolution
por: Fan, Zihao, et al.
Publicado: (2026)
por: Fan, Zihao, et al.
Publicado: (2026)
RealRestorer: Towards Generalizable Real-World Image Restoration with Large-Scale Image Editing Models
por: Yang, Yufeng, et al.
Publicado: (2026)
por: Yang, Yufeng, et al.
Publicado: (2026)
DiffAvatar: Simulation-Ready Garment Optimization with Differentiable Simulation
por: Li, Yifei, et al.
Publicado: (2023)
por: Li, Yifei, et al.
Publicado: (2023)
Unveiling the Dynamics of Information Interplay in Supervised Learning
por: Song, Kun, et al.
Publicado: (2024)
por: Song, Kun, et al.
Publicado: (2024)
Boosting Micro-Expression Analysis via Prior-Guided Video-Level Regression
por: Guo, Zizheng, et al.
Publicado: (2025)
por: Guo, Zizheng, et al.
Publicado: (2025)
UNOPose: Unseen Object Pose Estimation with an Unposed RGB-D Reference Image
por: Liu, Xingyu, et al.
Publicado: (2024)
por: Liu, Xingyu, et al.
Publicado: (2024)
MotionScape: A Large-Scale Real-World Highly Dynamic UAV Video Dataset for World Models
por: Guo, Zile, et al.
Publicado: (2026)
por: Guo, Zile, et al.
Publicado: (2026)
LongSplat: Robust Unposed 3D Gaussian Splatting for Casual Long Videos
por: Lin, Chin-Yang, et al.
Publicado: (2025)
por: Lin, Chin-Yang, et al.
Publicado: (2025)
PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image
por: Cao, Ziang, et al.
Publicado: (2025)
por: Cao, Ziang, et al.
Publicado: (2025)
ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration
por: Ni, Chaojun, et al.
Publicado: (2024)
por: Ni, Chaojun, et al.
Publicado: (2024)
DGGT: Feedforward 4D Reconstruction of Dynamic Driving Scenes using Unposed Images
por: Chen, Xiaoxue, et al.
Publicado: (2025)
por: Chen, Xiaoxue, et al.
Publicado: (2025)
LucidFusion: Reconstructing 3D Gaussians with Arbitrary Unposed Images
por: He, Hao, et al.
Publicado: (2024)
por: He, Hao, et al.
Publicado: (2024)
Edit3r: Instant 3D Scene Editing from Sparse Unposed Images
por: Liu, Jiageng, et al.
Publicado: (2025)
por: Liu, Jiageng, et al.
Publicado: (2025)
Zero-Shot CFC: Fast Real-World Image Denoising based on Cross-Frequency Consistency
por: Jiang, Yanlin, et al.
Publicado: (2025)
por: Jiang, Yanlin, et al.
Publicado: (2025)
Ejemplares similares
-
InstDrive: Instance-Aware 3D Gaussian Splatting for Driving Scenes
por: Liu, Hongyuan, et al.
Publicado: (2025) -
MonoMVSNet: Monocular Priors Guided Multi-View Stereo Network
por: Jiang, Jianfei, et al.
Publicado: (2025) -
MVSMamba: Multi-View Stereo with State Space Model
por: Jiang, Jianfei, et al.
Publicado: (2025) -
XYZCylinder: Towards Compatible Feed-Forward 3D Gaussian Splatting for Driving Scenes via Unified Cylinder Lifting Method
por: Yu, Haochen, et al.
Publicado: (2025) -
From Black Boxes to Transparent Minds: Evaluating and Enhancing the Theory of Mind in Multimodal Large Language Models
por: Li, Xinyang, et al.
Publicado: (2025)