RepVF: A Unified Vector Fields Representation for Multi-task 3D Perception
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Chunliang, Han, Wencheng, Yin, Junbo, Zhao, Sanyuan, Shen, Jianbing |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Depth Adaptive Efficient Visual Autoregressive Modeling
par: Li, Chunliang, et autres
Publié: (2026)
par: Li, Chunliang, et autres
Publié: (2026)
High-Precision Self-Supervised Monocular Depth Estimation with Rich-Resource Prior
par: Han, Wencheng, et autres
Publié: (2024)
par: Han, Wencheng, et autres
Publié: (2024)
DME-Driver: Integrating Human Decision Logic and 3D Scene Perception in Autonomous Driving
par: Han, Wencheng, et autres
Publié: (2024)
par: Han, Wencheng, et autres
Publié: (2024)
RAWMamba: Unified sRGB-to-RAW De-rendering With State Space Model
par: Chen, Hongjun, et autres
Publié: (2024)
par: Chen, Hongjun, et autres
Publié: (2024)
Rethinking the Encoding and Annotating of 3D Bounding Box: Corner-Aware 3D Object Detection from Point Clouds
par: Meng, Qinghao, et autres
Publié: (2025)
par: Meng, Qinghao, et autres
Publié: (2025)
ALOcc: Adaptive Lifting-Based 3D Semantic Occupancy and Cost Volume-Based Flow Predictions
par: Chen, Dubing, et autres
Publié: (2024)
par: Chen, Dubing, et autres
Publié: (2024)
Decoupling Fine Detail and Global Geometry for Compressed Depth Map Super-Resolution
par: Zheng, Huan, et autres
Publié: (2024)
par: Zheng, Huan, et autres
Publié: (2024)
AdaOcc: Adaptive Forward View Transformation and Flow Modeling for 3D Occupancy and Flow Prediction
par: Chen, Dubing, et autres
Publié: (2024)
par: Chen, Dubing, et autres
Publié: (2024)
Towards High-Fidelity 3D Portrait Generation with Rich Details by Cross-View Prior-Aware Diffusion
par: Wei, Haoran, et autres
Publié: (2024)
par: Wei, Haoran, et autres
Publié: (2024)
Breaking Down Monocular Ambiguity: Exploiting Temporal Evolution for 3D Lane Detection
par: Zheng, Huan, et autres
Publié: (2025)
par: Zheng, Huan, et autres
Publié: (2025)
VF-NeRF: Learning Neural Vector Fields for Indoor Scene Reconstruction
par: Puigjaner, Albert Gassol, et autres
Publié: (2024)
par: Puigjaner, Albert Gassol, et autres
Publié: (2024)
Bridging Scene Generation and Planning: Driving with World Model via Unifying Vision and Motion Representation
par: Gui, Xingtai, et autres
Publié: (2026)
par: Gui, Xingtai, et autres
Publié: (2026)
Self-Rewarding Large Vision-Language Models for Optimizing Prompts in Text-to-Image Generation
par: Yang, Hongji, et autres
Publié: (2025)
par: Yang, Hongji, et autres
Publié: (2025)
DC-ControlNet: Decoupling Inter- and Intra-Element Conditions in Image Generation with Diffusion Models
par: Yang, Hongji, et autres
Publié: (2025)
par: Yang, Hongji, et autres
Publié: (2025)
Towards Geometry-Aware and Motion-Guided Video Human Mesh Recovery
par: Chen, Hongjun, et autres
Publié: (2026)
par: Chen, Hongjun, et autres
Publié: (2026)
HanMoVLM: Large Vision-Language Models for Professional Artistic Painting Evaluation
par: Yang, Hongji, et autres
Publié: (2026)
par: Yang, Hongji, et autres
Publié: (2026)
IS-Fusion: Instance-Scene Collaborative Fusion for Multimodal 3D Object Detection
par: Yin, Junbo, et autres
Publié: (2024)
par: Yin, Junbo, et autres
Publié: (2024)
Towards Better Cephalometric Landmark Detection with Diffusion Data Generation
par: Guo, Dongqian, et autres
Publié: (2025)
par: Guo, Dongqian, et autres
Publié: (2025)
TrajDiff: End-to-end Autonomous Driving without Perception Annotation
par: Gui, Xingtai, et autres
Publié: (2025)
par: Gui, Xingtai, et autres
Publié: (2025)
TextFormer: A Query-based End-to-End Text Spotter with Mixed Supervision
par: Zhai, Yukun, et autres
Publié: (2023)
par: Zhai, Yukun, et autres
Publié: (2023)
Reducing CT Metal Artifacts by Learning Latent Space Alignment with Gemstone Spectral Imaging Data
par: Han, Wencheng, et autres
Publié: (2025)
par: Han, Wencheng, et autres
Publié: (2025)
VF-NeRF: Viewshed Fields for Rigid NeRF Registration
par: Segre, Leo, et autres
Publié: (2024)
par: Segre, Leo, et autres
Publié: (2024)
HiCoGen: Hierarchical Compositional Text-to-Image Generation in Diffusion Models via Reinforcement Learning
par: Yang, Hongji, et autres
Publié: (2025)
par: Yang, Hongji, et autres
Publié: (2025)
MambaVF: State Space Model for Efficient Video Fusion
par: Zhao, Zixiang, et autres
Publié: (2026)
par: Zhao, Zixiang, et autres
Publié: (2026)
DenoiseRep: Denoising Model for Representation Learning
par: Xu, Zhengrui, et autres
Publié: (2024)
par: Xu, Zhengrui, et autres
Publié: (2024)
Language Prompt for Autonomous Driving
par: Wu, Dongming, et autres
Publié: (2023)
par: Wu, Dongming, et autres
Publié: (2023)
RLGF: Reinforcement Learning with Geometric Feedback for Autonomous Driving Video Generation
par: Yan, Tianyi, et autres
Publié: (2025)
par: Yan, Tianyi, et autres
Publié: (2025)
DrivingSphere: Building a High-fidelity 4D World for Closed-loop Simulation
par: Yan, Tianyi, et autres
Publié: (2024)
par: Yan, Tianyi, et autres
Publié: (2024)
USDRL: Unified Skeleton-Based Dense Representation Learning with Multi-Grained Feature Decorrelation
par: Weng, Wanjiang, et autres
Publié: (2024)
par: Weng, Wanjiang, et autres
Publié: (2024)
UniM$^2$AE: Multi-modal Masked Autoencoders with Unified 3D Representation for 3D Perception in Autonomous Driving
par: Zou, Jian, et autres
Publié: (2023)
par: Zou, Jian, et autres
Publié: (2023)
LiDARFormer: A Unified Transformer-based Multi-task Network for LiDAR Perception
par: Zhou, Zixiang, et autres
Publié: (2023)
par: Zhou, Zixiang, et autres
Publié: (2023)
OLiDM: Object-aware LiDAR Diffusion Models for Autonomous Driving
par: Yan, Tianyi, et autres
Publié: (2024)
par: Yan, Tianyi, et autres
Publié: (2024)
SignRep: Enhancing Self-Supervised Sign Representations
par: Wong, Ryan, et autres
Publié: (2025)
par: Wong, Ryan, et autres
Publié: (2025)
HENet: Hybrid Encoding for End-to-end Multi-task 3D Perception from Multi-view Cameras
par: Xia, Zhongyu, et autres
Publié: (2024)
par: Xia, Zhongyu, et autres
Publié: (2024)
Rep-MTL: Unleashing the Power of Representation-level Task Saliency for Multi-Task Learning
par: Wang, Zedong, et autres
Publié: (2025)
par: Wang, Zedong, et autres
Publié: (2025)
Rethinking Temporal Fusion with a Unified Gradient Descent View for 3D Semantic Occupancy Prediction
par: Chen, Dubing, et autres
Publié: (2025)
par: Chen, Dubing, et autres
Publié: (2025)
CLIP-GS: Unifying Vision-Language Representation with 3D Gaussian Splatting
par: Jiao, Siyu, et autres
Publié: (2024)
par: Jiao, Siyu, et autres
Publié: (2024)
HENet++: Hybrid Encoding and Multi-task Learning for 3D Perception and End-to-end Autonomous Driving
par: Xia, Zhongyu, et autres
Publié: (2025)
par: Xia, Zhongyu, et autres
Publié: (2025)
Vector Quantized Feature Fields for Fast 3D Semantic Lifting
par: Tang, George, et autres
Publié: (2025)
par: Tang, George, et autres
Publié: (2025)
3DeepRep: 3D Deep Low-rank Tensor Representation for Hyperspectral Image Inpainting
par: Li, Yunshan, et autres
Publié: (2025)
par: Li, Yunshan, et autres
Publié: (2025)
Documents similaires
-
Depth Adaptive Efficient Visual Autoregressive Modeling
par: Li, Chunliang, et autres
Publié: (2026) -
High-Precision Self-Supervised Monocular Depth Estimation with Rich-Resource Prior
par: Han, Wencheng, et autres
Publié: (2024) -
DME-Driver: Integrating Human Decision Logic and 3D Scene Perception in Autonomous Driving
par: Han, Wencheng, et autres
Publié: (2024) -
RAWMamba: Unified sRGB-to-RAW De-rendering With State Space Model
par: Chen, Hongjun, et autres
Publié: (2024) -
Rethinking the Encoding and Annotating of 3D Bounding Box: Corner-Aware 3D Object Detection from Point Clouds
par: Meng, Qinghao, et autres
Publié: (2025)