Uni3D-LLM: Unifying Point Cloud Perception, Generation and Editing with Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Dingning, Huang, Xiaoshui, Hou, Yuenan, Wang, Zhihui, Yin, Zhenfei, Gong, Yongshun, Gao, Peng, Ouyang, Wanli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
di: Liu, Zexiang, et al.
Pubblicazione: (2023)
di: Liu, Zexiang, et al.
Pubblicazione: (2023)
Semi-supervised 3D Object Detection with PatchTeacher and PillarMix
di: Wu, Xiaopei, et al.
Pubblicazione: (2024)
di: Wu, Xiaopei, et al.
Pubblicazione: (2024)
NeRF-Det++: Incorporating Semantic Cues and Perspective-aware Depth Supervision for Indoor Multi-View 3D Detection
di: Huang, Chenxi, et al.
Pubblicazione: (2024)
di: Huang, Chenxi, et al.
Pubblicazione: (2024)
PSReg: Prior-guided Sparse Mixture of Experts for Point Cloud Registration
di: Huang, Xiaoshui, et al.
Pubblicazione: (2025)
di: Huang, Xiaoshui, et al.
Pubblicazione: (2025)
A Comprehensive Survey on 3D Content Generation
di: Liu, Jian, et al.
Pubblicazione: (2024)
di: Liu, Jian, et al.
Pubblicazione: (2024)
3DBench: A Scalable 3D Benchmark and Instruction-Tuning Dataset
di: Zhang, Junjie, et al.
Pubblicazione: (2024)
di: Zhang, Junjie, et al.
Pubblicazione: (2024)
A Self-Conditioned Representation Guided Diffusion Model for Realistic Text-to-LiDAR Scene Generation
di: Qu, Wentao, et al.
Pubblicazione: (2025)
di: Qu, Wentao, et al.
Pubblicazione: (2025)
Distributed Multi-Layer Editing for Rule-Level Knowledge in Large Language Models
di: Wang, Yating, et al.
Pubblicazione: (2026)
di: Wang, Yating, et al.
Pubblicazione: (2026)
Uni4D: A Unified Self-Supervised Learning Framework for Point Cloud Videos
di: Zuo, Zhi, et al.
Pubblicazione: (2025)
di: Zuo, Zhi, et al.
Pubblicazione: (2025)
TASeg: Temporal Aggregation Network for LiDAR Semantic Segmentation
di: Wu, Xiaopei, et al.
Pubblicazione: (2024)
di: Wu, Xiaopei, et al.
Pubblicazione: (2024)
UniEdit: A Unified Knowledge Editing Benchmark for Large Language Models
di: Chen, Qizhou, et al.
Pubblicazione: (2025)
di: Chen, Qizhou, et al.
Pubblicazione: (2025)
Towards Efficient and Intelligent Laser Weeding: Method and Dataset for Weed Stem Detection
di: Liu, Dingning, et al.
Pubblicazione: (2025)
di: Liu, Dingning, et al.
Pubblicazione: (2025)
UniGRPO: Unified Policy Optimization for Reasoning-Driven Visual Generation
di: Liu, Jie, et al.
Pubblicazione: (2026)
di: Liu, Jie, et al.
Pubblicazione: (2026)
LAHNet: Local Attentive Hashing Network for Point Cloud Registration
di: Qu, Wentao, et al.
Pubblicazione: (2025)
di: Qu, Wentao, et al.
Pubblicazione: (2025)
Ming-UniAudio: Speech LLM for Joint Understanding, Generation and Editing with Unified Representation
di: Yan, Canxiang, et al.
Pubblicazione: (2025)
di: Yan, Canxiang, et al.
Pubblicazione: (2025)
Diverse Teacher-Students for Deep Safe Semi-Supervised Learning under Class Mismatch
di: Wang, Qikai, et al.
Pubblicazione: (2024)
di: Wang, Qikai, et al.
Pubblicazione: (2024)
GVGEN: Text-to-3D Generation with Volumetric Representation
di: He, Xianglong, et al.
Pubblicazione: (2024)
di: He, Xianglong, et al.
Pubblicazione: (2024)
UniConv: Unifying Retrieval and Response Generation for Large Language Models in Conversations
di: Mo, Fengran, et al.
Pubblicazione: (2025)
di: Mo, Fengran, et al.
Pubblicazione: (2025)
UniVideo: Unified Understanding, Generation, and Editing for Videos
di: Wei, Cong, et al.
Pubblicazione: (2025)
di: Wei, Cong, et al.
Pubblicazione: (2025)
LLM-PCGC: Large Language Model-based Point Cloud Geometry Compression
di: Ye, Yuqi, et al.
Pubblicazione: (2024)
di: Ye, Yuqi, et al.
Pubblicazione: (2024)
3DAxisPrompt: Promoting the 3D Grounding and Reasoning in GPT-4o
di: Liu, Dingning, et al.
Pubblicazione: (2025)
di: Liu, Dingning, et al.
Pubblicazione: (2025)
An End-to-End Robust Point Cloud Semantic Segmentation Network with Single-Step Conditional Diffusion Models
di: Qu, Wentao, et al.
Pubblicazione: (2024)
di: Qu, Wentao, et al.
Pubblicazione: (2024)
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
di: Li, Yiheng, et al.
Pubblicazione: (2024)
di: Li, Yiheng, et al.
Pubblicazione: (2024)
PointLLM: Empowering Large Language Models to Understand Point Clouds
di: Xu, Runsen, et al.
Pubblicazione: (2023)
di: Xu, Runsen, et al.
Pubblicazione: (2023)
UniPCGC: Towards Practical Point Cloud Geometry Compression via an Efficient Unified Approach
di: Wang, Kangli, et al.
Pubblicazione: (2025)
di: Wang, Kangli, et al.
Pubblicazione: (2025)
UniMind: Unleashing the Power of LLMs for Unified Multi-Task Brain Decoding
di: Lu, Weiheng, et al.
Pubblicazione: (2025)
di: Lu, Weiheng, et al.
Pubblicazione: (2025)
UniMesh: Unifying 3D Mesh Understanding and Generation
di: Huang, Peng, et al.
Pubblicazione: (2026)
di: Huang, Peng, et al.
Pubblicazione: (2026)
EvoDefense: Co-Evolving Black-Box Defense with Large Language Models
di: Li, Yu, et al.
Pubblicazione: (2026)
di: Li, Yu, et al.
Pubblicazione: (2026)
Taming Stable Diffusion for Text to 360° Panorama Image Generation
di: Zhang, Cheng, et al.
Pubblicazione: (2024)
di: Zhang, Cheng, et al.
Pubblicazione: (2024)
Learning Geometry-Guided Depth via Projective Modeling for Monocular 3D Object Detection
di: Zhang, Yinmin, et al.
Pubblicazione: (2021)
di: Zhang, Yinmin, et al.
Pubblicazione: (2021)
UniSTD: Towards Unified Spatio-Temporal Learning across Diverse Disciplines
di: Tang, Chen, et al.
Pubblicazione: (2025)
di: Tang, Chen, et al.
Pubblicazione: (2025)
UniVG: A Generalist Diffusion Model for Unified Image Generation and Editing
di: Fu, Tsu-Jui, et al.
Pubblicazione: (2025)
di: Fu, Tsu-Jui, et al.
Pubblicazione: (2025)
UniLiP: Adapting CLIP for Unified Multimodal Understanding, Generation and Editing
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
Uni-Edit: Intelligent Editing Is A General Task For Unified Model Tuning
di: Zheng, Dian, et al.
Pubblicazione: (2026)
di: Zheng, Dian, et al.
Pubblicazione: (2026)
UniREditBench: A Unified Reasoning-based Image Editing Benchmark
di: Han, Feng, et al.
Pubblicazione: (2025)
di: Han, Feng, et al.
Pubblicazione: (2025)
Actial: Activate Spatial Reasoning Ability of Multimodal Large Language Models
di: Zhan, Xiaoyu, et al.
Pubblicazione: (2025)
di: Zhan, Xiaoyu, et al.
Pubblicazione: (2025)
B-VLLM: A Vision Large Language Model with Balanced Spatio-Temporal Tokens
di: Lu, Zhuqiang, et al.
Pubblicazione: (2024)
di: Lu, Zhuqiang, et al.
Pubblicazione: (2024)
Cross3DReg: Towards a Large-scale Real-world Cross-source Point Cloud Registration Benchmark
di: Xu, Zongyi, et al.
Pubblicazione: (2025)
di: Xu, Zongyi, et al.
Pubblicazione: (2025)
UniChange: Unifying Change Detection with Multimodal Large Language Model
di: Zhang, Xu, et al.
Pubblicazione: (2025)
di: Zhang, Xu, et al.
Pubblicazione: (2025)
Unsupervised Point Cloud Pre-Training via Contrasting and Clustering
di: Mei, Guofeng, et al.
Pubblicazione: (2022)
di: Mei, Guofeng, et al.
Pubblicazione: (2022)
Documenti analoghi
-
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
di: Liu, Zexiang, et al.
Pubblicazione: (2023) -
Semi-supervised 3D Object Detection with PatchTeacher and PillarMix
di: Wu, Xiaopei, et al.
Pubblicazione: (2024) -
NeRF-Det++: Incorporating Semantic Cues and Perspective-aware Depth Supervision for Indoor Multi-View 3D Detection
di: Huang, Chenxi, et al.
Pubblicazione: (2024) -
PSReg: Prior-guided Sparse Mixture of Experts for Point Cloud Registration
di: Huang, Xiaoshui, et al.
Pubblicazione: (2025) -
A Comprehensive Survey on 3D Content Generation
di: Liu, Jian, et al.
Pubblicazione: (2024)